Agentes de tarea
Agentes de propósito único que clasifican, extraen, consultan, redactan o concilian, y entregan un resultado preparado a una persona.
Desarrollar — Desarrollo de IA agéntica
Un agente que puede leer, decidir y actuar solo es útil si usted puede decir qué le está permitido hacer, demostrar qué hizo y detenerlo al instante. Onega diseña, desarrolla y evalúa agentes de IA y flujos de trabajo de varios pasos que trabajan en sus sistemas, con cada llamada a herramientas comprobada por la política, las acciones con consecuencias aprobadas por una persona y un registro que es suyo.
01 — Qué desarrollamos
Agentes de propósito único que clasifican, extraen, consultan, redactan o concilian, y entregan un resultado preparado a una persona.
Agentes que planifican a través de varias herramientas y sistemas, con puntos de control entre pasos y una vía de vuelta atrás definida cuando un paso falla.
Respuestas fundamentadas en sus documentos y registros, cada una con sus fuentes, y un «no encontrado» claro cuando las fuentes no dicen nada.
Conectores con sus sistemas ERP, CRM, de asistencia técnica, de gestión documental y de correo a través de sus API o del Model Context Protocol. Nunca se entregan credenciales a un modelo.
Conjuntos de pruebas extraídos de sus propios casos, puntuados antes del lanzamiento y en cada cambio, de modo que un nuevo modelo o prompt tenga que demostrar primero su valía.
Supervisión, presupuestos de costes, comprobaciones de deriva y manuales de operaciones ante incidentes para los agentes de uso diario.
02 — Autonomía
Cada clase de acción recibe su propio nivel. En un piloto, los agentes empiezan en L0, y nada sube de nivel sin evidencias sobre sus propios casos y sin su aprobación. El diseño prevé que el incumplimiento de una salvaguarda reduzca el nivel automáticamente.
| Nivel | Qué hace el agente | Qué exigimos antes |
|---|---|---|
| L0 · Observar | Funciona en modo sombra; nadie actúa según sus resultados | Una línea de base y un conjunto de evaluación |
| L1 · Sugerir | Propone; una persona confirma o corrige | Evidencias y fuentes con cada propuesta |
| L2 · Un clic | Prepara un conjunto de acciones; una persona lo ejecuta | Acciones tipadas y validación determinista |
| L3 · Automático con revisión | Ejecuta una acción cualificada; se notifica a las personas, que pueden revertirla | Una ventana de reversión y supervisión continua |
| L4 · Autónomo | Ejecuta sin supervisión una clase de acción acotada y probada | Auditoría por muestreo, un presupuesto de errores y bajada de nivel automática |
03 — Controles
Cuando los agentes funcionan a través de OneVeer, estos controles están en la ruta de la solicitud. Si usted ya opera una pasarela de IA, desarrollamos conforme a sus controles y documentamos cualquier carencia.
04 — Cómo avanza un desarrollo
La tarea, las herramientas, los datos, los riesgos, el nivel de autonomía inicial y los criterios de aceptación sobre sus propios casos.
Agente, conectores y conjunto de evaluación construidos en su entorno y probados sobre una muestra reservada.
Trabajo real en L0 o L1, cada propuesta revisada, esfuerzo y errores medidos frente a la línea de base.
Manual de operaciones, configuración, resultados de evaluación, limitaciones conocidas y una decisión: ampliar, subir un nivel o detenerse.
05 — Preguntas frecuentes
El más sencillo que cumpla el requisito, a menudo simple código en torno a la llamada a herramientas del modelo. Cuando sus equipos se han estandarizado en un framework o en el Model Context Protocol, desarrollamos conforme a él. La gobernanza reside en la pasarela, no en el framework, de modo que la elección sigue siendo reversible.
Sí. OneVeer admite la llamada a herramientas tanto en modelos locales como a través de proveedores en la nube, y un alias publicado puede trasladar un agente de unos a otros sin modificar el agente.
Todo lo que lee un agente se trata como no fiable. Cada agente tiene una lista de herramientas permitidas, las credenciales nunca llegan al modelo, los modelos guardián inspeccionan las entradas y el contexto recuperado, y las acciones con consecuencias necesitan la aprobación de una persona. La detección es falible, así que el diseño da por supuesto que algunos ataques pasarán y limita lo que podrían hacer.
Su organización; por eso cada agente tiene un responsable designado, una versión, un historial de evaluación y unos límites operativos acordados antes de su puesta en producción, y por eso su registro se queda con usted.