Desarrollar — Desarrollo de IA agéntica

Agentes que hacen trabajo real, dentro de los límites que usted fija.

Un agente que puede leer, decidir y actuar solo es útil si usted puede decir qué le está permitido hacer, demostrar qué hizo y detenerlo al instante. Onega diseña, desarrolla y evalúa agentes de IA y flujos de trabajo de varios pasos que trabajan en sus sistemas, con cada llamada a herramientas comprobada por la política, las acciones con consecuencias aprobadas por una persona y un registro que es suyo.

01 — Qué desarrollamos

De una tarea a un flujo de trabajo gobernado.

Agentes de tarea

Agentes de propósito único que clasifican, extraen, consultan, redactan o concilian, y entregan un resultado preparado a una persona.

Flujos de trabajo de varios pasos

Agentes que planifican a través de varias herramientas y sistemas, con puntos de control entre pasos y una vía de vuelta atrás definida cuando un paso falla.

Agentes de conocimiento

Respuestas fundamentadas en sus documentos y registros, cada una con sus fuentes, y un «no encontrado» claro cuando las fuentes no dicen nada.

Integración de herramientas y sistemas

Conectores con sus sistemas ERP, CRM, de asistencia técnica, de gestión documental y de correo a través de sus API o del Model Context Protocol. Nunca se entregan credenciales a un modelo.

Entornos de evaluación

Conjuntos de pruebas extraídos de sus propios casos, puntuados antes del lanzamiento y en cada cambio, de modo que un nuevo modelo o prompt tenga que demostrar primero su valía.

Operaciones

Supervisión, presupuestos de costes, comprobaciones de deriva y manuales de operaciones ante incidentes para los agentes de uso diario.

02 — Autonomía

Autonomía graduable, no de todo o nada.

Cada clase de acción recibe su propio nivel. En un piloto, los agentes empiezan en L0, y nada sube de nivel sin evidencias sobre sus propios casos y sin su aprobación. El diseño prevé que el incumplimiento de una salvaguarda reduzca el nivel automáticamente.

NivelQué hace el agenteQué exigimos antes
L0 · ObservarFunciona en modo sombra; nadie actúa según sus resultadosUna línea de base y un conjunto de evaluación
L1 · SugerirPropone; una persona confirma o corrigeEvidencias y fuentes con cada propuesta
L2 · Un clicPrepara un conjunto de acciones; una persona lo ejecutaAcciones tipadas y validación determinista
L3 · Automático con revisiónEjecuta una acción cualificada; se notifica a las personas, que pueden revertirlaUna ventana de reversión y supervisión continua
L4 · AutónomoEjecuta sin supervisión una clase de acción acotada y probadaAuditoría por muestreo, un presupuesto de errores y bajada de nivel automática

03 — Controles

Gobernado en cada llamada.

Cuando los agentes funcionan a través de OneVeer, estos controles están en la ruta de la solicitud. Si usted ya opera una pasarela de IA, desarrollamos conforme a sus controles y documentamos cualquier carencia.

  • Una única pasarela gobernada para cada llamada a modelos y herramientas, de modo que las políticas, la ocultación y los presupuestos se apliquen a todos los agentes.
  • Una parada de emergencia firmada con alcance a un agente, a un modelo o a todo, que se aplica antes de que se llegue a cualquier modelo.
  • Aprobaciones de un solo uso, otorgadas por una persona, para las llamadas a herramientas con consecuencias.
  • Credenciales guardadas en un almacén de secretos; los modelos ven resultados, nunca claves.
  • Modelos guardián sobre las entradas, el contexto recuperado y las salidas.
  • Un registro de cada paso (entradas, fuentes, llamadas a herramientas, aprobaciones y resultados) que se conserva en su entorno.

04 — Cómo avanza un desarrollo

Dos semanas para definir el alcance, de seis a ocho para demostrarlo.

  1. 01

    Discovery Sprint · 2 semanas

    La tarea, las herramientas, los datos, los riesgos, el nivel de autonomía inicial y los criterios de aceptación sobre sus propios casos.

  2. 02

    Desarrollo · 3–5 semanas

    Agente, conectores y conjunto de evaluación construidos en su entorno y probados sobre una muestra reservada.

  3. 03

    Ejecución supervisada · 2–3 semanas

    Trabajo real en L0 o L1, cada propuesta revisada, esfuerzo y errores medidos frente a la línea de base.

  4. 04

    Traspaso

    Manual de operaciones, configuración, resultados de evaluación, limitaciones conocidas y una decisión: ampliar, subir un nivel o detenerse.

05 — Preguntas frecuentes

Preguntas que hacen arquitectos y CISO.

¿Qué frameworks de agentes utilizan?

El más sencillo que cumpla el requisito, a menudo simple código en torno a la llamada a herramientas del modelo. Cuando sus equipos se han estandarizado en un framework o en el Model Context Protocol, desarrollamos conforme a él. La gobernanza reside en la pasarela, no en el framework, de modo que la elección sigue siendo reversible.

¿Pueden los agentes funcionar con modelos locales?

Sí. OneVeer admite la llamada a herramientas tanto en modelos locales como a través de proveedores en la nube, y un alias publicado puede trasladar un agente de unos a otros sin modificar el agente.

¿Qué impide que un agente sea manipulado por lo que lee?

Todo lo que lee un agente se trata como no fiable. Cada agente tiene una lista de herramientas permitidas, las credenciales nunca llegan al modelo, los modelos guardián inspeccionan las entradas y el contexto recuperado, y las acciones con consecuencias necesitan la aprobación de una persona. La detección es falible, así que el diseño da por supuesto que algunos ataques pasarán y limita lo que podrían hacer.

¿Quién responde de lo que hace un agente?

Su organización; por eso cada agente tiene un responsable designado, una versión, un historial de evaluación y unos límites operativos acordados antes de su puesta en producción, y por eso su registro se queda con usted.