Construir — Desenvolvimento de IA agêntica

Agentes que fazem trabalho real, dentro dos limites que definir.

Um agente que consegue ler, decidir e agir só é útil se puder dizer o que lhe é permitido fazer, provar o que fez e pará-lo de imediato. A Onega concebe, constrói e avalia agentes de IA e fluxos de trabalho de vários passos que trabalham nos seus sistemas, com cada chamada a ferramentas verificada pela política, as ações com consequências aprovadas por uma pessoa e um registo que lhe pertence.

01 — O que construímos

De uma tarefa a um fluxo de trabalho governado.

Agentes de tarefa

Agentes com um único objetivo que fazem triagem, extraem, consultam, redigem ou reconciliam, e entregam um resultado preparado a uma pessoa.

Fluxos de trabalho de vários passos

Agentes que planeiam através de várias ferramentas e sistemas, com pontos de controlo entre passos e um caminho de retorno definido quando um passo falha.

Agentes de conhecimento

Respostas fundamentadas nos seus documentos e registos, cada uma com as suas fontes, e um simples «não encontrado» quando as fontes são omissas.

Integração de ferramentas e sistemas

Conectores para os seus sistemas de ERP, CRM, service desk, gestão documental e correio, através das respetivas APIs ou do Model Context Protocol. As credenciais nunca são entregues a um modelo.

Estruturas de avaliação

Conjuntos de teste retirados dos seus próprios casos, pontuados antes do lançamento e em cada alteração, para que um novo modelo ou prompt tenha primeiro de provar o seu valor.

Operações

Monitorização, orçamentos de custos, verificações de desvio (drift) e manuais de resposta a incidentes para agentes em uso diário.

02 — Autonomia

Autonomia que se regula, não que se liga e desliga.

Cada classe de ações tem o seu próprio nível. Num piloto, os agentes começam em L0, e nada sobe de nível sem evidências nos seus próprios casos e sem a sua aprovação. Uma violação de salvaguarda está concebida para baixar o nível automaticamente.

NívelO que o agente fazO que exigimos primeiro
L0 · ObservarFunciona em sombra; ninguém age com base nos seus resultadosUma linha de base e um conjunto de avaliação
L1 · SugerirPropõe; uma pessoa confirma ou corrigeEvidências e fontes em cada proposta
L2 · Um cliquePrepara um conjunto de ações; uma pessoa executa-oAções tipificadas e validação determinística
L3 · Automático com revisãoExecuta uma ação qualificada; as pessoas são notificadas e podem revertê-laUma janela de reversão e monitorização contínua
L4 · AutónomoExecuta sem supervisão uma classe de ações restrita e comprovadaAuditoria por amostragem, um orçamento de erros e descida de nível automática

03 — Controlos

Governado em cada chamada.

Quando os agentes funcionam através do OneVeer, estes controlos estão no caminho do pedido. Quando já opera um gateway de IA, construímos de acordo com os respetivos controlos e documentamos qualquer lacuna.

  • Um único gateway governado para todas as chamadas a modelos e a ferramentas, para que a política, a ocultação e os orçamentos se apliquem a todos os agentes.
  • Uma paragem de emergência assinada, com âmbito para um agente, um modelo ou tudo, aplicada antes de qualquer modelo ser alcançado.
  • Aprovações de utilização única, dadas por uma pessoa, para chamadas a ferramentas com consequências.
  • Credenciais guardadas num cofre; os modelos veem resultados, nunca chaves.
  • Modelos de guarda nas entradas, no contexto recuperado e nas saídas.
  • Um registo de cada passo (entradas, fontes, chamadas a ferramentas, aprovações e resultados), guardado no seu ambiente.

04 — Como decorre uma construção

Duas semanas para delimitar, seis a oito para comprovar.

  1. 01

    Discovery Sprint · 2 semanas

    A tarefa, as ferramentas, os dados, os riscos, o nível de autonomia inicial e os critérios de aceitação nos seus próprios casos.

  2. 02

    Construção · 3–5 semanas

    Agente, conectores e conjunto de avaliação construídos no seu ambiente e testados numa amostra reservada (holdout).

  3. 03

    Execução supervisionada · 2–3 semanas

    Trabalho real em L0 ou L1, cada proposta revista, esforço e erros medidos face à linha de base.

  4. 04

    Entrega

    Manual de operação, configuração, resultados de avaliação, limitações conhecidas e uma decisão: alargar, subir um nível ou parar.

05 — Perguntas frequentes

Perguntas que os arquitetos e os CISO fazem.

Que frameworks de agentes utilizam?

A mais simples que cumpra o requisito, muitas vezes código simples em torno da chamada de ferramentas de um modelo. Quando as suas equipas já normalizaram uma framework ou o Model Context Protocol, construímos de acordo com essa escolha. A governação reside no gateway, não na framework, pelo que a escolha continua reversível.

Os agentes podem funcionar com modelos locais?

Sim. O OneVeer suporta a chamada de ferramentas em modelos locais, bem como através de fornecedores de nuvem, e um alias publicado pode transferir um agente entre eles sem alterar o agente.

O que impede que um agente seja manipulado pelo que lê?

Tudo o que um agente lê é tratado como não fiável. As ferramentas são autorizadas por agente através de uma lista de permissões, as credenciais nunca chegam ao modelo, os modelos de guarda inspecionam as entradas e o contexto recuperado, e as ações com consequências precisam da aprovação de uma pessoa. A deteção é falível, pelo que a conceção pressupõe que alguns ataques passarão e limita o que poderiam fazer.

Quem responde pelo que um agente faz?

A sua organização. É por isso que cada agente tem um responsável designado, uma versão, um registo de avaliação e limites de funcionamento acordados antes de entrar em produção, e é por isso que o seu registo fica consigo.