Agentes de tarefa
Agentes com um único objetivo que fazem triagem, extraem, consultam, redigem ou reconciliam, e entregam um resultado preparado a uma pessoa.
Construir — Desenvolvimento de IA agêntica
Um agente que consegue ler, decidir e agir só é útil se puder dizer o que lhe é permitido fazer, provar o que fez e pará-lo de imediato. A Onega concebe, constrói e avalia agentes de IA e fluxos de trabalho de vários passos que trabalham nos seus sistemas, com cada chamada a ferramentas verificada pela política, as ações com consequências aprovadas por uma pessoa e um registo que lhe pertence.
01 — O que construímos
Agentes com um único objetivo que fazem triagem, extraem, consultam, redigem ou reconciliam, e entregam um resultado preparado a uma pessoa.
Agentes que planeiam através de várias ferramentas e sistemas, com pontos de controlo entre passos e um caminho de retorno definido quando um passo falha.
Respostas fundamentadas nos seus documentos e registos, cada uma com as suas fontes, e um simples «não encontrado» quando as fontes são omissas.
Conectores para os seus sistemas de ERP, CRM, service desk, gestão documental e correio, através das respetivas APIs ou do Model Context Protocol. As credenciais nunca são entregues a um modelo.
Conjuntos de teste retirados dos seus próprios casos, pontuados antes do lançamento e em cada alteração, para que um novo modelo ou prompt tenha primeiro de provar o seu valor.
Monitorização, orçamentos de custos, verificações de desvio (drift) e manuais de resposta a incidentes para agentes em uso diário.
02 — Autonomia
Cada classe de ações tem o seu próprio nível. Num piloto, os agentes começam em L0, e nada sobe de nível sem evidências nos seus próprios casos e sem a sua aprovação. Uma violação de salvaguarda está concebida para baixar o nível automaticamente.
| Nível | O que o agente faz | O que exigimos primeiro |
|---|---|---|
| L0 · Observar | Funciona em sombra; ninguém age com base nos seus resultados | Uma linha de base e um conjunto de avaliação |
| L1 · Sugerir | Propõe; uma pessoa confirma ou corrige | Evidências e fontes em cada proposta |
| L2 · Um clique | Prepara um conjunto de ações; uma pessoa executa-o | Ações tipificadas e validação determinística |
| L3 · Automático com revisão | Executa uma ação qualificada; as pessoas são notificadas e podem revertê-la | Uma janela de reversão e monitorização contínua |
| L4 · Autónomo | Executa sem supervisão uma classe de ações restrita e comprovada | Auditoria por amostragem, um orçamento de erros e descida de nível automática |
03 — Controlos
Quando os agentes funcionam através do OneVeer, estes controlos estão no caminho do pedido. Quando já opera um gateway de IA, construímos de acordo com os respetivos controlos e documentamos qualquer lacuna.
04 — Como decorre uma construção
A tarefa, as ferramentas, os dados, os riscos, o nível de autonomia inicial e os critérios de aceitação nos seus próprios casos.
Agente, conectores e conjunto de avaliação construídos no seu ambiente e testados numa amostra reservada (holdout).
Trabalho real em L0 ou L1, cada proposta revista, esforço e erros medidos face à linha de base.
Manual de operação, configuração, resultados de avaliação, limitações conhecidas e uma decisão: alargar, subir um nível ou parar.
05 — Perguntas frequentes
A mais simples que cumpra o requisito, muitas vezes código simples em torno da chamada de ferramentas de um modelo. Quando as suas equipas já normalizaram uma framework ou o Model Context Protocol, construímos de acordo com essa escolha. A governação reside no gateway, não na framework, pelo que a escolha continua reversível.
Sim. O OneVeer suporta a chamada de ferramentas em modelos locais, bem como através de fornecedores de nuvem, e um alias publicado pode transferir um agente entre eles sem alterar o agente.
Tudo o que um agente lê é tratado como não fiável. As ferramentas são autorizadas por agente através de uma lista de permissões, as credenciais nunca chegam ao modelo, os modelos de guarda inspecionam as entradas e o contexto recuperado, e as ações com consequências precisam da aprovação de uma pessoa. A deteção é falível, pelo que a conceção pressupõe que alguns ataques passarão e limita o que poderiam fazer.
A sua organização. É por isso que cada agente tem um responsável designado, uma versão, um registo de avaliação e limites de funcionamento acordados antes de entrar em produção, e é por isso que o seu registo fica consigo.