Bygg — Utvikling av agentisk KI

Agenter som gjør reelt arbeid, innenfor grenser du setter.

En agent som kan lese, bestemme og handle, er bare nyttig hvis du kan si hva den har lov til, bevise hva den gjorde og stoppe den umiddelbart. Onega designer, bygger og evaluerer KI-agenter og arbeidsflyter i flere trinn som arbeider i systemene dine, med hvert verktøykall kontrollert av policy, handlinger med konsekvenser godkjent av en person og en logg du eier.

01 — Hva vi bygger

Fra én oppgave til en styrt arbeidsflyt.

Oppgaveagenter

Agenter med ett formål som sorterer, trekker ut, slår opp, lager utkast eller avstemmer, og leverer et forberedt resultat til en person.

Arbeidsflyter i flere trinn

Agenter som planlegger på tvers av flere verktøy og systemer, med kontrollpunkter mellom trinnene og en definert vei tilbake når et trinn feiler.

Kunnskapsagenter

Svar forankret i dokumentene og registrene dine, hvert med sine kilder, og et tydelig «ikke funnet» når kildene ikke gir svar.

Verktøy- og systemintegrasjon

Koblinger til ERP-, CRM-, servicedesk-, dokument- og e-postsystemene dine via deres API-er eller Model Context Protocol. Legitimasjon gis aldri til en modell.

Evalueringsrigger

Testsett hentet fra dine egne saker, målt før lansering og ved hver endring, slik at en ny modell eller prompt må bevise seg først.

Drift

Overvåking, kostnadsbudsjetter, kontroll av avdrift og driftshåndbøker for hendelseshåndtering når agentene er i daglig bruk.

02 — Autonomi

Autonomi med dimmer, ikke bryter.

Hver handlingsklasse får sitt eget nivå. Agenter starter på L0 i en pilot, og ingenting går opp et nivå uten grunnlag fra dine egne saker og din godkjenning. Et brudd på en sikkerhetsgrense er utformet for å senke nivået automatisk.

NivåHva agenten gjørHva vi krever først
L0 · ObserverKjører i skyggemodus; ingen handler på resultateneEt nullpunkt og et evalueringssett
L1 · ForeslåForeslår; en person bekrefter eller korrigererGrunnlag og kilder med hvert forslag
L2 · Ett klikkForbereder et sett med handlinger; en person utfører detTypede handlinger og deterministisk validering
L3 · Automatisk med gjennomgangUtfører en kvalifisert handling; folk varsles og kan reversere denEt angrevindu og kontinuerlig overvåking
L4 · AutonomKjører en smal, utprøvd handlingsklasse uten tilsynStikkprøverevisjon, et feilbudsjett og automatisk nedgradering

03 — Kontroller

Styrt ved hvert kall.

Når agenter kjører gjennom OneVeer, ligger disse kontrollene i forespørselsbanen. Der dere allerede har en KI-gateway i drift, bygger vi etter kontrollene i den og dokumenterer eventuelle mangler.

  • Én styrt gateway for alle modell- og verktøykall, slik at policy, sladding og budsjetter gjelder for alle agenter.
  • En signert nødstopp avgrenset til én agent, én modell eller alt, håndhevet før noen modell nås.
  • Engangsgodkjenninger fra en person for verktøykall med konsekvenser.
  • Legitimasjon oppbevares i et hvelv; modeller ser resultater, aldri nøkler.
  • Vaktmodeller på inndata, hentet kontekst og utdata.
  • En logg over hvert trinn (inndata, kilder, verktøykall, godkjenninger og utfall) som lagres i ditt miljø.

04 — Slik foregår utviklingen

To uker til å definere, seks til åtte til å bevise.

  1. 01

    Discovery Sprint · 2 uker

    Oppgaven, verktøyene, dataene, risikoene, autonominivået det skal startes på, og akseptkriterier på dine egne saker.

  2. 02

    Bygging · 3–5 uker

    Agent, koblinger og evalueringssett bygget i ditt miljø og testet på et tilbakeholdt utvalg.

  3. 03

    Overvåket drift · 2–3 uker

    Reelt arbeid på L0 eller L1, hvert forslag gjennomgått, innsats og feil målt mot nullpunktet.

  4. 04

    Overlevering

    Driftshåndbok, konfigurasjon, evalueringsresultater, kjente begrensninger og en beslutning: utvide, gå opp et nivå eller stoppe.

05 — Vanlige spørsmål

Spørsmål arkitekter og CISO-er stiller.

Hvilke agentrammeverk bruker dere?

Det enkleste som oppfyller kravet, ofte ren kode rundt modellens verktøykall. Der teamene deres har standardisert på et rammeverk eller på Model Context Protocol, bygger vi etter det. Styringen ligger i gatewayen, ikke i rammeverket, så valget kan reverseres.

Kan agenter kjøre på lokale modeller?

Ja. OneVeer støtter verktøykall på lokale modeller så vel som via skyleverandører, og et publisert alias kan flytte en agent mellom dem uten at agenten endres.

Hva hindrer at en agent blir manipulert av det den leser?

Alt en agent leser, behandles som ikke-klarert. Verktøy godkjennes per agent via en tillatelsesliste, legitimasjon når aldri modellen, vaktmodeller inspiserer inndata og hentet kontekst, og handlinger med konsekvenser krever godkjenning fra en person. Deteksjon kan feile, så designet forutsetter at noen angrep vil slippe gjennom, og begrenser hva de kan gjøre.

Hvem er ansvarlig for det en agent gjør?

Organisasjonen din. Derfor har hver agent en navngitt eier, en versjon, en evalueringshistorikk og driftsgrenser som avtales før den settes i produksjon, og derfor blir loggen over det den gjør, værende hos dere.