Rakentaminen — Agenttisen tekoälyn kehitys

Agentteja, jotka tekevät oikeaa työtä asettamienne rajojen sisällä.

Agentti, joka voi lukea, päättää ja toimia, on hyödyllinen vain, jos voitte määrittää, mitä se saa tehdä, todistaa, mitä se teki, ja pysäyttää sen välittömästi. Onega suunnittelee, rakentaa ja arvioi tekoälyagentteja ja monivaiheisia työnkulkuja, jotka toimivat järjestelmissänne: käytäntö tarkistaa jokaisen työkalukutsun, ihminen hyväksyy seurauksiltaan merkittävät toimenpiteet, ja kirjaukset ovat teidän omistuksessanne.

01 — Mitä rakennamme

Yhdestä tehtävästä hallittuun työnkulkuun.

Tehtäväagentit

Yhteen tarkoitukseen tehdyt agentit, jotka luokittelevat, poimivat tietoja, hakevat, luonnostelevat tai täsmäyttävät ja antavat valmistellun tuloksen ihmiselle.

Monivaiheiset työnkulut

Agentit, jotka suunnittelevat toimintansa useiden työkalujen ja järjestelmien yli; vaiheiden välillä tarkistuspisteet ja määritelty paluutie, kun vaihe epäonnistuu.

Tietoagentit

Dokumentteihinne ja tietueisiinne perustuvat vastaukset, kukin lähteineen, ja selkeä ”ei löytynyt”, kun lähteistä ei löydy vastausta.

Työkalu- ja järjestelmäintegraatio

Liittimet ERP-, CRM-, palvelupiste-, dokumentti- ja postijärjestelmiinne niiden API-rajapintojen tai Model Context Protocolin kautta. Tunnistetietoja ei koskaan anneta mallille.

Arviointiympäristöt

Omista tapauksistanne kootut testiaineistot, jotka pisteytetään ennen julkaisua ja jokaisen muutoksen yhteydessä, joten uuden mallin tai kehotteen on ensin osoitettava toimivuutensa.

Ylläpito

Valvonta, kustannusbudjetit, ajautumatarkistukset ja häiriötilanteiden ajokirjat päivittäisessä käytössä oleville agenteille.

02 — Autonomia

Autonomiaa säädetään, ei kytketä.

Jokainen toimenpideluokka saa oman tasonsa. Pilotissa agentit aloittavat tasolta L0, eikä mikään nouse ylemmälle tasolle ilman näyttöä omista tapauksistanne ja hyväksyntäänne. Suojarajan rikkominen on suunniteltu laskemaan tasoa automaattisesti.

TasoMitä agentti tekeeMitä edellytämme ensin
L0 · TarkkailuToimii varjotilassa; kukaan ei toimi sen tulosten perusteellaLähtötaso ja arviointiaineisto
L1 · EhdotusEhdottaa; ihminen vahvistaa tai korjaaPerusteet ja lähteet jokaisen ehdotuksen yhteydessä
L2 · Yksi napsautusValmistelee toimenpidekokonaisuuden; ihminen toteuttaa senTyypitetyt toimenpiteet ja deterministinen validointi
L3 · Automaattinen, tarkastettavaSuorittaa kelpuutetun toimenpiteen; ihmisille ilmoitetaan, ja he voivat perua senPeruutusikkuna ja jatkuva valvonta
L4 · AutonominenSuorittaa rajatun, toimivaksi todetun toimenpideluokan ilman valvontaaOtantaan perustuva auditointi, virhebudjetti ja automaattinen tason lasku

03 — Hallintakeinot

Hallittu jokaisessa kutsussa.

Kun agentit toimivat OneVeer:n kautta, nämä hallintakeinot ovat pyynnön reitillä. Jos käytössänne on jo tekoälyyhdyskäytävä, rakennamme sen hallintakeinojen mukaisesti ja dokumentoimme mahdolliset puutteet.

  • Yksi hallittu yhdyskäytävä jokaiselle malli- ja työkalukutsulle, joten käytännöt, peittäminen ja budjetit koskevat jokaista agenttia.
  • Allekirjoitettu hätäpysäytys, joka kohdistuu yhteen agenttiin, yhteen malliin tai kaikkeen ja joka pannaan täytäntöön ennen kuin pyyntö saavuttaa yhdenkään mallin.
  • Ihmisen kertakäyttöiset hyväksynnät seurauksiltaan merkittäville työkalukutsuille.
  • Tunnistetiedot säilytetään holvissa; mallit näkevät tulokset, eivät koskaan avaimia.
  • Vartijamallit syötteissä, haetussa kontekstissa ja tuotoksissa.
  • Kirjaus jokaisesta vaiheesta (syötteet, lähteet, työkalukutsut, hyväksynnät ja lopputulokset) säilytetään ympäristössänne.

04 — Miten rakentaminen etenee

Kaksi viikkoa rajaukseen, kuudesta kahdeksaan todentamiseen.

  1. 01

    Discovery Sprint · 2 viikkoa

    Tehtävä, työkalut, data, riskit, autonomiataso, jolta aloitetaan, ja hyväksymiskriteerit omilla tapauksillanne.

  2. 02

    Rakentaminen · 3–5 viikkoa

    Agentti, liittimet ja arviointiaineisto rakennetaan ympäristössänne ja testataan erillisellä testiotoksella.

  3. 03

    Valvottu ajo · 2–3 viikkoa

    Oikeaa työtä tasolla L0 tai L1: jokainen ehdotus tarkistetaan, ja työmäärää ja virheitä mitataan lähtötasoa vasten.

  4. 04

    Luovutus

    Ajokirja, konfiguraatio, arviointitulokset, tunnetut rajoitukset ja päätös: laajennetaan, nostetaan tasoa tai lopetetaan.

05 — Usein kysyttyä

Kysymyksiä, joita arkkitehdit ja tietoturvajohtajat kysyvät.

Mitä agenttikehyksiä käytätte?

Yksinkertaisinta, joka täyttää vaatimuksen, usein pelkkää koodia mallin työkalukutsujen ympärillä. Jos tiiminne ovat standardoineet tietyn kehyksen tai Model Context Protocolin, rakennamme sen mukaisesti. Hallinta on yhdyskäytävässä eikä kehyksessä, joten valinta pysyy peruttavissa.

Voivatko agentit toimia paikallisilla malleilla?

Kyllä. OneVeer tukee työkalukutsuja sekä paikallisilla malleilla että pilvipalveluntarjoajien kautta, ja julkaistu alias voi siirtää agentin niiden välillä agenttia muuttamatta.

Mikä estää agenttia joutumasta lukemansa sisällön manipuloimaksi?

Kaikkea, mitä agentti lukee, käsitellään epäluotettavana. Työkalut sallitaan agenttikohtaisilla sallittujen luetteloilla, tunnistetiedot eivät koskaan päädy mallille, vartijamallit tarkastavat syötteet ja haetun kontekstin, ja seurauksiltaan merkittävät toimenpiteet vaativat ihmisen hyväksynnän. Tunnistus ei ole erehtymätön, joten suunnittelussa oletetaan, että osa hyökkäyksistä pääsee läpi, ja rajoitetaan sitä, mitä ne voisivat tehdä.

Kuka vastaa siitä, mitä agentti tekee?

Organisaationne. Siksi jokaisella agentilla on nimetty omistaja, versio, arviointihistoria ja ennen tuotantoon siirtoa sovitut toimintarajat, ja siksi sen kirjaukset pysyvät teillä.