Agenci zadaniowi
Agenci jednozadaniowi, którzy klasyfikują zgłoszenia, wyodrębniają dane, wyszukują informacje, przygotowują wersje robocze lub uzgadniają dane i przekazują przygotowany wynik człowiekowi.
Budowanie — Tworzenie agentów AI
Agent, który potrafi czytać, decydować i działać, jest użyteczny tylko wtedy, gdy mogą Państwo określić, co wolno mu robić, udowodnić, co zrobił, i natychmiast go zatrzymać. Onega projektuje, buduje i ocenia agentów AI oraz wieloetapowe przepływy pracy działające w Państwa systemach: każde wywołanie narzędzia jest sprawdzane przez politykę, działania o istotnych skutkach zatwierdza człowiek, a zapis należy do Państwa.
01 — Co budujemy
Agenci jednozadaniowi, którzy klasyfikują zgłoszenia, wyodrębniają dane, wyszukują informacje, przygotowują wersje robocze lub uzgadniają dane i przekazują przygotowany wynik człowiekowi.
Agenci, którzy planują działania w wielu narzędziach i systemach, z punktami kontrolnymi między krokami i określoną drogą powrotu, gdy krok się nie powiedzie.
Odpowiedzi oparte na Państwa dokumentach i rekordach, każda ze źródłami, oraz jasne „nie znaleziono”, gdy źródła nie zawierają odpowiedzi.
Konektory do Państwa systemów ERP, CRM, service desk, systemów dokumentów i poczty przez ich API lub Model Context Protocol. Poświadczenia nigdy nie są przekazywane modelowi.
Zestawy testowe oparte na Państwa własnych przypadkach, oceniane przed wydaniem i przy każdej zmianie, tak aby nowy model lub prompt musiał najpierw udowodnić swoją wartość.
Monitorowanie, budżety kosztów, kontrole dryfu i runbooki na wypadek incydentów dla agentów w codziennym użyciu.
02 — Autonomia
Każda klasa działań otrzymuje własny poziom. W pilotażu agenci zaczynają od L0, a nic nie przechodzi na wyższy poziom bez dowodów na Państwa własnych przypadkach i Państwa zatwierdzenia. Naruszenie zabezpieczenia zaprojektowano tak, by automatycznie obniżało poziom.
| Poziom | Co robi agent | Czego wymagamy wcześniej |
|---|---|---|
| L0 · Obserwacja | Działa w trybie cienia; nikt nie działa na podstawie jego wyników | Punkt odniesienia i zbiór ewaluacyjny |
| L1 · Sugestia | Proponuje; człowiek potwierdza lub koryguje | Dowody i źródła przy każdej propozycji |
| L2 · Jedno kliknięcie | Przygotowuje zestaw działań; człowiek go wykonuje | Typowane działania i deterministyczna walidacja |
| L3 · Automatycznie z przeglądem | Wykonuje zakwalifikowane działanie; ludzie są powiadamiani i mogą je cofnąć | Okno na cofnięcie i ciągłe monitorowanie |
| L4 · Autonomia | Wykonuje bez nadzoru wąską, sprawdzoną klasę działań | Audyt wyrywkowy, budżet błędów i automatyczne obniżenie poziomu |
03 — Mechanizmy kontrolne
Gdy agenci działają przez OneVeer, te mechanizmy kontrolne znajdują się w ścieżce żądania. Jeśli już korzystają Państwo z bramy AI, budujemy w oparciu o jej mechanizmy kontrolne i dokumentujemy wszelkie luki.
04 — Przebieg budowy
Zadanie, narzędzia, dane, ryzyka, początkowy poziom autonomii i kryteria odbioru oparte na Państwa własnych przypadkach.
Agent, konektory i zbiór ewaluacyjny zbudowane w Państwa środowisku i przetestowane na wydzielonej próbce testowej.
Rzeczywista praca na poziomie L0 lub L1, przegląd każdej propozycji, nakład pracy i błędy mierzone względem punktu odniesienia.
Runbook, konfiguracja, wyniki ewaluacji, znane ograniczenia i decyzja: rozszerzenie, podniesienie poziomu lub zatrzymanie.
05 — Pytania i odpowiedzi
Z najprostszego, który spełnia wymagania; często jest to zwykły kod wokół mechanizmu wywoływania narzędzi przez model. Jeśli Państwa zespoły ustandaryzowały się na określonym frameworku lub na Model Context Protocol, budujemy zgodnie z nim. Nadzór znajduje się w bramie, a nie we frameworku, więc ten wybór pozostaje odwracalny.
Tak. OneVeer obsługuje wywoływanie narzędzi zarówno w modelach lokalnych, jak i przez dostawców chmurowych, a opublikowany alias pozwala przenieść agenta między nimi bez zmiany samego agenta.
Wszystko, co czyta agent, jest traktowane jako niezaufane. Narzędzia są dopuszczane osobno dla każdego agenta na podstawie listy dozwolonych, poświadczenia nigdy nie trafiają do modelu, modele ochronne sprawdzają dane wejściowe i pobrany kontekst, a działania o istotnych skutkach wymagają zatwierdzenia przez człowieka. Wykrywanie bywa zawodne, dlatego projekt zakłada, że niektóre ataki się przedostaną, i ogranicza to, co mogłyby wyrządzić.
Państwa organizacja. Dlatego każdy agent ma wyznaczonego właściciela, wersję, zapis ewaluacji i limity działania uzgodnione przed uruchomieniem produkcyjnym, a jego zapis pozostaje u Państwa.