Aufgabenagenten
Agenten mit einem einzigen Zweck, die sichten, extrahieren, nachschlagen, entwerfen oder abgleichen und einem Menschen ein vorbereitetes Ergebnis übergeben.
Entwickeln — Entwicklung von KI-Agenten
Ein Agent, der lesen, entscheiden und handeln kann, ist nur nützlich, wenn Sie sagen können, was er darf, nachweisen können, was er getan hat, und ihn sofort stoppen können. Onega konzipiert, entwickelt und evaluiert KI-Agenten und mehrstufige Workflows, die in Ihren Systemen arbeiten: Jeder Werkzeugaufruf wird durch Richtlinien geprüft, folgenreiche Aktionen gibt ein Mensch frei, und das Protokoll gehört Ihnen.
01 — Was wir entwickeln
Agenten mit einem einzigen Zweck, die sichten, extrahieren, nachschlagen, entwerfen oder abgleichen und einem Menschen ein vorbereitetes Ergebnis übergeben.
Agenten, die über mehrere Werkzeuge und Systeme hinweg planen, mit Kontrollpunkten zwischen den Schritten und einem definierten Rückweg, wenn ein Schritt fehlschlägt.
Antworten, gestützt auf Ihre Dokumente und Datensätze, jeweils mit Quellen, und ein klares „nicht gefunden“, wenn die Quellen nichts hergeben.
Konnektoren zu Ihren ERP-, CRM-, Servicedesk-, Dokumenten- und E-Mail-Systemen über deren APIs oder das Model Context Protocol. Anmeldedaten werden niemals an ein Modell gegeben.
Testdatensätze aus Ihren eigenen Fällen, bewertet vor dem Release und bei jeder Änderung, sodass sich ein neues Modell oder ein neuer Prompt erst bewähren muss.
Monitoring, Kostenbudgets, Drift-Prüfungen und Incident-Runbooks für Agenten im täglichen Einsatz.
02 — Autonomie
Jede Aktionsklasse erhält ihre eigene Stufe. Agenten beginnen im Pilotprojekt auf L0, und nichts steigt eine Stufe auf ohne Nachweise an Ihren eigenen Fällen und ohne Ihre Freigabe. Das Design sieht vor, dass eine Verletzung der Leitplanken die Stufe automatisch senkt.
| Stufe | Was der Agent tut | Was wir vorher verlangen |
|---|---|---|
| L0 · Beobachten | Läuft im Schattenbetrieb; niemand handelt auf Basis seiner Ergebnisse | Eine Ausgangsbasis und ein Evaluierungsdatensatz |
| L1 · Vorschlagen | Schlägt vor; ein Mensch bestätigt oder korrigiert | Nachweise und Quellen zu jedem Vorschlag |
| L2 · Ein Klick | Bereitet eine Reihe von Aktionen vor; ein Mensch führt sie aus | Typisierte Aktionen und deterministische Validierung |
| L3 · Automatisch mit Prüfung | Führt eine qualifizierte Aktion aus; Menschen werden benachrichtigt und können sie rückgängig machen | Ein Zeitfenster für die Rücknahme und kontinuierliches Monitoring |
| L4 · Autonom | Führt eine eng gefasste, bewährte Aktionsklasse unbeaufsichtigt aus | Stichprobenprüfung, ein Fehlerbudget und automatische Herabstufung |
03 — Kontrollen
Wenn Agenten über OneVeer laufen, sitzen diese Kontrollen im Anfragepfad. Wo Sie bereits ein KI-Gateway betreiben, bauen wir auf dessen Kontrollen auf und dokumentieren jede Lücke.
04 — Wie eine Entwicklung abläuft
Die Aufgabe, die Werkzeuge, die Daten, die Risiken, die Autonomiestufe für den Start und Abnahmekriterien an Ihren eigenen Fällen.
Agent, Konnektoren und Evaluierungsdatensatz, in Ihrer Umgebung gebaut und an einer Holdout-Stichprobe getestet.
Echte Arbeit auf L0 oder L1, jeder Vorschlag geprüft, Aufwand und Fehler gegen die Ausgangsbasis gemessen.
Runbook, Konfiguration, Evaluierungsergebnisse, bekannte Einschränkungen und eine Entscheidung: erweitern, eine Stufe höher gehen oder aufhören.
05 — Häufige Fragen
Das einfachste, das die Anforderung erfüllt, oft schlichter Code rund um die Werkzeugaufrufe eines Modells. Wo sich Ihre Teams auf ein Framework oder auf das Model Context Protocol festgelegt haben, bauen wir darauf auf. Die Governance sitzt im Gateway, nicht im Framework, sodass die Wahl umkehrbar bleibt.
Ja. OneVeer unterstützt Werkzeugaufrufe mit lokalen Modellen ebenso wie über Cloud-Anbieter, und ein veröffentlichter Alias kann einen Agenten zwischen beiden verschieben, ohne den Agenten zu ändern.
Alles, was ein Agent liest, gilt als nicht vertrauenswürdig. Werkzeuge werden pro Agent per Allowlist freigegeben, Anmeldedaten erreichen nie das Modell, Guard-Modelle prüfen Eingaben und abgerufenen Kontext, und folgenreiche Aktionen brauchen die Freigabe eines Menschen. Die Erkennung ist fehlbar, daher geht das Design davon aus, dass manche Angriffe durchkommen, und begrenzt, was sie anrichten könnten.
Ihre Organisation. Deshalb hat jeder Agent eine benannte verantwortliche Person, eine Version, einen Evaluierungsnachweis und Betriebsgrenzen, die vor dem Go-live vereinbart werden, und deshalb bleibt sein Protokoll bei Ihnen.