Görev ajanları
Önceliklendiren, bilgi çıkaran, sorgulayan, taslak hazırlayan ya da mutabakat yapan ve hazırladığı sonucu bir insana teslim eden tek amaçlı ajanlar.
Geliştirme — Ajan tabanlı yapay zekâ geliştirme
Okuyabilen, karar verebilen ve eyleme geçebilen bir ajan, ancak neler yapabileceğini söyleyebildiğiniz, ne yaptığını kanıtlayabildiğiniz ve onu anında durdurabildiğiniz sürece işe yarar. Onega, sistemlerinizde çalışan yapay zekâ ajanlarını ve çok adımlı iş akışlarını tasarlar, geliştirir ve değerlendirir: her araç çağrısı politikayla denetlenir, sonuç doğuran eylemler bir insan tarafından onaylanır ve kayıt size aittir.
01 — Ne geliştiriyoruz
Önceliklendiren, bilgi çıkaran, sorgulayan, taslak hazırlayan ya da mutabakat yapan ve hazırladığı sonucu bir insana teslim eden tek amaçlı ajanlar.
Birden çok araç ve sistem genelinde plan yapan, adımlar arasında kontrol noktaları bulunan ve bir adım başarısız olduğunda tanımlı bir geri dönüş yolu olan ajanlar.
Belgelerinize ve kayıtlarınıza dayanan, her biri kaynaklarıyla birlikte sunulan yanıtlar; kaynaklarda yanıt yoksa açıkça “bulunamadı”.
ERP, CRM, servis masası, doküman ve posta sistemlerinize, bunların API'leri ya da Model Context Protocol üzerinden bağlayıcılar. Kimlik bilgileri asla bir modele verilmez.
Kendi vakalarınızdan derlenen, yayından önce ve her değişiklikte puanlanan test setleri; böylece yeni bir model ya da istem önce kendini kanıtlamak zorundadır.
Günlük kullanımdaki ajanlar için izleme, maliyet bütçeleri, sapma kontrolleri ve olay müdahale kılavuzları (runbook).
02 — Otonomi
Her eylem sınıfı kendi düzeyini alır. Ajanlar pilotta L0 düzeyinde başlar; kendi vakalarınız üzerinde kanıt ve sizin onayınız olmadan hiçbir şey bir üst düzeye çıkmaz. Bir koruma sınırı ihlali, düzeyi otomatik olarak düşürecek şekilde tasarlandı.
| Düzey | Ajanın yaptığı | Önce şart koştuklarımız |
|---|---|---|
| L0 · Gözlem | Gölge modda çalışır; sonuçlarına göre kimse işlem yapmaz | Referans ölçüm ve bir değerlendirme seti |
| L1 · Öneri | Önerir; bir insan onaylar ya da düzeltir | Her öneriyle birlikte kanıt ve kaynaklar |
| L2 · Tek tık | Bir eylem seti hazırlar; bir insan bunu yürütür | Tipli eylemler ve deterministik doğrulama |
| L3 · İncelemeli otomatik | Koşulları sağlayan bir eylemi yürütür; insanlar bilgilendirilir ve eylemi geri alabilir | Bir geri alma süresi ve sürekli izleme |
| L4 · Otonom | Dar kapsamlı, kanıtlanmış bir eylem sınıfını gözetimsiz yürütür | Örneklem denetimi, bir hata bütçesi ve otomatik düzey düşürme |
03 — Kontroller
Ajanlar OneVeer üzerinden çalıştığında bu kontroller istek yolunda yer alır. Hâlihazırda bir YZ ağ geçidi işletiyorsanız, onun kontrollerine uygun geliştirir ve her türlü eksikliği belgeleriz.
04 — Geliştirme nasıl işler
Görev, araçlar, veriler, riskler, başlangıç otonomi düzeyi ve kendi vakalarınız üzerinde tanımlanan kabul kriterleri.
Ortamınızda geliştirilen ve ayrılmış bir test örneklemi (holdout) üzerinde test edilen ajan, bağlayıcılar ve değerlendirme seti.
L0 ya da L1 düzeyinde gerçek iş; her öneri incelenir, emek ve hatalar referans değerlere göre ölçülür.
İşletim kılavuzu (runbook), yapılandırma, değerlendirme sonuçları, bilinen sınırlamalar ve bir karar: genişletmek, bir düzey yükseltmek ya da durdurmak.
05 — SSS
Gereksinimi karşılayan en basit olanı; çoğu zaman bir modelin araç çağırma özelliği etrafında yazılmış sade kod. Ekipleriniz bir çerçeveyi ya da Model Context Protocol'ü standart olarak benimsediyse ona uygun geliştiririz. Yönetişim çerçevede değil ağ geçidinde yer aldığı için bu seçim geri alınabilir kalır.
Evet. OneVeer, bulut sağlayıcılarının yanı sıra yerel modellerde de araç çağırmayı destekler; yayımlanmış bir takma ad, ajanı değiştirmeden onu bunlar arasında taşıyabilir.
Bir ajanın okuduğu her şey güvenilmez kabul edilir. Araçlar her ajan için ayrı bir izin listesiyle sınırlanır, kimlik bilgileri asla modele ulaşmaz, koruma modelleri girdileri ve erişilen bağlamı inceler, sonuç doğuran eylemler ise bir insanın onayını gerektirir. Tespit yanılabilir; bu nedenle tasarım, bazı saldırıların geçebileceğini varsayar ve bunların yapabileceklerini sınırlar.
Kuruluşunuz. Bu yüzden her ajanın adı belirlenmiş bir sahibi, bir sürümü, bir değerlendirme kaydı ve canlıya alınmadan önce üzerinde anlaşılan işletim sınırları vardır; kaydı da bu yüzden sizde kalır.