بناء — تطوير الذكاء الاصطناعي الوكيل

وكلاء ينجزون عملًا حقيقيًا، ضمن حدود تضعونها.

لا يكون الوكيل القادر على القراءة واتخاذ القرار والتصرف مفيدًا إلا إذا استطعتم تحديد ما يُسمح له بفعله، وإثبات ما فعله، وإيقافه فورًا. تصمّم Onega وكلاء الذكاء الاصطناعي ومسارات العمل متعددة الخطوات وتبنيها وتقيّمها لتعمل في أنظمتكم، مع فحص كل استدعاء للأدوات وفق السياسة، وموافقة شخص على الإجراءات ذات العواقب، وسجل تملكونه.

٠١ — ما نبنيه

من مهمة واحدة إلى سير عمل خاضع للحوكمة.

وكلاء المهام

وكلاء أحاديو الغرض يفرزون، أو يستخلصون، أو يبحثون، أو يصوغون المسودات، أو يطابقون، ثم يسلّمون نتيجة جاهزة إلى شخص.

مسارات عمل متعددة الخطوات

وكلاء يخططون عبر عدة أدوات وأنظمة، مع نقاط تحقق بين الخطوات وطريق محدد للعودة عند فشل إحدى الخطوات.

وكلاء المعرفة

إجابات مستندة إلى مستنداتكم وسجلاتكم، لكل منها مصادرها، وعبارة «غير موجود» صريحة حين تخلو المصادر من الإجابة.

تكامل الأدوات والأنظمة

موصلات إلى أنظمة ERP وCRM ومكتب الخدمة والمستندات والبريد لديكم، عبر واجهات API الخاصة بها أو عبر Model Context Protocol. ولا تُمنح بيانات الاعتماد لأي نموذج أبدًا.

أُطر التقييم

مجموعات اختبار مأخوذة من حالاتكم الخاصة، تُقيَّم قبل الإصدار ومع كل تغيير، بحيث يتعيّن على أي نموذج أو مطالبة جديدة إثبات الجدارة أولًا.

التشغيل

المراقبة، وميزانيات التكلفة، وفحوص الانحراف، وأدلة تشغيل للحوادث، للوكلاء المستخدمين يوميًا.

٠٢ — الاستقلالية

استقلالية تضبطونها تدريجيًا، لا بضغطة زر.

لكل فئة من الإجراءات مستواها الخاص. يبدأ الوكلاء عند L0 في المشروع التجريبي، ولا يرتفع أي مستوى دون أدلة على حالاتكم الخاصة ودون موافقتكم. وقد صُمِّم النظام بحيث يؤدي خرق أي ضابط حماية إلى خفض المستوى تلقائيًا.

المستوىما يفعله الوكيلما نشترطه أولًا
L0 · المراقبةيعمل في الوضع الظلّي؛ ولا يتصرف أحد بناءً على نتائجهخط أساس ومجموعة تقييم
L1 · الاقتراحيقترح؛ ويؤكد شخصٌ الاقتراح أو يصحّحهأدلة ومصادر مع كل اقتراح
L2 · بنقرة واحدةيُعِدّ مجموعة إجراءات؛ وينفّذها شخصإجراءات محددة الأنواع وتحقق حتمي
L3 · تلقائي مع المراجعةينفّذ إجراءً مؤهَّلًا؛ ويُبلَّغ الأشخاص المعنيون ويمكنهم التراجع عنهمهلة للتراجع ومراقبة مستمرة
L4 · المستقلينفّذ فئة إجراءات ضيقة ومُثبتة دون إشراف مباشرتدقيق بالعينات، وميزانية أخطاء، وخفض تلقائي للمستوى

٠٣ — الضوابط

حوكمة عند كل استدعاء.

عندما يعمل الوكلاء عبر OneVeer، تقع هذه الضوابط في مسار الطلب. وحيث تشغّلون بالفعل بوابة ذكاء اصطناعي، نبني وفق ضوابطها ونوثّق أي فجوة.

  • بوابة واحدة خاضعة للحوكمة لكل استدعاء للنماذج والأدوات، بحيث تنطبق السياسة والحجب والميزانيات على كل وكيل.
  • مفتاح إيقاف طارئ موقّع يشمل نطاقه وكيلًا واحدًا أو نموذجًا واحدًا أو كل شيء، ويُطبَّق قبل الوصول إلى أي نموذج.
  • موافقات أحادية الاستخدام من شخص لاستدعاءات الأدوات ذات العواقب.
  • بيانات الاعتماد محفوظة في خزنة؛ ترى النماذج النتائج، لا المفاتيح أبدًا.
  • نماذج حماية على المدخلات والسياق المسترجَع والمخرجات.
  • سجل لكل خطوة (المدخلات، والمصادر، واستدعاءات الأدوات، والموافقات، والنتائج) يُحفظ في بيئتكم.

٠٤ — كيف يسير البناء

أسبوعان لتحديد النطاق، ومن ستة إلى ثمانية للإثبات.

  1. ٠١

    Discovery Sprint · أسبوعان

    المهمة، والأدوات، والبيانات، والمخاطر، ومستوى الاستقلالية الذي نبدأ عنده، ومعايير القبول على حالاتكم الخاصة.

  2. ٠٢

    البناء · ٣–٥ أسابيع

    الوكيل والموصلات ومجموعة التقييم، تُبنى في بيئتكم وتُختبر على عينة محجوزة.

  3. ٠٣

    التشغيل تحت الإشراف · ٢–٣ أسابيع

    عمل حقيقي عند L0 أو L1، مع مراجعة كل اقتراح، وقياس الجهد والأخطاء مقارنةً بخط الأساس.

  4. ٠٤

    التسليم

    دليل التشغيل، والإعدادات، ونتائج التقييم، والقيود المعروفة، وقرار: التوسيع، أو رفع المستوى، أو الإيقاف.

٠٥ — الأسئلة الشائعة

أسئلة يطرحها مهندسو البنية ومسؤولو أمن المعلومات.

ما أطر عمل الوكلاء التي تستخدمونها؟

أبسط إطار يلبّي المتطلبات، وغالبًا ما يكون شيفرة بسيطة حول قدرة النموذج على استدعاء الأدوات. وحيث تكون فرقكم قد اعتمدت إطار عمل معيّنًا أو Model Context Protocol معيارًا، نبني وفقه. فالحوكمة تقع في البوابة لا في إطار العمل، لذا يبقى الاختيار قابلًا للتراجع عنه.

هل يمكن تشغيل الوكلاء على نماذج محلية؟

نعم. يدعم OneVeer استدعاء الأدوات على النماذج المحلية وكذلك عبر المزوّدين السحابيين، ويمكن لاسم مستعار منشور أن ينقل الوكيل بينهما دون تغيير الوكيل.

ما الذي يمنع التلاعب بالوكيل عبر ما يقرؤه؟

يُعامَل كل ما يقرؤه الوكيل على أنه غير موثوق. وتُدرج الأدوات في قائمة سماح خاصة بكل وكيل، ولا تصل بيانات الاعتماد إلى النموذج أبدًا، وتفحص نماذج الحماية المدخلات والسياق المسترجَع، وتتطلب الإجراءات ذات العواقب موافقة شخص. الاكتشاف قابل للخطأ، لذا يفترض التصميم أن بعض الهجمات ستنفذ، ويحدّ مما يمكنها فعله.

من المسؤول عمّا يفعله الوكيل؟

مؤسستكم، ولهذا السبب يكون لكل وكيل مالك محدد بالاسم، وإصدار، وسجل تقييم، وحدود تشغيل يُتفق عليها قبل بدء تشغيله الفعلي، ولهذا أيضًا يبقى سجله لديكم.