المشكلة المتكررة مع وكلاء البرمجة: كل جلسة تبدأ من الصفر. الوكيل يتعلّم شيئًا مفيدًا عن مشروعك، ثم تُغلق النافذة ويضيع كل شيء. Prime Agent من Prime Intellect يبني حلًا حول تجريدين أساسيين.
التجريد الأول: نموذج اللغة العودي (RLM)
الفكرة الأساسية: يعامل السياق كمتغيرات (prompt-as-a-variable)، والأدوات والوكلاء الفرعيين كاستدعاءات دوال داخل بيئة REPL مستمرة.
الفرق العملي عن النمط المعتاد كبير:
- بيئة IPython مستمرة هي الأداة المدمجة الأساسية. لا مجرد إضافة.
- عمليات الملفات وأوامر الصدفة واستخدام الأدوات وإدارة السياق كلها تمر عبر الكود.
- استدعاء rlm(..) يولّد وكلاء أبناء حقيقيين لعمل متوازٍ أو خلفي، ويرجّع نتائجهم برمجيًا.
المبدأ نفسه المطبَّق في ego lite: حين يكتب الوكيل كودًا بدل تنفيذ أوامر متتابعة، يدمج مهمة متعددة الخطوات في مخرج واحد بدل الدوران في حلقة استدعاء وقراءة.
التجريد الثاني: الحزام المستمر (Continual Harness)
يخزّن الحزام مطالبات تكميلية وذكريات وأوصاف مهارات ومواصفات وكلاء فرعيين قابلة لإعادة الاستخدام. كحالة دائمة يستطيع الوكيل تحسينها بتحديثات صغيرة مدعومة بالأدلة، محلية للجلسة افتراضيًا.
الأمر /refine يراجع المسار الحالي ويطبّق تحديثات مركّزة وقابلة للمراجعة. ونقطتان أمنيتان مهمتان في التصميم:
- لا يعيد كتابة مطالبة النظام الأساسية غير القابلة للتغيير إطلاقًا.
- اللقطات المسجّلة تدعم التراجع (rollback) عن أي تحسين.
مصمَّم للعمل طويل الأمد
أغلب مزايا المشروع تدور حول استمرارية المهام الطويلة، خصوصًا لتقييمات البحث:
| الميزة | ماذا تحل |
|---|---|
| استمرارية بخدمة خلفية (daemon) | الجلسات وحالة IPython والجداول والوكلاء الفرعيون يستمرون بعد فصل الطرفية، ويمكن إعادة الاتصال بهم لاحقًا |
| تواصل مباشر بين الوكلاء | الوكلاء العاملون يكتشفون بعضهم ويتبادلون الرسائل ويوجّهون العمل النشط دون المرور بالمستخدم |
| نبضات وجداول | أوامر heartbeat وschedule تعيد الدخول للجلسة دوريًا أو في وقت محدد |
| أهداف دائمة | الأمر /goal يبقي الهدف وتقدّمه نشطًا عبر الأدوار حتى يكتمل أو يُلغى |
| وضع مستقل محدود | الأمر /autonomous يواصل ضمن ميزانيات أدوار وتوكنات ووقت، مع بوابات جودة يعرّفها المستخدم |
ويوضح التوثيق نقطة مهمة: اجتياز بوابة جودة يتحقق فقط مما تفحصه تلك البوابة، وبلوغ حد الميزانية لا يعني نجاح المهمة. هذا تمييز يغيب عن كثير من أدوات الوكلاء.
المهارات كحزم قابلة للتنفيذ
المهارات هنا ليست ملفات نصية توجيهية، بل حزم Python قابلة للاستيراد. ومنشئ المهارات المدمج يحوّل أنماط العمل المتكررة إلى مهارات على مستوى المشروع أو المستخدم.
والتوثيق يفرّق بوضوح بين الأمرين: /refine يحفظ دروسًا في الحالة التكميلية، لكنه لا يحل محل تغليف مهارة تنفيذية جديدة ومراجعتها.
التشغيل والأدوات المحيطة
التثبيت بأمر واحد على macOS أو لينكس، والمثبّت يتحقق من بصمة SHA-256 للإصدار ويجهّز بيئة IPython. ثم تشغّله من داخل المجلد الذي تريده أن يعمل فيه.
| المشروع | دوره في المنظومة |
|---|---|
| prime-agent | الوكيل نفسه. رخصة MIT مفتوحة بالكامل |
| verifiers | بيئات تحقق لتقييم أداء الوكلاء |
| prime-rl | إطار التعلّم المعزز من Prime Intellect |
| pi (earendil-works) | الأساس الذي بُني عليه الوكيل والواجهة الطرفية |
ويدعم أوضاعًا للأتمتة بلا واجهة: JSON mode وRPC mode للتكامل مع أنظمة أخرى. نقطة مهمة لمن يريد دمجه في خط أنابيب قائم.
تحذير أمني صريح من المشروع
التوثيق يذكر بوضوح أن Prime Agent ينفّذ كود Python المولّد من النموذج وأوامر المشروع بصلاحيات المستخدم نفسه. وعمليات العامل والنواة تحسّن عزل دورة الحياة والتعافي، لكنها ليست صندوقًا رمليًا أمنيًا.
التوصية العملية المستخلصة:
- شغّله في نسخة مستنسخة قابلة للاستغناء أو فرع نظيف يمكنك فحصه واستعادته.
- استخدم مستودعات وتعليمات ومهارات وإضافات موثوقة فقط.
- شغّل أي كود أو تعليمات غير موثوقة في بيئة معزولة خارجية.
- راجع التغييرات فعليًا قبل الدمج، خصوصًا في الوضع المستقل.
والمقايضة في الوكلاء طويلة الأمد: كلما زادت استقلالية الوكيل واستمراريته، زادت الحاجة لضوابط مراجعة صريحة. لأن الخطأ الصامت يتراكم عبر جلسات لا عبر رسالة واحدة.