كل وكيل يعتمد على نموذج لغوي كبير ليستدل ويولّد الردود ويفسّر الموجّهات. فالنموذج هو محرّك الاستدلال في وكيلك: يعالج المعلومات ويحدّد الخطوة التالية.
كل وكيل يعتمد على نموذج لغوي كبير ليستدل ويولّد الردود ويفسّر الموجّهات. فالنموذج هو محرّك الاستدلال في وكيلك: يعالج المعلومات ويحدّد الخطوة التالية.
ويُتاح الوصول إلى هذه النماذج عبر واجهات برمجة التطبيقات: ترسل موجّهًا، فيعود إليك رد. وكلما كان النموذج أقدر، تحسّن أداء وكيلك في مهام مثل التلخيص والاستدلال والإجابة عن أسئلة المستخدمين.
الجدول 8-1: مزوّدو النماذج اللغوية ونقاط قوّتهم
| المزوّد | نقاط القوّة | الأنسب لـ |
|---|---|---|
| OpenAI (عائلة GPT) | استدلال قوي وترابط عالٍ في المخرجات | وكلاء عامّو الغرض |
| Anthropic (Claude) | التزام دقيق بالتعليمات وتركيز على السلامة | المساعدات والكتابة والامتثال |
| Google (Gemini) | استدلال متقدّم متعدّد الوسائط | وكلاء يجمعون الصورة والنص |
| DeepSeek / Mistral / LLaMA | نماذج مفتوحة الأوزان أو قابلة للتشغيل محليًا، بحسب النموذج وترخيصه | الاستخدام الخاص أو الحسّاس للكلفة |
إن كنت تبني أول وكيل لك، فابدأ بنموذج رائد عام الغرض من OpenAI أو Anthropic أو Google: هذه النماذج موثوقة وسهلة الدمج ومدعومة على نطاق واسع في الأدوات. وإن احتجت تحكّمًا أكبر أو خصوصية أعلى أو كلفة أقل، فاستكشف النماذج مفتوحة الأوزان مثل Mistral أو LLaMA التي يمكنك تشغيلها في بيئتك. وانتبه إلى أن «مفتوح الأوزان» لا يعني بالضرورة «مفتوح المصدر» بالمعنى القانوني: لكل نموذج ترخيصه الخاص، وبعض التراخيص تقيّد الاستخدام التجاري أو إعادة التوزيع، فراجع الترخيص قبل الاعتماد على النموذج في عمل فعلي.
بعد أن يتوفّر لك النموذج، تحتاج إلى طريقة لإدارة المنطق والأدوات والذاكرة وتسلسل الخطوات. هنا يأتي دور أطر تطوير الوكلاء. يمكن اعتبارها نظام التشغيل الخاص بوكيلك: تدير الموجّهات، وتوجّه المهام، وتنسّق استخدام الأدوات.
الجدول 8-2: أطر تطوير الوكلاء الشائعة
| الإطار | ما يفعله | الأنسب لـ |
|---|---|---|
| LangChain | يربط الموجّهات في سلاسل، ويوصل الأدوات، ويدير الذاكرة | وكلاء عامّو الغرض |
| LlamaIndex | يستوعب المستندات ويشغّل الوكلاء القائمين على الاسترجاع | مساعدات مبنيّة على قاعدة معرفة |
| CrewAI | يدير عدة وكلاء يعملون بالتوازي بأدوار موزّعة | التعاون بين عدة وكلاء |
| AutoGen | يبني مسارات عمل للوكلاء بإعداد قليل، ويدير الحوار بينهم | المهام الخفيفة ومسارات البيانات |
| Semantic Kernel Google Vertex AI Agent Builder | يجمعان النماذج التأسيسية مع خدمات معيارية للذاكرة والتخطيط واستخدام الأدوات | تطبيقات مؤسسية تحتاج معيارية وقابلية توسّع |
استخدم LangChain إن أردت طبقة تنسيق كاملة الميزات. واضممها إلى LlamaIndex عند العمل على مستندات كبيرة أو مسارات استرجاع. وإن كنت تبني وكلاء معياريين قابلين للتوسّع في بيئة مؤسسية، فانظر في منصّات مثل Semantic Kernel أو Google Vertex AI Agent Builder التي تدمج التخطيط والاسترجاع والتنفيذ في بنية واحدة.
بدون ذاكرة، يبدأ وكيلك من الصفر في كل مرة. وأنظمة الذاكرة تتيح له تذكّر ما قاله المستخدم، وما الأدوات التي استُخدمت، بل والتفضيلات طويلة المدى.
ولدينا نوعان:
الجدول 8-3: أدوات الذاكرة الشائعة
| الأداة | النوع | الأنسب لـ |
|---|---|---|
| ChromaDB | قاعدة بيانات متجهية | إعدادات خفيفة وذاكرة محلية |
| Pinecone | قاعدة بيانات متجهية | ذاكرة قابلة للتوسّع للوكلاء الكبار |
| Weaviate | متجهات مع مخطّط بيانات | ذاكرة دلالية مع بيانات وصفية |
| Redis | مخزن مفتاح-قيمة | ذاكرة مؤقّتة أو مرتبطة بالجلسة |
ابدأ بـ ChromaDB أو Redis في المشاريع الصغيرة. وانتقل إلى Pinecone أو Weaviate مع نمو وكيلك وحاجته إلى ذاكرة أكثر تنظيمًا وقابلية للتوسّع.
الوكيل المفيد فعلًا لا يتحدّث فقط، بل يعمل. فبفضل دمج الأدوات يستطيع الوكيل ترتيب المواعيد، واسترجاع بيانات حديثة، وإرسال الرسائل، والتفاعل مع قواعد البيانات. هذه الأدوات هي ما ينقله من مجرّد المحادثة إلى الفعل.
الجدول 8-4: أنواع الأدوات الشائعة
| الأداة / الواجهة | الوظيفة | مثال على الاستخدام |
|---|---|---|
| واجهة التقويم | حجز المواعيد أو إلغاؤها أو تعديلها | مساعد شخصي |
| واجهة البحث | الوصول إلى بيانات أو أجوبة حديثة | وكلاء البحث والأخبار |
| واجهة البريد أو Slack | إرسال الإشعارات والملخّصات | دعم العملاء وتحديثات الحالة |
| واجهات داخلية | الاتصال بأنظمة المؤسسة كالموارد البشرية أو إدارة العملاء | الأتمتة المؤسسية |
اختر أداتين أو ثلاثًا أساسية يحتاجها وكيلك في البداية، ولا تُثقل التصميم. وركّز على مهمة واحدة: ترتيب المواعيد، أو إرسال البريد، أو جلب تفاصيل المنتجات. ثم استخدم إطار التطوير لتحديد كيف ومتى تُستدعى هذه الأدوات، ولتقييد ما يستطيع الوكيل فعله بها.
لا يعرف أي نموذج كل شيء. فإن كان على وكيلك أن يجيب انطلاقًا من مستندات داخلية أو أدلّة منتجات أو سياسات مؤسسة، فيحتاج إلى طريقة لاسترجاع هذه المعلومات قبل توليد الرد. وهذا هو RAG في التطبيق العملي.
الجدول 8-5: أدوات شائعة لبناء RAG
| الأداة | الغرض | الأنسب لـ |
|---|---|---|
| LlamaIndex | يستوعب المستندات ويقسّمها ويسترجعها | الأسئلة والأجوبة على المستندات الداخلية |
| LangChain RAG | يدمج الاسترجاع مع مسارات الموجّهات | وكلاء واعون بالسياق |
| Chroma / Pinecone | يخزّنان التمثيلات المتجهية للوصول السريع | استرجاع خفيف أو قابل للتوسّع |
إن كان على وكيلك أن يجيب من معرفة داخلية لا من بيانات عامة، فأنت تحتاج RAG. ابدأ بـ LlamaIndex و ChromaDB: سريعان، ومناسبان للمطوّرين، ويتكاملان جيدًا مع LangChain.
بعد أن يعمل وكيلك، عليك أن تحدّد المكان الذي سيتفاعل فيه المستخدمون معه. قد يكون واجهة محادثة، أو تكاملًا مع Slack، أو حتى مساعدًا صوتيًا.
الجدول 8-6: خيارات النشر الشائعة
| المنصّة | أين يعيش الوكيل | الأنسب لـ |
|---|---|---|
| تطبيق ويب | مدمج في موقع أو بوّابة | أدوات موجّهة للعملاء أو للاستخدام الداخلي |
| Slack / Teams | واجهة محادثة داخل بيئة العمل | أتمتة سير العمل الداخلي |
| نقطة نهاية API | مُتاح لبرامج أخرى لاستخدامه | الدمج في أنظمة أكبر |
| واجهة صوتية | مدخلات ومخرجات صوتية | إتاحة الوصول أو الأدوات الصوتية أولًا |
ابدأ بواجهة ويب أو Slack، حيث يقضي المستخدمون وقتهم أصلًا. واستخدم أدوات مثل Streamlit أو Gradio أو واجهات مبنيّة على React لبناء نموذج أولي ونشره بسرعة.
وتذكّر التمييز الذي أشرنا إليه سابقًا: النشر يعني إتاحة النظام للعمل في بيئة فعلية. أما الانتقال إلى بيئة الإنتاج فيستدعي أيضًا متابعة الأداء، وتحديد الصلاحيات، وحفظ سجلات يمكن تدقيقها، وخطة واضحة للتعامل مع الأخطاء.
لدينا الآن الصورة الكاملة من المخطّط إلى الأدوات. في الجزء التالي ننظر إلى الواقع: أين تعمل هذه الأنظمة فعليًا اليوم، وما القيمة التي تحقّقها.