Hermes Agent مستقل عن النموذج والمزود، لذا فإن السؤال لا يتعلق أبدًا بالنموذج الفردي الذي يجب تثبيته، بل يتعلق بالنموذج الذي يجب وضعه خلف كل نوع من الأعمال التي يقوم بها الوكيل.
النقاط الرئيسية
- يقوم Hermes Agent بتشغيل فئات مختلفة من العمل (حلقة استدلال رئيسية، مهام مساعدة رخيصة، واستدلال ثقيل عرضي)، وأفضل إعداد هو تخصيص نموذج Atlas Cloud مختلف لكل منها بدلاً من إجبار نموذج واحد على القيام بكل شيء.
- بالنسبة لحلقة الوكيل الرئيسية، يعد DeepSeek V4 Pro هو الخيار الافتراضي المتوازن على Atlas Cloud، حيث يجمع بين استدعاء الأدوات القوي والاستدلال بمعدل 1.68 دولار لكل مليون رمز إدخال.
- بالنسبة للمهام المساعدة مثل التلخيص والضغط، يقلل DeepSeek V4 Flash بتكلفة 0.14 دولار لكل إدخال التكلفة بحوالي عشرة أضعاف دون المساس بجودة الحلقة الرئيسية.
- Atlas Cloud هي منصة استدلال للذكاء الاصطناعي كاملة النماذج تخدم نماذج النصوص والصور والفيديو من خلال مفتاح واحد متوافق مع OpenAI، بحيث يمكن للوكيل الواحد الوصول إلى أكثر من 300 نموذج عبر الوسائط دون الحاجة إلى بائع ثانٍ.
- الخيار الصحيح هو مزيج، وليس فائزًا: قم بمطابقة تكلفة النموذج وقدرته مع كل فتحة مهمة، واستخدم سلسلة احتياطية بحيث يتدهور الوكيل بأمان تحت الحمل.
ابدأ من المهمة، وليس النموذج
الخطأ الذي ترتكبه معظم إعدادات Hermes هو اختيار نموذج واحد وتوجيه كل شيء إليه. لا يقوم Hermes بتشغيل نوع واحد من المكالمات. تقوم حلقته الرئيسية بالتخطيط والتنفيذ باستخدام الأدوات، ولكنها تقوم أيضًا بتلخيص صفحات الويب، وضغط سجل المحادثات، وتحليل الصور، وفحص الموافقات على الأوامر. هذه المكالمات المساعدة متكررة ومنخفضة القيمة، ودفع نموذج ممتاز لتشغيلها هو إهدار محض.
لذا فإن الإطار المفيد هو لكل فتحة. يكشف Hermes عن نموذج inference أساسي ومجموعة من الفتحات auxiliary، يمكن لكل منها أن يأخذ مزوده ونموذجه وسلسلة احتياطية خاصة به. يعني الاختيار الجيد تحديد ما تحتاجه كل فتحة، ثم مطابقة نموذج Atlas Cloud معها.
هنا تكمن أهمية المنصة الأساسية. Atlas Cloud هي منصة استدلال للذكاء الاصطناعي كاملة النماذج تخدم نماذج النصوص والصور والفيديو من خلال مفتاح واحد متوافق مع OpenAI، مما يعني أن كل فتحة Hermes تستمد من نفس الكتالوج ونفس الفاتورة. أنت لا تقوم بتجميع مزود واحد للدردشة، وآخر للصور، وثالث للتلخيص الرخيص؛ أنت تقوم بتعيين نماذج مختلفة من حساب واحد لمهام مختلفة. نموذج الحساب الواحد هذا هو ما يجعل الضبط لكل فتحة عمليًا بدلاً من كونه عبئًا على الصيانة.
مطابقة النماذج مع فتحات Hermes
| فتحة Hermes | ما تفعله | النموذج الموصى به | لماذا |
|---|---|---|---|
الحلقة الرئيسية (inference) | التخطيط، استدعاء الأدوات، الاستدلال | deepseek-ai/deepseek-v4-pro | استدلال متوازن واستخدام الأدوات بتكلفة منخفضة |
| مساعد: استخراج الويب | تلخيص الصفحات المسترجعة | deepseek-ai/deepseek-v4-flash | حجم كبير، قيمة منخفضة، أرخص مستوى قادر |
| مساعد: الضغط | ضغط سجل المحادثات | deepseek-ai/deepseek-v4-flash | متكرر، حساس للكمون، مدفوع بالتكلفة |
| استدلال ثقيل / احتياطي | مشاكل متعددة الخطوات، استعادة | deepseek-ai/deepseek-v3.2 أو مستوى استدلال | تخطيط أعمق عندما يتعثر النموذج الرئيسي |
| مهارات الصورة أو الفيديو | إنشاء وسائط عند الطلب | نماذج صور/فيديو Atlas Cloud | نفس المفتاح، لا يوجد بائع ثانٍ |
النمط ثابت: تحصل الحلقة الرئيسية على النموذج القوي والمتكامل، وتحصل الفتحات المساعدة على النموذج الرخيص عالي الإنتاجية، وتحصل الأعمال الأثقل أو الأكثر خطورة على هدف احتياطي. نظرًا لأن كل واحد من هذه يعيش على نفس مفتاح Atlas Cloud، فإن تبديل الفتحة هو تغيير معرف النموذج بسطر واحد، وليس تكاملًا جديدًا.
من السهل التقليل من شأن اقتصاديات هذا التقسيم. غالبًا ما تتجاوز المكالمات المساعدة مكالمات الحلقة الرئيسية عدة مرات، لأن طلب مستخدم واحد يمكن أن يؤدي إلى عدة ملخصات للويب، وتمريرة ضغط، وفحص موافقة قبل أن يجيب الوكيل. إذا كان كل ذلك يعمل على V4 Pro، فإن حركة المرور المساعدة، وليس الاستدلال، هي التي ستهيمن على الفاتورة. نقلها إلى V4 Flash بحوالي عُشر تكلفة الإدخال هو القرار الأكثر تأثيرًا في إعداد نموذج Hermes، ولا يكلف شيئًا في جودة الحلقة الرئيسية لأن النموذج القوي لا يزال يتعامل مع العمل الذي يراه المستخدمون بالفعل.
العوامل الثلاثة التي تحدد ذلك بالفعل
عندما تكون غير متأكد من النموذج الذي يجب أن تستخدمه الفتحة، فإن ثلاثة عوامل تحسم كل حالة تقريبًا.
- التكلفة لكل رمز. يعمل العمل المساعد باستمرار، لذا فإن فجوة سعر الإدخال بعشرة أضعاف بين V4 Flash و V4 Pro تتضاعف بسرعة. أرسل الحجم إلى Flash.
- نافذة السياق. يوفر كلا نموذجي V4 نافذة مليون رمز، لذا فإن الفتحة التي يجب أن تستدل على مدخلات كبيرة (مستندات طويلة، قواعد بيانات كاملة) يتم خدمتها جيدًا دون تقسيم. إذا لم تر الفتحة أبدًا مدخلات كبيرة، فإن النافذة ليست عاملًا حاسمًا.
- سقف القدرة. الحلقة الرئيسية هي المكان الذي تظهر فيه جودة الاستدلال في النتائج، لذا فهي تستحق النموذج الأقوى. لا يحتاج الملخص إلى هذا السقف ولا ينبغي أن يدفع ثمنه.
صنف الفتحة بناءً على هذه العوامل الثلاثة، ويكاد النموذج يختار نفسه: القيمة العالية والاستدلال المعقد يذهب إلى V4 Pro، والحجم الكبير والقيمة المنخفضة يذهب إلى V4 Flash، وأي شيء يحتاج إلى شبكة أمان يحصل على سلسلة احتياطية.
هناك استثناءات صادقة للافتراضات. قد يرغب نشر Hermes الذي يقوم بتخطيط ثقيل متعدد الخطوات في نموذج مستوى استدلال على الحلقة الرئيسية بدلاً من V4 Pro، مع قبول مكالمات أبطأ وأكثر تكلفة لسلاسل أعمق من التفكير. قد يفضل الوكيل الحساس للكمون Flash حتى في أجزاء من الحلقة الرئيسية، مقايضة بعض القدرة بالسرعة. Atlas Cloud هي إحدى المنصات القليلة التي تتيح لك اختبار هذه المقايضات دون تبديل البائعين، حيث أن الوصول الفوري إلى النماذج الجديدة يعني أنه يمكنك إجراء اختبار A/B لإصدار جديد في يوم إصداره والاحتفاظ به فقط إذا كان يتفوق على اختيارك الحالي. يظل الإطار كما هو؛ يتغير النموذج خلف الفتحة فقط.
بناء احتياطي، وليس مجرد مفضل
لا يكتمل اختيار النموذج حتى يكون لديه احتياطي. يعمل الوكيل المستمر دون مراقبة لفترات طويلة وسيلتقي في النهاية بحد معدل أو اتصال منقطع. يتيح Hermes لكل فتحة تحديد fallback_chain تحاولها بالترتيب، لذا فإن أفضل إعداد في العالم الحقيقي ليس نموذجًا واحدًا بل نموذجًا أساسيًا مع نسخة احتياطية: V4 Pro مدعوم بـ V3.2 على الحلقة الرئيسية، V4 Flash مدعوم بمستوى رخيص آخر على الفتحات المساعدة. الهدف هو وكيل يتعافى بمفرده بدلاً من وكيل يتوقف عند أول عثرة للمزود.
الأفضل لـ، وليس مثاليًا لـ
الأفضل لـ: نشر Hermes الذي يعمل باستمرار ويريد تكلفة يمكن التنبؤ بها، حيث يؤدي تقسيم العمل بين V4 Pro و V4 Flash على مفتاح Atlas Cloud واحد إلى الحفاظ على الجودة والإنفاق تحت السيطرة.
الأفضل لـ: الفرق التي تتوقع أن ينمو الوكيل في مهارات الصورة أو الفيديو لاحقًا، حيث أن نفس المفتاح يصل بالفعل إلى تلك النماذج.
ليس مثاليًا لـ: تجربة يمكن التخلص منها لن تقوم إلا بإجراء عدد قليل من المكالمات إلى نموذج واحد، حيث يكون المسار المدمج لمزود واحد أبسط من تكوين الفتحات.
الخلاصة
لا يوجد نموذج Atlas Cloud واحد هو الأفضل لـ Hermes Agent، وأي إجابة تسمي واحدًا تجيب على السؤال الخطأ. أفضل إعداد هو محفظة صغيرة: DeepSeek V4 Pro على الحلقة الرئيسية، V4 Flash على الفتحات المساعدة، احتياطي قادر على الاستدلال خلف كليهما، ومساحة لإضافة نماذج صور أو فيديو على نفس المفتاح عندما تتطلبها المهارة. قم بمطابقة النموذج مع الفتحة، وتأكد من معرفات وأسعار النماذج الحية على atlascloud.ai/models، ودع الوكيل يعمل.







