العواملالنماذج 🇷🇺 05.08.2026 13:03

وكيل بدولار: اقتصاديات مزيج Hermes Agent مع DeepSeek V4 Flash

DeepSeekDeepSeek
لقطة شاشة انتشرت على نطاق واسع تدّعي معالجة مئات الملايين من الرموز بأكثر قليلاً من دولار واحد باستخدام Hermes Agent مفتوح المصدر على DeepSeek V4 Flash. يشرح هذا الخبر الآليات وراء هذه التكاليف المنخفضة، مع التركيز على التخزين المؤقت التلقائي للبادئات، ويوضح ما يكسر هذا التخزين وادعاءات البائع.
في أوائل شهر أغسطس، انتشرت لقطة شاشة على منصة إكس تعرض لوحة تحكم تحتوي على مئات الملايين من الرموز المميزة المعالجة وفاتورة تزيد قليلاً عن دولار واحد، ويُقال إنها ناتجة عن استخدام وكيل Hermes مفتوح المصدر على نموذج DeepSeek V4 Flash. وكيل Hermes، الذي طورته Nous Research بموجب ترخيص MIT، يعمل مع أي نقطة نهاية متوافقة مع OpenAI ويتميز بحلقة تعلم مغلقة، حيث يحفظ المهارات المكتسبة في ملفات ماركداون. نموذج DeepSeek V4 Flash، المتاح في النسخة التجريبية العامة منذ 31 يوليو، يستخدم نفس البنية المعمارية المستخدمة في معاينة أبريل ولكنه يتمتع بقدرات وكيلية محسنة بعد الضبط الدقيق. التوفير الرئيسي في التكلفة لا يأتي من السعر الأساسي المنخفض، بل من التخزين المؤقت التلقائي للبادئة: البادئات المتكررة للطلبات تتم فوترتها بسعر أقل بعشرات المرات. حلقة الوكيل تتلاءم مع هذه الآلية بشكل شبه مثالي، حيث أن كل استدعاء يعيد إرسال نفس الطلب النظامي ونفس السجل مع إضافة بضعة أسطر جديدة فقط. ومع ذلك، ينكسر التوفير إذا تغيرت عناصر في رأس الطلب، مثل الطوابع الزمنية أو معرفات الجلسة أو قوائم الأدوات المعاد ترتيبها ديناميكيًا. يدعي البائع أن النموذج الأصغر يتفوق على نموذج المعاينة الأكبر في المقاييس الوكيلية، لكنه يوصي باستخدام V4-Pro للمهام التي تتطلب تفكيرًا عميقًا. تم الإعلان عن رسوم إضافية لساعات الذروة ولكنها غير مفعلة بعد، والتوجيه الهجين مع التصعيد إلى Pro يعيد تعيين ذاكرة التخزين المؤقت. توفر المقالة معدلات التسعير، وتدرج أسباب كسر التخزين المؤقت الشائعة، وتقدم نصائح حول التخطيط والاعتبارات التشغيلية مثل حدود المعدل والنطاق الأمني.
المصدر: Habr — хаб ИИ — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة