أصدرت Fireworks AI Fireworks Nexus، وهي عبارة عن منصة لإدارة وتوجيه الذكاء الاصطناعي تستهدف المؤسسات الهندسية. فهو يربط أدوات البرمجة التي يستخدمها المطورون بالفعل بطبقة مُدارة من النماذج ذات الوزن المفتوح.

المشكلة التي تستهدفها موثقة جيدا. ذكرت مجلة فوربس أن أوبر استنفدت ميزانية الذكاء الاصطناعي لعام 2026 بالكامل في أربعة أشهر. وصل كلود كود إلى ما يقرب من 5000 مهندس بعد طرحه في ديسمبر. تستشهد شركة Fireworks بالتقرير نفسه، مشيرةً إلى أن اعتماد الوكلاء ارتفع من حوالي ثلث المهندسين إلى أكثر من أربعة أخماس خلال شهرين.

تضع الألعاب النارية المشكلة الأساسية في إطار عدم التطابق، وليس الإفراط في الإنفاق. تدير معظم المنظمات أعمالًا روتينية بأسعار حدودية. لقد جعل التعقيد التشغيلي التحول إلى النماذج ذات الوزن المفتوح أمرًا غير جذاب بالنسبة لفرق المنصات.

الألعاب النارية نيكزس

يتكون Nexus من ثلاثة مكونات:

1. ضوابط المؤسسة وإمكانية ملاحظة التكلفة: تقوم الفرق بتحديد الميزانيات على مستوى الفريق أو الشركة. إنهم يتتبعون عائد الاستثمار عبر النماذج والأدوات، ويفرضون السياسة من مكان واحد. يتم تشغيل الطلبات على منصة استدلال إنتاج Fireworks، مع نقاط نهاية مستضافة في الولايات المتحدة، وعدم الاحتفاظ بأي بيانات، وتغطية عبر 20 مركز بيانات عالمي.

2. استمرارية سير العمل: FireConnect عبارة عن تثبيت من سطر واحد يقوم بتعيين فتحات نماذج تسخير نماذج الألعاب النارية. تم إصداره ضمن Apache 2.0 ويمكن تثبيته من Fireworks Dashboard بأمر واحد. يستمر Claude Code وCodex وOpenCode في العمل دون تغيير. يعمل FireConnect على واجهات برمجة تطبيقات Fireworks Serverless المتوافقة مع Anthropic وOpenAI، لذا تتصل معظم الأدوات بعنوان URL الأساسي ومعرف النموذج.

3. إدارة حركة المرور الذكية: نموذج مدرب مخصص يسجل صعوبة كل طلب. تذهب الطلبات الروتينية إلى نموذج الوزن المفتوح منخفض التكلفة الذي تقدمه شركة Fireworks. تمر الطلبات الصعبة إلى المزود الحالي الخاص بك على المفتاح الخاص بك، والذي تنص عليه Fireworks أنه لا يتم تخزينه أبدًا من جانب الخادم. أفاد فريق البحث أن هذا يؤدي عادةً إلى خفض التكلفة بمقدار 3 إلى 5 مرات.

ملاحظة مهمة لأي شخص يخطط للطرح. جهاز التوجيه هو معاينة البحث. وهو يتنقل حاليًا بين Claude Opus 5 وGLM-5.2، لذا فإن مسار التمرير يتطلب مفتاحًا إنسانيًا. مسارات تكوين مفتوحة بالكامل بين Kimi K3 وGLM-5.2 بدلاً من ذلك.

أداء

قام فريق أبحاث Fireworks باختبار Nexus مع فرق التطوير بما في ذلك Notion وDoximity. تظهر النتائج الأولية انخفاضًا بمقدار الثلث في التكلفة لكل طلب سحب مدمج. أبلغ فريق البحث أيضًا عن معدل رمزي مختلط يقارب ربع المختبرات النموذجية المغلقة. هذه أرقام البائعين من برنامج المعاينة، ويجب قراءتها بهذه الطريقة.

الأدلة الأكثر فائدة تأتي من تقييمين مستقلين يستشهد بهما Fireworks.

قامت شركة Faros AI بتنفيذ 211 مهمة هندسية حقيقية مستمدة من 12 مستودعًا عبر سبعة مسارات للنماذج والأدوات. حصل كلود كود على GLM-5.2 على 0.568 على أساس نموذج التحكيم. سجل كلود كود على Opus 4.8 0.521. كانت فجوة التكلفة أكبر من فجوة الجودة: 0.92 دولارًا أمريكيًا لكل مهمة مقابل 1.76 دولارًا أمريكيًا. كانت حصة ذاكرة التخزين المؤقت 89.7% و99.7% على التوالي، لذا فإن التخزين المؤقت لا يفسر النتيجة. يؤكد فاروس على أن المجموعة النموذجية خاصة بالشركة وليست لوحة متصدرين عالمية.

قامت Arize، في دراسة مشتركة مع Fireworks، بتقييم 10 نماذج في 40 مهمة على مقاعد البدلاء في ست تجارب لكل منها. وهذا يعني 2400 عملية تشغيل و626 دولارًا أمريكيًا من إنفاق واجهة برمجة التطبيقات (API)، مصنفة حسب مجموعة الاختبار الخاصة بكل مهمة. المقياس الرئيسي هو التكلفة لكل مهمة ناجحة، والتي تحسب كل محاولة فاشلة وإعادة المحاولة.

هناك نتيجتان من تلك الدراسة تتعلقان مباشرة بتصميم Nexus. في المهام السهلة، لا تشتري القسط الحدودي شيئًا: فقد تجاوز Kimi K2.6 نسبة 73% بينما تجاوز GPT-5.5 نسبة 69%. في المهام الصعبة، يتنافس المستوى الأعلى فقط، مع GPT-5.5 بنسبة 51% وكيمي K3 بنسبة 32%. إن أدوات التقييم الخاصة بـ Arize مفتوحة المصدر، لذا يمكن للفرق إعادة تشغيلها وفقًا لأعباء العمل الخاصة بهم.

التوجيه الذي تمت محاكاته خلال عمليات التشغيل هذه يتفوق على كل إستراتيجية ذات نموذج واحد. وصل سلم التصعيد المتعمد إلى 0.525 دولارًا أمريكيًا لكل مهمة ناجحة مع حل 32.3 مهمة من أصل 40 مهمة بشكل موثوق. تكلف GPT-5.5 وحده 0.636 دولارًا وتم حل 25 من 40 بشكل موثوق. وكلف التصعيد الساذج عبر جميع النماذج العشرة 1.319 دولارًا، وهو أسوأ من أي نموذج تم اختباره. تصميم السلم ليس اختياريًا.

كيف تقوم الفرق بتشغيلها فعليًا

هناك ثلاثة مسارات عملية، ولها أنصاف أقطار انفجار مختلفة.

مسار FireConnect هو أقل احتكاك. يتطلب برنامج التثبيت وجود Claude Code CLI قيد التشغيل بالفعل PATH، ويطالب مرة واحدة بمفتاح Fireworks API، ويسجل سوقًا للمكونات الإضافية، ويكتب إعدادات Claude Code مع نسخة احتياطية ذات طابع زمني. إنه يفضح /fireconnect:on, /fireconnect:off, /fireconnect:setup, /fireconnect:models و /fireconnect:set-models.

المسار الثاني يتخطى البرنامج المساعد تماما. تعيين ANTHROPIC_BASE_URL ومفتاح Fireworks، أو استخدم العميل المتوافق مع OpenAI مع عنوان URL الأساسي ومعرف النموذج الذي تم تغييره. أشار Arize إلى أن إضافة نموذج إلى الحزام الخاص به كان عبارة عن سطر تكوين واحد. إن قابلية التبادل هذه هي ما يجعل سلم التصعيد قابلاً للبناء.

المسار الثالث هو جهاز التوجيه نفسه، والذي يقع أمام العقد الحدودي الحالي.