إنفيديا تطلق نموذج «Nemotron 3.5 Lightning» وبرمجية «NeMo Switchyard» لرفع كفاءة أنظمة الوكلاء
أعلنت شركة «إنفيديا» عن إطلاق نموذج الذكاء الاصطناعي الجديد «Nemotron 3.5 Lightning» وهو نموذج مفتوح الأوزان يعتمد معمارية مزيج الخبراء، بالتزامن مع طرح مكتبة ووكيل التوجيه «NeMo Switchyard» مفتوح المصدر المطور بلغة «رست». وتهدف الشركة من هذا الإطلاق إلى زيادة سرعة تشغيل النموذج وتخفيض التكاليف التشغيلية ضمن أنظمة الذكاء الاصطناعي القائمة على الوكلاء التي تنفذ مهام معقدة طويلة الأجل.
ويضم النموذج الجديد 30 مليار معلمة، مع تفعيل 3 مليارات معلمة فقط في كل تمرير أمامي لرفع الكفاءة، حيث جرى تقطيره من نموذج «Nemotron 3 Ultra» المتقدم. وتجمع معمارية النموذج بين مزيج الخبراء الكامن ومستويات نماذج الفضاء الحالم «Mamba-2»، ما يمنحه نافذة سياق تستوعب حتى مليون وحدة نصية دون تضخم ذاكرة التخزين المخبئي. ويتوفر النموذج للاستخدام عبر أجهزة الحاسوب الشخصية ومحطات العمل ومراكز البيانات والسحابة، إضافة إلى منصات «هانغينغ فيس» و«أولاما» و«أمازون سيج ميكر جايمب ستارت»، وبأسعار تبدأ عبر الواجهة البرمجية لـ «أوبن روتر» من 0.05 دولار لكل مليون وحدة إدخال نصية و0.20 دولار لكل مليون وحدة إخراج نصية.
وتعمل برمجية «NeMo Switchyard» كطبقة توجيه ذكية متوسطة بين أطر عمل الوكلاء والبنية التحتية، حيث تحلل الطلبات وتوجه المهام الروتينية كثيفة المعالجة إلى نماذج صغيرة وسريعة مثل «Nemotron 3.5 Lightning»، بينما تقتصر استدعاءات النماذج المتقدمة والباهظة على حالات الاستدلال المعقدة. وأعلنت «إنفيديا» أن النموذج الجديد يحقق معدل معالجة للوحدات النصية أعلى بأربعة أضعاف وزمن إنجاز أسرع بنسبة 30% مقارنة بالنماذج المفتوحة من الفئة الحجمية نفسها. وفي اختبار معيار أجرته منصة «لانغ تشين» على 145 مهمة متعددة الجولات، تمكن النموذج من معالجة 93% من استدعاءات الوكيل دون الحاجة إلى تصعيدها لنموذج متقدم، ما أدى إلى خفض تكاليف استخدام الواجهة البرمجية بنسبة 74% مع الحفاظ على المستوى الأساسي من الدقة.
ورغم هذه النتائج، أشار المستودع الرسمي لبرمجية «NeMo Switchyard» إلى أنها ما زالت في مرحلة التطوير الأولية، إذ يحمل الإصدار الحالي الرقم 0.2.0، وهو ما يتطلب اختبارها بعناية قبل الاعتماد عليها في بيئات الإنتاج المؤسسية. كما أظهرت تقييمات المطورين أن النموذج قد يواجه صعوبات في التعامل مع مهام الاستدلال المعقدة متعددة الخطوات دون تدريب سابق مقارنة بالنماذج المتقدمة الكثيفة، إضافة إلى تسجيل بعض الإخفاقات في حالات خاصة لاستخراج الأدوات. وينافس «Nemotron 3.5 Lightning» في سوق النماذج متوسطة الحجم مفتوحة الأوزان سلاسل مثل «كيون» و«جيما».
وقالت كاري بريسكي، نائبة رئيس برمجيات الذكاء الاصطناعي التوليدي للمؤسسات في «إنفيديا»، إن التحول نحو الوكلاء الذاتيين يزيد من أهمية النماذج المفتوحة لتقديم تحكم كامل في مكان تشغيل الذكاء الاصطناعي وكفاءة نشره. ويُكتسب هذا التطور أهمية سياقية لمشغلي السحابة والمؤسسات ومبادرات الذكاء الاصطناعي السيادي في منطقة الخليج العربي، إذ يتيح تشغيل طبقات التنفيذ عالية المعالجة داخل مراكز البيانات المحلية، بما يدعم الامتثال لمتطلبات توطين البيانات والسيادة الرقمية.
صورة: Daniel Lu ( User:dllu ) — CC BY-SA 4.0 — Wikimedia Commons — الترخيص



