أطلقت شركة ناشئة فرنسية تراهن ضد الهيمنة البرمجية لـ Nvidia أداة صُممت لتشغيل نماذج الذكاء الاصطناعي في أي مكان تقريباً. أصدرت ZML، وهي شركة مقرها باريس، LLMD في 8 يوليو — وهو خادم استدلال LLM مجاني صُمم لتشغيل النماذج مفتوحة الأوزان عبر شرائح شديدة الاختلاف من حزمة واحدة. ويقول المؤسس Steeve Morin إن الهدف هو "كسر العزلات القائمة" وإنهاء الارتباط بمورّد واحد الذي يربط أعباء عمل الذكاء الاصطناعي بصانع عتاد واحد.

أي نموذج، أي عتاد

تأتي LLMD مع دعم خمس معماريات منذ البداية: Nvidia CUDA وAMD ROCm وGoogle TPU وIntel وApple Metal. وقال Morin لموقع TechCrunch: "الفكرة هي أن نعيد للناس القدرة على إنشاء نظامهم الخاص وتحقيق مكاسب حقيقية في الكفاءة"، مضيفاً أن ZML "وصلت إلى النقطة التي نشارك فيها في تصميم الشرائح". وشعار الشركة مباشر: "أي نموذج. أي عتاد. من دون أي تنازل."

كيف بُنيت

بُنيت LLMD بلغة البرمجة Zig فوق MLIR وOpenXLA، متجنبةً عمداً سلسلة الاعتماد على Python وPyTorch. وهي تعتمد على التجميع الصريح المسبق، بحيث تبقى الكمونات "ثابتة وقابلة للتنبؤ"، من دون تجميع خفي أثناء التشغيل. ويستند الخادم إلى إطار الاستدلال مفتوح المصدر الخاص بـ ZML، الذي طُرح لأول مرة في سبتمبر 2024 وتم تحديثه إلى الإصدار v2 في مارس 2026 بموجب ترخيص Apache-2.0.

مجاني، لكنه غير مفتوح

وهنا المفارقة: LLMD مجانية لكنها ليست مفتوحة المصدر — وهو خروج عن الإطار الذي تقوم عليه. ويبرر Morin ذلك بمنطق تجاري قائم على الصبر: "أفضل أن أقيس [وأحقق إيرادات] حيث يكون ذلك أكثر فاعلية من دون أن أعيق نموي بطريقة غبية." تعرّف أولاً على كيفية استخدام الناس له، ثم احصد العائد لاحقاً.

اختبار للواقع

الطرح الإعلاني يتقدم على الشيفرة المُسلَّمة. فبينما تعلن ZML عن تقسيم موازٍ للـ tensor، وتخزين prefix caching، ودعم واسع للنماذج، أظهر اختبار عملي مستقل نُشر على Hugging Face أن النسخة الألفا الحالية أضيق بكثير: شريحة GPU واحدة فقط، وحد أقصى لحجم الدفعة يبلغ 16، ولا يوجد prefix caching، والدعم يقتصر على أنواع نماذج Llama وQwen3. ولم تُنشر أي أرقام صلبة للإنتاجية أو الكمون؛ أما ادعاء السرعة بأنها "أحياناً أسرع من الأصل" فما يزال وصفياً. وتبدو الميزات المعلنة، حتى الآن، كخارطة طريق.

من يقف وراءها

تأسست ZML في 2023 بفريق يضم نحو 20 شخصاً، ويقودها Morin، نائب رئيس الهندسة السابق في Zenly، تطبيق مشاركة الموقع الذي استحوذت عليه Snap في 2017. وقد جمعت الشركة 20 مليون دولار، بقيادة 20VC التابعة لـ Harry Stebbings وبمشاركة Kima Ventures التابعة لـ Xavier Niel وLocalGlobe وKindred Capital، إلى جانب قائمة بارزة من المستثمرين الأفراد: Yann LeCun الحائز جائزة Turing، ومؤسس Docker Solomon Hykes، والمؤسسين المشاركين في Hugging Face. وقال Morin: "لم أكن لأستطيع إنشاء ZML في أي مكان سوى باريس." وتنافس الشركة في سوق استدلال مزدحم يضم Baseten، البالغة قيمتها 13 مليار دولار، والفرق التي تقف وراء vLLM وSGLang.