استخدمت OpenAI أول ظهور لها على الإطلاق في مؤتمر Hot Chips لوضع الأرقام على الشريحة الداخلية للاستدلال، Jalapeño، وقالت إن هذا المكوّن يخدم بالفعل Codex. أُقيمت الكلمة متأخرة يوم الثلاثاء 25 أغسطس في Stanford. وهذه هي المرة الأولى التي تعرض فيها الشركة سيليكونها الخاص علنًا مع أرقام مرفقة.
ما الذي كُشف فعليًا
لكل شريحة: 13.4 PFLOP/s من حوسبة المصفوفات MXFP4-by-MXFP4، و15.4 TB/s من عرض نطاق HBM4 عبر 216 GiB، داخل حزمة بقدرة 700 watts. أما الربط البيني فهو شبكة Clos ثنائية المستوى شبه مفلطحة مبنية على مفاتيح Broadcom Tomahawk 6 — نطاق محلي بقدرة 600 GB/s عبر عنقود من 128 شريحة ASIC، ونطاق عالمي بقدرة 200 GB/s عبر النظام بالكامل. وقد جرى الإقرار بكل من Broadcom وCelestica كشريكين.
الجدول الزمني هو الجزء المثير للإعجاب
قدّمت OpenAI الجدول الزمني بصيغته الحرفية: مفهوم المعمارية في أواخر 2024، تجميد RTL في 2025، وإرسال المخطط للتصنيع في أواخر 2025، ثم تشغيل Codex على الشريحة في أوائل 2026، على أن يتبع ذلك ChatGPT. إن الانتقال من صفحة فارغة إلى خدمة عبء عمل إنتاجي في نحو عامين يُعد سريعًا بالنسبة إلى مسرّع من المحاولة الأولى.
ما الذي يخطئ فيه الإطار الشائع
ثلاثة أخطاء، وتُراكم نتائجها. أولًا، 27 EFLOP/s هو رقم على مستوى النظام — أي 13.4 PFLOP/s مضروبة في 2,048 شريحة، إلى جانب 432 TiB من الذاكرة الإجمالية. وسيُذكر هذا الرقم إلى جانب أرقام Nvidia لكل GPU، حيث لا يعني شيئًا. ثانيًا، MXFP4 هي أصغر دقة متاحة وأكثرها تفضيلًا. فحسابات المصفوفات المقيّسة بدقة أربع بتات لا يمكن مقارنتها برقم FP8 أو BF16 كثيف، ولم تنشر OpenAI أي رقم كثيف أصلًا، لذا فإن أي حسابات من نوع "يتفوق على Nvidia" تتجاوز بين درجات الدقة تصبح لاغية. ثالثًا، إن مقارنة 700 W مقابل 1.2 kW في GB200 و1.4 kW في GB300 هي مقارنة لقدرة الحزمة، لا لنتيجة الأداء لكل واط — فهذه الشرائح من Nvidia هي حوسبات فائقة تجمع CPU وGPU معًا وتملك قدرة تدريب، بينما Jalapeño مخصصة للاستدلال فقط، ولم يُعرض أي معيار قياس مشترك.
وهي أول سيليكون أيضًا
تم رفع حزمة البرمجيات بين عودة A0 إلى المختبر وإلقاء الكلمة. وهذه قصة انتقال من المختبر إلى خدمة محدودة. ولم يُكشف شيء عن عقدة التصنيع أو حجم الرقائق على الويفر أو معدل الإنتاجية أو حجم الأسطول — وهي بالضبط مجموعة الحقائق التي تميّز الشريحة العاملة عن سلسلة الإمداد.
