قدّمت Microsoft أول كشف معماري كامل لـ Maia 200 في مؤتمر Hot Chips يوم الثلاثاء بعد الظهر: شريحة بمساحة 820 mm² تضم 140 billion transistors على TSMC 3nm، وتستهلك 750 W، ومصنفة عند 10,000 TFLOPS of FP4، وعُرضت في تكوين يضم 128 racks and roughly 6,000 chips.
قطعة كبيرة حقًا من السيليكون
تُعد مساحة 820 mm² ضمن فئة reticle-class — وهي قريبة من الحد الأقصى الذي يمكن أن تصل إليه شريحة واحدة. أما الربط الشبكي فغير مألوف ومقصود: بطاقة NIC مخصصة وإيثرنت موحّد مع no separate scale-out fabric، وثمانية مسارات Ethernet لكل SoC موزعة على أربع طبقات شبكية. تراهن Microsoft على أن شبكة واحدة قائمة على Ethernet يمكنها حمل حركة المرور الخاصة بـ scale-up وscale-out معًا.
ما يخطئ فيه التأطير الشائع
أمران. رقم الحوسبة هنا هو FP4: فـ10 PFLOPS من حسابات الأربع بتات تقارب إلى حد ما 13.4 PFLOP/s من MXFP4 لدى OpenAI، ولا يمكن مقارنتها بأي رقم من فئة FP8 أو BF16. ولم يُذكر أي رقم density. لكن الخلاصة المطمورة هنا تتعلق بالذاكرة، وهي تشير في الاتجاه الخطأ بالنسبة إلى Microsoft. تستخدم Maia 200 ذاكرة HBM3e بينما تستخدم الشرائح التي عُرضت معها في اليوم نفسه HBM4. كشفت Microsoft عن عرض النطاق — 7 TB/s — لكن ليس السعة، بل عدد الأكوام فقط. إن ذكر 7 TB/s إلى جانب 15.4 TB/s لدى OpenAI من دون الإشارة إلى جيل الذاكرة هو الخطأ الذي ينبغي تجنبه: ستة أكوام من HBM3e تعني منظومة ذاكرة من جيل 2024 على مسرّع من جيل 2026، والسعة هي الرقم الذي يحدد أي النماذج يمكن أن تناسب.
'تستعد للنشر' ليست قد نُشرت
وصفت Microsoft الشريحة بأنها تُجهَّز لــ Azure. وهذا ادعاء مختلف عن ادعاء OpenAI، الذي قيل بعد ساعات، بأن Codex يعمل بالفعل على Jalapeño. أما رقم 128 rack و6,000 chip فهو تكوين مُثبت، لا أسطولًا مُركّبًا.
وقد يكون هناك بالفعل خليفة في الطريق
تشير تقارير سابقة في أغسطس إلى انتقال Microsoft إلى Maia 300 مع إطار زمني في سبتمبر. وإذا صحّ ذلك، فسيكون Maia 200 جيلًا قصير العمر يصل بذاكرة أقدم من أقرانه، ولا يزال قبل النشر، بينما تعمل الجهة التي صُمم جزئيًا من أجلها على أشباه موصلاتها الخاصة.
