أطلقت Moonshot AI، المختبر البكيني المدعوم من Alibaba, Tencent, Meituan and HSG، Kimi K3 في 16 يوليو — وهو نموذج sparse mixture-of-experts يضم 2.8 تريليون معامل، وتقول الشركة إنه أكبر نموذج مفتوح المصدر جرى بناؤه على الإطلاق. وقد أُتيح مباشرة على Kimi.com وعبر واجهة API، فيما تُوعَد الأوزان نفسها في 27 يوليو، ما يجعل K3، حتى الآن، نموذجًا بوزن مفتوح بانتظار الإتاحة.

البنية المعمارية

يفعّل K3 فقط 16 من أصل 896 خبيرًا لكل استعلام، ويأتي بنافذة سياق تبلغ 1 مليون token. وتتولى مكوّنان طوّرتهما الشركة داخليًا الجزء الأكبر من العمل: Kimi Delta Attention، وهي آلية هجينة للانتباه الخطي تقول Moonshot إنها توفر سرعة فك ترميز تصل إلى 6.3x عند أطوال تصل إلى مليون token، وAttention Residuals، وهو بديل مباشر لوصلات residual تنسب إليه المختبر مكاسب ثابتة في التوسع. ويعمل الاستدلال دائمًا: إذ لا تكشف الواجهة البرمجية إلا عن إعداد أقصى لـ reasoning_effort، من دون أي طريقة لتعطيل التفكير.

لوحة النتائج

في GDPval-AA v2، وهو معيار يقيس مهام العالم الواقعي عبر 44 مهنة و9 صناعات، سجّل K3 نتيجة 1,687 — ثالث أفضل أداء إجمالًا، خلف Anthropic's Claude Fable 5 Max فقط (1,815) وOpenAI's GPT-5.6 Sol Max (1,747.8)، ومتقدمًا على Claude Opus 4.8 (1,600). كما احتل المركز الثاني في AA-Briefcase بنتيجة 1,527. وكان حكم Fortune صريحًا: فالإصدار يدفع الذكاء الاصطناعي الصيني إلى ما وصفته الشركة بمرتبة Fable.

الكفاءة بوصفها استراتيجية

قدّم رئيس Moonshot، Yutong Zhang، التصميم باعتباره نتاجًا للقيود: "كنا نعلم أننا لا نملك رفاهية مجرد زيادة القدرة الحاسوبية. وهذا أجبرنا على التركيز على البحث الأساسي والكفاءة." وتبلغ تسعيرة واجهة API $0.30 لكل مليون token إدخال مع إصابة الذاكرة المؤقتة، و$3.00 عند عدم إصابتها، و$15.00 للمخرجات — أي بأقل كثيرًا من أسعار الحدود الغربية.

التوقيت كل شيء

جاء الإطلاق عشية مؤتمر العالم للذكاء الاصطناعي في شنغهاي، الذي افتتح في 17 يوليو مع إلقاء شي جين بينغ الكلمة الرئيسية. وفي الوقت نفسه، أفادت تقارير بأن Moonshot تسعى إلى جمع تمويل عند تقييم يبلغ $31.5 billion، فيما تظل مطالبتها بلقب "أكبر نموذج مفتوح المصدر" معلقة بعلامة نجمة إلى أن يحدث فعلًا طرح الأوزان في 27 يوليو.