نشرت DeepSeek أوزان V4-Flash-Vision-Exp على Hugging Face في 31 أغسطس. وتأتي طوابع زمن المستودع مباشرة من واجهة برمجة التطبيقات الخاصة بالمنصة: أُنشئ في 06:16:18 UTC، ورُفعت الـ shard من 06:57 UTC، وبطاقة النموذج عند 07:57 UTC. وهذا يوافق 14:16 بتوقيت CST — بعد ظهر الاثنين في الصين.
لماذا التاريخ هو القصة
أعلنت DeepSeek هذا النموذج في 21 أغسطس، ووصفته وثائقها الخاصة بأنه متاح عبر API. ولم ترد أي إشارة إلى الأوزان. ولذلك يؤرخ متتبّعو النماذج إصداره إلى 21 أغسطس، ما يعني أن الإصدار اليوم يُسجَّل بوصفه نسخة مكررة لشيء عمره عشرة أيام، لا بوصفه الحدث الذي وقع فعلاً — أي تحوّل نموذج مغلق إلى نموذج مفتوح الأوزان. بالنسبة إلى من لا يستطيع إرسال البيانات إلى API، فهذان ليسا الحدث نفسه، ولا يغيّر سوى واحد منهما ما يمكنهم نشره.
ما الذي يتضمنه الإصدار
رخصة MIT. 48 shard، و167,811,372,792 bytes — أي نحو 167.8 GB. 43 طبقة، و256 خبيرًا موجَّهًا إضافة إلى خبير مشترك واحد، وستة خوارزميات فعالة لكل رمز، وسياق بطول 1,048,576 token، وأوزان FP8 e4m3 مع خبراء عند FP4، وبرج رؤية أصلي من 32 طبقة. وتُعد رخصة MIT على نموذج متعدد الوسائط من نوع mixture-of-experts بهذا الحجم شديدة السخاء على نحو غير معتاد — بلا ملحق للاستخدام المقبول، ولا حدّ لإيرادات، ولا بند مراجعة من النوع الذي أخذ يظهر مؤخرًا في رخص الأوزان المفتوحة الصينية.
ما تخطئه الصياغة الشائعة
تستحق الأرقام العلنية الخاصة بأداء الوسائط المتعددة قدرًا من التدقيق. فالمكسب الرئيسي المعلن لهذا النموذج يُقاس مقارنةً بخط أساس تقول الحاشية نفسها لدى DeepSeek إنه لا يتلقى الصور — لذا يُحتسب جزء من التحسن مقابل مقارنة نصية فقط، وهي حدّ أدنى لا منافس. وتكون البطاقة واضحة في هذا الشأن؛ أما الملخصات التي تكرر الرقم فلا تكون كذلك. وهناك أمران آخران يُهمَلان: فقد تراجع على الأقل معيار واحد لأمن البرمجة مقارنة بالإصدار السابق، كما أن النموذج يخسر معظم الصفوف المباشرة أمام نموذج الحدود الغربية الرائد. إن عبارة "أداء نصي قابل للمقارنة" تُخفي قدرًا كبيرًا من المتوسطات.
ادعاء واحد لم يصمد
تصف التغطية إصدارًا متزامنًا على Hugging Face وModelScope. لكن ModelScope يعرض record not found بالنسبة إلى النموذج. وحتى وقت النشر، كانت الأوزان موجودة على Hugging Face فقط.
