تحمل وثائق مطوري OpenAI الخاصة بـ GPT-6 Astra قاعدة تسعير غابت عن معظم التغطيات عند الإطلاق، وهي تقلب اقتصاديات بالضبط تلك الأعباء التي يُسوَّق لها النموذج. فالسعر المعلن البالغ 10 دولارات لكل مليون رمز إدخال و50 دولارًا لكل مليون رمز إخراج لا ينطبق إلا دون عتبة معينة، وما إن تُتجاوز حتى يُعاد تسعير الطلب كله.

تنطبق العتبة على كل شيء، لا على الزيادة فقط

توضح صفحة النموذج ذلك بعبارة صريحة: "Prompts with more than 272K input tokens are priced at 2x input and cache rates and 1.5x output for the full request." وتحمل عبارة for the full request عبء التكلفة. فالطلب الذي يبلغ 273,000 رمز لا يُحاسَب بالسعر القياسي مع فرض رسم إضافي على آخر ألف رمز — بل يُعاد تسعير كامل الطلب إلى 20 دولارًا للإدخال و75 دولارًا للإخراج. أما الطلب الأقصر بألفي رمز فيكلف نصف ذلك.

كتابة الذاكرة المؤقتة تكلف أكثر من الإدخال الجديد

ويُسعِّر الجدول نفسه الإدخال المخزن مؤقتًا عند 1.00 دولار لكل مليون، وكتابة الذاكرة المؤقتة عند 12.50 دولارًا — وتذكر الصفحة أن عمليات الكتابة تُحاسَب بمعدل 1.25 ضعف سعر الإدخال غير المخزن. وعادة ما يُقدَّم التخزين المؤقت للمطالبات على أنه توفير؛ لكنه هنا علاوة مقدمة لا تؤتي ثمارها إلا عند إعادة الاستخدام. كما يعمل الوضع Batch وFlex بنصف السعر القياسي؛ بينما يعمل وضع Fast بمضاعف السعر، وتضيف الصفحة أن وضع Fast "is unavailable for GPT-6 Astra with EU data residency."

ضوابط لم يعد النموذج يقبلها

يسرد سجل التغييرات لدى OpenAI القيود التالية: لا دعم لمستوى none الخاص بجهد الاستدلال، ولا لـ temperature أو top_p المخصصين، ولا لـ logprobs. وهذا ليس مجرد تخفيض طفيف في معلمات نادرًا ما تُستخدم. فبيئات التقييم وخطوط أنابيب التصنيف وأي شيء يعتمد على احتمالات الرموز لا يمكن نقله إلى Astra إطلاقًا، أياً كانت نتائج اختباره المعيارية.

ما تخطئه الصياغة المتداولة

تطبع أدوات التتبع والمواد المنشورة 10/50 دولارًا ثابتة لنموذج بمليون رمز. وكلتا النقطتين مضللة. فالسعر ينطبق على حالة السياق القصير، بينما تعمل الجولات الوكيلة وجولات استخدام الحاسوب — وهي الجولات التي تسوّق لها OpenAI Astra من أجلها — فوق العتبة، وبالتالي هي نموذج 20/75 دولارًا. كما أن رقم "1M context" هو نافذة سياق تبلغ 1,050,000 رمز مذكورة في الصفحة، وتشمل هامشًا للتوليد؛ ومع 128,000 رمز إخراج أقصى مذكورين هناك أيضًا، فإن الإدخال القابل للاستخدام يبلغ نحو 922,000. ولا تنشر OpenAI هذا الطرح، وأي شخص يقدّر حجم خط أنابيب للوثائق بالاستناد إلى "1M input" يكون قد أخطأ بنحو 128 ألفًا.