في 22 سبتمبر، أعلنت OpenAI خفض أسعار سول ولونا، نموذجَيها للعمل اليومي، إلى النصف. والنسبة محسوبة على أسعار ترويجية، أما تكلفة الملف المعالَج فلا تزال قيد القياس.
قراءة المبالغ قبل النسبة
لكل مليون رمز، ينتقل سول من 4 إلى 2 دولار في المدخلات ومن 20 إلى 10 دولارات في المخرجات. وينتقل لونا من 0.20 إلى 0.10 دولار في المدخلات ومن 1.20 إلى 0.50 دولار في المخرجات. وتعلن OpenAI «أرخص بنسبة 50%» للنموذجين. والحساب صحيح لسول ولمدخلات لونا، لكن مخرجات لونا تنخفض بنحو 58%.
أسعار الانطلاق هي أسعار العروض الترويجية لـ GPT-5.6، لا أسعاره المعلنة في القائمة، وهو ما توضحه OpenAI في نصّها. وتعزو الشركة الانخفاض إلى تحسينات في التخزين المؤقت والاستدلال، مع تخفيض بنسبة 90% على قراءة المدخلات المخزّنة سابقًا في الذاكرة.
منذ الإطلاق، تحمل الصفحة تحديثًا بتاريخ 29 سبتمبر يحيل إلى نموذج أحدث، هو GPT-6.1 سول. ولا يقول الإعلان شيئًا آخر عنه في النص الذي قرأته: لذا ينبغي التحقق مما إذا كانت أسعار هذا المقال ومقارناته ما زالت صالحة لهذا النموذج الجديد.
تكلفة المهمة، كما يقيسها المزوّد
تفضّل OpenAI الحديث عن التكلفة لكل مهمة. ففي AutomationBench، وهو معيار لتدفقات العمل في المؤسسات، يحقق سول بإعداد «xhigh» نسبة 33.2% بكلفة 0.27 دولار للمهمة، مقابل 26.9% لـ Claude Opus 5 في أقصى إعداداته، بتكلفة تقدّرها الشركة بأكثر من أحد عشر ضعف تكلفة سول. وفي معيار DeepSWE المخصص لهندسة البرمجيات، يُعرض سول بنسبة 68.8%، أي أعلى بقليل من نقطة واحدة دون أفضل نتيجة لـ Claude Fable 5.
هذه الأرقام صادرة عن OpenAI، التي اختارت الاختبارات والإعدادات المقارَنة. وتشير إلى أنها تأخذ نتائج المنافسين من تقارير عامة، وإلى أنها استخدمت نتائج Claude Fable 5 حين لم تكن نتائج الإصدار 5.1 متاحة. وتبقى نتائج هذه العائلة على هذا المعيار المؤسسي متواضعة في قيمتها المطلقة.
مستوى لكل مهمة، يُختبر بدل أن يُفترض
ما يلي قراءة للكاتب. فعمل الفرز، مثل رصد ملف ناقص، لا يستدعي النفقة نفسها التي يستدعيها تحليل المصدر أو نص يُلزم الدار. ويمكن إذن تصوّر نموذج اقتصادي للأول، ونموذج أكثر تطلبًا للبقية. واسم النموذج لا يثبت أنه يلائم المهمة.
وسيحسن بالفريق أن يحدّد ما تتضمنه النتيجة المقبولة قبل الاختيار: المعلومات التي لا غنى عنها، والأخطاء المحتملة، والحالات التي ترتفع إلى شخص. وتسليم المهمة يهمّ بقدر التسعير. فالمعالجة الأولى الرخيصة التي تمحو مصادرها أو تخفي شكوكها تنقل مشكلة لن تراها المرحلة التالية.
الوحدة التي تُحتسب
سعر الرمز مُدخَل، واستهلاك المهمة يتوقف على مستوى الجهد المختار. وللمفاضلة، فإن عشرة ملفات حقيقية تُمرَّر على ثلاثة مستويات من النماذج، مع جدول بالأخطاء التي تهمّ، ستعطي الرقم المفيد: التكلفة لكل ملف يقبله شخص دون أن يعيده. ولا تستطيع أي صفحة إطلاق أن تقدّمه.
Cette publication est également disponible en :
