أمضت صناعة الذكاء الاصطناعي النصف الأول من 2026 في الجدل حول أي نموذج كان الأذكى. لكن أكبر عملائها كانوا يطرحون سؤالًا أضيق، وهو السؤال الذي يظهر في فواتيرهم: ما تكلفة وحدة من ذلك الذكاء؟
أجابت OpenAI عن جزء من ذلك يوم الخميس، بخفض سعر GPT-5.6 Luna، وهو الأسرع والأقل كلفة في أحدث عائلاتها من النماذج، بنحو 80%. ويبلغ سعر Luna الآن 0.20 دولار لكل مليون رمز إدخال و1.20 دولار لكل مليون رمز إخراج. أما النموذج المتوسط، GPT-5.6 Terra، فانخفض 20% إلى 2 دولار و12 دولارًا. بينما بقي النموذج الرائد، GPT-5.6 Sol، دون تغيير عند 5 دولارات و30 دولارًا. وجاءت هذه التخفيضات بعد ثلاثة أسابيع من الإتاحة العامة للعائلة في 9 يوليو.
السرعة هي ما يجعل هذا غير معتاد. إذ أشارت Ina Fried، التي أوردت هذه التخفيضات لموقع Axios، إلى أن مثل هذه الخصومات تصل عادة بعد أشهر من إطلاق النموذج لا بعد أسابيع.
الرموز هي وحدة الفوترة لنماذج الذكاء الاصطناعي، ويعادل كل واحد منها تقريبًا ثلاثة أرباع الكلمة. رموز الإدخال هي ما ترسله؛ ورموز الإخراج هي ما يكتبه النموذج ردًا عليك. ويمكن لمهمة ترميز مؤتمتة واحدة أن تدفع ملايين الرموز عبر واجهة خلال ظهيرة واحدة. وهذا هو الضغط الكامن وراء أخبار التسعير خلال الأشهر القليلة الماضية، إذ إن OpenAI وAnthropic كلتيهما أعادتا صياغة الأسعار وحدود المعدلات وسياسات الاستخدام بينما تستهلك نماذج الاستدلال الأحدث عددًا أكبر بكثير من الرموز في المهام طويلة التشغيل مقارنةً بأسلافها.
OpenAI تقول إن نموذجها الخاص ساعد في خفض تكلفة تشغيله
يوم الأربعاء، قبل يوم من تغيير السعر، نشرت OpenAI تدوينة هندسية تشرح مصدر هذه الوفورات. وحتى الآن، كان انخفاض تكلفة تشغيل نموذج كبير يعتمد أساسًا على عاملين: عتاد أفضل، ومهندسون بشريون يضبطون يدويًا البرمجيات التي تعمل عليه. وتقول OpenAI إن عاملًا ثالثًا قد أصبح متاحًا.
وتكتب الشركة أنه أثناء العمل داخل أداة البرمجة Codex التابعة لها، "أعاد GPT-5.6 Sol كتابة نوى الإنتاج لدينا وحسّنها بصورة مستقلة." والنوى هي الشيفرة منخفضة المستوى التي تنفذ العمليات الرياضية للنموذج على شريحة رسوميات. وتقول OpenAI إن هذا العمل، إلى جانب تغييرات مرتبطة، خفض تكاليف التشغيل من الطرف إلى الطرف بنسبة 20%.
وبالنسبة إلى قارئ من خارج المجال، فالأهمية ليست في الهندسة ذاتها، بل في الحلقة. فإذا كان بوسع نموذج ريادي أن يخفض بصورة ملموسة تكلفة تشغيل النماذج الريادية، فإن منحنى الأسعار يزداد انحدارًا من تلقاء نفسه، من دون انتظار الجيل التالي من الشرائح. وهذه قصة اقتصادية مختلفة عن تلك التي ترويها 700 مليار دولار من الإنفاق المعلن على البنية التحتية في 2026.
Luna أرخص، لكنه ليس الأرخص
حتى بعد خفض بنسبة 80%، لا ينزل Luna تحت الحد الأدنى السعري في السوق. فالنموذج الصيني مفتوح الأوزان DeepSeek V4 Flash يعمل بسعر 0.14 دولار للإدخال و0.28 دولار للإخراج. أما Gemini 2.5 Flash-Lite من Google فيبلغ 0.10 دولار و0.40 دولار. ولا يزال سعر الإخراج في Luna يزيد بأكثر من أربعة أضعاف سعر DeepSeek، والإخراج هو المجال الذي تنفق فيه معظم أعباء العمل الخاصة بالوكلاء المال.
ويطابق السعران الجديدان لـ Terra، 2 دولار و12 دولارًا، تمامًا الأسعار المعلنة لـ Gemini 3.1 Pro، وهو ما يُرجح أنه ليس من قبيل المصادفة. وفي الوقت نفسه، تشغّل Anthropic نموذج Claude Sonnet 5 بسعر ترويجي يبلغ 2 دولار و10 دولارات حتى 31 أغسطس، قبل أن يعود إلى 3 دولارات و15 دولارًا في 1 سبتمبر. وتتقارب الفئتان الرخيصة والمتوسطة نحو الأرقام نفسها. أما الفئة الرائدة فلا.
الأرقام التي لم تنشرها OpenAI
يُعد تحسن تكلفة التشغيل بنسبة 20% قياسًا إنتاجيًا داخليًا لدى OpenAI. ولم تُدققه أي جهة خارجية، كما أن الشركة لم تفصح عن هامش الربح الإجمالي للاستدلال في أي فئة، لذا لا توجد وسيلة عامة لمعرفة ما إذا كان Luna يحقق ربحًا عند 0.20 دولار أو ما إذا كان يُسعَّر للحفاظ على الحصة أمام منافسين مفتوحي الأوزان أرخص.
كما أن عدة تفاصيل تعمل أيضًا ضد الرقم الوارد في العنوان. فجميع فئات GPT-5.6 الثلاث تحمل مقياسًا للسياق الطويل يضاعف الأسعار تقريبًا بمجرد أن يتجاوز الطلب النافذة القياسية. وتكلفة كتابة محتوى جديد إلى ذاكرة التخزين المؤقت للموجّه تبلغ 1.25 مرة من سعر الإدخال غير المخزن مؤقتًا، رغم أن القراءة منها تحصل على خصم 90%. أما Sol، وهو النموذج الأرجح لتولي تشغيلات الوكلاء المكلفة متعددة الساعات التي دفعت شكاوى التسعير أساسًا، فلم ينل شيئًا.
ما أظهرته OpenAI هو أرضية تواصل الهبوط وسقف لا يتحرك. فالذكاء الرخيص يزداد رخصًا وفق جدول يُقاس الآن بالأسابيع. أما الذكاء الريادي فلا تزال تكلفة ما يكتبه تبلغ 30 دولارًا لكل مليون كلمة، وقد رفضت الشركة للتو فرصة تغيير ذلك.
