Alibaba أطلقت Qwen3.8-Max يوم الاثنين وقالت إنها ستنشر أوزان النموذج الأسبوع المقبل، ما يفتح البنية الداخلية لأقوى نظام ذكاء اصطناعي لديها أمام أي شخص يريد تنزيله. يعمل Qwen3.8-Max باستخدام 2.4 تريليون معامل، وهي القيم التي يعدلها النموذج أثناء التدريب والمقياس التقريبي للحجم في الصناعة، رغم أن نحو 95 مليارًا منها فقط تكون نشطة لأي كلمة معينة ينتجها. ويقبل ما يصل إلى 1 مليون token في استعلام واحد.
اعتبر المستثمرون ذلك مكسبًا. وأسهم Alibaba المدرجة في هونغ كونغ أغلقت مرتفعة 7% عند HK$125.20، وارتفعت أسهمها المدرجة في الولايات المتحدة 4.2% في تداولات ما قبل الافتتاح. وربط محللو Citi جزءًا من هذه الحركة بنتائج النموذج الجديد على المقاييس المرجعية.
هذا التفاعل يتعلق بما تفعله Alibaba به أكثر من تعلقه بالنموذج نفسه. فقد أمضت الشركة جزءًا كبيرًا من هذا العام وهي تُبقي أقوى نماذجها احتكارية، والعودة إلى جعل إصداراتها الأعلى مستوى مفتوحة المصدر يوم الاثنين يَعكس ذلك.
وصياغة Alibaba نفسها مباشرة. فهذا هو "أول مرة سنجعل فيها أوزان نموذج من فئة Qwen-Max مفتوحة المصدر"، كما كتب الفريق، مع وصول الملفات إلى Hugging Face وModelScope الأسبوع المقبل. وحتى الآن، كان على أي شركة تريد أقوى نموذج لدى Alibaba أن ترسل بياناتها إلى خوادم Alibaba وتدفع مقابل كل استخدام. وابتداءً من الأسبوع المقبل يمكنها تنزيل النموذج نفسه وتشغيله على عتاد تتحكم فيه. ولا ينشر أي من المختبرات الأميركية الرائدة أوزان نماذجها الحدودية أصلًا.
كما أن Alibaba تصل إلى نمط سبق أن حدده جيرانها بالفعل. فقد نشرت Moonshot AI أوزان Kimi K3 ذي 2.8 تريليون معامل في 27 يوليو، ووضعتْه جهات التتبع المستقلة خلف Claude Fable 5 وGPT-5.6 Sol Max فقط. وأعادت DeepSeek تدريب نموذجها الرخيص V4-Flash في 31 يوليو، متأخرًا عن Claude Opus 4.8 في جميع التسعة من مقاييس البرمجة التي نشرتها، وبتكلفة token تقارب واحدًا من أربعة وخمسين. لقد أصبح العرض الصيني الآن قريبًا من النماذج الحدودية، وقابلًا للتنزيل، ورخيصًا، وهو يُسعَّر في مواجهة نماذج أميركية لا تمتلك أيًا من هذه الصفات الثلاث.
مهام تستمر أيامًا، لا إجابات مفردة
بنت Alibaba الإطلاق حول الأعمال الطويلة بدلًا من الإجابات الذكية. فقد أطلقت النموذج على مشروع برمجي لأكثر من 10 أيام؛ وحتى 30 يوليو، كان المستودع قد راكم 265 عملية commit، و127 طلب سحب، و151 issue بعد نحو 16 يومًا من دون أي تدخل بشري.
وفي اختبار آخر، سلّمت النموذج ورقة بحثية عن اختيار بيانات التدريب، بالإضافة إلى مجموعة من وحدات GPU ومن دون أي كود ابتدائي. وعلى مدى نحو 125 ساعة كتب ما يقارب 7,600 سطر من الكود، وأجرى 33 جولة تدريب، وأعاد إنتاج النتائج الست للورقة، ثم اختبر 18 فكرة من أفكاره الخاصة واستقر على طريقة تفوقت على الورقة بفارق 2.7 نقطة على مقياس رياضيات بمستوى المسابقات.
كما دخل مسابقة مباشرة في تعلم الآلة على منصة Tianchi التابعة لـ Alibaba ضد 526 فريقًا بشريًا. وعمل بمفرده ضمن حد زمني قدره 24 ساعة، وقدّم 45 مشاركة وأنهى المنافسة متقدمًا على 458 منها. وفي تشغيل منفصل لتصميم الرقائق، خفّض دائرة تشفيرية من 8,298 بوابة منطقية إلى 678، وقلّص المخطط الفيزيائي بنسبة 81%.
وتُعدّ محاكاة أعمال تجارة إلكترونية لمدة عام الحالة التي قد يجدها مستثمرو التجزئة الأكثر وضوحًا. فبدءًا من ¥100,000، أنهى النموذج عند ¥416,252، متقدمًا 38% على صاحب المركز الثاني GLM 5.2 و152% فوق الرائد السابق لدى Alibaba، Qwen3.7-Max.
متقدم في بعض المقاييس، ومتأخر في أخرى
جدول المقارنة المنشور مختلط لا احتفالي. إذ يسجل Qwen3.8-Max درجة 86.6 على Terminal Bench 2.1، متقدمًا على Claude Opus 4.8 وClaude Fable 5 اللذين سجلا 84.6، لكنه متأخر عن GPT-5.6 Sol الذي سجل 88.8. كما يتصدر الجدول في PaperBench، وهو اختبار لإعادة إنتاج الأوراق البحثية، بدرجة 93.0.
وفي اختبارات أخرى يتأخر بوضوح. إذ يسجل Claude Fable 5 درجة 80.0 على SWE-bench Pro مقابل 67.7 لـ Qwen3.8-Max، و53.3 على Humanity's Last Exam، وهو اختبار استدلال واسع، مقابل 43.6. وأفادت Bloomberg بأن النموذج يحتل مرتبة أعلى من Kimi K3 في عدة مقاييس، وهي المقارنة التي تحمل أكبر وزن داخل الصين.
ما الذي لا تحسمه الأرقام
الكثير من الأدلة يأتي من Alibaba نفسها. فقد بُنيت عدة مقاييس في الجدول داخليًا، وتأتي نتائج البرمجة الذاتية وتصميم الرقائق من تجارب Alibaba الخاصة غير المدققة، وتحذر حاشية من أن درجات Claude Fable 5 قد تتضمن حلولًا احتياطية. ولم تُقيّم جهات التتبع المستقلة النموذج المُطلق بعد.
كما أن الأوزان المفتوحة لا تعني بالضرورة أوزانًا قابلة للاستخدام. فملف بمعاملات تبلغ 2.4 تريليون يحتاج إلى رف من وحدات GPU الخاصة بمراكز البيانات، وهو الجدار نفسه الذي اصطدم به Kimi K3 الأسبوع الماضي. ولم تقل Alibaba أي ترخيص سيحكم هذا الإطلاق.
ما الذي تكسبه Alibaba الأسبوع المقبل هو التوزيع لا الإيرادات. فكل شركة تُنزّل Qwen3.8-Max هي شركة لم توقّع عقدًا مع OpenAI أو Anthropic، وكل شركة تبني عليه يصبح نقلها لاحقًا أصعب. ستُشحن الأوزان الأسبوع المقبل. وسيُظهر الترخيص مقدار هذا الرهان الذي تقدمه Alibaba فعليًا.
