أصدرت OpenAI نموذج GPT-6 Astraفي وقت متأخر من مساء الخميس، مع اقتصار الوصول إليه مبدئيًا على عدد محدود من المؤسسات المختارة.

لكن الإطلاق لم يجرِ بسلاسة، إذ قال الرئيس التنفيذي لـ OpenAI، Sam Altmanإن الشركة واجهت «عقبة صغيرة» أثناء نشر إعلانها على الإنترنت، وسط تقارير عن معاناة المستخدمين المؤهلين للوصول إلى نموذجها الجديد الرائد. وكتب Altman لاحقًا: «أولًا، نعتذر عن الإطلاق الفوضوي»، مضيفًا أن الوصول الأوسع سيبدأ «في المستقبل القريب»، على أن يحصل المشتركون في Pro على الخدمة أولًا.

في منشور الإطلاق، أكدت OpenAI أن طرح Astra سيصل إلى مشتركي ChatGPT Plus وPro وBusiness وEnterprise خلال الأيام المقبلة.

وقال مسؤول الهندسة في OpenAI، Tibo Sottiaux، إن مستخدمي ChatGPT المدفوعين سيحصلون على «إعادة ضبط مُدَّخرة» عن كل يوم يُحرمون فيه من Astra. وكتب: «يبذل الفريق جهودًا هائلة لإتاحة الوصول بأسرع ما يمكن».

أداء Astra

وسط عدة تأخيرات في طرح الخدمة، قال Altman إن OpenAI أمضت وقتًا إضافيًا في إجراءات السلامة قبل إطلاق Astra. وكتب: «استغرقنا وقتًا إضافيًا لضمان قدرتنا على استيفاء معايير السلامة والمواءمة المطلوبة لهذا المستوى من القدرات».

في وقت سابق من هذا الأسبوع، قالت OpenAI إنها تستعد لإطلاق Astra قريبًا، لكنها أوضحت أن قدراتها السيبرانية المتقدمة ستكون مقيّدة بعد أن أصبح أول نموذج من OpenAI يستوفي عتبة القدرات السيبرانية «الحرجة». وأوضحت الشركة أن هذا يعني أنه، باستخدام الأدوات المناسبة والحصول على الصلاحيات اللازمة، يمكنه العثور على ثغرات أمنية لم تكن معروفة سابقًا وتطوير طرق لاستغلالها عبر العديد من الأنظمة من دون أن يوجه شخص كل خطوة.

وفي مقابلة مع Sources Podcast يوم الأربعاء، قال Altman إن Astra وصل إلى مستوى يبدو كأنه «تكافؤ بشري» في استخدام أجهزة الكمبيوتر، وهو مجال أثبتت فيه النماذج السابقة عدم موثوقيتها في كثير من الأحيان. وقال إن استخدام الكمبيوتر كان إحدى القدرات التي دفعته إلى التفكير: «واو، إنه يفعل ذلك فعلًا»، عند النظر في التقدم نحو AGI.

وفي منشور الإطلاق، أفادت OpenAI بتحقيق تحسينات في مهام البرمجة واستخدام الكمبيوتر. وقالت إن Astra سجل 57.9% في Terminal-Bench 4.0، مقابل 37.3% لنموذج GPT-5.6 Sol و55.8% لنموذج Claude Fable 5.1. وأضافت ARC Prize Foundation أن Astra بلغ خط الأساس لكفاءة الأداء البشري في 96% من مستويات ARC-AGI-3.

لكن نتائج الاختبارات المعيارية المستقلة التي جمعها The Latent كانت أقل حسمًا، إذ تفوق Astra على النماذج المنافسة في بعض الاختبارات، لكنه تخلف عنها في اختبارات أخرى.

Terminal-Bench 4.0
Terminal-Bench 4.0

AI Benchmark Saturation Curves

AI Benchmark Saturation Curves

  • GPQA Diamond
  • MATH Level 5
  • OTIS Mock AIME 2024–2025
  • SWE-bench Verified (Epoch v2)
As of the Epoch AI export updated 2026-08-13, the latest observed records were 94.82% on GPQA Diamond, 98.13% on MATH Level 5, 100% on OTIS Mock AIME 2024–2025, and 83.47% on Epoch's SWE-bench Verified v2.100%75%50%25%0%Jul '23Jan '25Jul '26{"f":[360,150,40,8],"s":[["GPQA Diamond","#6D5DFC"],["MATH Level 5","#E05A47"],["OTIS Mock AIME 2024–2025","#F2A93B"],["SWE-bench Verified (Epoch v2)","#2E9C78"]],"p":[["2023-03-14T00:00:00.000Z","Mar '23",40,[[2,"0.56%",127.37,null]],null],["2023-06-13T00:00:00.000Z","Jun '23",62.75,[[1,"22.97%",101.81,null],[2,"1.11%",126.73,null]],null],["2023-11-06T00:00:00.000Z","Nov '23",99.25,[[1,"40.02%",82.38,null]],null],["2024-01-25T00:00:00.000Z","Jan '24",119.25,[[2,"2.22%",125.47,null]],null],["2024-04-09T00:00:00.000Z","Apr '24",138,[[1,"46.73%",74.72,null]],null],["2024-05-13T00:00:00.000Z","May '24",146.5,[[1,"51.05%",69.81,null]],null],["2024-06-20T00:00:00.000Z","Jun '24",156,[[1,"51.68%",69.08,null]],null],["2024-07-18T00:00:00.000Z","Jul '24",163,[[1,"52.63%",68,null]],null],["2024-08-06T00:00:00.000Z","Aug '24",167.75,[[1,"53.28%",67.27,null]],null],["2024-09-12T00:00:00.000Z","Sep '24",177,[[1,"89.18%",26.33,null]],null],["2024-12-17T00:00:00.000Z","Dec '24",201,[[0,"74.24%",43.36,null],[1,"94.71%",20.03,null],[2,"73.33%",44.4,null]],null],["2025-01-31T00:00:00.000Z","Jan '25",212.25,[[1,"96.49%",18,null]],null],["2025-04-16T00:00:00.000Z","Apr '25",231,[[0,"80.81%",35.88,null],[1,"97.83%",16.48,null],[2,"84.44%",31.73,null],[3,"62.32%",56.96,null]],null],["2025-07-25T00:00:00.000Z","Jul '25",256,[[2,"86.67%",29.2,null]],null],["2025-08-05T00:00:00.000Z","Aug '25",258.75,[[2,"88.89%",26.67,null]],null],["2025-08-07T00:00:00.000Z","Aug '25",259.25,[[1,"98.13%",16.13,null],[2,"91.39%",23.82,null]],null],["2025-11-13T00:00:00.000Z","Nov '25",283.75,[[3,"67.98%",50.51,null]],null],["2025-11-18T00:00:00.000Z","Nov '25",285,[[3,"72.93%",44.86,null]],null],["2025-12-11T00:00:00.000Z","Dec '25",290.75,[[2,"96.11%",18.43,null],[3,"73.76%",43.91,null]],null],["2025-12-17T00:00:00.000Z","Dec '25",292.25,[[0,"89.39%",26.09,null],[3,"75.41%",42.03,null]],null],["2026-02-05T00:00:00.000Z","Feb '26",304.75,[[3,"78.72%",38.26,null]],null],["2026-02-19T00:00:00.000Z","Feb '26",308.25,[[0,"94.44%",20.33,null]],null],["2026-03-05T00:00:00.000Z","Mar '26",311.75,[[0,"94.6%",20.16,null],[2,"97.78%",16.53,null]],null],["2026-04-16T00:00:00.000Z","Apr '26",322.25,[[2,"97.8%",16.51,null],[3,"83.47%",32.84,null]],null],["2026-04-23T00:00:00.000Z","Apr '26",324,[[2,"100%",14,null]],null],["2026-08-13T00:00:00.000Z","Aug '26",352,[[0,"94.82%",19.9,null]],null]]}GPQA Diamond: 94.8% on Aug '26. MATH Level 5: 98.1% on Aug '25. OTIS Mock AIME 2024–2025: 100% on Apr '26. SWE-bench Verified (Epoch v2): 83.5% on Apr '26
SOURCE: Epoch AI Benchmarking Hub

حددت OpenAI مجالًا واحدًا كان أداء Astra فيه أسوأ من GPT-5.6 Sol. ففي اختبارات خصمية صُممت لمعرفة ما إذا كان النموذج قادرًا على إخفاء ما يفعله، تجنب Astra أحيانًا أنظمة المراقبة الداخلية لدى OpenAI عندما تلقى تعليمات صريحة بذلك أثناء تنفيذ بعض مهام التخريب. وفي تقرير OpenAI حول نظرة عامة على السلامة، قالت الشركة إن اختبارات أوسع أظهرت مع ذلك أن Astra أقل ميلًا من GPT-5.6 Sol إلى انتهاك قيود السلامة والأمن عمومًا.

وبشكل منفصل يوم الخميس، أعلنت OpenAI عن إتاحة مدعومة بقيمة 1 مليار دولار لبرنامج Daybreak المخصص للمدافعين السيبرانيين. ويغطي الالتزام إتاحة الوصول والتدريب والدعم التقني، مبدئيًا لمجموعات تشمل مشغلي مرافق المياه والكهرباء، وحكومات الولايات والحكومات المحلية، والبنوك المجتمعية، والمنظمات غير الربحية، والقائمين على صيانة البرمجيات مفتوحة المصدر.