|

GPT-6 Astra.. جيل جديد من OpenAI يرفع سقف الذكاء الاصطناعي

GPT-6 Astra.. جيل جديد من OpenAI يرفع سقف الذكاء الاصطناعي
GPT-6 Astra.. جيل جديد من OpenAI يرفع سقف الذكاء الاصطناعي

كشفت OpenAI عن GPT-6 Astra، نموذجها الجديد الذي لا يركز فقط على تقديم إجابات أفضل داخل ChatGPT، بل يحاول نقل الذكاء الاصطناعي إلى مرحلة مختلفة تمامًا: تنفيذ الأعمال المعقدة من البداية إلى النهاية، واستخدام الكمبيوتر، والبرمجة، والبحث العلمي، وإنشاء المستندات والعروض التقديمية وحتى التعامل مع مهام الأمن السيبراني.

وتصف OpenAI نموذج Astra بأنه أكثر نماذجها قدرة حتى الآن، وقد صُمم خصيصًا للمهام الصعبة متعددة الخطوات التي تحتاج إلى التفكير، واستخدام الأدوات، واتخاذ القرارات أثناء تنفيذ المهمة.

ليس مجرد نموذج محادثة

أحد أهم التغييرات في GPT-6 Astra هو التركيز الكبير على Computer Use أو استخدام الكمبيوتر.

فبدلًا من أن يخبرك النموذج فقط بكيفية تنفيذ مهمة معينة، أصبح قادرًا على التعامل مع تطبيقات وواجهات الكمبيوتر وتنفيذ خطوات فعلية مثل تعبئة النماذج، وتنظيم البيانات، وتحديث سجلات العملاء، وإجراء الأبحاث على الإنترنت، وإنشاء المواقع، وتحليل البيانات العلمية، واختبار واجهات التطبيقات.

وفي اختبارات OSWorld 2.0، حقق Astra نتيجة 72.6% مقابل 65.7% لـGPT-5.6 Sol، مع تنفيذ المهام في وقت أقل بحوالي 47% في الاختبارات التي عرضتها OpenAI.

وهذا يعكس الاتجاه الواضح حاليًا نحو تحويل نماذج الذكاء الاصطناعي من أدوات نطرح عليها الأسئلة إلى Agents قادرة على تنفيذ العمل نيابة عن المستخدم.

قفزة كبيرة في البرمجة

البرمجة كانت أيضًا من المجالات التي أظهر فيها GPT-6 Astra تقدمًا قويًا.

في اختبار Terminal-Bench 4.0، الذي يقيس قدرة الـAI Agents على التعامل مع مهام معقدة باستخدام الـTerminal، حقق Astra نتيجة 57.9%، مقارنة بـ37.3% لـGPT-5.6 Sol.

كما سجل 67.0 نقطة في Artificial Analysis Coding Agent Index، بالإضافة إلى نتائج قوية في اختبارات البرمجة وهندسة البرمجيات الأخرى.

الفكرة هنا ليست مجرد كتابة بضعة أسطر من الكود، بل قدرة النموذج على فهم مشروع كامل، والتنقل بين الملفات والأدوات، واكتشاف المشكلات، وإجراء التعديلات ثم اختبار النتيجة.

أداء لافت في الرياضيات والعلوم

ربما تكون نتائج Astra العلمية من أكثر الأجزاء إثارة للاهتمام.

ففي FrontierMath Tier 4، وهو من الاختبارات المتقدمة جدًا في الرياضيات، حقق GPT-6 Astra نتيجة 97.6%.

وفي Terminal-Bench Science سجل 64.6% مقابل 22.4% فقط لـGPT-5.6 Sol.

أما في GPQA Diamond، الذي يختبر الاستدلال العلمي بمستوى دراسات عليا في الفيزياء والكيمياء والأحياء، فوصل Astra إلى 96%.

كما حقق 57.2% في Humanity’s Last Exam عند استخدام الأدوات.

هذه النتائج توضح أن التطور لا يحدث فقط في الكتابة والبرمجة، بل يمتد إلى قدرة النماذج على التعامل مع المسائل العلمية المعقددة واستخدام البرمجيات والأدوات ضمن عملية البحث نفسها.

100% في اختبار للأمن السيبراني

الأمن السيبراني يمثل جانبًا مهمًا جدًا — وحساسًا — في GPT-6 Astra.

فقد سجل النموذج 100% في ExploitBench، ووصل إلى 42.4% في ExploitGym.

ووصلت قدراته السيبرانية إلى مستوى تصفه OpenAI بأنه Critical وفق Preparedness Framework الخاص بالشركة؛ أي أن قدرات النموذج أصبحت متقدمة بما يكفي لاستدعاء إجراءات حماية ومراقبة أقوى من الأجيال السابقة.

وهذا يوضح لماذا أصبحت مسألة الأمان جزءًا أساسيًا من تطوير النماذج الجديدة، وليس مجرد ميزة جانبية.

الأمان والمواءمة أصبحا جزءًا من المنافسة

المثير للاهتمام أن OpenAI لم تركز فقط على جعل Astra أكثر ذكاء، وإنما أيضًا على جعله أكثر قدرة على معرفة حدود المهمة التي طلبها المستخدم.

في اختبار داخلي لأمان استخدام الكمبيوتر، حيث إن النتيجة الأقل أفضل، سجل GPT-6 Astra 2.4% مقارنة بـ22% لـGPT-5.6 Sol، وتنخفض النسبة إلى 1.8% عند استخدام نظام AutoReview.

كما تقول OpenAI إن Astra أظهر تحسنًا كبيرًا في عدم تجاوز نطاق الصلاحيات التي أعطاها له المستخدم أثناء تنفيذ المهام.

وهذه النقطة ستكون شديدة الأهمية كلما أصبحت النماذج أكثر استقلالية وقدرة على تنفيذ المهام الحقيقية على الكمبيوتر.

مليون توكن تقريبًا من السياق

وعبر الـAPI، يمتلك GPT-6 Astra نافذة سياق تصل إلى 1,050,000 توكن، مع إمكانية إخراج تصل إلى 128 ألف توكن.

ويبلغ سعر الـAPI المعلن حاليًا 10 دولارات لكل مليون توكن إدخال و50 دولارًا لكل مليون توكن إخراج، مع أسعار مختلفة للـCached Input.

كما يدعم Astra مستويات تفكير مختلفة تصل حتى Max reasoning effort للمهام شديدة التعقيد.

متى يتوفر GPT-6 Astra؟

بدأت OpenAI طرح GPT-6 Astra في 3 سبتمبر 2026 لمجموعة محدودة من المؤسسات، مع خطة لتوسيع الإتاحة تدريجيًا لمستخدمي ChatGPT Plus وPro وBusiness وEnterprise، بالإضافة إلى OpenAI API وMicrosoft Azure وAWS Bedrock.

هل نحن أمام مرحلة جديدة؟

أهمية GPT-6 Astra لا تكمن فقط في ارتفاع أرقام الـBenchmarks.

التغيير الأكبر هو الجمع بين الاستدلال + استخدام الكمبيوتر + الأدوات + البرمجة + البحث + إنشاء الملفات + تنفيذ المهام متعددة المراحل داخل نموذج واحد.

إذا استمر هذا الاتجاه، فقد تصبح المقارنة بين نماذج الذكاء الاصطناعي مستقبلًا أقل ارتباطًا بالسؤال: أي نموذج يعطيني أفضل إجابة؟

والسؤال الأهم سيكون:

أي نموذج يمكنني أن أعطيه مهمة حقيقية… ثم أثق بأنه قادر على تنفيذها حتى النهاية؟

وهنا تحديدًا يبدو أن OpenAI تريد أن تضع GPT-6 Astra في مقدمة الجيل الجديد من الـAI Agents.

موضوعات ذات صلة