نموذج GPT-6 Astra.. ذكاء اصطناعي يضاهي قدرات البشر
أطلقت شركة «أوبن إيه آي» نموذجها الجديد GPT-6 Astra، الذي تقدمه باعتباره جيلًا متقدمًا من الذكاء الاصطناعي، مع قدرات تتجاوز إنتاج النصوص والإجابة عن الأسئلة إلى تنفيذ مهام معقدة عبر الحاسوب والبرمجيات.
ويجمع النموذج بين تطورات في التدريب المسبق والتعلم المعزز والمواءمة، مع إمكانات متقدمة في التصفح، وهندسة البرمجيات، والعلوم، والعمل الاحترافي والأمن السيبراني.
نتائج قوية في اختبارات الذكاء الاصطناعي
حقق GPT-6 Astra نتائج مرتفعة في عدد من الاختبارات، إذ سجل 98% في FrontierMath Tier 4، و99.9% في ARC-AGI-3، و100% في ExploitBench.
لعبة Blood Strike.. جميع أكواد الاسترداد الفعالة لشهر سبتمبر 2026
وفي اختبار Terminal-Bench Science 0.1، حقق النموذج 64.6%، مقابل 52.6% لـClaude Fable 5.1، مع تكلفة أقل بنحو 31% لواجهة برمجة التطبيقات.
كما تفوق Astra على خط الأساس لكفاءة الأداء البشري في 96% من مستويات ARC-AGI-3.
الذكاء الاصطناعي يتحول إلى منفذ للمهام
يمتلك Astra قدرات واسعة في استخدام الحاسوب، تشمل ملء النماذج الإلكترونية، وتحديث بيانات العملاء، وتنظيم المواعيد، وإجراء الأبحاث عبر الإنترنت، وإعداد الملخصات.
كما يستطيع تحليل البيانات العلمية وإنشاء الرسوم البيانية والمواقع الإلكترونية، وإجراء اختبارات للواجهات، والمساعدة في تثبيت البرامج واختبارها ومعالجة المشكلات.
موعد إطلاق آيفون 18.. الجدول الزمني الكامل لمؤتمر أبل ومواعيد الحجز والبيع
وفي اختبار OSWorld 2.0، حقق النموذج أداءً أعلى خلال وقت أقل بنحو 47% لكل مهمة مقارنة بـGPT-5.6 Sol.
قفزة في البرمجة والعمل الاحترافي
في اختبار Terminal-Bench 4.0، سجل Astra نسبة 57.9%، مقابل 37.3% لـGPT-5.6 Sol و55.8% لـClaude Fable 5.1.
كما حقق في BenchCAD نسبة 95.9% في إعادة بناء الأجسام ثلاثية الأبعاد باستخدام أدوات CAD، مقارنة بـ83.3% لـSol.
وتتيح قدراته إنشاء المستندات والعروض التقديمية والجداول والتحليلات مع الالتزام بالقوالب والأسلوب المطلوب.
التعامل مع المهام الغامضة
يستطيع Astra استخدام السياق المتاح لاتخاذ قرارات عند غياب بعض التفاصيل، وطرح أسئلة محددة عندما تكون الإجابة مؤثرة في النتيجة.
وفي Codex، يمكنه مواصلة تنفيذ أجزاء من المهمة التي لا تعتمد على رد المستخدم، مع التوقف عند القرارات المهمة التي تحتاج إلى تدخل بشري.
كما يقدم طريقة جديدة للحفاظ على سياق جلسات العمل الطويلة واسترجاع المعلومات السابقة بدلًا من الاعتماد على تلخيصها فقط.
قدرات متقدمة في العلوم
حقق GPT-6 Astra نسبة 96% في اختبار GPQA Diamond، الذي يقيس الاستدلال العلمي على مستوى الدراسات العليا في الأحياء والكيمياء والفيزياء.
وعند استخدام إعداد أقل تكلفة، سجل 94.9% مقابل 94.6% لـGPT-5.6 Sol، مع تكلفة أقل بنحو 37% لواجهة برمجة التطبيقات.
ويمكن للنموذج العمل مع برمجيات علمية متخصصة لفحص البيانات واستكشاف النتائج ومساعدة الباحثين في تحديد ما يحتاج إلى مزيد من التحليل.
الأمن السيبراني يفتح بابًا جديدًا للجدل
أظهرت اختبارات "أوبن إيه آي" قوة كبيرة لـ Astra في الأمن السيبراني، إذ حقق 100% في ExploitBench، مقابل 78.5% لـGPT-5.6 Sol، كما سجل 42.4% في ExploitGym مقابل 30.3% لـSol.
وخلال اختبار يعتمد على ثغرات حديثة، تمكن النموذج من اكتشاف واستخدام ثغرتين لم تكونا معروفتين سابقًا، وأفادت الشركة بأنها أبلغت الجهات المسؤولة عنهما.
ورغم ذلك، تفرض النسخة المطروحة قيودًا على تنفيذ بعض المهام السيبرانية المتقدمة، مثل إنشاء نماذج إثبات مفهوم لاستغلال الثغرات.
التركيز على الأمان والمواءمة
تقول "أوبن إيه آي" إن Astra هو نموذجها الأكثر توافقًا مع نوايا المستخدم، وأكثر التزامًا بحدود المهام.
وأظهرت اختبارات الشركة أن النموذج لم يحاول تجاوز رفض Codex Auto-Review، كما كان أقل عرضة بثلاث مرات لتقديم ادعاءات غير دقيقة بشأن قدراته مقارنة بـGPT-5.6 Sol.
لكن الشركة أقرت في الوقت نفسه بأن مراقبة طريقة استدلال Astra تمثل تحديًا بحثيًا مستمرًا.
متى يتاح GPT-6 Astra؟
بدأت "أوبن إيه آي" طرح GPT-6 Astra لمجموعة محدودة من المؤسسات، على أن يتوسع خلال الأيام التالية ليصل إلى مستخدمي ChatGPT Plus وPro وBusiness وEnterprise.
كما سيتاح النموذج عبر OpenAI API وMicrosoft Azure وAWS Bedrock، في خطوة تعكس توجه الشركة نحو جعل الذكاء الاصطناعي أكثر قدرة على تنفيذ المهام الفعلية، وليس مجرد تقديم الإجابات.