شركة OpenAI تطلق نموذج GPT-6 Astra بقدرات متقدمة في استخدام الحاسوب

أعلنت شركة OpenAI عن إطلاق نموذج GPT-6 Astra، الذي تصفه بأنه النموذج «الأكثر ذكاءً وتوافقاً في العالم»، مع تحسينات كبيرة في استخدام الحاسوب، وتصفح الويب، وهندسة البرمجيات، والأمن السيبراني، والعلوم، وتنفيذ المهام المهنية المعقدة.

ويمثل النموذج الجديد نقلة واضحة مقارنة بعائلة GPT-5.6، إذ صُمم لتنفيذ سير عمل طويل ومتعدد الخطوات، مع قدرة أفضل على الحفاظ على تعليمات المستخدم وعدم الابتعاد عن الهدف الأساسي للمهمة.

قدرات GPT-6 Astra في استخدام الحاسوب

يركز نموذج GPT-6 Astra بصورة خاصة على المهام الوكيلة أو Agentic Tasks، وهي المهام التي تتطلب من الذكاء الاصطناعي التخطيط واتخاذ سلسلة من الخطوات للوصول إلى نتيجة نهائية.

ويستطيع النموذج التعامل مع مهام مثل تعبئة النماذج الإلكترونية، وتحديث سجلات العملاء، وتنظيم التقويم، وإجراء الأبحاث عبر الإنترنت، وتحليل البيانات، وإنشاء المخططات، وتطوير مواقع الويب، واختبار الواجهات والتأكد من عمل خصائصها بصورة صحيحة.

كما يمكنه إنتاج مستندات وجداول بيانات وعروض تقديمية متوافقة مع القوالب المحددة، مع المحافظة على أسلوب الكتابة والهوية البصرية للمستخدم أو المؤسسة.

وتقول OpenAI إن التحسينات الجديدة تمنح Astra قدرة أقوى على الحكم البصري، ما يساعده في تصميم مواقع الويب والألعاب والنماذج ثلاثية الأبعاد، بالإضافة إلى التعامل مع تطبيقات احترافية مثل Blender وUnreal Engine.

أداء قياسي في اختبارات الذكاء والبرمجة

حقق GPT-6 Astra نتائج متقدمة في عدد من اختبارات قياس قدرات نماذج الذكاء الاصطناعي. وسجل النموذج نتيجة بلغت 99.9% في اختبار ARC-AGI-3 المخصص لقياس القدرة على فهم البيئات الجديدة وحل المشكلات غير المألوفة.

وفي اختبار Terminal-Bench 4.0، الذي يقيس أداء النماذج في المهام المعقدة عبر الطرفية، سجل Astra نتيجة 57.9%، مقارنة بنحو 37.3% لنموذج GPT-5.6 Sol.

كما حصل النموذج على 59.3% في اختبار Agents’ Last Exam المخصص للمهام الوكيلة الاحترافية، مقابل 53.6% للنموذج السابق.

أما في اختبار OSWorld 2.0 لاستخدام الحاسوب، فقد سجل Astra نتيجة 72.6%، مقارنة بـ65.7% لنموذج GPT-5.6 Sol. ووفقاً للشركة، أنجز Astra هذه المهام في وقت أقل بنحو 47%.

تحسينات كبيرة في هندسة البرمجيات

تصف OpenAI نموذج GPT-6 Astra بأنه أفضل نماذجها حتى الآن في مجال هندسة البرمجيات. ويمكن للنموذج فهم قواعد الشيفرة البرمجية الكبيرة، وبناء التطبيقات، ومعالجة الأخطاء، وتشغيل الاختبارات، وتنفيذ التعديلات البرمجية مع حاجة أقل إلى المراجعات المتكررة.

كما يتمتع النموذج بقدرة أفضل على متابعة المشاريع الطويلة والاحتفاظ بالتفاصيل المهمة عند امتلاء نافذة السياق، ما يساعده على تذكر المتطلبات ونتائج الاختبارات والمحاولات السابقة أثناء العمل على المشروعات المعقدة.

قدرات متقدمة في الأمن السيبراني

أظهر GPT-6 Astra تطوراً كبيراً في اختبارات الأمن السيبراني، إذ حقق العلامة الكاملة بنسبة 100% في اختبار ExploitBench، مقارنة بنتيجة بلغت 78.5% لنموذج GPT-5.6 Sol.

وفي اختبار SRE-Bench، الذي يقيس قدرة النموذج على إجراء الهندسة العكسية للملفات البرمجية دون الوصول إلى الشيفرة المصدرية، نجح Astra في حل 88% من المهام من المحاولة الأولى، وارتفعت النسبة إلى 99.2% خلال أربع محاولات.

لكن هذه القدرات تثير مخاوف واضحة بشأن إمكانية إساءة استخدام النموذج. ولهذا أوضحت OpenAI أن النسخة المتاحة عند الإطلاق سترفض تنفيذ بعض المهام السيبرانية المتقدمة، مثل إنشاء نماذج عملية لاستغلال الثغرات الأمنية.

وأضافت الشركة طبقات حماية أقوى لمقاومة محاولات تجاوز القيود، إلى جانب أنظمة لمراقبة تصرفات النموذج وإيقاف الأنشطة التي قد تتجاوز نطاق الصلاحيات المحدد.

توافق أفضل مع تعليمات المستخدم

إلى جانب تحسين الأداء، ركزت OpenAI على جعل GPT-6 Astra أكثر التزاماً بنية المستخدم وحدود المهمة. ويستطيع النموذج التعامل بصورة أفضل مع التعليمات التي تترك مجالاً للتفسير، وطرح أسئلة مركزة عندما تكون المعلومات الناقصة قادرة على تغيير النتيجة.

وفي اختبار داخلي أُجري دون وسائل الحماية المستخدمة في المنتجات النهائية، لم يتجاوز Astra النطاق المصرح به في أي حالة، مقابل نسبة بلغت 48% لنموذج GPT-5.6 Sol.

كما أصبح النموذج أقل ميلاً إلى تقديم ادعاءات غير دقيقة بشأن إمكاناته، وأكثر شفافية عند توضيح ما يمكنه فعله أو القيود التي تمنعه من إكمال مهمة معينة.

توفر GPT-6 Astra وأسعار واجهة API

بدأت OpenAI إتاحة GPT-6 Astra لمجموعة محدودة من المؤسسات، على أن يصل تدريجياً إلى مشتركي ChatGPT Plus وPro وBusiness وEnterprise خلال الأيام التالية للإطلاق.

وسيتوفر النموذج أيضاً للمطورين عبر OpenAI API، إلى جانب منصتي Microsoft Azure وAmazon Bedrock. ويحصل مستخدمو خطط Pro وBusiness وEnterprise على إمكانية الوصول إلى إصدار GPT-6 Astra Pro.

ويبلغ السعر القياسي للنموذج عبر واجهة OpenAI البرمجية:

  • 10 دولارات لكل مليون رمز إدخال.
  • 50 دولاراً لكل مليون رمز إخراج.

وتطبق أسعار منفصلة على قراءة ذاكرة التخزين المؤقت وكتابتها. كما توفر الشركة وضعاً سريعاً يمنح المطورين سرعة تصل إلى ضعفي الوضع القياسي، مقابل تكلفة تعادل ضعفي السعر الأساسي.

هل يغير GPT-6 Astra مفهوم تكلفة الذكاء الاصطناعي؟

رغم أن أسعار GPT-6 Astra تضعه ضمن الفئة المرتفعة من نماذج الذكاء الاصطناعي، فإن قدرته على إنجاز مهام كاملة قد تجعل تكلفة المهمة النهائية أكثر أهمية من تكلفة كل مليون رمز.

فبالنسبة إلى الشركات، لا تقتصر القيمة على عدد الرموز التي يستهلكها النموذج، بل تشمل أيضاً قدرته على إكمال العمل بسرعة، وتقليل التدخل البشري، وخفض عدد المحاولات اللازمة للوصول إلى نتيجة قابلة للاستخدام.

ويعكس GPT-6 Astra توجه OpenAI نحو نماذج لا تكتفي بتقديم الإجابات، بل تستطيع استخدام التطبيقات والأدوات وتنفيذ عمليات مهنية متكاملة، مع المحافظة على مستوى أعلى من الأمان والالتزام بتعليمات المستخدم.