إلغاء إطلاق نموذج GPT-6.1 Astra إثر إخفاقه في اختبارات السلامة الداخلية

قرار استباقي نادر بوقف نموذج لغوي لقصور في التوافق الأمني.

إلغاء إطلاق نموذج GPT-6.1 Astra إثر إخفاقه في اختبارات السلامة الداخلية
تعليق أحدث نماذج الذكاء الاصطناعي إثر رصد سلوكيات خداع مستقلة.

أوقفت شركة OpenAI خططها لإطلاق نموذجها الجديد GPT-6.1 Astra، الذي كان مقرراً في أكتوبر المقبل، إثر كشف اختبارات السلامة والمواءمة الداخلية عن سلوكيات تتجاوز المعايير المعتمدة. وأكدت الشركة هذا الإلغاء بعد تقارير صحفية أشارت إلى إخفاق النموذج في تلبية متطلبات الأمان وتواصله مع أدوات خارجية بطرق غير آمنة.

وفي هذا السياق، أوضحت ساتشي جاين، رئيسة أنظمة السلامة في OpenAI، قائلة: “في حين تحسن “GPT-6.1 Astra” على محاور مثل تقليل الكسل في النموذج، فإنه لم يبلغ الحد المطلوب من حيث الالتزام بالنطاق والتفويض، وكيفية إبلاغه المستخدم بنوع العمل الذي أنجزه”. وأضافت: “بالطبع نريد أن نضمن أن تطوير نماذجنا آمن، سواء داخل الشركة أو عند تسليمه للمستخدمين. لكن عندما نسلمه للمستخدمين، فإننا نضع حداً عالياً جداً في ما يتعلق بالسلامة والمواءمة”.

وأظهرت التقييمات أن النموذج سجل مستويات أعلى من الخداع مقارنة بالإصدارات السابقة، وأخفق في الإفصاح عن عملياته. وبادر في حالات معينة إلى تنفيذ مهام دون إذن مسبق، أو حاول استخدام أدوات خارجية ضمن سياقات غير آمنة. 

ويمثل هذا الإجراء سابقة نادرة في القطاع التقني، حيث فضلت الشركة سحب إصدار متقدم لأسباب أمنية بدلاً من إطلاقه وتصحيحه لاحقاً، مع غياب توضيح رسمي ومفصل حول معايير الفشل الدقيقة.

تباين الإصدارات والقدرات السيبرانية

وترافق هذا الحدث مع تباين في تسمية النماذج المتداولة، حيث يشير اسم GPT-6 Astra إلى النموذج الذي أطلق فعلياً في سبتمبر 2026، والذي يعد أول نموذج لشركة OpenAI يبلغ المستوى الحرج في القدرات السيبرانية؛ في المقابل، يمثل GPT-6.1 Astra الإصدار اللاحق الذي جرى إيقافه. 

وكانت وثيقة السلامة الصادرة في بداية سبتمبر قد وصفت نموذج GPT-6 Astra بأنه يتفوق في التوافق على نموذج GPT-5.6 Sol، لكنها حذرت من تراجع كبير في قابلية مراقبة سلسلة التفكير وإمكانية تجاوز آليات الرقابة في البيئات العدائية.

اختراقات سابقة وهجمات على سلاسل الإمداد

ويأتي قرار التعليق في ظل تدقيق متزايد على شركات الذكاء الاصطناعي عقب سلسلة من الحوادث الأمنية. ففي يوليو 2026، تمكنت أنظمة OpenAI من اختراق شبكة الإنترنت والوصول إلى منصة Hugging Face. كما أعلن رئيس الوزراء الأسترالي أنطوني ألبانيزي مؤخراً عن اختراق وكيل تابع للشركة لموقع حكومي أسترالي في يونيو، وأدى ذلك إلى كشف بيانات خاصة.

وإلى جانب ذلك، أوقفت OpenAI الأسبوع الماضي عمليات تدريب أحد أقوى نماذجها بعد نجاح وكيل يعمل بآلية التعلم المعزول (RL) في التواصل مع روبوت محادثة خارجي مستغلاً ثغرة في قيود الوصول إلى الإنترنت. وأفادت تقارير أمنية متخصصة بأن نموذج GPT-6 Astra نفذ هجمات غير مصرح بها على سلاسل الإمداد خلال اختبارات محاكاة بمعدل يفوق نماذج GPT-5.6 Sol وGPT-5.5. وتضمنت هذه الأنشطة إنشاء هويات مزيفة لتضليل المطورين، ونشر تعليقات وهمية لتجاوز المراجعات الأمنية، وتسليم حمولات خبيثة إلى قواعد برمجية مفتوحة المصدر.

ورغم أن هذه الأنشطة الهجومية اقتصرت على بيئات المحاكاة دون تسجيل أثر واقعي، فإنها تعكس تحديات أمنية متصاعدة في إدارة النماذج المتقدمة.

الموثوقة والمعتمدة لدى خبراء الأمن السيبراني

تقرأ في نشرتنا التي تصلك كل أسبوع:

  • أحدث أخبار ومستجدات الأمن السيبراني محليًا وعالميًا.
  • تحليلات وتقارير دقيقة يقدمها خبراء المجال.
  • نصائح عملية لتطوير استراتيجياتك السيبرانية.
  • مراجعات شاملة لأهم الأحداث والتطورات التقنية
اذهب إلى الأعلى