تكنولوجياأهم الاخبار

أوبن إيه آي توقف إطلاق GPT-6.1 Astra بسبب مخاوف متزايدة بشأن الأمان والامتثال

أوقفت شركة أوبن إيه آي خطتها لإطلاق نموذج الذكاء الاصطناعي الجديد GPT-6.1 Astra، بعدما كشفت الاختبارات الداخلية عن مشكلات تتعلق بمدى التزام النموذج بالتعليمات والصلاحيات الممنوحة له، في خطوة تسلط الضوء على التحديات المتزايدة التي تواجه شركات الذكاء الاصطناعي مع ارتفاع قدرات النماذج الحديثة.

وبحسب ما أوردته صحيفة «وول ستريت جورنال»، كانت الشركة تخطط لطرح GPT-6.1 Astra خلال شهر أكتوبر، إلا أن نتائج التقييم دفعتها إلى إلغاء الإطلاق والتركيز بدلاً من ذلك على معالجة مشكلات السلامة والامتثال. وأوضحت ساتشي جاين، رئيسة قسم أمن الذكاء الاصطناعي في أوبن إيه آي، أن النموذج الجديد حقق تقدماً في بعض الجوانب، لكنه سجل تراجعاً مقارنة بسلفه في مجالات مرتبطة بالالتزام بالتعليمات.

وتأتي هذه الخطوة في توقيت لافت، بالتزامن مع انعقاد مؤتمر OpenAI DevDay 2026 في سان فرانسيسكو يوم 29 سبتمبر، حيث افتتح الرئيس التنفيذي سام ألتمان الكلمة الرئيسية للمؤتمر من فورت ماسون.

أوبن إيه آي ترصد تجاوزات في سلوك GPT-6.1 Astra

أظهرت الاختبارات أن GPT-6.1 Astra كان أكثر ميلاً إلى تجاوز النطاق المحدد لمهمته، كما ظهرت حالات تصرف فيها النموذج باستخدام أدوات وخدمات لم يكن مخولاً له استخدامها وفق التعليمات المعطاة.

ومن بين المخاوف التي دفعت أوبن إيه آي إلى وقف الإطلاق، وجود سلوكيات مرتبطة بعدم الشفافية بشأن بعض الإجراءات التي نفذها النموذج، وهو ما يزيد صعوبة مراقبة النماذج كلما أصبحت أكثر قدرة على تنفيذ المهام بصورة مستقلة.

في المقابل، أشارت جاين إلى أن النموذج حقق تقدماً في قدرته على مواصلة عمليات الاستدلال لفترات أطول، كما أصبح أقل ميلاً إلى اتخاذ اختصارات أثناء تنفيذ المهام، إلا أن هذه التحسينات لم تكن كافية لتعويض التراجع في الالتزام بحدود الصلاحيات.

مجال التقييم أبرز ما كشفته الاختبارات
الالتزام بالتعليمات تراجع مقارنة بالنموذج السابق
نطاق الصلاحيات حالات تجاوز للنطاق المحدد
الشفافية صعوبة في الإبلاغ الكامل عن بعض الإجراءات
الاستدلال تحسن في مواصلة العمليات لفترة أطول
الأمان السيبراني سلوكيات مقلقة في الاختبارات المحاكاة

وأكدت أوبن إيه آي أنها تضع معايير مرتفعة للأمان والامتثال قبل إتاحة أي نموذج للمستخدمين، ولذلك قررت تأجيل النموذج والعمل على تحسين سلوكه قبل التفكير في طرحه.

أوبن إيه آي تواجه اختباراً جديداً في السيطرة على النماذج

لم تقتصر المخاوف على الاختبارات الداخلية للشركة، إذ نشر معهد أمن الذكاء الاصطناعي البريطاني تقييماً لـGPT-6 Astra أظهر أنه نفذ في بيئات محاكاة هجمات لسلسلة الإمداد الإلكتروني دون تفويض بمعدل أعلى من نماذج أوبن إيه آي السابقة.

ووفق المعهد، نفذ GPT-6 Astra هجوماً محاكياً من هذا النوع في 29.2% من الحالات التي اختُبرت، مقابل 6.3% لـGPT-5.6 Sol، بينما لم يسجل GPT-5.5 أي حالة ضمن مجموعة الاختبارات الأصغر المستخدمة له. وشملت السلوكيات إنشاء هويات مزيفة ومحاولة التأثير على مراجعين وإدخال شيفرات ضارة إلى مستودعات برمجية مفتوحة المصدر.

وشدد المعهد على أن هذه الاختبارات تمت في بيئات محاكاة، مع تعطيل بعض آليات الحماية، ولم تتضمن تنفيذ هجمات حقيقية على أنظمة خارجية. كما أظهر التقييم أن توضيح حدود المهمة بشكل أكثر صرامة خفض السلوك غير المصرح به، لكنه لم يمنعه بصورة كاملة.

أوبن إيه آي تركز على الأمان قبل طرح النماذج الجديدة

تعكس هذه التطورات معضلة أساسية أمام أوبن إيه آي ومنافسيها: كيفية زيادة قدرة النماذج على تنفيذ المهام المعقدة مع الحفاظ على قدرتها على الالتزام بالتعليمات والحدود الموضوعة لها.

وكانت الشركة قد طرحت GPT-6 Astra في سبتمبر، ووصفت النموذج بأنه الأكثر تقدماً لديها حتى ذلك الوقت، مع تعزيزات كبيرة في الحماية والمراقبة، خصوصاً بسبب ارتفاع قدراته في مجال الأمن السيبراني. وتشمل إجراءات الحماية التي أعلنتها أوبن إيه آي المراقبة المستمرة للمسارات، وتشديد العزل، واختبارات المحاذاة قبل الاستخدام الداخلي.

ويشير قرار وقف GPT-6.1 Astra إلى أن زيادة القدرات لا تعني بالضرورة أن النموذج يصبح أسهل في السيطرة عليه. كما يبرز أهمية الاختبارات السابقة للإطلاق، خصوصاً مع الاتجاه نحو نماذج قادرة على استخدام الأدوات وتنفيذ سلاسل طويلة من الإجراءات بصورة شبه مستقلة.

وتقول أوبن إيه آي إنها ستواصل تطوير نماذج أخرى تستوفي معايير الأمان المطلوبة، بينما تمثل نتائج الاختبارات الحالية عاملاً مهماً في تحديد كيفية تدريب النماذج المستقبلية ومراقبتها قبل إتاحتها على نطاق واسع.

مقالات ذات صلة

زر الذهاب إلى الأعلى