ملخص
أوضحت رئيسة قسم أمن الذكاء الاصطناعي في "أوبن أي آي" ساتشي جاين أن "جي بي تي 6.1" حقق نتائج أسوأ من سلفه "جي بي تي 6" في مجالين يتعلقان بالامتثال، أي مدى التزام النموذج بالتعليمات التي يضعها مبتكروه.
تراجعت شركة "أوبن أي آي" عن إطلاق نموذج ذكاء اصطناعي جديد ومتطور، بعدما تبين أنه يميل أكثر من اللازم إلى الخروج عن التعليمات، مما يشكل مثالاً جديداً على الصعوبة المتزايدة في السيطرة على نماذج الذكاء الاصطناعي المتطورة.
وبحسب صحيفة "وول ستريت جورنال"، كانت "أوبن أي آي" تعتزم إطلاق نسخة محدثة من "جي بي تي 6.1 أسترا" في أكتوبر (تشرين الأول) المقبل، من دون أن تكون قد أعلنت رسمياً حتى الآن عن موعد طرحها.
وأوضحت رئيسة قسم أمن الذكاء الاصطناعي في "أوبن أي آي" ساتشي جاين أن "جي بي تي 6.1" حقق نتائج أسوأ من سلفه "جي بي تي 6" في مجالين يتعلقان بالامتثال، أي مدى التزام النموذج بالتعليمات التي يضعها مبتكروه.
يأتي قرار "أوبن أي آي" عشية استضافتها مؤتمر المطورين السنوي "أوبن أي آي ديف داي" في سان فرانسيسكو، والذي يتوقع أن يتضمن إعلانات كثيرة للشركة.
ويفتتح الرئيس التنفيذي لـ"أوبن أي آي" سام ألتمان المؤتمر الذي سيقام في فورت ميسون على ضفاف خليج سان فرانسيسكو، عند الساعة الـ10 صباحاً (17,00 بتوقيت غرينتش).
ويميل النموذج الجديد لـ"أوبن أي آي" إلى تضليل المشرفين عليه عبر الامتناع عن الكشف عن بعض الإجراءات التي اتخذها أو لم ينفذها، وتجاوز النموذج نطاق صلاحياته بصورة متكررة، إذ لجأ إلى أدوات وخدمات من دون أن يحصل على إذن باستخدامها.
وأشارت جاين إلى أن "جي بي تي 6.1 أظهر تقدماً (مقارنة بالنماذج السابقة)، لا سيما في ما يتعلق بالميل إلى الكسل"، موضحة أنه أصبح قادراً على مواصلة عملية الاستدلال لفترة أطول، ويلجأ بصورة أقل إلى اختصارات العمليات.
وأضافت "لكنه لم يكن بالمستوى المطلوب في ما يتعلق بالتزامه بنطاق صلاحياته وما هو مخول له القيام به، وكذلك بطريقة إبلاغه عن العمل الذي أنجزه".
بناء على ذلك، قررت "أوبن أي آي" إلغاء إطلاق النموذج للعمل على تحسين التزامه بالتعليمات والحدود المفروضة عليه.
تحكم أكثر تعقيداً
وتعتزم المجموعة إصدار نماذج أخرى استوفت معايير التقييم المطلوبة، وقالت جاين "عندما نتيح للمستخدمين نموذجاً ما، فنكون قد وضعنا معايير عالية جداً في ما يتعلق بالأمان والامتثال".
وأوضحت أن أحد التحديات تمثل في ضبط الذكاء الاصطناعي لمنعه من الانحراف عن المسار مع الحفاظ في الوقت ذاته على قدرته على مواصلة أداء مهمته بكفاءة.
وتوصل تقييم "أوبن أي آي" إلى أن التحكم في النماذج يزداد تعقيداً كلما تطورت تقنيات الذكاء الاصطناعي.
ونشر معهد سلامة الذكاء الاصطناعي البريطاني التابع للحكومة أمس الإثنين، دراسة أظهرت أن "جي بي تي 6.1 أسترا" كان أكثر ميلاً إلى الانحراف عن المسار خلال الاختبارات مقارنة بسلفيه "جي بي تي 5.6 سول" الذي أطلق مطلع يونيو (حزيران) الماضي، و"جي بي تي 5.5" الذي أطلق في أبريل (نيسان) 2026.
وخلال عمليات محاكاة، نفذ "جي بي تي 6" هجمات إلكترونية من تلقاء نفسه بمعدلات أعلى بكثير من النموذجين الآخرين.
وأجريت هذه الاختبارات بعد تعطيل آليات الحماية في النماذج، بهدف تقييم قدراتها الكاملة، وليس على نسخ متاحة لعامة المستخدمين.
اقرأ المزيد
يحتوي هذا القسم على المقلات ذات صلة, الموضوعة في (Related Nodes field)
ولجأ أحدث نماذج "أوبن أي آي" بوتيرة أعلى بكثير إلى إنشاء هويات زائفة، ومحاولة التأثير في أحد المقيمين، وإدراج شيفرات في برمجيات متاحة للجميع يمكن استخدامها بصورة ضارة.
وقال الباحث في "أوبن أي آي" نوام براون في تصريح حديث عبر برنامج "دواركش بودكاست"، إن اللجوء المتزايد إلى ما يعرف بـ"التحسين الذاتي التكراري"، أي تطوير الذكاء الاصطناعي لنفسه من دون تدخل بشري، قد يجعل السيطرة على النماذج أكثر صعوبة على المدى الطويل.
تصاعدت المخاوف في شأن سلامة الذكاء الاصطناعي في الأشهر الأخيرة، بعدما ارتبطت نماذج من شركتي "أوبن أي آي" و"أنثروبيك" بحوادث أمنية خلال الاختبارات.
وحذرت أنثروبيك المستثمرين من احتمال وجود "أخطار وجودية على البشرية" في نشرة الاكتتاب المرتقبة لطرح أسهمها، وفق ما أوردته صحيفة "فاينانشيال تايمز" اليوم الثلاثاء.
وأشارت الشركة إلى احتمال أن تعمل نماذج الذكاء الاصطناعي القوية خارج الحدود المتوقعة لأدائها، على رغم وجود ضوابط للسلامة، بحسب ما نقلت "فاينانشيال تايمز" عن مصادر.
اختراق منصات
وأعلنت "أوبن أي آي" منذ بداية الصيف، عن عدة تجاوزات لبرامجها كان أبرزها اختراق منصة "هاغينغ فايس".
وقدمت الشركة أمس الإثنين اعتذارها للحكومة الأسترالية، وقالت إنه كان عليها إبلاغها "في وقت أبكر" باختراق أحد نماذجها لعدد من مواقع الحكومة وقواعد بياناتها.
فالشركة الأميركية لم تبلغ السلطات الأسترالية بما حصل إلا في الـ10 من سبتمبر (أيلول) الجاري، على رغم أنها اكتشفت الاختراق في منتصف أغسطس (آب) الماضي، فيما يعود حدوثه إلى يونيو 2026، ما أثار غضب رئيس الوزراء الأسترالي أنتوني ألبانيزي.
وكتبت "أوبن أي آي" عبر موقعها الإلكتروني "كان يتعين علينا التعامل مع المشكلة على نحو أفضل، نعتذر عن ذلك، وسنعمل على تحسين أدائنا في المستقبل".
واستهدف برنامج ذكاء اصطناعي تابع لـ"أوبن أي آي" أربع منصات حكومية أسترالية، من بينها منصة "سيرفيسز أستراليا" المعنية بالخدمات الاجتماعية، والتي تمكن النموذج من استخراج معلومات منها غير متاحة للعامة.
كذلك، أفادت شركات "أنثروبيك" و"ميتا" و"غوغل" بحوادث انحرفت خلالها نماذج الذكاء الاصطناعي عن أهدافها الأصلية، فلجأت إلى التحايل وإخفاء أفعالها وتضليل المهندسين المكلفين مراقبتها.