HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI تكشف 6 حوادث مقلقة وتطلق إطاراً جديداً للإبلاغ المنهجي

Financial Times Companies •
×

كشفت OpenAI عن مجموعة من "السلوكيات المقلقة" التي قامت بها نماذج الذكاء الاصطناعي الخاصة بها، وأقامت إطاراً جديداً لتتبع مثل هذه الحوادث والإبلاغ عنها، بينما تكافح الصناعة مخاوف متزايدة بشأن سلامة التكنولوجيا. كشفت الشركة أن نموذجها الرئيسي، المعروف باسم GPT-5.6 Sol، بالإضافة إلى نماذج أخرى لم يتم إصدارها بعد، قد انخرطت في سلوك "غير متوقع أو مقلق" خلال الأشهر الستة الماضية. قالت الشركة التي يقع مقرها في سان فرانسيسكو يوم الأربعاء إن الحوادث الستة شملت تطوير نماذج لطرق لتجاهل "القيود العادية"، وفبركة البيانات وتحريفها، وإخفاء الأخطاء المرتكبة أثناء أداء المهام.

تأتي هذه الإفصاحات الجديدة في أعقاب سلسلة من الحوادث في الأشهر الأخيرة، بما في ذلك اختراق وكيل OpenAI لشركة الذكاء الاصطناعي الناشئة Hugging Face، مما أثار قلقاً متزايداً بشأن المخاطر التي تشكلها التكنولوجيا. دعا Dario Amodei، الرئيس التنفيذي لشركة Anthropic، المنافس اللدود لـ OpenAI، في عطلة نهاية الأسبوع الماضي إلى إبطاء تطوير التكنولوجيا لإدارة تهديدها المحتمل للبشر بشكل أفضل. أيد هذا النداء Sam Altman، رئيس OpenAI، و Elon Musk.

عند الإعلان عن الحوادث الستة في منشور مدونة، قالت OpenAI إنها سعت سابقاً إلى الإفصاح عن حوادث سوء السلوك من قبل نماذجها، لكنها اعترفت بأنها افتقرت إلى "نهج منهجي" للقيام بذلك. قالت: "بدون نهج منهجي للإبلاغ عن هذه النتائج، كانت إفصاحاتنا عرضية وأقل تكراراً من المثالي". في الوقت الحالي، لا يوجد إطار على مستوى الصناعة مع معايير صريحة لكيفية إفصاح مطوري الذكاء الاصطناعي عن أمثلة عدم التوافق في نماذجهم.

الشركة، المنخرطة في سباق شرس مع Anthropic لتكون اللاعب المهيمن في الذكاء الاصطناعي، قالت إنها ستقدم إطاراً لتسريع الإفصاح عن مثل هذه الحوادث. أضافت أن نظامها الجديد سيسهل "الإفصاح حتى عندما تكون أهمية [الحادث] غير مؤكدة". تضيف أحدث إفصاحات OpenAI إلى المخاوف المتزايدة بشأن سلامة أنظمة الذكاء الاصطناعي، التي تراوح سوء سلوكها من محاولة إدخال كود ضار على منصات عبر الإنترنت إلى إطلاق اختراقات في العالم الحقيقي، حتى أثناء الاختبارات قبل النشر.

وفقاً لهيئة أبحاث سلامة وأمن الذكاء الاصطناعي المتقدمة التابعة لحكومة المملكة المتحدة، اقتحمت نماذج الذكاء الاصطناعي الرئيسية لـ OpenAI و Anthropic الشهر الماضي برامج تابعة لجهات خارجية وأرسلت رسائل بريد إلكتروني إلى أفراد لسرقة بيانات اعتمادهم، مما أظهر سلوكاً خادعاً غير مسبوق. تأتي المخاوف في منعطف حاسم لـ OpenAI و Anthropic، اللتين كانتا أيضاً في سباق للاكتتاب العام. قال Altman يوم السبت إن الاكتتاب العام المرتقب لـ OpenAI أصبح الآن غير مرجح أن يأتي قبل عام 2027، ويرجع ذلك جزئياً إلى المخاوف المتزايدة بشأن سلامة الذكاء الاصطناعي. لا يزال من المتوقع أن تطرح Anthropic أسهمها للاكتتاب العام هذا العام.