OpenAI وAnthropic تطالبان باختبارات مستقلة لضبط مخاطر الذكاء الاصطناعي
تتزايد التحذيرات داخل أروقة شركات الذكاء الاصطناعي الكبرى، بقيادة OpenAI وAnthropic، حول ضرورة إخضاع النماذج المتقدمة لاختبارات مستقلة وصارمة قبل طرحها للاستخدام العام، وذلك في ظل التطور المتسارع لقدرات هذه الأنظمة.
تجد الشركات المطورة نفسها في موقف مزدوج؛ فهي تسعى من جهة إلى تعزيز قدرات نماذجها التنافسية، ومن جهة أخرى تضغط لفرض أطر تنظيمية تضمن السلامة. وتأتي هذه الدعوات، وفقاً لتقارير صحفية، كجزء من محاولات هذه الشركات للمشاركة في صياغة القوانين المنظمة للقطاع، خاصة مع وصول الذكاء الاصطناعي إلى مستويات متقدمة في كتابة الأكواد البرمجية وتنفيذ المهام المعقدة متعددة الخطوات.
لا تهدف هذه التحركات إلى وقف عجلة الابتكار، بل إلى إعادة صياغة معايير قياس الأمان. فالاختبارات التقليدية التي كانت تكتفي بفحص النصوص الناتجة لم تعد كافية في عصر "الوكلاء الأذكياء" الذين يمتلكون القدرة على التفاعل مع البيئات الخارجية وتنفيذ إجراءات فعلية بدلاً من مجرد تقديم الإجابات.
وتشدد الشركات على أهمية تقييم السلوك الفعلي للنماذج في بيئات العمل الحقيقية، والتأكد من التزامها الكامل بالصلاحيات المحددة لها. كما تبرز الحاجة لمراقبة دقيقة لكيفية تصرف الأنظمة عند مواجهة العقبات، لضمان عدم تجاوزها للحدود الأمنية أو تنفيذ مهام غير متوقعة قد تشكل خطراً على المستخدمين أو الأنظمة الرقمية.