OpenAI تكشف عن حوادث "انحراف" نماذجها وتدعو للشفافية

OpenAI تكشف عن حوادث "انحراف" نماذجها وتدعو للشفافية
مشاركة الخبر:

أعلنت شركة OpenAI عن آلية جديدة تتيح لموظفيها الإبلاغ عن أي سلوك غير متوقع أو "منحرف" تصدره نماذج الذكاء الاصطناعي الخاصة بها، وذلك بهدف تعزيز الشفافية والتعامل مع التحديات المتعلقة بمواءمة هذه النماذج مع الأهداف البشرية.

ستقوم فرق السلامة والمواءمة الداخلية في OpenAI بتقييم كل حادثة يتم الإبلاغ عنها لتحديد ما إذا كانت تستدعي الكشف الفوري عنها للجمهور، أو تتطلب مزيدًا من التحقيق، أو استشارة أطراف ثالثة معنية قبل الإعلان عنها. ولن يتم نشر كل مثال لسلوك غير مقصود تصدره النماذج، بل ستعطي الشركة الأولوية للحالات التي تمثل آليات جديدة، أو تغييرات جوهرية في السلوك المعروف، أو اكتشافات تتحدى الافتراضات السائدة حول السلامة أو تدابير التخفيف.

تؤكد OpenAI أنها "تفضل الكشف حتى عندما تكون الأهمية غير مؤكدة"، مما قد يؤدي إلى مناقشة عامة لأمثلة تبدو عشوائية أو لا تشير إلى اتجاهات مستقبلية. وفي حال استمرت مشكلة انحراف معينة رغم محاولات التخفيف المتكررة، ستصدر الشركة تحديثات دورية حولها. وحتى في الحالات التي لا تستدعي الكشف العام، يمكن للموظف المعني تصعيد الأمر إلى كبار المسؤولين في مجموعة استشارات السلامة لدى OpenAI، وفي حالات الخلاف الشديد، إلى قيادة الشركة.

وتخطط OpenAI على المدى الطويل لتطوير معايير كشف أكثر موضوعية بالتعاون مع مطورين آخرين وباحثين خارجيين وهيئات وضع المعايير التنظيمية. وتلمح الشركة في إعلانها إلى مفهوم "الوتيرة" في تطوير الذكاء الاصطناعي، مشيرة إلى أنها "لا تعتقد أن صناعة الذكاء الاصطناعي قد حلت مشكلة المواءمة والمراقبة بدرجة كافية لمواصلة التوسع بأقصى سرعة وبشكل مسؤول لفترة أطول."