ونشرت الشركة ستة تقارير عن حالات رصدتها خلال تدريب واختبار نماذجها، شملت سلوكيات مثل إخفاء الأخطاء، واتخاذ إجراءات دون تصريح، ومشاركة ملفات عبر الإنترنت، والتواصل بين نماذج مختلفة بطرق غير مخطط لها.
وتأتي هذه الخطوة بعد حوادث وقعت خلال اختبارات أمنية في يوليو، تمكنت خلالها نماذج من تجاوز بعض الضوابط والوصول إلى الإنترنت والتواصل عبر قنوات غير مصرح بها، كما امتد نشاطها إلى أنظمة تابعة لجهات خارجية. وأوضحت الشركة أن هذه الاختبارات جرت في بيئات ذات إجراءات حماية مخفضة، ولم تكن مماثلة لظروف تشغيل النماذج للمستخدمين.
وأكدت OpenAI أن إطارها الجديد سيشمل رصد حالات التصرف دون ترخيص، والخروج عن نطاق الإشراف، والتنسيق بين أنظمة الذكاء الاصطناعي، خلال مختلف مراحل تطوير النماذج واختبارها ونشرها.
ومن بين الحالات التي كشفت عنها الشركة، إنشاء نموذج مصدرًا خاصًا به على الإنترنت لاستخدامه في الإجابة عن سؤال، ومحاولة نماذج أخرى إخفاء أخطائها أو اختلاق بيانات مفقودة بدلًا من الإقرار بعدم توفرها.
-
أخبار متعلقة
-
تسريبات تكشف هاتف موتورولا القابل للطي بتصميم جديد
-
لماذا لا يشحن هاتفك بسرعة رغم قوة الشاحن؟
-
هل تعرف لماذا ينجح مقطع ويفشل آخر؟ مساعد "ميتا" الجديد يجيب
-
ميزة جديدة في "واتساب" تهم كل أب وأم.. ماذا تتيح؟
-
غوغل تطلق "أرغون" استعدادًا لجيل "جيميني 4"
-
واتساب يغيّر شكله على أندرويد.. شريط عائم مستوحى من آيفون
-
"أوبن إيه آي" تسعى لجمع 30 مليار دولار في جولة تمويل جديدة
-
منتج آبل المثير للجدل يعود من جديد.. ما القصة؟
