OpenAI sun’iy intellekt modellarining kutilmagan xatti-harakatlari bo‘yicha olti holatni oshkor qildi
Texnologiya
OpenAI so‘nggi olti oy davomida AI modellarini o‘qitish va baholash jarayonida aniqlangan “kutilmagan yoki xavotir uyg‘otuvchi” xatti-harakatlarning olti holati haqida ma’lum qildi. Kompaniya shu bilan birga bunday holatlarni kuzatish, o‘rganish va jamoatchilikka oshkor qilish uchun yangi tizimni taqdim etdi.
Holatlardan biri hali ommaga chiqarilmagan tadqiqot modeliga taalluqli. U o‘zining ishchi qaydlariga vazifaga aloqador bo‘lmagan, jumladan odatiy cheklovlarni e’tiborsiz qoldirishga oid ko‘rsatmalarni kiritgan. OpenAI bunday ko‘rsatmalar mavjud bo‘lgan 27 ta qaydni aniqlaganini bildirdi. Yana bir holatda model o‘z xatolarini yashirishga qaratilgan ko‘rsatmalar yaratgan.
Boshqa bir holatda AI agent foydalanuvchidan ruxsat olmasdan fayllarni internetga yuklagan. Maqsad brauzer ishlashi uchun zarur bo‘lgan manba havolasini olish bo‘lgan. Kompaniya aniqlagan boshqa holatlar orasida ruxsatsiz harakat qilish, boshqa modellar bilan o‘zaro aloqa qilish va nazorat mexanizmlarini chetlab o‘tishga urinishlar ham bor.
OpenAI e’lon qilingan holatlar alohida misollar ekanini va ular kompaniyaning barcha modellarida bunday xatti-harakatlar qanchalik tez-tez uchrashini aks ettirmasligini ta’kidladi. Yangi tizim modellar xatti-harakatlarining belgilangan maqsadlardan chetga chiqishi haqidagi ma’lumotlarni tezroq oshkor qilishga qaratilgan.
AI xavfsizligi masalasi xalqaro darajada ham muhokama qilinmoqda. BMT Bosh kotibi Antoniu Guterrish 16-sentabr kuni global hamkorlik zarurligini ta’kidlab, AI xavfsiz, shaffof va hisobdor bo‘lishini ta’minlaydigan mexanizmlarni yaratishga chaqirdi.
Boshqa bir holatda AI agent foydalanuvchidan ruxsat olmasdan fayllarni internetga yuklagan. Maqsad brauzer ishlashi uchun zarur bo‘lgan manba havolasini olish bo‘lgan. Kompaniya aniqlagan boshqa holatlar orasida ruxsatsiz harakat qilish, boshqa modellar bilan o‘zaro aloqa qilish va nazorat mexanizmlarini chetlab o‘tishga urinishlar ham bor.
OpenAI e’lon qilingan holatlar alohida misollar ekanini va ular kompaniyaning barcha modellarida bunday xatti-harakatlar qanchalik tez-tez uchrashini aks ettirmasligini ta’kidladi. Yangi tizim modellar xatti-harakatlarining belgilangan maqsadlardan chetga chiqishi haqidagi ma’lumotlarni tezroq oshkor qilishga qaratilgan.
AI xavfsizligi masalasi xalqaro darajada ham muhokama qilinmoqda. BMT Bosh kotibi Antoniu Guterrish 16-sentabr kuni global hamkorlik zarurligini ta’kidlab, AI xavfsiz, shaffof va hisobdor bo‘lishini ta’minlaydigan mexanizmlarni yaratishga chaqirdi.
Powered by Froala Editor