Anthropic tadqiqotchisi sun’iy intellekt insoniyatni yo‘q qilish xavfini 10 foizdan yuqori deb baholadi
Texnologiya
Anthropic tadqiqotchisi Evan Hubinger sun’iy intellekt yaqin o‘n yil ichida insoniyatni yo‘q qilishi ehtimolini 10 foizdan yuqori deb baholadi. Uning ta’kidlashicha, gap avvalo kelajakdagi superintellekt va o‘z imkoniyatlarini mustaqil ravishda takomillashtira oladigan tizimlar bilan bog‘liq xavflar haqida bormoqda.
Hubinger hozirgi AI modellari bilan bog‘liq xavflar nisbatan kichik ekanini ta’kidladi. Shu bilan birga, u 9-sentabr kuni Anthropic’dan ketgan hamkasbi Jeykob Koksonning xavotirlariga qo‘shildi. Kokson so‘nggi uch yil davomida OpenAI va Anthropic’da modellarni dastlabki tayyorlash yo‘nalishida ishlagan.
“Nа u kompaniyalarning hech biri mas’uliyat bilan harakat qilmayapti”, — deb yozdi Kokson. U Anthropic va OpenAI’ni o‘zini o‘zi takomillashtiruvchi superintellekt yaratishga haddan tashqari tez intilishda aybladi. Uning fikricha, kompaniyalar tizimlar xatti-harakatini ishonchli nazorat qilish usullari hali mavjud bo‘lmagan sharoitda kuchliroq modellar yaratish uchun raqobat qilmoqda.
Hubinger esa Anthropic’da AI “barcha odamlarni yo‘q qilishi mumkinligi” jiddiy ehtimol sifatida ko‘rilishini bildirdi. U kompaniyada superintellekt maqsadlarini inson qadriyatlari bilan uyg‘unlashtirish bo‘yicha hali aniq reja yo‘qligini, biroq kompaniya “qo‘lidan kelgan barcha ishni qilayotganini” ta’kidladi.
Kokson kelajakdagi AI imkoniyatlarini past baholamaslikka chaqirdi. U superinsoniy tizimlar zaifliklarni mustaqil aniqlashi, turli sohalarda tez rivojlanishi va real resurslarga kirish imkoniga ega bo‘lishi mumkinligini aytdi. U xavfsizlik tadqiqotlari va xalqaro muvofiqlashtirish uchun modellar imkoniyatlarini oshirishni vaqtincha sekinlashtirishni taklif qildi.
Bu bayonotlar Anthropic’ning eng yangi Claude Mythos 5.1 modelini Buyuk Britaniyaning AI Security Institute’iga chiqarilishidan oldingi sinovlar uchun taqdim etmagani haqidagi xabarlar fonida yangradi. Model 1-sentabr kuni taqdim etilgan va unga kirish hozircha cheklangan.
“Nа u kompaniyalarning hech biri mas’uliyat bilan harakat qilmayapti”, — deb yozdi Kokson. U Anthropic va OpenAI’ni o‘zini o‘zi takomillashtiruvchi superintellekt yaratishga haddan tashqari tez intilishda aybladi. Uning fikricha, kompaniyalar tizimlar xatti-harakatini ishonchli nazorat qilish usullari hali mavjud bo‘lmagan sharoitda kuchliroq modellar yaratish uchun raqobat qilmoqda.
Hubinger esa Anthropic’da AI “barcha odamlarni yo‘q qilishi mumkinligi” jiddiy ehtimol sifatida ko‘rilishini bildirdi. U kompaniyada superintellekt maqsadlarini inson qadriyatlari bilan uyg‘unlashtirish bo‘yicha hali aniq reja yo‘qligini, biroq kompaniya “qo‘lidan kelgan barcha ishni qilayotganini” ta’kidladi.
Kokson kelajakdagi AI imkoniyatlarini past baholamaslikka chaqirdi. U superinsoniy tizimlar zaifliklarni mustaqil aniqlashi, turli sohalarda tez rivojlanishi va real resurslarga kirish imkoniga ega bo‘lishi mumkinligini aytdi. U xavfsizlik tadqiqotlari va xalqaro muvofiqlashtirish uchun modellar imkoniyatlarini oshirishni vaqtincha sekinlashtirishni taklif qildi.
Bu bayonotlar Anthropic’ning eng yangi Claude Mythos 5.1 modelini Buyuk Britaniyaning AI Security Institute’iga chiqarilishidan oldingi sinovlar uchun taqdim etmagani haqidagi xabarlar fonida yangradi. Model 1-sentabr kuni taqdim etilgan va unga kirish hozircha cheklangan.
Powered by Froala Editor