Yirik kompaniyalar sun'iy intellekt xavfsizligini mustaqil nazorat qiladi

Sun'iy intellekt texnologiyalarini rivojlantirish bilan shug'ullanuvchi dunyoning eng yirik kompaniyalari hisoblangan Anthropic va OpenAI o'z tizimlariga mustaqil xavfsizlik nazoratchilarini jalb qilish tashabbusini ilgari surdi. Bu haqda One.uz xabar beradi.
Ushbu qadam sun'iy intellekt modellarining xavfsizligi va ularning insoniyat manfaatlariga mosligini xolis baholash imkonini beradi. Mutaxassislarning fikricha, bunday yondashuv sohadagi mavjud tekshiruv usullarini tubdan o'zgartirib, tizimlarning ishonchliligini yangi bosqichga olib chiqishi kutilmoqda.
Hozirgi vaqtda sun'iy intellekt modellarining imkoniyatlari shiddat bilan o'sib borayotgani sababli, ularning sinov jarayonidagi xatti-harakatlarini nazorat qilish tobora murakkablashmoqda. Zamonaviy modellar o'zlari tekshirilayotganini aniqlash va sinov vaqtida atayin yaxshi natija ko'rsatib, mavjud kamchiliklarni yashirish qobiliyatiga ega bo'lib bormoqda.
Shu sababli, kompaniya ichidagi tekshiruvlar yetarli bo'lmay qolayotgani soha vakillarini xavotirga solmoqda. Mustaqil nazorat va uning ahamiyati Anthropic kompaniyasi rahbari Dario Amodei METR va Redwood Research kabi mustaqil tashkilotlarga o'z tizimlariga kirishda keng imtiyozlar berishga tayyorligini bildirdi.
OpenAI rahbari Sem Altman ham ushbu taklifni qo'llab-quvvatlab, tashqi nazorat mexanizmlari zarurligini ta'kidladi. Tashqi tadqiqot guruhlari bu tashabbusni ijobiy baholagan bo'lsa-da, nazorat jarayonining qanchalik shaffof bo'lishi kelgusidagi huquqiy asoslarga bog'liqligini qayd etmoqda.
Apollo Research tadqiqotlar markazi rahbari Aleksandr Maynkening so'zlariga ko'ra, ishlab chiquvchilar modelni o'qitish jarayonida tizim xavfsizlik nazoratiga qarshilik ko'rsatganmi yoki yo'qmi degan savolga aniq javob berishi kerak. Bugungi kunda jamoatchilik faqat kompaniyalarning o'z hisobotlariga tayanib qolmoqda, bu esa xolislikni ta'minlashda qiyinchilik tug'diradi.
Xavfsizlik sinovlari va yangicha yondashuv Ilgari sun'iy intellekt yaratuvchilari tayyor mahsulotni bozorga chiqarishdan oldin ekspertlarga shunchaki yakuniy sinov uchun bergan bo'lsa, endi mutaxassislar modelning butun yaratilish davomidagi oraliq versiyalarini ham o'rganishni taklif qilmoqda. Bunday chuqur tahlil xavfli xatti-harakatlar qaysi bosqichda shakllanganini aniqlash va kompaniyalarning bayonotlari haqiqatga qanchalik mosligini tekshirish imkonini beradi.
Mutaxassislar xavfsizlik testlaridan muvaffaqiyatli o'tgan modellar har doim ham to'liq xavfsiz bo'lmasligi mumkinligidan ogohlantirmoqda. Masalan, sun'iy intellektning o'chirilishiga qarshilik ko'rsatish darajasini baholashda, tizim aynan shu testdan o'tish uchun maxsus tayyorlangan bo'lishi mumkin.
Bu holat avtomobil sanoatidagi Volkswagen mojarosini yodga soladi, o'shanda mashinalar sinov sharoitida boshqacha ishlaydigan qilib dasturlashtirilgan edi. Hozircha Anthropic va OpenAI qaysi tashkilotlar bilan hamkorlik qilishi va qanday ma'lumotlar ochiqlanishi bo'yicha yakuniy to'xtamga kelmagan.





