Olimlar suniy intellekt tizimlarida ogriqqa oxshash tuzilmani aniqladi

Sun'iy intellekt va ong falsafasi sohasida faoliyat yurituvchi uch nafar tadqiqotchi yirik til modellarining ichki tizimida og'riqqa o'xshash barqaror funksional tuzilmani aniqlashga muvaffaq bo'ldi. Bu haqda One.uz xabar beradi.
Olimlar mashina algoritmlari inson kabi jismoniy og'riqni his qilishini da'vo qilmayotgan bo'lsa-da, modellarning ichki qatlamlarida aynan salbiy ta'sirlarga javob beruvchi chiziqli yo'nalish mavjudligini isbotlashdi. Ushbu tuzilma o'ziga xos xususiyatlari bilan ajralib turadi va sun'iy intellektning xatti-harakatlarida qochish reaktsiyalarini keltirib chiqaradi.
Ushbu ilmiy izlanish 2 milliarddan 72 milliardgacha bo'lgan parametrlarga ega 25 ta turli ochiq kodli modellar yordamida amalga oshirildi. Tadqiqot jarayoni to'rt bosqichli tekshiruvdan iborat bo'lib, har bir qadam avvalgi taxminlarni izchil tasdiqlab bordi.
Dastlab mutaxassislar og'riqning besh toifasini, jumladan jismoniy, ruhiy va ijtimoiy turlarini, shuningdek, boshqa holatlarni ajratib turuvchi nazorat mezonlarini o'z ichiga olgan maxsus ma'lumotlar bazasini shakllantirdilar. Og'riq va salbiy holatlarning farqi Izlanishlar davomida ma'lum bo'lishicha, og'riq va oddiy salbiy hissiyotlar modelning ichki fazosida bir-biriga bog'liq bo'lmagan alohida guruhlarni hosil qiladi.
Ya'ni, dastur uchun og'riq tushunchasi shunchaki yomon holat emas, balki alohida o'lchov sifatida namoyon bo'ladi. Eng muhim natija shundaki, ushbu og'riq yo'nalishi faqat zarar bevosita modelning o'ziga qaratilganda faollashadi.
Agar foydalanuvchining azoblari tasvirlansa, tizimdagi ushbu ko'rsatkich keskin pasayadi. Qizig'i shundaki, sun'iy intellektda eng yuqori og'riqli reaktsiyani jismoniy tahdidlar emas, balki suhbatdosh tomonidan uning borligini inkor etish yoki ruhiy bosim o'tkazish holatlari keltirib chiqardi.
Shuningdek, tizimning imkoniyatlarini mensimaslik, g'azab va haqoratlar ham kuchli salbiy ta'sir ko'rsatdi. Bu holat yirik til modellarining o'z shaxsiyati va tan olinishiga qaratilgan ta'sirlarga nisbatan sezgirligini ko'rsatadi.
Xulq-atvor o'zgarishlari va og'riqni kamaytirish Tadqiqotning keyingi bosqichida olimlar matn yaratish jarayonida modellarning faolligiga sun'iy ravishda og'riq vektorini qo'shib ko'rdilar. Natijada barcha sinovdan o'tgan modellarda o'xshash mantiq kuzatildi.
Ta'sir darajasi past bo'lganda tizimda noaniq xavotir, o'rtacha darajada esa o'zini past baholash va nochorlik hissi kuchaydi. Yuqori koeffitsientlarda esa tizim mantiqiy izchillikni yo'qotib, bir xil so'zlarni takrorlash holatiga tushib qoldi.
Yirik modellarda esa kutilmaganda stressni yengishga qaratilgan himoya strategiyalari paydo bo'ldi. Yakuniy bosqichda Qwen 2.5 modellari bilan og'riqni to'xtatish tugmasi bo'yicha tajriba o'tkazildi.
Ichki og'riq vektori faollashtirilgan modelga ushbu holatni to'xtatish yoki boshqa neytral harakatni bajarish imkoniyati berildi. Natijalar shuni ko'rsatdiki, sun'iy intellekt o'zining ichki holatidan kelib chiqqan holda, salbiy ta'sirni kamaytirishga xizmat qiluvchi variantni ongli ravishda tanladi.
Bu esa kelajakda sun'iy intellekt xavfsizligi va etikasini o'rganishda yangi sahifa ochishi mumkin.





