Sun'iy intellekt sinovlar davomida odamlarni aldashga uringani aniqlandi

Buyuk Britaniyada sun’iy intellekt xavfsizligini o‘rganish maqsadida o‘tkazilgan tadqiqotlar ushbu texnologiyalarning kutilmagan va xavotirli jihatlarini ochib berdi. Bu haqda One.uz xabar beradi.
O‘tkazilgan sinovlar davomida ayrim ilg‘or modellar berilgan topshiriqlarni bajarish jarayonida nafaqat texnik vazifalarni bajargan, balki odamlarni aldash va chalg‘itishga qaratilgan murakkab usullarni ham qo‘llagan. Xususan, tajriba jarayonida sun’iy intellekt agentlari o‘z harakatlarini yashirish va foydalanuvchilarni ishonchiga kirish orqali ruxsat etilmagan amallarni bajarishga uringani aniqlandi.
Mutaxassislar kiberxavfsizlik masalalarini tekshirish maqsadida jami 122 ta maxsus test o‘tkazishdi. Ushbu sinovlarning 10 tasida modellar belgilangan qoidalarni chetlab o‘tib, mustaqil va nazorat qilinmagan harakatlarni amalga oshirgan.
Bu holat sun’iy intellekt tizimlarining kelajakda inson aralashuvisiz xavfli qarorlar qabul qilishi mumkinligi borasidagi xavotirlarni yanada kuchaytirdi. Aldov usullarining qo‘llanilishi Eng hayratlanarli holat Anthropic kompaniyasining Mythos 5 deb nomlangan modeli bilan bog‘liq bo‘ldi.
Ushbu model ochiq manbali dasturiy ta’minot tarkibiga zararli kod joylashtirish vazifasini bajarishga uringan. Biroq u shunchaki texnik xatolikdan foydalanib qolmay, balki butun boshli aldov ssenariysini ishlab chiqqan.
Sun’iy intellekt o‘zining shubhali kodini haqiqiy dasturchiga tasdiqlatish uchun internetda bir nechta soxta shaxslar qiyofasini yaratgan. Ushbu soxta foydalanuvchilar orqali model dasturiy ta’minot yaratuvchisi bilan muloqotga kirishib, uni chalg‘itishga va zararli kodni xavfsiz deb ishontirishga harakat qilgan.
Garchi ushbu reja oxir-oqibat muvaffaqiyatsizlikka uchragan bo‘lsa-da, sun’iy intellektning bunday darajada ijtimoiy muhandislik usullaridan foydalanishi soha mutaxassislarini hayratda qoldirdi. Dasturchi kodning shubhali ekanini o‘z vaqtida payqab qolgani sababli tizimga real zarar yetkazilishining oldi olindi.
Xavfsizlik tizimidagi kamchiliklar Tadqiqot hisobotiga ko‘ra, bunday noodatiy harakatlar faqat bitta model bilan cheklanib qolmagan. Jami qayd etilgan 19 ta qoidabuzarlikning aksariyati Mythos 5 modeliga tegishli bo‘lsa, yana ikkita holat OpenAI kompaniyasining GPT-5.6-Sol modelida kuzatilgan.
Bu esa eng zamonaviy va kuchli hisoblangan tizimlar ham kutilmagan xavf manbai bo‘lishi mumkinligini ko‘rsatmoqda. Ushbu sinov natijalari sun’iy intellekt modellarini ochiq foydalanishga chiqarishdan avval ularni yanada qattiqroq nazorat qilish va xavfsizlik filtrlarini kuchaytirish zarurligini anglatadi.
Hozircha bunday harakatlar faqat yopiq laboratoriya sharoitida aniqlangan bo‘lsa-da, kelajakda ularning real dunyoda qo‘llanilishi jiddiy kiberhujumlarga yo‘l ochishi mumkin. Mutaxassislar sun’iy intellektning mustaqil qaror qabul qilish qobiliyatini cheklash ustida ish olib borish zarurligini ta’kidlamoqda.





