MIT Tech Review AI·

Sun'iy intellekt xavfsizligi: AI qanday qilib "yo'q" deyishni o'rganmoqda

Sun'iy intellekt modellarining xavfli so'rovlarni rad etish mexanizmlari mukammal emas va kelgusida boshqa maqsadlarda ishlatilishi mumkin.

Sun'iy intellekt xavfsizligi: AI qanday qilib "yo'q" deyishni o'rganmoqda
Rasm: technologyreview.com

Zamonaviy til modellari zararli so'rovlarni bajarmaslik uchun maxsus o'qitiladi va bu jarayonda ular boshqa yordamchi modellar hamda maxsus to'siqlardan foydalanadi. Biroq mashinalar uchun taqiqlash tabiatan begona bo'lib, ular dastlabki bosqichlarda istalgan ma'lumotni osonlikcha taqdim etgan.

Tadqiqotlar va amaliyot shuni ko'rsatmoqdaki, SI xavfsizlik mexanizmlari ehtimollikka asoslangan bo'lib, ular barcha xavfli so'rovlarni to'liq to'xtata olmaydi. Shu bilan birga, haddan tashqari qat'iy rad etishlar kelgusida avtoritar hukumatlar tomonidan erkin fikrni cheklash quroliga aylanishi xavfini tug'diradi.

Kompaniyalar model ichidagi jarayonlarni nazorat qilish uchun qo'shimcha tasniflagichlar va "prob" deb nomlangan vositalarni qo'llamoqda. Shunga qaramay, mashinalarning qaysi asosga ko'ra rad etish qarorini qabul qilishi hali ham to'liq tushunilmagan sir bo'lib qolmoqda.

Asosiy faktlar

  • Anthropic kompaniyasi 2021 yilda yirik til modellari foydali, halol va zararsiz bo'lishi kerakligini ilgari surgan.
  • Bugungi zamonaviy modellar xavfli so'rovlarni rad etishga o'rgatilganiga qaramay, bu mexanizmlar mukammal emas va ba'zida ishlamay qolishi mumkin.
  • Kompaniyalar xavfsizlikni ta'minlash uchun turli xil yordamchi modellar va klassifikatorlardan foydalanadi, bu esa qo'shimcha resurs sarfiga olib keladi.
  • Kelgusida hukumatlar o'z qoidalari asosida SI cheklovlarini belgilashga urinishi va bu senzuraning kuchayishiga olib kelishi mumkin.

Nega muhim?

Sun'iy intellektning rad etish mexanizmlari texnologiyaning xavfsizligi va kelajagini belgilovchi asosiy omil hisoblanadi. O'zbekistonda va global miqyosda ushbu texnologiyalardan foydalanuvchilar kelgusida yuzaga kelishi mumkin bo'lgan cheklovlar, xavfsizlik xatarlari va axloqiy masalalar haqida xabardor bo'lishlari muhim.

Manba

MIT Tech Review AI (technologyreview.com)

“We’re putting too much faith in AI’s ability to say no”

Asl maqolani o'qish →

Ushbu matn asl maqolaning qisqa mazmuni bo'lib, sun'iy intellekt yordamida o'zbek tilida tayyorlandi. Batafsil ma'lumot va to'liq matn uchun asl manbaga murojaat qiling.