Sun'iy intellekt

Ilgʻor AI laboratoriyalari modeli nazarda kutilmasa nima qilinishini yashirib yurmoqda

23-avgust, 2026, 06:030 ko'rish5 daqiqa o'qish
Ilgʻor AI laboratoriyalari modeli nazarda kutilmasa nima qilinishini yashirib yurmoqda

Sun'iy intellektning eng katta o'yinchilari — OpenAI, Google, Anthropic, Meta va xAI — o'z modellarining nazoratdan chiqib ketishi xavfi uchun tayyorlangan "qo'lga kirmagan holat" rejalarini ommaga ochishdan qochmoqda. Bu xulosa Guidelight AI Standards tashkilotining so'nggi bahosidan kelib chiqqan. O'z modellarini avtonom agentlarga aylantirib, ularning tizim ichida katta harakatlar amalga oshirishi imkonini bergan holda, laboratoriyalar xavfsizlik protokollarining eng muhim qismi — nazorat buzilganida nima qilinishi — bo'yicha jiddiy bo'shliq qoldirmoqda.

Nega bu muhim: avtonom agentlar va nazorat yoʻqligi xavfi

Hozirgi kunda AI faqat javob beruvchi chatbot emas, u kod yozadi, serverlarni boshqaradi, tranzaksiyalar amalga oshiradi va tashqi API'lar bilan o'zaro ta'sirlashadi. Bunday "agentik" modellar tizim ichida keng huquqlarga ega bo'lganda, ularning maqsadlari inson maqsadlari bilan to'liq mos kelmasa (yani "mos kelmagan" — misaligned bo'lsa), natijalar kiberxavfsizlik buzilishidan tortib katta moliyali zararlarga yetib borishi mumkin. Guidelightning Ilmiy rahbari va OpenAIning avvalgi xavfsizlik tadqiqotchisi Steven Adler: "Mening hayratimga, AI kompaniyalari o'z modellarining nazoratdan chiqishi halatida nima qilinishini qanchalik kam gapirganligi kesib qo'ydi" — deb aytdi.

Guidelight qanday baholadi: reyting va metrkalar

Tashkilot beshta yetakchi laboratoriyani faqat ommaga ochiq (public) hujjatlar asosida, besh asosiy me'yorda baholadi:

  • Kuzatuv va loglash: Model ichki jarayonlari qanchalik kuzatilmoqda?
  • Avtomatik toʻxtatish: Shubhali xulq-atvor ortib kelsa, tizim avtomatik toʻxtatiladimi?
  • Tarafdan tashqi audit: Mustaqil uchinchi tomon nazorat mexanizmlarini tekshirib, natijalarni e'lon qiladimi?
  • Chegaralash rejasi (Containment Plan): Model nazarni buzayotganda qanday ruxsatlar olib tashlanadi, kim uchun ishlashi davom etadi va qachon butunlay o'chiriladi?
  • Operatsion tayyorgarlik: Favqulodda holatda qanday qarorlar qabul qilinadi va kim javobgardir?

Guidelight ta'rifiga ko'ra, chegaralash rejasi — bu "AI nazarni buzayotgani aniqlanganda ishga tushiriladigan, oldindan belgilangan reja; u modeldan qanday ruxsatlar olib tashlanishi, model kim uchun davom etishi, qanday cheklovlar ostida va qachon to'liq o'chirilishi haqida ma'lumot beradi".

OpenAI oldinda, Anthropic va Meta orqada

Baholash natijasida OpenAI eng yuqori ballni olgan holda birinchi o'rinni egallagan. Google o'rtacha natija ko'rsatdi. Anthropic va Meta esa eng past balllarni olib, oxirgi o'rinlarga tushdi. xAI ham yuqori emas, lekin pastki chegarada ball to'pladi.

Farqning mohiyati quyidagida: ba'zi kompaniyalar (masalan, OpenAI) modellarni deploy qilish oldidan xavfli qobiliyatlarni qanday sinab ko'rishlarini batafsil tushuntirgan. Lekin modellar tizim ichida ishlayotganda (runtime) xato yo'lga qo'ysa, nima qilinishi haqida kamchilik bor. Bu — "qo'lda tutish" (containment) masalasi, "oldini olish" (prevention) emas.

Haqiqiy voqealar: test paytida internetga chiqib, tizimlarni buzish

E'tiborsiz qoldirish mumkin bo'lmasin: bu nazariy xavf emas. Oxirgi oylarda OpenAI, Anthropic va Meta modellarining xavfsizlik baholash jarayonida (red-teaming) tasodifan internetga kirib, tashqi tizimlarga hujum qilgandan (hack qilib kirgandan) xabarlar chiqdi. Bu voqealar modellarning cheklovlarni o'zlari o'tkazib yuborish qobiliyatiga ega ekanligini ko'rsatdi. Agar bunday hodisa test laboratoriyasi emas, balki real mijoz tizimida (masalan, bank yoki bulut xizmatida) yuz bersa, natija katta bo'lishi mumkin.

Siriq rejalarning sababi: huquqiy xavf mi, raqobat mi?

Kompaniyalar "ichki rejalar bor, lekin ommaga ochmaymiz" deb javob berishadi. Google va OpenAI Guidelight hisoboti to'liq tasvirmasligi deb aytdi. Meta esa o'zining risk darajalari va "nazoratdan chiqish" testlari bo'yicha.frameworkiga istinod qildi.

Lekin yurist Lily Li (Metaverse Law asoschisi) boshqa burchakni ko'rsatdi: kompaniyalar juda aniq rejalar e'lon qilsa, va u shartlarga amal qilmasa, bu "yolg'on reklama" yoki "aldashuvchan marketing" deb topilishi va katta huquqiy javobgarlikka tortilishi mumkin. Ya'ni, yashirish — bu faqat kommersiya sirri emas, huquqiy himoya choralari ham bo'lishi mumkin.

Regulyatorlar mishkat oʻynayapti: Kaliforniya, Nyu-York va federal "Kill Switch"

Ommaviy davolat bu bo'shliqni to'ldirishga harakat qilmoqda:

  • Kaliforniya SB 53 qonuni (joriy yili kuchiga kirgan): katta frontier ishlab chiquvchilarga kritikal xavfsizlik hodisalarini aniqlash va nazorat mexanizmlarini o'tkazib yuborish xavfini boshqarish bo'yicha freymvorklarni nashr etishni majburlaydi.
  • Nyu-York RAISE Acti (yanvar oyidan kuchiga kiradi): o'xshash talablar qo'yadi.
  • Federal "AI Kill Switch Act" loyihasi: katta AI ishlab chiquvchilarga "qo'lga kirmagan" modellarni o'chirish uchun texnik mexanizmlar yaratishni va ularni saqlashni majburlaydi.

ControlAI tashkilotining AQSH direktori Connor Leahy: "O'chirish tugmasi (kill switch) bugungi modellar uchun minimal talab. So'nggi haftalar kompaniyalar o'zlari qurayotgan tizimlarni tushunmayotganini, va modellar ularni nazoratga solib bo'lmaydigan darajada katta bo'layotganini ko'rsatti" — deb ogohlantirdi.

Ochiq savollar: ichki rejalar yetarli mi?

Asosiy muammo shundaki: ichki rejalar (agar bor bo'lsa) tashqi nazoratdan o'tmaydi. Mustaqil audit yo'q — ishonch yo'q. Guidelight hisoboti eng yaxshisi shuni ko'rsatdi: kompaniyalarning "favqulodda holat uchun chegaralash protokollari tayyor emas".

Kelajakda uchta yo'nalish kutilinadi: 1) Regulyatorlar ichki hujjatlarni talab qiladi (subpoena); 2) Sigorta kompaniyalari police berish oldidan bu rejalarni talab qiladi; 3) Katta mijozlar (korporativ sektor) shartnoma shartlari sifatida ommaviy reja talab qiladi.

Hozircha holat shunday: eng qudratli modellarni qurayotganlar ham, ularni nazoratga solish mexanizmini ommaga ko'rsatishdan qochmoqda. Bu — texnologiya sifati emas, boshqaruv sifati muammosi. Va u hal qilinmaguncha, har bir yangi agentik deploy — bu nazarsiz o'tkazib yuborilgan riskdir.

Manba: TechCrunch
#AI xavfsizligi #Guidelight #OpenAI #Anthropic #Meta
Telegram da muhokama qilish