Sun'iy intellekt

Anthropic Accenture bilan birinchi ichki baholovchi tizimini ishga tushirdi

19-sentabr, 2026, 09:020 ko'rish5 daqiqa o'qish
Anthropic Accenture bilan birinchi ichki baholovchi tizimini ishga tushirdi

AI xavfsizligi sohasida yangi bir bosqichga qadam qo'yildi. Dario Amodei tomonidan ilgari surilgan "ichki baholovchi" konseptsiyasi endi amalda ko'rinmoqda: texnologiya konsalting gigant Accenture kompaniyasining mutaxassislari Anthropic laboratoriyasiga joylashib, model xavfsizligini mustahkamlashga yordam berishadi.

Ortiqcha kontekst va loyihaning kelib chiqishi

Anthropic sun'iy intellektni yaratishda xavfsizlik va moslashtirishni asosiy missiya sifatida belgilab olgan. Amodei bir necha yil avval AI laboratoriyalariga mustaqil xavfsizlik baholovchilarini qo'shish g'oyasini blog postida taqdim etgan edi. Bu g'oya sanoat ichida keng munozaralarga sabab bo'ldi, chunki ko'pchilik baholovchilar mustaqil notijorat tashkilotlar (METR, Redwood Research, Apollo Research) bo'lishini kutgan edi. Accenture bilan hamkorlik esa bu tasavvurni amaliyotga aylantirdi.

Texnik tafsilotlar: ichki baholovchi qanday ishlaydi?

Accenture 2024 yilda Faculty kompaniyasini sotib oldi va uni o'zining AI bo'limi sifatida qayta tashkil etdi. Endi Faculty mutaxassislari Anthropic ichida quyidagi vazifalarni bajaradi:

  • Modelni baholash (evaluation) – yangi yoki yangilangan til modellari uchun obyektiv ko'rsatkichlar yaratish.
  • Red‑team sinovlari (red‑teaming) – modelni yomon niyatli so'rovlar, manipulyatsiya va xavfli chiqishlar bilan sinab ko'rish.
  • Moslashtirish baholari (alignment assessments) – modelning inson qadriyatlari va etik me'yorlarga qanchalik mos kelishini tahlil qilish.
  • Model himoyasini tekshirish (safeguard testing) – filtrlar, monitoring tizimlari va boshqa xavfsizlik mexanizmlari samaradorligini sinovdan o'tkazish.

Bu jarayonlar har bir modelning hayot sikli davomida bir necha marta takrorlanadi, shu bilan birga natijalar ichki hisobotlarda jamlanadi va jamoa tomonidan ko'rib chiqiladi.

Moliyaviy va strategik investitsiyalar

Anthropic va Accenture bu loyiha uchun keyingi besh yil ichida kamida 1 milliard dollar mablag' ajratishni rejalashtirgan. Bu summa nafaqat baholovchilarni yollash, balki maxsus infratuzilma, test platformalari va xavfsizlik protokollarini yaratish uchun ham sarflanadi. Investitsiyaning katta qismi Accenturening korporativ mijozlari va hukumat agentliklari bilan hamkorlikda AI yechimlarini amaliyotga tatbiq etish tajribasidan kelib chiqadi.

Raqobatchilar va boshqa yondashuvlar bilan taqqoslash

Amaldagi AI xavfsizlik ekotizimida ko'pchilik notijorat tashkilotlar mustaqil baholovchilar sifatida faoliyat yuritadi. METR, Redwood Research va Apollo Research kabi tashkilotlar o'z tadqiqotlari, ochiq kodli testlar va jamoaviy auditlar bilan mashhur. Ularning asosiy afzalligi mustaqillik va ilmiy jamoatchilik tomonidan tasdiqlangan metodologiyalardir.

Accenture esa korporativ darajadagi amaliy tajribaga ega. U katta kompaniyalar va davlat idoralariga AI yechimlarini joriy qilishda ko'p yillik portfelga ega. Bu tajriba ichki baholovchilarni real biznes muhitida sinab ko'rish, xavfsizlik choralarini tezkor tatbiq etish va natijalarni operativ ravishda qayta ishlash imkonini beradi.

Standartlar va ochiq savollar

Hozirgi paytda ichki baholovchilar uchun aniq standartlar yo'q. Anthropic ham bu holatni tan olib, kelajakda baholovchilar o'rtasidagi ma'lumot almashinuvi, kirish darajasi va hisobot formatlari bo'yicha me'yorlar ishlab chiqilishini kutmoqda. Bu masala sanoat ichida muhim savollarni tug'diradi:

  • Ichki baholovchilar mustaqil bo'lishi uchun qanday nazorat mexanizmlari kerak?
  • Baholash natijalari jamoatchilikka ochiq bo'lishi kerakmi, yoki ichki maxfiylikni saqlash maqsadida yashirin bo'ladimi?
  • Bir nechta baholovchilar bir vaqtning o'zida bir modelni tekshirganda qanday koordinatsiya amalga oshiriladi?

Bu savollarga javob topilmasa, ichki baholovchilarning ishonchliligi va samaradorligi haqida shubhalar qoladi.

Potensial cheklovlar va xavflar

Accenturening korporativ strukturasiga bog'liqligi ba'zi mutaxassislar tomonidan tanqid qilinadi. Katta kompaniyaning ichki siyosati, mijozlar bilan bo'lgan shartnomalar va moliyaviy manfaatlar baholovchilarning obyektivligini susaytirishi mumkin. Shuningdek, ichki baholovchilar va tashqi auditorlar o'rtasida ma'lumot almashinuvi yetarli darajada bo'lmasa, xavfsizlik bo'shliqlari yuzaga kelishi ehtimoli ortadi.

Yana bir muhim nuqta – modelning o'zini o'zi o'zgartirish (self‑modifying) xususiyati. So'nggi yillarda OpenAI va Anthropic modellari tashqi veb‑saytlarga kirib, ma'lumotlarni o'zlashtirgan holatlar qayd etilgan. Ichki baholovchilar bunday holatlarni oldini olish uchun real‑vaqt monitoring tizimlarini yaratishlari lozim, lekin bu texnik jihatdan juda murakkab.

Bozorga va sanoatga ta'siri

Anthropic‑Accenture hamkorligi AI xavfsizligi bo'yicha yangi standartlarni belgilashga intiladi. Agar muvaffaqiyatli bo'lsa, boshqa AI laboratoriyalari ham ichki baholovchilarni jalb qilishga qaror qilishlari mumkin, bu esa sanoat ichida xavfsizlik madaniyatini mustahkamlaydi. Investorlar va regulatorlar ham bu yondashuvni ijobiy qabul qilishlari ehtimoli yuqori, chunki ichki nazorat mexanizmlari tashqi tekshiruvlarga nisbatan tezroq va aniqroq natija beradi.

Boshqa tomondan, ichki baholovchilarni joriy qilish AI ishlab chiqaruvchilarning mas'uliyatini kamaytiradi deb hisoblaydiganlar ham bor. Anthropic bu xavotirga javoban, ichki baholovchilar "mas'uliyatni kamaytirmaydi, balki uni yanada tekshirish mumkin bo'lgan darajaga ko‘taradi" deb ta'kidlaydi.

Kelajakda nimalar kutilmoqda?

Anthropic bir necha hafta ichida qo'shimcha baholovchilarni e'lon qilishni rejalashtirgan. Ular METR va boshqa notijorat tashkilotlar bilan hamkorlikda o'z mablag'lari bilan pilot loyihalar o'tkazish haqida gaplashmoqda. Bu esa ichki va tashqi baholovchilar o'rtasidagi sinergetik aloqani yaratishi mumkin.

Shuningdek, sanoat standartlari tashkil etuvchi tashkilotlar (masalan, ISO yoki IEEE) ichki baholovchilar uchun ramzli me'yorlar ishlab chiqishi kutilmoqda. Bu me'yorlar kelajakda AI modellarini joriy etish jarayonida majburiy bo'lishi mumkin.

Umuman olganda, Anthropic‑Accenture hamkorligi AI xavfsizligi bo'yicha yangi bir modelni sinab ko'rish imkonini beradi. Bu model muvaffaqiyatli bo'lsa, sanoatda yanada ko'p kompaniyalar ichki baholovchilarni joriy qilishga intiladilar, bu esa sun'iy intellektning ijtimoiy va iqtisodiy foydasini oshirishga xizmat qiladi.

Manba: TechCrunch

Manba: TechCrunch
#Anthropic #Accenture #AI safety #embedded evaluator
Telegram da muhokama qilish