Odamlar sun'iy intellektdan aslida qanday foydalanmoqda? Mustaqil tadqiqot AI kompaniyalari hisobotlaridagi bo'shliqlarni ochib berdi

Stanford va MIT tadqiqotchilari tomonidan yaratilgan "AI Observatory" loyihasi 52 xil sun'iy intellekt modeli bilan bo'lgan 24 mingdan ortiq real suhbatlarni tahlil qildi. Tadqiqot shuni ko'rsatdiki, Anthropic va OpenAI kabi yirik kompaniyalar taqdim etayotgan hisobotlar faqat ish va samaradorlikka qaratilgan bo'lib, nozik va shaxsiy foydalanish holatlarini to'liq aks ettirmaydi. Masalan, Anthropic metodologiyasi qo'llanilganda suhbatlarning 48 foizi filtrlangan bo'lib, ular orasida munosabatlar, salomatlik va taqiqlangan mavzular ko'p uchragan. Tahlilga ko'ra, foydalanuvchilar Claude'dan ko'proq kod yozishda, Gemini'dan ijtimoiy rolli o'yinlarda, Grok'dan siyosat va yangiliklarda, ChatGPT'dan esa uy vazifalarida foydalanmoqda.
OpenAI va Anthropic kabi yetakchi texnologiya gigantlari foydalanuvchilar ChatGPT yoki Claude bilan qanday muloqot qilayotgani haqida muntazam hisobotlar e'lon qilib keladi. Biroq Stanford va MIT tadqiqotchilarining fikricha, bu hisobotlar faqat kompaniyalar jamoatchilikka ko'rsatishni xohlagan ma'lumotlarni o'z ichiga oladi. Qaror qabul qiluvchilar va ekspertlar cheklangan ma'lumotlarga tayangan holda sun'iy intellektning xavf-xatarlari va foydasi haqida xulosalar chiqarmoqda.
Ushbu bo'shliqni to'ldirish maqsadida Stanfordning STAIR laboratoriyasi va MIT vakillari "AI Observatory" loyihasini ishga tushirdi. Loyiha doirasida 2023β2025 yillar oralig'ida 5000 nafar foydalanuvchining 52 xil AI modeli bilan bo'lgan 24 521 ta haqiqiy suhbatlari tahlil qilindi. Natijalar shuni ko'rsatdiki, kompaniyalar hisoboti ko'pincha ish jarayonlariga e'tibor qaratgani sababli, insonlarning shaxsiy va nozik masalalardagi xatti-harakatlari chetda qolib ketgan.
Masalan, mashhur "Anthropic Economic Index" tahlili faqat ish va samaradorlikka yo'naltirilgan. AI Observatory tadqiqotchilari xuddi shu usulni o'z ma'lumotlariga qo'llab ko'rganida, barcha suhbatlarning 48 foizi filtrlash tufayli hisobga kirmay qolishi aniqlandi. Filtrlangan bu qismda sog'liq va munosabatlar, haqoratli so'zlar hamda kattalar uchun mo'ljallangan nozik mavzular kompaniya hisobotiga qaraganda ancha yuqori ulushni tashkil etgan.
Tadqiqot foydalanuvchilarning turli modellardan turlicha maqsadda foydalanishini ham ko'rsatib berdi. Xususan, odamlar Claude'dan ko'proq dasturlashda, Gemini'dan rolli o'yinlar va muloqotda, ChatGPT'dan uy vazifalarini bajarishda, Grok va Gemini'dan esa axborot qidirishda faol foydalangan. Shu bilan birga, xAI kompaniyasining Grok modelida yangiliklar va siyosat faol muhokama qilinsa-da, unda noto'g'ri axborotlar tarqalishi yuqori bo'lgan.
Shuningdek, vaqt o'tishi bilan AI bilan olib borilgan suhbatlar hajmi va davomiyligi oshgan, odatiy suhbatlar (small talk) va hamrohlik qilish holatlari ko'paygan. Shu bilan birga, zararli va taqiqlangan mazmundagi nozik muloqotlar ulushi kamaygani qayd etildi, bu esa platformalarning xavfsizlik choralari yaxshilanayotganidan dalolat beradi.
Tadqiqot natijalari AI mahsulot yaratuvchilariga foydalanuvchilar aslida texnologiyadan qanday maqsadda foydalanayotganini tushunishga hamda o'z modellarida kontent xavfsizligi va ijtimoiy funksiyalarni to'g'ri loyihalashtirishga yordam beradi.
Noaniq savolni aniq promptga aylantirish, javobni bosqichma-bosqich yaxshilash va tayyor prompt shablonlaridan foydalanishni o'rganing.