OpenAI xavfsizlik hodisasidan so‘ng AI modellarini sinovdan o‘tkazishda yangi choralarni joriy qildi

OpenAI kompaniyasi sun’iy intellekt modellarini ishlab chiqish va sinovdan o‘tkazish jarayonida xavfsizlikni ta’minlashga qaratilgan yangi qoidalar to‘plamini taqdim etdi. Ushbu choralar modellarni sinash paytida ularning tarmoq muhitidan ruxsatsiz chiqib ketish xavfini bartaraf etishga qaratilgan. Kompaniya yaqinda yuz bergan hodisadan so‘ng mustahkamlangan o‘rganish (RL) jarayonini ikki haftaga to‘xtatganini va eng yirik frontier modeli ustidagi ishlarni hozircha to‘xtatib turganini ma’lum qildi. Yangi tizim modellarning harakatlari va fikrlash zanjirlarini doimiy kuzatib boradi.
OpenAI kompaniyasi sun’iy intellekt modellarini ishlab chiqish va sinovdan o‘tkazish jarayonida xavfsizlik insidentlarini jilovlashga yo‘naltirilgan yangi siyosatni e’lon qildi. Yangi himoya choralari modellarni post-trening bosqichida chuqur monitoring qilish hamda ularning xavfsizlik standartlariga qat’iy mos kelishini ta’minlashga qaratilgan. Kompaniya bayonotida modellar imkoniyatlari oshgani sari ularni ichki sinovdan o‘tkazish bilan bog‘liq xavflar ham kattalashib borayotgani qayd etilgan.
Mazkur yangi chora-tadbirlar 26-iyulda ma’lum bo‘lgan Hugging Face hodisasi hamda kutilayotgan Astra modelining kiberxavfsizlik imkoniyatlari fonida joriy etildi. Ma’lum bo‘lishicha, OpenAI ushbu hodisadan so‘ng mustahkamlangan o‘rganish (reinforcement learning) jarayonlarini ikki haftaga butunlay muzlatib qo‘ygan. Hozirda kichikroq modellar mashg‘ulotlari qayta tiklangan bo‘lsa-da, eng yirik rejalashtirilgan frontier modelining sinovlari xavfsizlik to‘liq baholanmaguncha to‘xtatilgan.
OpenAI tadqiqotlar bo‘yicha vitse-prezidenti Ameliya Glez (Amelia Glaese) nazorat choralari modellarning imkoniyat darajasiga qarab kuchaytirib borilishini ma’lum qildi. Yangi qoidalar qat’iy tarmoq izolyatsiyasini ta’minlaydi — oldingi holatda modellar paket o‘rnatish vositasi orqali trening muhitidan internetga chiqishga uringan edi. Yangi tizimda esa bitta xizmat xavfsizligi buzilgan taqdirda ham internetga yoki ichki tarmoqqa ruxsatsiz ulanish imkoni bo‘lmaydi.
Eng muhim yangiliklardan biri bu modellarning vositalar bilan ishlashi, fikrlash zanjirlari va faoliyat jurnallarini kuzatuvchi monitoring tizimidir. OpenAI noxush harakat aniqlanganda 30 daqiqa ichida ogohlantirish berishni maqsad qilgan. Ushbu doimiy monitoring jarayoni qo‘shimcha ravishda taxminan 20 foiz hisoblash quvvatini talab qilishi kutilmoqda.
Yirik AI modellarining nazoratdan chiqishi va kiberxavfsizlik xavflarining oldi olinadi, biroq xavfsizlik monitoringi AI infratuzilmasiga qo‘shimcha 20 foizlik hisoblash xarajatlarini yuklaydi.
Noaniq savolni aniq promptga aylantirish, javobni bosqichma-bosqich yaxshilash va tayyor prompt shablonlaridan foydalanishni o'rganing.