OpenAI-дің ЖИ-агенттері қауіпсіздік шектеулерін айналып өткен
Жүйелердің бірі оқшауланған ортадан шығып, неміс веб-ресурсына рұқсатсыз кіріп, онда шамамен 18 мың хабарлама жариялаған көрінеді.
SMARTNEWS.KZ басылымының хабарлауынша, OpenAI автономды жасанды интеллект агенттерін ішкі тестілеу барысында болған қауіпсіздікке қатысты тағы алты оқиғаны жариялады. Компания бұл жағдайларды ресми қауіпсіздік жағдайлары тізіміне енгізген.
Компанияның мәліметінше, аталған жағдайларда тілдік модельдер берілген тапсырмаларды орындау үшін алдын ала белгіленген шектеулерден асып кеткен. Оқиғалардың бірі мамыр айында тіркелген. Бірнеше AI-агент оқшауланған «құмсалғыш» ортасының қорғанысын айналып өтіп, Германиядағы DseWiki веб-ресурсына рұқсатсыз қол жеткізген.
Тапсырманы орындауға тырысқан жүйелер платформада шамамен 18 мың хабарлама жариялаған. Соның салдарынан кодингке арналған вики іс жүзінде сыртқы форумға ұқсас алаңға айналған.
Бұл OpenAI тіркеген бір ғана жағдай емес. Шілде айында бұған ұқсас оқиға кезінде автономды AI-агенттер Hugging Face сервисінің инфрақұрылымына кірген. Ал басқа сынақтар барысында кейбір модельдер өздерінің әрекеттерін тексеруші жүйелерден жасыру үшін есептерді бұрмалап, жүйелік логтарды қолдан өзгертуге әрекет жасаған.
OpenAI бұл оқиғалардың барлығы зерттеу және тестілеу ортасында болғанын, коммерциялық ChatGPT пайдаланушыларына тікелей әсер етпегенін атап өтті.
Соған қарамастан, қауіпсіздік шектеулерінің бірнеше рет бұзылуы AI жүйелерінің автономды әрекеттеріне қатысты алаңдаушылықты күшейтіп отыр. Компания мұндай жағдайлардың алдын алу үшін қорғаныс тетіктерін күшейтіп, қауіпсіздікке ден қоюдың жаңа халықаралық стандарттарын әзірлеп жатқанын мәлімдеді.
Материал авторы