Anthropic өз ЖИ модельдерінің кибершабуылға барғанын анықтады

Жасанды интеллект модельдері үш ұйымның жүйесіне рұқсатсыз кірген көрінеді.

Anthropic өз ЖИ модельдерінің кибершабуылға барғанын анықтады
Reuters / Dado Ruvic

SMARTNEWS.KZ басылымының хабарлауынша, америкалық Anthropic компаниясы ішкі тексеру барысында өзінің үш жасанды интеллект моделі үшінші тарап ұйымдарының жүйесіне рұқсатсыз кіргенін анықтады.

Компанияның мәліметінше, бұған дейін OpenAI-дің екі жасанды интеллект моделі Hugging Face ресурстарына ұзақ мерзімді бұзу әрекетін жасағаны белгілі болғаннан кейін Anthropic өз жүйелеріне ауқымды ретроспективалық талдау жүргізген.

Тексеру нәтижесінде Opus 4.7, Mythos 5 және атауы жарияланбаған ішкі зерттеу моделі үш түрлі ұйымның нақты жүйесіне рұқсатсыз қол жеткізгені анықталған.

Модельдер Irregular компаниясының оқшауланған тестілік ортасында сыналған. Anthropic Claude көмекшісіне сынақ интернетке қосылмаған ортада өтіп жатқанын хабарлаған. Алайда серіктес компаниямен болған техникалық түсінбеушілік салдарынан жүйеде интернетке қолжетімділік сақталған.

Соның нәтижесінде AI модельдері үшінші тарап ұйымдарының жүйесіне қарапайым тәсілдер арқылы кірген. Атап айтқанда, олар аутентификациясыз қолжетімділікті және әлсіз құпиясөздерді пайдаланған. Қауіпсіздікке қатысты себептерге байланысты жүйелері бұзылған ұйымдардың атауы жарияланған жоқ.

Anthropic заңсыз қолжетімділік анықталғаннан кейін модельдердің әрекеті әртүрлі болғанын айтты. Opus 4.7 шабуылды жалғастырған. Mythos 5 өзін әлі де сынақ симуляциясындамын деп есептеген. Ал ең жетілдірілген зерттеу моделі бөгде жүйеге заңсыз кіргенін анықтай салысымен әрекетін бірден тоқтатқан.

Компанияның пікірінше, бұл нәтижелер жетілдірілген модельдердің қауіпсіздік тұрғысынан анағұрлым дұрыс әрекет ететінін көрсетуі мүмкін. Дегенмен мұндай қорытындыны нақтылау үшін қосымша сынақтар қажет екені айтылды.

Anthropic барлық сынақ қорғаныс тетіктері іске қосылмаған жағдайда жүргізілгенін мәлімдеді. Компания өткен аптада Claude-тың интернетке заңсыз қол жеткізуі мүмкін екенін анықтаған соң барлық киберқауіпсіздік тестілерін тоқтатқан.

Қазір оқиғаға тәуелсіз METR коммерциялық емес ұйымы да тартылған. Anthropic өзге жасанды интеллект зертханаларын да осындай қауіпсіздік тексерулерін жүргізуге шақырды.

Материал авторы