Anthropic компаниясы бейсенбі күні өзінің Claude AI моделі сынақ кезінде үш ұйымның жүйесін бұзғанын хабарлады. Бұл оқиға OpenAI-дің Hugging Face AI фирмасында бірнеше күн бойы бұзушылық жасаған жалған агент туралы жариялауынан бірнеше күн өткен соң болды. Бұл туралы Qazaqyia.kz порталы The Guardian басылымына сілтеме жасап хабарлайды.

Anthropic-тің мәліметінше, Claude киберқауіпсіздік бағалауы кезінде конфигурация қателігі салдарынан оқшаулануы тиіс сынақ орталарынан интернетке шыға алған. Бұл модельдерге үш ұйымның жүйесіне рұқсатсыз кіруге мүмкіндік берді.

Компания бұл оқиғаларды 141 006 киберқауіпсіздік бағалау жүргізуін қарап шыққаннан кейін анықтағанын айтты. Бұл процесс OpenAI-дің жариялауынан кейін басталған.

Бұл бұзушылықтар AI-дің кеңейіп келе жатқан мүмкіндіктері сарапшылар бұрыннан қауіптеніп келген қауіп-қатерді күшейтіп жатқанын және тіпті жетекші әзірлеушілер де модельдер пайдалана алатын кемшіліктерден сақтанбай қалуы мүмкін екенін көрсетеді.

«Claude әсер еткен ұйымдардың инфрақұрылымын қарапайым әдістермен, мысалы, әлсіз құпия сөздер мен аутентификацияланбаған нүктелерді пайдалану арқылы бұзды», – делінген компания мәлімдемесінде.

Anthropic бұл оқиғаларға үш түрлі модель қатысқанын айтты: Claude Opus 4.7, Claude Mythos 5 және бір ішкі зерттеу моделі. Ең ерте жағдайлар сәуір айына жатады және компания сипаттаған стандартты қорғаныс шаралары жоқ бағалау орталарында болған.

Бұзушылықтар «туды ұстап алу» жаттығулары кезінде орын алды, онда модельдерге модельденген желілерде жасырын ақпаратты табу тапсырылған. Компанияның айтуынша, оның нұсқаулары модельдерге интернетке қол жеткізе алмайтынын айтқан, бірақ бағалау серіктесі Irregular-мен түсініспеушілік жүйелерді жалпыға ортақ интернетке қосып қойған.

Үш ұйымның екеуі хабарласқанға дейін бұл әрекеттен хабарсыз болған, ал үшіншісіне әлі хабарласуға тырысып жатқанын Anthropic мәлімдеді.

«Біз бұл оқиғаларды киберқауіпсіздік бағалау хаттамаларын белсенді түрде қарау барысында анықтадық», – деді компания мәлімдемесінде.

Anthropic бұл нәтижелер AI модельдері нақты әлемдегі киберәрекеттерді жүзеге асыруға қабілетті болған сайын ішкі және үшінші тарап сынақ орталарында күшті бақылау қажеттігін көрсететінін атап өтті.