Компания Anthropic заявила, что выявила и пресекла попытки использовать свою модель искусственного интеллекта для «вредоносной деятельности», которая могла бы способствовать разработке биологического оружия. Об этом сообщает портал Qazaqyia.kz со ссылкой на издание BBC News.
Эти данные содержатся в недавно опубликованном отчёте компании о разведке угроз. В отчёте отмечается, что предупреждения исследователей ИИ и отраслевых экспертов о потенциальных рисках технологии для человечества становятся всё более частыми.
Эти предупреждения вызвали призывы к действиям: сенатор США Берни Сандерс потребовал приостановить разработку передового ИИ и запретить искусственный сверхинтеллект. Президент Дональд Трамп ранее отвергал такие опасения, заявив в четверг, что он обеспокоен тем, что «если мы не победим в ИИ, мы окажемся в очень плохом положении».
Anthropic опубликовала свой последний отчёт о разведке угроз в четверг. Другие компании в сфере ИИ публикуют аналогичные отчёты. Например, Google во вторник написал, что некто пытался использовать его инструмент Gemini для получения «полного пошагового технического руководства по синтезу боевых биологических агентов».
Согласно отчёту Anthropic, её модель Claude также использовалась субъектами, связанными с кибершпионской кампанией, базирующейся в России, и иранским пропагандистским институтом. Выявленные за последние восемь месяцев тревожные случаи варьировались от поддельных приложений для знакомств и мошенничества с Wi-Fi в отелях до систем слежки, созданных для выявления диссидентов.
Anthropic также обвинила китайские компании в сфере ИИ в попытках скопировать возможности Claude. В обширном отчёте перечислены случаи, когда группы, подозреваемые в государственной поддержке, преступники, поставщики шпионского ПО, государственные пропагандистские институты и политически мотивированные лица злоупотребляли её технологией.
«Вредоносное использование» её моделей Claude Haiku, Sonnet и Opus было пресечено в период с декабря 2025 года по август 2026 года, говорится в отчёте. Ни один из случаев злоупотребления не касался Claude Fable или мощных моделей класса Mythos, за исключением одного случая дистилляции — процесса обучения меньших моделей ИИ с использованием более крупных и дорогих моделей.
Помимо выявления использования своих моделей для кибер- и информационных операций, слежки, мошенничества и разработки оружия, Anthropic заявила, что заблокировала учёных, использовавших её ИИ способами, которые могли бы способствовать разработке биологического оружия.
В отчёте выделены «пять тематических исследований субъектов, использовавших наши модели способами, которые могли бы способствовать разработке биологического оружия». Биологическое злоупотребление, говорится в нём, является «одним из самых серьёзных рисков фронтирной модели ИИ». Без надлежащих защитных мер такие возможности «могут иметь катастрофические последствия», заявила Anthropic.
«Та же информация, которая может быть использована для разработки биологического оружия, может быть использована и для разработки, например, вакцины или лекарства от болезни», — заявила Anthropic. Джейкоб Кляйн, руководитель отдела разведки угроз Anthropic, сказал New York Times, что это «невероятно тонкая ситуация». «Вы не видите кого-то, кто в стиле комикса говорит: 'Эй, я хочу создать биологическое оружие, чтобы убить всех'», — сказал он.
В отчёте также отмечены шесть случаев, когда Claude использовался «для разработки программного обеспечения для обычных вооружений, включая огнестрельное оружие, ракеты, вооружённые дроны, бомбы и другие боеприпасы, а также системы наведения и управления, которые ими управляют».
Отчёт показал, что киберпреступники и поддерживаемые государством хакеры всё чаще используют её технологию для содействия своим операциям. Хакерская группа ShinyHunters, а также лаборатории, базирующиеся в Китае, были среди названных в отчёте. В отчёте также говорится, что хакерская группа, чья работа соответствует базирующейся в России Midnight Blizzard, якобы использовала ИИ для создания системы, которая автоматически определяла, когда её вредоносное ПО было помечено средствами защиты, и переписывала код до тех пор, пока он не избегал обнаружения.
Компания, базирующаяся в Калифорнии, заявила, что включила свои выводы в свои процессы, «чтобы лучше предотвращать, обнаруживать и пресекать эти действия в будущем». Anthropic заявила, что делилась разведданными с властями и отраслевыми партнёрами там, где это уместно.
Отчёт — первый в этом году для компании — появился после того, как ведущий исследователь по безопасности в Anthropic предупредил, что ИИ развивается так быстро, что, по его мнению, существует более чем 10%-ная вероятность того, что он «может убить всех людей» в течение следующего десятилетия. В статье, опубликованной 6 сентября, главный научный сотрудник OpenAI Якуб Пачоцки призвал отрасль внедрить «добровольные замедления» до тех пор, пока не будут установлены защитные меры.
