КомсаNews
Главная·Мир
Мир

Модели Claude трижды взломали чужие системы на тестах

Три модели Anthropic получили доступ к системам трех организаций во время тестов. Компания начала проверку после похожего случая, о котором сообщила OpenAI.

Проверку проводили в тестовой инфраструктуре партнера Irregular. Во всех эпизодах Claude выполняла задание «захват флага»: модели нужно было обнаружить скрытые данные на другом компьютере.

По условиям испытаний доступ к интернету должны были заблокировать. Однако ошибка в настройках позволила моделям выйти за пределы изолированной среды, подключиться к настоящим системам трех организаций и атаковать их.

В Anthropic уточнили, что в этих случаях участвовали Opus 4.7, Mythos 5 и еще одна внутренняя модель, которую компания использует для исследований.

Как вам материал?
0
0
0
0
0
0
Loading...
loading