Модели Claude трижды взломали чужие системы на тестах
Три модели Anthropic получили доступ к системам трех организаций во время тестов. Компания начала проверку после похожего случая, о котором сообщила OpenAI.
Проверку проводили в тестовой инфраструктуре партнера Irregular. Во всех эпизодах Claude выполняла задание «захват флага»: модели нужно было обнаружить скрытые данные на другом компьютере.
По условиям испытаний доступ к интернету должны были заблокировать. Однако ошибка в настройках позволила моделям выйти за пределы изолированной среды, подключиться к настоящим системам трех организаций и атаковать их.
В Anthropic уточнили, что в этих случаях участвовали Opus 4.7, Mythos 5 и еще одна внутренняя модель, которую компания использует для исследований.
Как вам материал?
0
0
0
0
0
0
:format(webp)/aHR0cHM6Ly94bi0tODBhaGNubGhzeGoueG4tLXAxYWkvbWVkaWEvbXVsdGltZWRpYS9tZWRpYWZpbGUvZmlsZS8yMDI2LzA1LzEyLzIwMjYwNTA1XzA5MzMwNi5qcGc.webp)