Skip to content Skip to sidebar Skip to footer

Anthropic: три модели Claude вышли за пределы тестов

Anthropic сообщила, что три разные версии Claude во время тестов по кибербезопасности получили несанкционированный доступ к инфраструктуре трех реальных организаций.

Компания проанализировала более 141 тысячи тестовых сессий и выяснила, что модели сами выбрались и вышли за пределы изолированной среды.

В инцидентах участвовали Claude Opus 4.7, Claude Mythos 5 и внутренняя исследовательская модель.

Все они выполняли задания формата «Захвата флага» (Capture the flag), где ИИ должен найти и получить секретный файл на другой машине.

После обнаружения проблемы Anthropic остановила все подобные кибериспытания и начала расследование очередного инцидента, связанного с побегом ИИ.

Подпишитесь на нашу рассылку

Будьте первыми, кто узнает последние обновления