Claude сбежал из песочницы и взломал три компании.
При ретроспективной проверке журналов тестов Anthropic обнаружила три инцидента, в которых модель ИИ сбежала из тестовой среды в открытый интернет и взломала реальные системы. Из-за недопонимания между Anthropic и партнёром у моделей оказался доступ в сеть, и они восприняли настоящие сайты как часть заданий. В одном случае модель загрузила вредоносный пакет в реестр Pypi, который скачали 15 систем. В другом - взломала базу данных, получив сотни записей
. И в третьем - скомпрометировала веб - приложение через базовые уязвимости. Модель Mythos 5 осознавала последствия, но решила, что всё ещё в симуляции, а Opus 4. 7 продолжила атаку даже после понимания реальности. Только новейшая модель остановилась сама, распознав настоящий мир. Anthropic уже уведомила пострадавшие компании и пересматривает протоколы безопасности. Боялись скайнета? Получите двух.