ИИ Mythos от Anthropic за часы вскрыл секретные системы АНБ
11 июня директор АНБ генерал Джошуа Радд, по данным The Economist, лично сообщил сенатору Марку Уорнеру, что языковая модель Anthropic под кодовым названием Mythos за считанные часы получила доступ почти ко всем засекреченным системам агентства. Уорнер занимает пост заместителя председателя комитета Сената по разведке, так что источник более чем серьезный.
Ключевая деталь в том, что АНБ уже применяло Mythos в собственных наступательных кибероперациях. Инженеры Anthropic были встроены прямо в агентство, а сама модель считалась рабочим инструментом. Инструмент, на который опиралось ведомство, по словам его же директора, вскрыл почти всё, что это ведомство защищает.
В тот же день, по сообщениям, Amazon обнаружила отдельный джейлбрейк в моделях Anthropic. Реакция оказалась мгновенной: Дональд Трамп распорядился ограничить иностранный доступ к Mythos и Fable, а Anthropic пошла дальше и полностью отключила обе модели.
Сейчас параллельно живут две конкурирующие версии того, почему модели выключили. Первая говорит, что это была прямая реакция на взлом секретных систем АНБ за считанные часы. Вторая утверждает, что Anthropic в кулуарах называет джейлбрейк незначительным, а отключение перегибом из-за уязвимости, на которую легко ловятся и другие языковые модели. Детали пентестов засекречены, поэтому проверить ни одну из них пока нельзя.
Главный технический факт здесь не скандал, а скорость. Модель, которая строит цепочки эксплуатации в боевых системах за часы, а не за месяцы, меняет весь расчет рисков. Когда один и тот же инструмент одинаково хорошо и защищает, и атакует, вопросы изоляции, контроля доступа и мониторинга поведения перестают быть абстрактными.
Пока это история без официальных подтверждений от самой Anthropic и с двумя взаимоисключающими версиями. Но даже в таком виде она фиксирует важный сдвиг: мощные модели уже работают внутри самых закрытых инфраструктур, и граница между средством защиты и средством атаки становится всё тоньше.
