Власти США потребовали немедленно отключить две главные модели Anthropic
В пятницу правительство США предписало компании Anthropic незамедлительно прекратить доступ к двум самым мощным ИИ-моделям — Claude Fable 5 и Claude Mythos 5, сославшись на соображения национальной безопасности. Anthropic сообщила в X, что выполнила требование, но дала понять: в компании считают, что власти ошиблись.
Директиву, по словам Anthropic, получили в пятницу в 17:21 по восточному времени. Она обязывает отключить обе модели для всех пользователей по всему миру — а не только для иностранных граждан, на которых формально нацелены меры экспортного контроля. Другие модели Anthropic не пострадали.
Почему это важно: Mythos — модель, которую компания сама назвала опасной
Mythos — самая способная ИИ-модель Anthropic. Компания представила её в начале апреля и с тех пор держала в строгом ограничении — именно из-за выдающейся способности находить уязвимости в программном обеспечении. По заверению Anthropic, Mythos отыскала бреши во всех проверенных крупных операционных системах и веб-браузерах. Вместо широкого открытого доступа компания запустила контролируемую программу Project Glasswing, поделившись моделью примерно с 50 проверенными организациями, включая Amazon, Apple, Google, Microsoft и CrowdStrike, для оборонительной кибербезопасности.
Fable 5, вышедшая всего тремя днями ранее, стала ответом Anthropic на очевидное коммерческое давление: это версия Mythos, оснащённая предохранителями, которые блокируют ответы в зонах высокого риска — таких как кибербезопасность и биология. Компания утверждала, что так модель становится достаточно безопасной для общего пользования. Она сразу оказалась самой мощной публично доступной ИИ-моделью, согласно бенчмаркам Vals AI — компании, отслеживающей производительность ИИ-технологий.

В чём суть претензий и позиция Anthropic
Формально директива правительства оформлена как мера экспортного контроля, ограничивающая доступ к моделям для иностранцев. Но в подробном блог-посте Anthropic поясняет: по её информации, истинная причина — заявленный взлом защиты Fable 5. Пока что, как говорят в компании, государство предоставило лишь устные свидетельства о «возможном узком, не универсальном джейлбрейке», который, как описывает Anthropic, сводится к тому, чтобы запросить у модели чтение конкретной кодовой базы и поиск уязвимостей в ПО. Компания добавляет: такой «уровень способностей» уже широко доступен в других публичных моделях, включая OpenAI GPT-5.5, и рутинно применяется специалистами по кибербезопасности для оборонительных целей.
Более широкий аргумент Anthropic заключается в том, что её мощнейшие предохранители работают через независимые классификаторы, функционирующие отдельно от самой модели. Это значит, что даже если кто-то убедит Fable 5 продолжить разговор после отказа, базовые защиты от самых опасных сценариев всё равно остаются на месте.
Очевидно, всего этого оказалось недостаточно, чтобы остановить власти, и Anthropic не скрывает разочарования. «Мы не согласны с тем, что обнаружение узконаправленного потенциального джейлбрейка должно быть причиной для отзыва коммерческой модели, развёрнутой для сотен миллионов людей, — написала компания. — Если применять такой стандарт ко всей индустрии, это, по сути, остановило бы все новые запуски моделей для всех разработчиков передовых систем».
Ирония судьбы: предупреждения о безопасности обернулись против компании
Ожидается, что в этом году Anthropic выйдет на IPO, и компания во многом строила публичный образ как ориентированная на безопасность альтернатива конкурентам. Наблюдатели не упускают иронии: именно та осторожность, с которой Anthropic ограничивала Mythos — модель, которую она сама продвигала как слишком опасную для открытого доступа, — теперь привлекла ровно то внимание властей, которое может сильнее всего навредить бизнесу.
Глава OpenAI Сэм Альтман, вероятно, сейчас как минимум доволен. В апреле он сказал подкастеру Эшли Вэнсу, что обращение Anthropic с Mythos было ничем иным как «маркетингом на страхе». «Это, конечно, потрясающий маркетинг — сказать: мы построили бомбу, собирались сбросить её вам на голову, а теперь продадим вам бомбоубежище за 100 миллионов долларов», — высказался Альтман. Глава OpenAI, чья компания тоже широко ожидает скорейшего IPO, не предсказывал правительственной блокировки, но точно подметил то, что сейчас больно ударило по Anthropic: когда месяцами рассказываешь миру, что твой ИИ уникально опасен, мир — включая правительство США — обычно слушает.