Американские власти приказали Anthropic закрыть доступ к моделям Fable 5 и Mythos 5

Американские власти приказали Anthropic закрыть доступ к моделям Fable 5 и Mythos 5 — Cybersecurity | Versia.media

Хакер #325. Шпионские уловки

Содержание номера

Оформление подписки на «Хакер» со скидкой 60%

Спустя несколько суток после запуска ИИ-моделей Fable 5 и Mythos 5 фирма Anthropic была вынуждена заблокировать к ним доступ для всех пользователей. Причиной стало предписание властей Соединенных Штатов, которое обязало запретить эксплуатацию данных моделей любыми иностранными гражданами — вне зависимости от их местонахождения (в США либо за их пределами).

Как сообщили представители компании, распоряжение поступило вечером 12 июня. В документе правительство ссылается на интересы национальной безопасности и по факту вводит экспортные ограничения для обеих моделей. Причем запрет на применение Fable 5 и Mythos 5 распространяется даже на иностранных сотрудников самой Anthropic.

В компании отметили, что оперативно выполнить такое предписание и адресно ограничить круг пользователей не представлялось возможным. В связи с этим доступ к моделям был отключен для всех клиентов без каких-либо исключений. Остальные продукты Anthropic, в том числе Claude Opus 4.8, продолжали функционировать в обычном режиме.

Напомним, что Fable 5 является урезанной версией получившей широкую известность Mythos. Модели базируются на единой платформе, однако в Fable встроены дополнительные защитные механизмы. В частности, модель должна ограничивать ответы на потенциально опасные запросы из сфер кибербезопасности, биологии и химии, которые могут способствовать созданию эксплоитов, биологических и химических угроз. Более мощная версия Mythos 5 по-прежнему доступна исключительно проверенным государственным учреждениям и научным партнерам.

Согласно информации издания Axios, поводом для вмешательства властей стали сообщения о джейлбрейке, разработанном исследователем Pliny the Liberator, который позволяет обходить часть защитных механизмов Fable 5. Источники издания утверждают, что администрация Дональда Трампа потребовала приостановить распространение моделей, чтобы государственные структуры успели подготовиться к возможным угрозам. Предполагается, что этот процесс может занять несколько недель.

В самой Anthropic считают реакцию правительства избыточной. В компании заявляют, что получили лишь устные сведения о «потенциальном ограниченном джейлбрейке», который сводится к тому, что модель может анализировать определенную кодовую базу и выявлять в ней программные ошибки. Разработчики подчеркивают, что обнаруженные возможности не выходят за пределы того, что способны делать другие общедоступные модели (в частности, GPT-5.5).

Также в компании утверждают, что опубликованные исследователем примеры не демонстрируют полноценного джейлбрейка: часть скриншотов якобы вообще не относится к Fable 5, а остальные содержат лишь общедоступную информацию.

«Мы выполняем юридически обязательное распоряжение правительства и отключаем доступ к Fable 5 и Mythos 5 для всех пользователей. Однако мы не согласны с тем, что обнаружение узкоспециализированного потенциального джейлбрейка должно приводить к отзыву коммерческой модели, развернутой для сотен миллионов людей», — подчеркивается в заявлении компании.

«Мы выполняем юридически обязательное распоряжение правительства и отключаем доступ к Fable 5 и Mythos 5 для всех пользователей. Однако мы не согласны с тем, что обнаружение узкоспециализированного потенциального джейлбрейка должно приводить к отзыву коммерческой модели, развернутой для сотен миллионов людей», — подчеркивается в заявлении компании.

По мнению представителей Anthropic, если применять такой подход ко всей индустрии, выпуск новых передовых моделей может фактически стать невозможным.

В Anthropic называют происходящее недоразумением и рассчитывают восстановить доступ к моделям в ближайшее время. Кроме того, в компании раскритиковали сам механизм принятия решения, заявив, что подобные меры должны базироваться на прозрачных процедурах, технических фактах и понятных критериях оценки рисков.

Как сообщает издание The Wall Street Journal, источником опасений правительства могли стать результаты внутреннего тестирования Amazon — одного из крупнейших инвесторов Anthropic. По данным журналистов, незадолго до блокировки моделей глава Amazon Энди Джесси (Andy Jassy) обсуждал с представителями американских властей результаты исследований, в ходе которых от Fable 5 якобы удалось получить информацию, потенциально пригодную для проведения разрушительных кибератак.

Представители Amazon подтвердили изданию лишь то, что власти регулярно консультируются с компанией по вопросам безопасности, однако отказались раскрывать детали обсуждений.

В свою очередь, бывший ИИ-советник администрации Трампа Дэвид Сакс (David Sacks) утверждает, что некий «надежный партнер» правительства и Anthropic продемонстрировал работоспособный джейлбрейк модели. По его словам, администрация предложила генеральному директору компании Дарио Амодеи (Dario Amodei) устранить проблему или отозвать модель, однако стороны не сумели прийти к соглашению.

← Cybersecurity