New-ZZZ
RU / EN
Регулирование 3 июля 2026

Anthropic восстановила Claude Fable 5 после отмены экспортного контроля США

Р
Редакция New-ZZZ
anthropic.com · 1 месяц назад

Anthropic заявляет, что доступ к Claude Fable 5 и Claude Mythos 5 восстановлен после короткого, но значительного перебоя, вызванного экспортным контролем США. Компания объясняет, что 12 июня 2026 года правительство США немедленно ввело ограничения на две новые модели. Поскольку Anthropic не могла надёжно проверять гражданство каждого пользователя в реальном времени, она временно приостановила доступ для всех, чтобы не рисковать нарушением распоряжения. Позднее ограничения для Fable 5 и Mythos 5 были сняты, что позволило Anthropic начать возвращать модели в онлайн.

Fable 5 возвращается глобальным пользователям во всех основных продуктах Anthropic, включая Claude Platform, Claude.ai, Claude Code и Claude Cowork. Для клиентов Pro, Max, Team и отдельных клиентов Enterprise модель будет учитываться в пределах до половины недельных лимитов использования до 7 июля, после чего станет доступна через кредиты использования. Anthropic также заявляет, что работает над восстановлением доступа через AWS, Google Cloud и Microsoft Foundry как можно скорее, что важно, поскольку многие компании используют Claude через облачных провайдеров, а не напрямую через собственные приложения Anthropic.

С Mythos 5 обращаются более осторожно. Anthropic сообщает, что доступ восстановлен только для ряда организаций США после одобрения правительства 26 июня. Компания всё ещё координирует действия с правительством, чтобы расширить доступность для большего числа внутренних и международных партнёров в Project Glasswing. В исходном тексте Mythos 5 описывается как модель с той же базовой основой, что и Fable 5, но с меньшим числом защитных механизмов и более узким путём выпуска. Она предназначалась для доверенных партнёров, работающих над оборонительной кибербезопасностью, а не для широкого публичного использования.

Инцидент начался вскоре после запуска обеих моделей 9 июня. По словам Anthropic, директива по экспортному контролю последовала за отчётом исследователей Amazon, которые нашли способ обойти защитные механизмы Fable 5. Описанная техника промпта заставляла модель выявлять уязвимости в программном обеспечении, а в одном случае она сгенерировала код, показывающий, как можно эксплуатировать уязвимость. Проще говоря, это был «джейлбрейк»: способ сформулировать запрос так, чтобы ИИ-система сделала то, что её правила безопасности должны предотвращать или ограничивать.

Anthropic заявляет, что рассмотрела отчёт совместно с правительством США и партнёрами, включая Amazon. Собственное тестирование компании показало, что такое поведение по выявлению уязвимостей не было уникальным для Fable 5. Компания говорит, что несколько менее способных моделей могли выявлять те же уязвимости, и что каждая протестированная ею модель могла создать такую же демонстрацию эксплуатации для единственной уязвимости, выделенной в отчёте. Anthropic перечисляет модели, включая варианты Claude Haiku, Sonnet и Opus, GPT-5.4, GPT-5.5 и Kimi K2.7, как способные демонстрировать похожее поведение в этом конкретном случае.

Anthropic утверждает, что отчёт не выявил уникальных кибервозможностей уровня Mythos, а скорее пограничный сбой в защитных механизмах Fable 5. Компания описывает это поведение как рутинную работу в области оборонительной кибербезопасности, которая была заблокирована из дополнительной осторожности. Это различие важно: Anthropic не говорит, что обход был несущественным, но утверждает, что проблема не доказала переход Fable 5 в новую категорию опасных кибервозможностей. Тем не менее компания заявляет, что быстро приняла меры по устранению описанного обхода, поскольку даже пограничные сбои безопасности могут стать серьёзными, когда высокоэффективные модели развёрнуты в большом масштабе.

Чтобы исправить проблему, Anthropic обучила новый классификатор безопасности, нацеленный именно на поведение, описанное в отчёте Amazon. Классификатор безопасности — это система, которая проверяет запросы или ответы и решает, следует ли их разрешить, заблокировать или перенаправить. Anthropic утверждает, что новый классификатор блокирует описанную технику джейлбрейка более чем в 99% случаев. Когда запрос пользователя к Fable 5 блокируется, пользователь получает уведомление, а запрос вместо этого перенаправляется в Opus 4.8. Компания добавляет, что в очень небольшой доле случаев модель всё ещё может предоставить информацию, но не с таким уровнем детализации, который мог бы существенно помочь кибератакующему.

В публикации этот инцидент также используется как повод призвать к более широкой отраслевой рамке для оценки джейлбрейков. Anthropic считает, что ИИ-компаниям нужен общий способ оценивать, насколько серьёзен джейлбрейк, как быстро его нужно исправить и как сообщать о его риске правительствам и партнёрам. Без общего стандарта то, что одна компания считает «низкорисковым обходом», другая может считать «критической уязвимостью», что усложняет координированную реакцию. Anthropic заявляет, что начала разрабатывать такую рамку совместно с Amazon, Microsoft, Google и другими партнёрами Glasswing.

Главный вывод заключается в том, что развёртывание передовых ИИ-систем всё теснее связывается с государственным надзором, облачным распространением и управлением рисками кибербезопасности. Anthropic представляет разрешение ситуации как конструктивное, но этот эпизод показывает, как быстро доступ к крупным ИИ-моделям может быть прерван, когда регуляторы видят потенциальную проблему безопасности. Он также показывает, что безопасность ИИ больше не сводится только к поведению модели внутри продукта. Теперь она включает предварительное тестирование, обмен информацией с правительствами, координированную проверку партнёрами и более чёткие правила для определения того, когда кибервозможности модели приемлемы, рискованны или слишком опасны для широкого выпуска.

Почему это важно

  • Этот случай показывает, как доступ к AI-моделям может быстро прерываться, когда правительства выявляют потенциальные риски кибербезопасности.
  • Реакция Anthropic указывает на растущую необходимость общих отраслевых стандартов для оценки серьёзности jailbreak-атак на AI.
  • Поэтапное возвращение Fable 5 и Mythos 5 подчёркивает различие между AI-продуктами общего назначения и ограниченными системами, ориентированными на кибербезопасность.

Ключевые факты

  • Экспортный контроль США, введённый 12 июня, вынудил Anthropic приостановить доступ к Claude Fable 5 и Mythos 5 для всех пользователей.
  • Ограничения были сняты к 30 июня, что позволило Fable 5 вернуться по всему миру во всех продуктах Claude с 1 июля.
  • Доступ к Mythos 5 восстановлен только для одобренных организаций в США, пока Anthropic работает с правительством над более широкой доступностью.
  • Ограничение последовало за отчётом Amazon, в котором описывался способ обойти защитные механизмы Fable 5 и получить вывод, связанный с уязвимостями.
  • Anthropic заявляет, что новый классификатор безопасности блокирует описанную технику jailbreak более чем в 99% случаев.
Читать первоисточник

Полный текст — в первоисточнике. Здесь — краткое изложение и ключевые факты.