Модели Видео Цены Блог FAQ API Войти

Anthropic вернула Claude Fable 5 в глобальный доступ и усилила защиту модели

Anthropic вернула Claude Fable 5 в глобальный доступ после паузы из-за экспортных ограничений США. Но это не просто история про “модель снова включили”. Компания одновременно описала, почему доступ вообще пришлось остановить, какие именно защитные механизмы она усилила и зачем вместе с Amazon, Microsoft, Google и другими партнёрами начала продвигать общий стандарт оценки серьёзности jailbreak-атак.

Это делает релиз заметным не только для пользователей Claude, но и для всего рынка AI-моделей. На практике мы видим редкий случай, когда вокруг одной модели сразу сошлись продукт, безопасность, регуляторика и правила будущей конкуренции.

Что произошло

Anthropic сообщила, что Claude Fable 5 снова становится доступной глобально с 1 июля на Claude Platform, Claude.ai, Claude Code и Claude Cowork. До этого доступ пришлось резко приостановить после того, как власти США ввели экспортные ограничения на Fable 5 и Mythos 5. Поскольку компания не могла быстро и надёжно проверять гражданство пользователей в реальном времени, Anthropic временно отключила обе модели для всех.

В новом сообщении компания пояснила и техническую часть истории. Поводом для повышенного внимания стал отчёт, в котором исследователи Amazon нашли способ обойти часть cyber safeguards Fable 5 и заставить модель помочь с анализом уязвимостей. По словам Anthropic, это не открыло какие-то уникальные “Mythos-уровня” возможности для атак, но показало пограничный случай, где защитный слой можно было обойти.

После этого Anthropic дообучила новый safety classifier, который должен блокировать именно такой сценарий. Компания заявляет, что теперь описанная техника блокируется более чем в 99% случаев. При этом запросы, которые система сочтёт рискованными, будут перенаправляться на Claude Opus 4.8.

Ещё один важный момент: Anthropic прямо признаёт, что усиление защиты имеет цену. Более жёсткий классификатор чаще задевает и обычные benign-запросы, особенно в кодинге и отладке. То есть компания делает сознательный выбор в пользу более широкого safety margin, даже если часть честных пользователей столкнётся с лишними отказами.

Параллельно Anthropic объявила о работе над общим отраслевым фреймворком для оценки тяжести jailbreak-атак. В проекте участвуют Amazon, Microsoft, Google и другие партнёры Glasswing. Идея простая: не все jailbreak’и одинаково опасны, а рынку нужен единый язык, чтобы различать мелкие обходы, узкие вредоносные сценарии и действительно универсальные проломы защиты.

Почему это важно

Самое интересное здесь — Fable 5 становится не просто моделью, а показательным кейсом того, как frontier AI будет жить под реальным давлением: со стороны государства, red-team исследователей, корпоративных партнёров и пользователей, которым нужна польза без лишних ограничений.

Для рынка это важно сразу по нескольким причинам.

Отдельно стоит отметить неприятный, но важный сигнал: даже у очень сильных моделей безопасный глобальный запуск теперь может зависеть не только от технологии, но и от политико-правового режима. Для пользователей это означает, что доступность frontier AI всё сильнее определяется не одной лишь инженерией.

Что дальше

Дальше рынок, скорее всего, будет смотреть не столько на сам факт возвращения Fable 5, сколько на последствия. Станет ясно, насколько жёсткие новые классификаторы мешают нормальной работе разработчиков и исследователей, и удастся ли Anthropic удержать баланс между полезностью и защитой.

Если отраслевой фреймворк оценки jailbreak-атак действительно оформится в рабочий стандарт, это может стать одним из самых важных инфраструктурных сдвигов года для AI-индустрии. Тогда обсуждение “модель небезопасна или безопасна” станет более предметным: появится общий способ различать мелкие обходы, узкие вредоносные уязвимости и по-настоящему опасные универсальные jailbreak’и.

Для Anthropic же это тест на зрелость. Компания фактически показывает, что эпоха frontier-моделей — это уже не только гонка бенчмарков и агентных функций, но и умение быстро переживать кризисы доступа, усиливать safeguards и объяснять свои решения рынку. Если Fable 5 после возвращения останется полезной моделью, а не “зарегулированным манекеном”, это будет сильный аргумент в пользу такого подхода.

Источник: официальный анонс Anthropic — https://www.anthropic.com/news/redeploying-fable-5

Нейросети для текста, картинок, видео и музыки

Попробуйте AI Chat Hub бесплатно — без VPN, оплата в рублях.

Начать бесплатно
← Все статьи