Claude Fable 5 выпущен: 80.3% на SWE-Bench Pro, цена в 2× от Opus 4.8, бесплатно до 22 июня

Anthropic сегодня выпустила первую публично доступную модель класса Mythos — Claude Fable 5, с защитными механизмами, которые переключаются на Opus 4.8 при высокорисковых запросах. 80.3% на SWE-Bench Pro (на 11 пунктов выше Opus 4.8). $10/$50 за 1 млн токенов. Бесплатно на планах Pro/Max до 22 июня, затем с посимвольной тарификацией.

By WaveSpeedAI 9 min read

Anthropic сегодня выпустила первую публично доступную модель класса Mythos. Claude Fable 5 стала общедоступной через Claude API, AWS Bedrock, Vertex AI и Microsoft Foundry 9 июня 2026 года — в паре с Claude Mythos 5, той же базовой моделью, но со снятыми ограничениями, доступной только участникам партнёрской программы Project Glasswing. Цены на обе модели составляют $10 за входные / $50 за выходные токены на 1 млн — ровно в 2 раза выше тарифов Claude Opus 4.8.

Самое интересное, впрочем, скрыто за заголовками. За цифрами запуска стоит неочевидный ценовой манёвр (бесплатно на Pro/Max до 22 июня, затем по кредитам), профиль бенчмарков мирового уровня, который действительно отделяет Fable 5 от предыдущего фронтира, и новое архитектурное решение — автоматизированные классификаторы безопасности, которые при срабатывании переключаются на Opus 4.8 вместо отказа, — что существенно влияет на развёртывание модели.

Что выпущено

ДетальЗначение
Название моделиClaude Fable 5 (публичная) + Claude Mythos 5 (ограниченная)
ID модели в APIclaude-fable-5
Цена входных токенов$10/1М токенов
Цена выходных токенов$50/1М токенов
В сравнении с Opus 4.8В 2 раза дороже ($5/$25)
ДоступностьClaude API, AWS Bedrock, Vertex AI, Microsoft Foundry
Доступ по подпискеPro / Max / Team / Enterprise — бесплатно до 22 июня 2026 года
После 22 июняТребуются дополнительные кредиты поверх подписки
Доступ к Mythos 5Только партнёры Project Glasswing; исследователи в области биологии — через программу доверенного доступа

Два ценовых момента, заслуживающих отдельного внимания:

  1. 13-дневное бесплатное окно — главный рычаг запуска. Anthropic использует связку с подпиской, чтобы стимулировать принятие модели в первые две недели. После 22 июня та же модель на Pro/Max потребует явной покупки кредитов, что возвращает продакшн-пользователей к почарной тарификации по заявленной ставке $10/$50.
  2. Ценник в 2× Opus 4.8 — высокий, но разрыв в бенчмарках объясняет большую его часть (см. ниже). При $50/1М выходных токенов Fable — самая дорогая модель фронтира на рынке: примерно в 3,3× дороже Sonnet 4.6, в 5× дороже GPT-5.5 и в 5,5× дороже Gemini 3.5 Flash по выходным токенам.

Бенчмарки — и что они на самом деле показывают

Fable 5 выходит с заявлениями о превосходстве на «почти всех протестированных бенчмарках». Наиболее конкретные и поддающиеся прямому сравнению цифры, опубликованные Anthropic:

БенчмаркFable 5Opus 4.8GPT-5.5Gemini 3.1 Pro
SWE-Bench Pro80,3%69,2%58,6%54,2%
FrontierCode29,3%13,4%5,7%

Три ключевых вывода:

80,3% на SWE-Bench Pro — главная цифра. Это наиболее сложный из вариантов SWE-Bench и наиболее показательный для прогнозирования поведения модели на реальном продакшн-коде. Fable 5 опережает Opus 4.8 на 11,1 пункта, GPT-5.5 — на 21,7 пункта, Gemini 3.1 Pro — на 26,1 пункта. Это разрыв в классе, а не незначительное преимущество. Для рабочих процессов, связанных с кодом, где сравнивается качество моделей, это крупнейшее одноосевое преимущество на фронтире, зафиксированное в этом году.

FrontierCode — более показательная цифра. Этот бенчмарк нацелен на самый сложный уровень задач программирования — абстрактные алгоритмические головоломки, работу с новыми структурами данных, оптимизацию критичного по производительности кода. Fable 5 с 29,3% превосходит Opus 4.8 более чем в 2 раза и GPT-5.5 — более чем в 5 раз. На бенчмарке, где потолок фронтира составляет около 30%, такой скачок — это максимально близкое к доказательству качественного изменения возможностей, которое могут дать данные бенчмарков.

Кейсы Anthropic подкрепляют цифры. По имеющимся данным, Stripe использовала Fable 5 для завершения миграции кодовой базы объёмом 50 миллионов строк за один день. Hebbia называет Fable 5 лидером своего Finance Benchmark. IMC сообщает, что модель «справилась с их оценками торгового анализа практически в полном объёме». Это дружественные первосторонние отзывы, однако согласованность формулировки «код/финансы/научная интеллектуальная работа» от нескольких независимых клиентов — сигнал, заслуживающий внимания.

Чего нет в релизе бенчмарков: цифр Terminal-Bench, GPQA, MMLU, HumanEval, AIME. Anthropic, по всей видимости, сделала акцент на SWE-Bench Pro и FrontierCode как на ключевых метриках для кода, что согласуется с позиционированием модели как фронтира в области разработки программного обеспечения.

Ограничения безопасности — другое архитектурное решение

Причина, по которой Fable 5 вообще может выйти в публичный доступ, — три автоматизированных классификатора безопасности, которые Anthropic выстроила поверх Mythos 5:

  1. Кибербезопасность — блокирует наступательные кибератаки и разработку эксплойтов
  2. Биология/химия — переключается на Opus 4.8 для большинства запросов по биологии/химии с риском двойного использования (в том числе дизайн AAV-векторов)
  3. Предотвращение дистилляции — блокирует попытки извлечь возможности для конкурирующих моделей

Важное архитектурное решение: когда срабатывает ограничение, ответ обрабатывается Opus 4.8, а не просто отклоняется. Это значимый выбор с точки зрения UX. Пользователи получают полезный ответ на большинство запросов, даже когда фронтирное мышление Fable 5 закрыто проверкой безопасности. По данным Anthropic, более 95% сессий с Fable не сопровождаются переключением — то есть ограничения настроены достаточно точно, чтобы продакшн-рабочие процессы их практически не замечали.

Результаты внешнего red-teaming:

  • Более 1000 часов внешнего bug bounty-тестирования — универсальных обходов не обнаружено
  • Ни одного выполненного вредоносного запроса по кибербезопасности из 30 публичных техник обхода защиты в однотурных взаимодействиях
  • Внешний red-teamer назвал ограничения «наиболее надёжными из всех протестированных моделей»

Для разработчиков, развёртывающих клиентские приложения, это принципиально иная операционная позиция по сравнению с отказом при срабатывании политики. Продукт можно строить вокруг модели, не проектируя запасной UX для каждого отказа по соображениям безопасности — Opus 4.8 обрабатывает длинный хвост незаметно.

Mythos 5 — и что его существование означает

Та же модель со снятыми ограничениями выходит как Mythos 5, доступная только партнёрам Project Glasswing в области кибербезопасности и расширяющаяся через программу доверенного доступа для исследователей в области биологии. Разрыв в возможностях между Fable 5 и Mythos 5 сосредоточен в трёх категориях:

  • ExploitBench (кибер): Mythos 5 — 78% против 40% у Opus 4.8 (Fable 5 не проходит этот бенчмарк, поскольку киберзапросы попадают под ограничение)
  • Разработка препаратов: Mythos 5 предположительно ускорил процессы проектирования белков примерно в 10 раз, при этом 9 из 14 мишеней дали кандидатов в препараты
  • Генерация научных гипотез: новые гипотезы в области молекулярной биологии предпочтительнее в ~80% случаев при слепом сравнении экспертами

Существование Mythos 5 говорит о том, что базовая модель обладает существенно более широкими возможностями, чем то, что открывает Fable 5. Для большинства продакшн-рабочих процессов это невидимо, — но для исследований в области безопасности, разработки лекарств и схожих областей именно ветка Mythos является настоящим фронтиром. Публичный доступ ограничен именно потому, что Anthropic пришла к выводу, что сырая модель несёт риски двойного использования, для смягчения которых и были созданы классификаторы безопасности.

Что разрыв с паттерном Sonnet говорит вам

Две недели назад я утверждал, что исторический паттерн Anthropic — парный выпуск минорных версий Opus и Sonnet — делает выход Sonnet 4.7 более вероятным, чем Sonnet 4.8. Паттерн нарушился сильнее, чем я ожидал: ни Sonnet 4.7, ни Sonnet 4.8, а заголовочным релизом стала ветка Mythos. Opus 4.8 вышел, чтобы занять слот Pro-уровня; Fable 5 занимает совершенно новый уровень выше него.

Три интерпретации того, что это означает для линейки Claude в будущем:

  1. Ветка Mythos — это новый фронтир, тогда как Sonnet и Opus становятся выборами продакшн-уровня ниже него. Потолок возможностей явно поднялся.
  2. Именование отделилось от версионирования. В будущем стоит ожидать больше именованных веток (Mythos, Fable) и меньше триады Opus/Sonnet/Haiku. Метод предсказания выпусков моделей по строкам в исходных картах устарел.
  3. Разрыв ценовых уровней расширяется. Fable 5 за $10/$50 — это в 2× дороже Opus 4.8, который уже в 5× дороже Haiku 4.5. Стоимость возможностей фронтира растёт быстрее, чем стоимость возможностей продакшн-уровня, — а значит, решения о маршрутизации важнее, чем прежде.

Где Fable 5 вписывается в продакшн сегодня

Конкретные выводы для развёртывания:

Используйте Fable 5 для:

  • Тяжёлых рабочих процессов с кодом, где напрямую важна производительность на SWE-Bench Pro — крупномасштабные миграции, разработка новых алгоритмов, критичные по производительности рефакторинги. Преимущество в 11 пунктов над Opus 4.8 означает измеримо лучший результат на реальных кодовых базах.
  • Насыщенной визуальными данными интеллектуальной работы — извлечение структурированных данных из научных графиков, восстановление веб-приложений по скриншотам, обработка технической документации со встроенными диаграммами.
  • Рассуждений в длинном контексте — позиционирование Anthropic акцентирует «сохранение фокуса в пределах миллионов токенов», что предполагает значительно лучшую кривую деградации модели на конце контекста 1М+ по сравнению с предыдущим фронтиром.
  • Финансового/торгового анализа — независимые бенчмарки (Hebbia) ставят Fable 5 на первое место в финансово-специализированных оценках.

Оставайтесь на более дешёвых альтернативах для:

  • Высокообъёмной / низкорисковой генерации — при $50/1М выходных токенов Fable 5 экономически нецелесообразна для генерации контента, классификации или структурированного извлечения данных. Sonnet 4.6 или Gemini 3.5 Flash справляются с этой работой примерно за 10% цены.
  • Агентских рабочих процессов MCP / с оркестрацией инструментов — Gemini 3.5 Flash в настоящее время лидирует на MCP Atlas и Toolathlon при значительно меньших затратах. Сила Fable в коде не переносится автоматически на оркестрацию агентов.
  • Киберзапросов или биозапросов, по которым Fable всё равно переключится — вы платите по ценам Fable за вывод Opus 4.8. Просто используйте Opus 4.8 напрямую.

Как получить доступ к Claude Fable 5 сегодня

Три пути развёртывания:

  1. Напрямую через Anthropicclaude-fable-5 уже доступна на Claude API, а также через AWS Bedrock, Vertex AI и Microsoft Foundry. Бесплатно на планах Pro/Max до 22 июня; после этого включается почарная тарификация по ставке $10/$50.
  2. Через LLM-эндпоинт WaveSpeedAI — совместимый с OpenAI доступ к актуальным фронтирным текстовым моделям через единый API-ключ. Когда Fable 5 распространится на платформу, вы сможете проводить A/B-тестирование её против Opus 4.8, Sonnet 4.6, GPT-5.5 и Gemini 3.5 Flash в едином интерфейсе без смены учётных данных провайдера.
  3. Через маршрутизаторы провайдеров — если вы используете агрегатор (Vercel AI SDK, LangChain и т.д.), ID модели claude-fable-5 уже находится в публичном реестре моделей. Политики маршрутизации вида «использовать Fable для SWE-задач, Sonnet для всего остального» становятся изменением в одну строку конфигурации.

За чем следить в ближайшие две недели

Три сигнала:

  1. Переход к платному тарифу 22 июня. Когда бесплатное окно Pro/Max закроется, сигнал принятия моделей публикой станет показатель того, сколько подписчиков реально платит перерасход за Fable 5. Это наиболее чистый индикатор того, устойчива ли ценовая ставка 2× Opus 4.8 для длинного хвоста сценариев использования.
  2. Независимая репликация бенчмарков. Цифры SWE-Bench Pro и FrontierCode от Anthropic — первосторонние. Следите за репликацией независимыми бенчмарк-сьютами и за тем, сохранится ли преимущество в 11 пунктов над Opus 4.8 за пределами тестовых наборов, курируемых Anthropic.
  3. Следующий релиз Sonnet. Учитывая, что Mythos стала новой фронтирной веткой, что произойдёт с Sonnet? Обновлённый Sonnet, позиционированный против Gemini 3.5 Flash по соотношению цены/бенчмарков агентов, заново закрепит ценностный уровень в линейке Claude. Молчание о Sonnet будет сигналом того, что Anthropic оставляет продакшн-уровень на 4.6 дольше, чем подсказывает историческая периодичность.

До тех пор: Fable 5 — новый потолок, Opus 4.8 — стандартный выбор продакшн-уровня, а Sonnet 4.6 остаётся оптимальным по соотношению цены и качества. Ближайшие две недели покажут, является ли ветка Mythos разовым явлением на фронтире или новой нормой для темпа выпусков Anthropic.

Поделиться