Claude Fable 5 выпущен: 80.3% на SWE-Bench Pro, цена в 2× от Opus 4.8, бесплатно до 22 июня
Anthropic сегодня выпустила первую публично доступную модель класса Mythos — Claude Fable 5, с защитными механизмами, которые переключаются на Opus 4.8 при высокорисковых запросах. 80.3% на SWE-Bench Pro (на 11 пунктов выше Opus 4.8). $10/$50 за 1 млн токенов. Бесплатно на планах Pro/Max до 22 июня, затем с посимвольной тарификацией.
Anthropic сегодня выпустила первую публично доступную модель класса Mythos. Claude Fable 5 стала общедоступной через Claude API, AWS Bedrock, Vertex AI и Microsoft Foundry 9 июня 2026 года — в паре с Claude Mythos 5, той же базовой моделью, но со снятыми ограничениями, доступной только участникам партнёрской программы Project Glasswing. Цены на обе модели составляют $10 за входные / $50 за выходные токены на 1 млн — ровно в 2 раза выше тарифов Claude Opus 4.8.
Самое интересное, впрочем, скрыто за заголовками. За цифрами запуска стоит неочевидный ценовой манёвр (бесплатно на Pro/Max до 22 июня, затем по кредитам), профиль бенчмарков мирового уровня, который действительно отделяет Fable 5 от предыдущего фронтира, и новое архитектурное решение — автоматизированные классификаторы безопасности, которые при срабатывании переключаются на Opus 4.8 вместо отказа, — что существенно влияет на развёртывание модели.
Что выпущено
| Деталь | Значение |
|---|---|
| Название модели | Claude Fable 5 (публичная) + Claude Mythos 5 (ограниченная) |
| ID модели в API | claude-fable-5 |
| Цена входных токенов | $10/1М токенов |
| Цена выходных токенов | $50/1М токенов |
| В сравнении с Opus 4.8 | В 2 раза дороже ($5/$25) |
| Доступность | Claude API, AWS Bedrock, Vertex AI, Microsoft Foundry |
| Доступ по подписке | Pro / Max / Team / Enterprise — бесплатно до 22 июня 2026 года |
| После 22 июня | Требуются дополнительные кредиты поверх подписки |
| Доступ к Mythos 5 | Только партнёры Project Glasswing; исследователи в области биологии — через программу доверенного доступа |
Два ценовых момента, заслуживающих отдельного внимания:
- 13-дневное бесплатное окно — главный рычаг запуска. Anthropic использует связку с подпиской, чтобы стимулировать принятие модели в первые две недели. После 22 июня та же модель на Pro/Max потребует явной покупки кредитов, что возвращает продакшн-пользователей к почарной тарификации по заявленной ставке $10/$50.
- Ценник в 2× Opus 4.8 — высокий, но разрыв в бенчмарках объясняет большую его часть (см. ниже). При $50/1М выходных токенов Fable — самая дорогая модель фронтира на рынке: примерно в 3,3× дороже Sonnet 4.6, в 5× дороже GPT-5.5 и в 5,5× дороже Gemini 3.5 Flash по выходным токенам.
Бенчмарки — и что они на самом деле показывают
Fable 5 выходит с заявлениями о превосходстве на «почти всех протестированных бенчмарках». Наиболее конкретные и поддающиеся прямому сравнению цифры, опубликованные Anthropic:
| Бенчмарк | Fable 5 | Opus 4.8 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| SWE-Bench Pro | 80,3% | 69,2% | 58,6% | 54,2% |
| FrontierCode | 29,3% | 13,4% | 5,7% | — |
Три ключевых вывода:
80,3% на SWE-Bench Pro — главная цифра. Это наиболее сложный из вариантов SWE-Bench и наиболее показательный для прогнозирования поведения модели на реальном продакшн-коде. Fable 5 опережает Opus 4.8 на 11,1 пункта, GPT-5.5 — на 21,7 пункта, Gemini 3.1 Pro — на 26,1 пункта. Это разрыв в классе, а не незначительное преимущество. Для рабочих процессов, связанных с кодом, где сравнивается качество моделей, это крупнейшее одноосевое преимущество на фронтире, зафиксированное в этом году.
FrontierCode — более показательная цифра. Этот бенчмарк нацелен на самый сложный уровень задач программирования — абстрактные алгоритмические головоломки, работу с новыми структурами данных, оптимизацию критичного по производительности кода. Fable 5 с 29,3% превосходит Opus 4.8 более чем в 2 раза и GPT-5.5 — более чем в 5 раз. На бенчмарке, где потолок фронтира составляет около 30%, такой скачок — это максимально близкое к доказательству качественного изменения возможностей, которое могут дать данные бенчмарков.
Кейсы Anthropic подкрепляют цифры. По имеющимся данным, Stripe использовала Fable 5 для завершения миграции кодовой базы объёмом 50 миллионов строк за один день. Hebbia называет Fable 5 лидером своего Finance Benchmark. IMC сообщает, что модель «справилась с их оценками торгового анализа практически в полном объёме». Это дружественные первосторонние отзывы, однако согласованность формулировки «код/финансы/научная интеллектуальная работа» от нескольких независимых клиентов — сигнал, заслуживающий внимания.
Чего нет в релизе бенчмарков: цифр Terminal-Bench, GPQA, MMLU, HumanEval, AIME. Anthropic, по всей видимости, сделала акцент на SWE-Bench Pro и FrontierCode как на ключевых метриках для кода, что согласуется с позиционированием модели как фронтира в области разработки программного обеспечения.
Ограничения безопасности — другое архитектурное решение
Причина, по которой Fable 5 вообще может выйти в публичный доступ, — три автоматизированных классификатора безопасности, которые Anthropic выстроила поверх Mythos 5:
- Кибербезопасность — блокирует наступательные кибератаки и разработку эксплойтов
- Биология/химия — переключается на Opus 4.8 для большинства запросов по биологии/химии с риском двойного использования (в том числе дизайн AAV-векторов)
- Предотвращение дистилляции — блокирует попытки извлечь возможности для конкурирующих моделей
Важное архитектурное решение: когда срабатывает ограничение, ответ обрабатывается Opus 4.8, а не просто отклоняется. Это значимый выбор с точки зрения UX. Пользователи получают полезный ответ на большинство запросов, даже когда фронтирное мышление Fable 5 закрыто проверкой безопасности. По данным Anthropic, более 95% сессий с Fable не сопровождаются переключением — то есть ограничения настроены достаточно точно, чтобы продакшн-рабочие процессы их практически не замечали.
Результаты внешнего red-teaming:
- Более 1000 часов внешнего bug bounty-тестирования — универсальных обходов не обнаружено
- Ни одного выполненного вредоносного запроса по кибербезопасности из 30 публичных техник обхода защиты в однотурных взаимодействиях
- Внешний red-teamer назвал ограничения «наиболее надёжными из всех протестированных моделей»
Для разработчиков, развёртывающих клиентские приложения, это принципиально иная операционная позиция по сравнению с отказом при срабатывании политики. Продукт можно строить вокруг модели, не проектируя запасной UX для каждого отказа по соображениям безопасности — Opus 4.8 обрабатывает длинный хвост незаметно.
Mythos 5 — и что его существование означает
Та же модель со снятыми ограничениями выходит как Mythos 5, доступная только партнёрам Project Glasswing в области кибербезопасности и расширяющаяся через программу доверенного доступа для исследователей в области биологии. Разрыв в возможностях между Fable 5 и Mythos 5 сосредоточен в трёх категориях:
- ExploitBench (кибер): Mythos 5 — 78% против 40% у Opus 4.8 (Fable 5 не проходит этот бенчмарк, поскольку киберзапросы попадают под ограничение)
- Разработка препаратов: Mythos 5 предположительно ускорил процессы проектирования белков примерно в 10 раз, при этом 9 из 14 мишеней дали кандидатов в препараты
- Генерация научных гипотез: новые гипотезы в области молекулярной биологии предпочтительнее в ~80% случаев при слепом сравнении экспертами
Существование Mythos 5 говорит о том, что базовая модель обладает существенно более широкими возможностями, чем то, что открывает Fable 5. Для большинства продакшн-рабочих процессов это невидимо, — но для исследований в области безопасности, разработки лекарств и схожих областей именно ветка Mythos является настоящим фронтиром. Публичный доступ ограничен именно потому, что Anthropic пришла к выводу, что сырая модель несёт риски двойного использования, для смягчения которых и были созданы классификаторы безопасности.
Что разрыв с паттерном Sonnet говорит вам
Две недели назад я утверждал, что исторический паттерн Anthropic — парный выпуск минорных версий Opus и Sonnet — делает выход Sonnet 4.7 более вероятным, чем Sonnet 4.8. Паттерн нарушился сильнее, чем я ожидал: ни Sonnet 4.7, ни Sonnet 4.8, а заголовочным релизом стала ветка Mythos. Opus 4.8 вышел, чтобы занять слот Pro-уровня; Fable 5 занимает совершенно новый уровень выше него.
Три интерпретации того, что это означает для линейки Claude в будущем:
- Ветка Mythos — это новый фронтир, тогда как Sonnet и Opus становятся выборами продакшн-уровня ниже него. Потолок возможностей явно поднялся.
- Именование отделилось от версионирования. В будущем стоит ожидать больше именованных веток (Mythos, Fable) и меньше триады Opus/Sonnet/Haiku. Метод предсказания выпусков моделей по строкам в исходных картах устарел.
- Разрыв ценовых уровней расширяется. Fable 5 за $10/$50 — это в 2× дороже Opus 4.8, который уже в 5× дороже Haiku 4.5. Стоимость возможностей фронтира растёт быстрее, чем стоимость возможностей продакшн-уровня, — а значит, решения о маршрутизации важнее, чем прежде.
Где Fable 5 вписывается в продакшн сегодня
Конкретные выводы для развёртывания:
Используйте Fable 5 для:
- Тяжёлых рабочих процессов с кодом, где напрямую важна производительность на SWE-Bench Pro — крупномасштабные миграции, разработка новых алгоритмов, критичные по производительности рефакторинги. Преимущество в 11 пунктов над Opus 4.8 означает измеримо лучший результат на реальных кодовых базах.
- Насыщенной визуальными данными интеллектуальной работы — извлечение структурированных данных из научных графиков, восстановление веб-приложений по скриншотам, обработка технической документации со встроенными диаграммами.
- Рассуждений в длинном контексте — позиционирование Anthropic акцентирует «сохранение фокуса в пределах миллионов токенов», что предполагает значительно лучшую кривую деградации модели на конце контекста 1М+ по сравнению с предыдущим фронтиром.
- Финансового/торгового анализа — независимые бенчмарки (Hebbia) ставят Fable 5 на первое место в финансово-специализированных оценках.
Оставайтесь на более дешёвых альтернативах для:
- Высокообъёмной / низкорисковой генерации — при $50/1М выходных токенов Fable 5 экономически нецелесообразна для генерации контента, классификации или структурированного извлечения данных. Sonnet 4.6 или Gemini 3.5 Flash справляются с этой работой примерно за 10% цены.
- Агентских рабочих процессов MCP / с оркестрацией инструментов — Gemini 3.5 Flash в настоящее время лидирует на MCP Atlas и Toolathlon при значительно меньших затратах. Сила Fable в коде не переносится автоматически на оркестрацию агентов.
- Киберзапросов или биозапросов, по которым Fable всё равно переключится — вы платите по ценам Fable за вывод Opus 4.8. Просто используйте Opus 4.8 напрямую.
Как получить доступ к Claude Fable 5 сегодня
Три пути развёртывания:
- Напрямую через Anthropic —
claude-fable-5уже доступна на Claude API, а также через AWS Bedrock, Vertex AI и Microsoft Foundry. Бесплатно на планах Pro/Max до 22 июня; после этого включается почарная тарификация по ставке $10/$50. - Через LLM-эндпоинт WaveSpeedAI — совместимый с OpenAI доступ к актуальным фронтирным текстовым моделям через единый API-ключ. Когда Fable 5 распространится на платформу, вы сможете проводить A/B-тестирование её против Opus 4.8, Sonnet 4.6, GPT-5.5 и Gemini 3.5 Flash в едином интерфейсе без смены учётных данных провайдера.
- Через маршрутизаторы провайдеров — если вы используете агрегатор (Vercel AI SDK, LangChain и т.д.), ID модели
claude-fable-5уже находится в публичном реестре моделей. Политики маршрутизации вида «использовать Fable для SWE-задач, Sonnet для всего остального» становятся изменением в одну строку конфигурации.
За чем следить в ближайшие две недели
Три сигнала:
- Переход к платному тарифу 22 июня. Когда бесплатное окно Pro/Max закроется, сигнал принятия моделей публикой станет показатель того, сколько подписчиков реально платит перерасход за Fable 5. Это наиболее чистый индикатор того, устойчива ли ценовая ставка 2× Opus 4.8 для длинного хвоста сценариев использования.
- Независимая репликация бенчмарков. Цифры SWE-Bench Pro и FrontierCode от Anthropic — первосторонние. Следите за репликацией независимыми бенчмарк-сьютами и за тем, сохранится ли преимущество в 11 пунктов над Opus 4.8 за пределами тестовых наборов, курируемых Anthropic.
- Следующий релиз Sonnet. Учитывая, что Mythos стала новой фронтирной веткой, что произойдёт с Sonnet? Обновлённый Sonnet, позиционированный против Gemini 3.5 Flash по соотношению цены/бенчмарков агентов, заново закрепит ценностный уровень в линейке Claude. Молчание о Sonnet будет сигналом того, что Anthropic оставляет продакшн-уровень на 4.6 дольше, чем подсказывает историческая периодичность.
До тех пор: Fable 5 — новый потолок, Opus 4.8 — стандартный выбор продакшн-уровня, а Sonnet 4.6 остаётся оптимальным по соотношению цены и качества. Ближайшие две недели покажут, является ли ветка Mythos разовым явлением на фронтире или новой нормой для темпа выпусков Anthropic.
