Claude Fable 5 출시: SWE-Bench Pro 80.3%, Opus 4.8 대비 2× 가격, 6월 22일까지 무료
Anthropic이 오늘 첫 번째 공개 Mythos 클래스 모델인 Claude Fable 5를 출시했습니다. 고위험 프롬프트에서 Opus 4.8로 폴백하는 안전장치가 포함되어 있으며, SWE-Bench Pro 80.3%(Opus 4.8 대비 11점 높음), 100만 토큰당 $10/$50 가격이 책정되었습니다. Pro/Max 플랜에서 6월 22일까지 무료 제공 후 크레딧 방식으로 전환됩니다.
Anthropic은 오늘 최초의 공개 Mythos급 모델을 출시했습니다. Claude Fable 5는 2026년 6월 9일 Claude API, AWS Bedrock, Vertex AI, Microsoft Foundry에서 일반 공개되었으며 — Claude Mythos 5와 함께 출시되었습니다. Mythos 5는 동일한 기반 모델이지만 안전 장치가 해제된 버전으로, Project Glasswing 파트너 프로그램 내부에서만 운용됩니다. 두 모델의 가격은 입력 $10 / 출력 $50 per 1M 토큰으로 책정되었으며 — 이는 Claude Opus 4.8 요금의 정확히 2배입니다.
그러나 흥미로운 부분은 헤드라인 수치에 있지 않습니다. 출시 숫자 이면에는 의미 있는 가격 구조(6월 22일까지 Pro/Max에서 무료, 이후 크레딧 과금), 이전 프론티어와 Fable 5를 실질적으로 구분하는 최첨단 벤치마크 프로파일, 그리고 새로운 아키텍처적 선택 — 거부 대신 Opus 4.8로 폴백하는 자동화된 분류기 안전 장치 — 이 있으며, 이는 배포 방식에 실질적인 영향을 미칩니다.
출시 내용
| 항목 | 값 |
|---|---|
| 모델명 | Claude Fable 5 (공개) + Claude Mythos 5 (제한) |
| API 모델 ID | claude-fable-5 |
| 입력 가격 | $10/1M 토큰 |
| 출력 가격 | $50/1M 토큰 |
| Opus 4.8 대비 가격 | 2× ($5/$25) |
| 가용성 | Claude API, AWS Bedrock, Vertex AI, Microsoft Foundry |
| 구독 접근 | Pro / Max / Team / Enterprise — 2026년 6월 22일까지 무료 |
| 6월 22일 이후 | 구독 외 추가 사용 크레딧 필요 |
| Mythos 5 접근 | Project Glasswing 파트너 전용; 신뢰 접근 프로그램을 통한 생물학 연구자 포함 |
주목할 만한 두 가지 가격 사항:
- 13일간의 무료 기간은 출시 레버입니다. Anthropic은 처음 2주 동안 채택을 유도하기 위해 구독 번들을 활용하고 있습니다. 6월 22일 이후에는 Pro/Max에서 동일한 모델을 사용하려면 명시적인 크레딧 구매가 필요하며, 이는 프로덕션 사용자를 $10/$50 헤드라인 요금의 토큰당 과금 방식으로 되돌립니다.
- Opus 4.8 대비 2배 가격은 가파르지만, 벤치마크 격차가 대부분을 설명합니다(아래 참조). 출력 $50/1M 토큰으로 Fable는 현재 시장에서 가장 비싼 프론티어 모델입니다 — 출력 토큰 기준 Sonnet 4.6의 약 3.3배, GPT-5.5의 5배, Gemini 3.5 Flash의 5.5배입니다.
벤치마크 — 실제로 보여주는 것
Fable 5는 “거의 모든 테스트된 벤치마크”에서 최첨단 성능을 달성했다고 주장합니다. Anthropic이 공개한 가장 구체적이고 직접 비교 가능한 수치:
| 벤치마크 | Fable 5 | Opus 4.8 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| SWE-Bench Pro | 80.3% | 69.2% | 58.6% | 54.2% |
| FrontierCode | 29.3% | 13.4% | 5.7% | — |
세 가지 해석:
SWE-Bench Pro 80.3%가 핵심 수치입니다. 이는 SWE-Bench 변형 중 가장 어렵고 실제 프로덕션 코드에서의 모델 성능을 가장 잘 예측하는 벤치마크입니다. Fable 5는 Opus 4.8보다 11.1포인트, GPT-5.5보다 21.7포인트, Gemini 3.1 Pro보다 26.1포인트 앞섭니다. 이는 단순한 미미한 우위가 아니라 계층적 격차입니다. 모델 품질을 정면 비교하는 코딩 워크플로에서, 이는 올해 보고된 가장 큰 단일 축 프론티어 격차입니다.
FrontierCode가 더 시사하는 바가 큰 수치입니다. 이 벤치마크는 가장 어려운 프로그래밍 문제 — 추상적 알고리즘 퍼즐, 새로운 데이터 구조 작업, 성능 최적화 — 를 대상으로 합니다. 29.3%를 기록한 Fable 5는 Opus 4.8의 2배 이상, GPT-5.5의 5배 이상입니다. 프론티어 상한선이 약 30%인 벤치마크에서 이런 도약은 벤치마크 데이터가 제공할 수 있는 단계적 역량 변화의 증거에 가장 가까운 것입니다.
Anthropic의 사례 연구가 수치를 뒷받침합니다. Stripe는 Fable 5를 사용해 5천만 줄 코드베이스 마이그레이션을 하루 만에 완료했다고 전해집니다. Hebbia는 Fable 5가 자체 Finance Benchmark에서 최고 점수를 기록했다고 보고합니다. IMC는 “거래 분석 평가를 거의 전 항목에서 완벽히 수행했다”고 말합니다. 이는 자사 친화적 추천사이지만, 여러 독립 고객에 걸쳐 “코드/금융/과학적 지식 업무” 프레이밍이 일관된다는 점이 주목할 만한 신호입니다.
벤치마크 발표에 없는 것: Terminal-Bench 수치, GPQA, MMLU, HumanEval, AIME. Anthropic은 SWE-Bench Pro와 FrontierCode를 헤드라인 코딩 지표로 우선시한 것으로 보이며, 이는 소프트웨어 엔지니어링 프론티어로서의 모델 포지셔닝과 일치합니다.
안전 장치 — 다른 아키텍처적 선택
Fable 5가 공개적으로 출시될 수 있는 이유는 Anthropic이 Mythos 5 위에 구축한 세 가지 자동화된 분류기 안전 장치 덕분입니다:
- 사이버보안 — 공격적 사이버 작업 및 익스플로잇 개발 차단
- 생물학/화학 — 이중 사용 위험이 있는 대부분의 생물/화학 요청에서 Opus 4.8으로 폴백 (AAV 설계 포함)
- 증류 방지 — 경쟁 모델에 역량을 추출하려는 시도 차단
주목할 만한 아키텍처적 선택: 안전 장치가 트리거될 때 응답은 거부되는 것이 아니라 Opus 4.8이 처리합니다. 이는 의미 있는 UX 선택입니다. Fable 5의 프론티어 추론이 안전 검토 뒤에 잠겨 있어도 사용자는 대부분의 쿼리에 사용 가능한 답변을 받습니다. Anthropic은 Fable 세션의 95% 이상에서 폴백이 전혀 발생하지 않는다고 보고합니다 — 즉 안전 장치가 프로덕션 워크플로가 이를 거의 인식하지 못할 만큼 정밀하게 조정되어 있음을 의미합니다.
외부 레드팀 결과:
- 1,000시간 이상의 외부 버그 바운티 테스트 — 범용 탈옥 방법 미발견
- 30가지 공개 탈옥 기법에 걸쳐 단일 턴 사이버보안 유해 요청 준수 사례 제로
- 외부 레드팀원이 “테스트한 모델 중 가장 견고한 안전 장치”라고 평가
고객 대면 애플리케이션을 배포하는 개발자에게, 이는 정책 트리거 시 거부하는 방식과는 다른 운영 자세입니다. 모든 안전 거부에 대한 폴백 UX를 설계하지 않고도 이 모델을 기반으로 제품을 구축할 수 있습니다 — Opus 4.8이 긴 꼬리를 눈에 띄지 않게 처리합니다.
Mythos 5 — 그 존재가 시사하는 것
안전 장치가 해제된 동일한 모델이 Mythos 5로 출시되어, Project Glasswing 사이버보안 파트너와 생물학 연구자를 위한 신뢰 접근 프로그램을 통해 제공됩니다. Fable 5와 Mythos 5 간의 역량 격차는 세 가지 카테고리에 집중되어 있습니다:
- ExploitBench (사이버): Mythos 5 78% vs Opus 4.8의 40% (Fable 5는 사이버 프롬프트가 안전 장치에 걸려 이 벤치마크를 실행하지 않음)
- 신약 설계: Mythos 5는 단백질 설계 프로세스를 ~10배 가속했으며, 14개 타깃 중 9개에서 약물 후보 도출
- 과학적 가설 생성: 맹검 전문가 비교에서 새로운 분자생물학 가설이 ~80% 선호
Mythos 5의 존재는 기반 모델이 Fable 5가 노출하는 것보다 실질적으로 더 강력한 역량을 가지고 있음을 알려줍니다. 대부분의 프로덕션 워크플로에서는 이것이 보이지 않지만 — 보안 연구, 신약 발견 등의 분야에서는 Mythos 브랜치가 실제 프론티어가 있는 곳입니다. 공개 접근은 Anthropic이 원시 모델에 분류기 안전 장치가 완화하기 위해 존재하는 이중 사용 위험이 있다고 결론 내렸기 때문에 특별히 제한됩니다.
Sonnet 패턴 이탈이 말해주는 것
2주 전 저는 Anthropic의 역사적 패턴인 Opus와 Sonnet 마이너 버전 쌍 출시가 Sonnet 4.8보다 Sonnet 4.7 출시를 더 가능성 있게 만든다고 주장했습니다. 패턴은 예상보다 더 크게 깨졌습니다: Sonnet 4.7도 없고, Sonnet 4.8도 없고, 이제 Mythos 브랜치가 헤드라인 출시가 되었습니다. Opus 4.8은 Pro 계층 슬롯을 채우기 위해 출시되었고, Fable 5는 그 위에 완전히 새로운 계층을 차지합니다.
이것이 앞으로의 Claude 라인업에 의미하는 바에 대한 세 가지 해석:
- Mythos 브랜치가 새로운 프론티어이며, Sonnet과 Opus는 그 아래 프로덕션 계층 선택지입니다. 역량 상한선이 눈에 띄게 높아졌습니다.
- 네이밍이 버저닝에서 분리되었습니다. 앞으로는 더 많은 명명된 브랜치(Mythos, Fable)와 Opus/Sonnet/Haiku 3인조는 줄어들 것으로 예상됩니다. 소스맵 내 문자열로 모델 출시를 예측하는 방식은 끝났습니다.
- 가격 계층 분리가 확대되고 있습니다. Fable 5의 $10/$50는 이미 Haiku 4.5의 5배였던 Opus 4.8의 2배입니다. 프론티어 역량의 비용이 프로덕션급 역량의 비용보다 빠르게 상승하고 있습니다 — 즉 라우팅 결정이 이전보다 더 중요해졌습니다.
오늘 프로덕션에서 Fable 5의 위치
구체적인 배포 관점:
Fable 5를 사용해야 할 때:
- SWE-Bench Pro 성능이 직접적으로 중요한 코드 집약적 워크플로 — 대규모 마이그레이션, 새로운 알고리즘 작업, 성능 최적화 리팩토링. Opus 4.8 대비 11포인트 우위는 실제 코드베이스에서 측정 가능한 더 나은 출력으로 이어집니다.
- 비전이 풍부한 지식 업무 — 과학 그림에서 구조화된 데이터 추출, 스크린샷으로 웹앱 재구성, 내장 다이어그램이 있는 기술 문서 처리.
- 장문 컨텍스트 추론 — Anthropic의 프레이밍은 “수백만 토큰에 걸쳐 집중력 유지”를 강조하며, 이는 1M+ 컨텍스트 끝에서 모델의 성능 저하 곡선이 이전 프론티어보다 의미 있게 낫다는 것을 시사합니다.
- 금융/거래 분석 — 독립 벤치마크(Hebbia)에서 Fable 5가 금융 특화 평가 최상위에 위치합니다.
더 저렴한 대안을 유지해야 할 때:
- 대량/저위험 생성 — 출력 $50/1M 토큰으로 Fable 5는 콘텐츠 생성, 분류, 구조화된 추출에 비경제적입니다. Sonnet 4.6이나 Gemini 3.5 Flash는 약 10% 비용으로 이 작업을 수행합니다.
- MCP / 도구 오케스트레이션 에이전트 워크플로 — Gemini 3.5 Flash가 현재 훨씬 낮은 비용으로 MCP Atlas와 Toolathlon을 리드하고 있습니다. Fable의 코딩 강점이 에이전트 오케스트레이션 강점으로 자동 이어지지는 않습니다.
- Fable가 어차피 폴백할 사이버 또는 생물 쿼리 — Fable 가격을 내고 Opus 4.8 출력을 받는 것입니다. Opus 4.8을 직접 사용하세요.
오늘 Claude Fable 5에 접근하는 방법
세 가지 배포 경로:
- Anthropic 직접 경유 —
claude-fable-5는 Claude API와 AWS Bedrock, Vertex AI, Microsoft Foundry에서 라이브입니다. 6월 22일까지 Pro/Max 플랜에서 무료; 이후 $10/$50로 토큰당 과금이 시작됩니다. - WaveSpeedAI LLM 엔드포인트 경유 — 단일 API 키로 현재 프론티어 텍스트 모델에 OpenAI 호환 접근. Fable 5가 플랫폼에 전파되면 프로바이더 자격증명을 교체하지 않고도 동일한 인터페이스에서 Opus 4.8, Sonnet 4.6, GPT-5.5, Gemini 3.5 Flash와 A/B 테스트할 수 있게 됩니다.
- 프로바이더 라우터 경유 — 애그리게이터(Vercel AI SDK, LangChain 등)를 사용 중이라면
claude-fable-5모델 ID가 이미 공개 모델 레지스트리에 있습니다. “SWE 집약적 작업에는 Fable, 나머지는 Sonnet 사용” 같은 라우팅 정책은 한 줄 설정 변경이 됩니다.
앞으로 2주간 주목할 것
세 가지 신호:
- 6월 22일 가격 전환. 무료 Pro/Max 기간이 끝나면, 공개 채택 신호는 Fable 5를 위해 실제로 초과 요금을 지불하는 구독자 수가 됩니다. 이것이 2× Opus 4.8 가격이 긴 꼬리 사용 사례에서 지속 가능한지에 대한 가장 명확한 판단 기준입니다.
- 독립적인 벤치마크 재현. Anthropic의 SWE-Bench Pro와 FrontierCode 수치는 자사 발표입니다. 독립 벤치마크 스위트의 재현을 주시하세요 — 그리고 Opus 4.8 대비 11포인트 격차가 Anthropic이 선별한 테스트 세트 외부에서도 유지되는지 확인하세요.
- 다음 Sonnet 출시. Mythos가 새로운 프론티어 브랜치가 된 상황에서 Sonnet에는 어떤 일이 일어날까요? 비용/에이전트 벤치마크에서 Gemini 3.5 Flash에 맞서 포지셔닝된 업데이트된 Sonnet은 Claude 라인업의 가치 계층을 재정립할 것입니다. Sonnet에 대한 침묵은 Anthropic이 역사적 출시 주기가 시사하는 것보다 더 오래 프로덕션 계층을 4.6에 유지할 것임을 신호할 것입니다.
그때까지: Fable 5가 새로운 상한선이고, Opus 4.8이 프로덕션 기본값이며, Sonnet 4.6이 가치 선택지로 남아있습니다. 앞으로 2주가 Mythos 브랜치가 일회성 프론티어인지 Anthropic 출시 주기의 새로운 표준인지 알려줄 것입니다.
출처: Anthropic의 Fable 5 / Mythos 5 발표, The Decoder 벤치마크 분석, TechCrunch 출시 및 안전 맥락, CNBC 커버리지, Amazon Bedrock 가용성.
