API do Claude Fable 5: Acesso, Preços e Casos de Uso
O Claude Fable 5 está disponível para uso geral através da API. Saiba mais sobre acesso, preços, salvaguardas e casos de uso para desenvolvedores antes de direcionar suas cargas de trabalho.
A Anthropic lançou o Claude Fable 5 em 9 de junho de 2026. O ID do modelo na API é claude-fable-5. Passei os últimos dias revisando a documentação e executando-o em algumas cargas de trabalho reais, e este artigo é a visão geral de acesso à API, preços e casos de uso do Claude Fable 5 que eu gostaria de ter tido no primeiro dia.
Dois pontos importantes a destacar logo de início. Este é o primeiro modelo publicamente disponível do que a Anthropic chama de classe Mythos — o preço é o dobro do Claude Opus 4.8, e a capacidade está posicionada um nível acima. Além disso, a API do Claude Fable 5 se comporta de forma diferente dos modelos Claude anteriores em algumas formas específicas que importam para integração em produção. As diferenças principais valem a pena entender antes de alterar uma única linha de código.
O que o Claude Fable 5 significa para desenvolvedores
O anúncio oficial da Anthropic apresenta o Anthropic Fable 5 como o primeiro modelo da classe Mythos geralmente disponível, desenvolvido para sustentar tarefas autônomas longas em engenharia de software, trabalho do conhecimento, visão e pesquisa científica. Essa é a linha de marketing. O que se segue é o que isso significa na prática.
Capacidade da classe Mythos com salvaguardas públicas
Fable 5 e Claude Mythos 5 são o mesmo modelo subjacente. A diferença está no que cada um ajuda. O Mythos 5 é restrito a parceiros verificados através do Project Glasswing e mantém o conjunto completo de capacidades, incluindo habilidades avançadas de cibersegurança ofensiva. O Fable 5 é o lançamento público, que executa classificadores de segurança que redirecionam solicitações nos domínios de cibersegurança, biologia, química e extração de capacidades do modelo para o Claude Opus 4.8 em vez disso.
A posição da Anthropic é que menos de 5% das sessões acionam o redirecionamento. Fora esses quatro domínios, os dois modelos se comportam da mesma forma.
ID do modelo na API e plataformas suportadas
O identificador do modelo na API é claude-fable-5. A partir do lançamento em 9 de junho, o Fable 5 está disponível através da API Claude, da Plataforma Claude na AWS, do Amazon Bedrock, do Vertex AI e do Microsoft Foundry. O suporte ao Claude Code requer a versão v2.1.170 ou posterior — versões mais antigas não exibem o Fable 5 no seletor de modelos.
Por que isso importa para cargas de trabalho de agentes de longo horizonte
A diferença de capacidade aparece com mais clareza em trabalhos agênticos longos, com múltiplas etapas. O posicionamento da Anthropic — e a cobertura inicial de benchmarks — aponta para uma autonomia sustentada notavelmente mais forte do que o Opus 4.8 em tarefas medidas em horas ou dias, em vez de minutos. Para desenvolvedores que executam harnesses de agentes em múltiplos estágios, isso se multiplica. Para desenvolvedores que executam chat único, em grande parte não faz diferença. O preço reflete essa diferença.
Acesso à API e disponibilidade
Cinco caminhos para acessar o modelo no lançamento. Cada um tem suas próprias particularidades de habilitação, mas a superfície da API do Claude Fable 5 é a mesma em todos eles.
API Claude e Plataforma Claude na AWS
O acesso direto através de api.anthropic.com é simples — aponte seu SDK da API Claude existente para o ID do modelo claude-fable-5 e a solicitação chegará ao modelo. O mesmo ID de modelo funciona na Plataforma Claude na AWS através da implantação da Anthropic. As notas de integração da API que a Anthropic publicou junto com o lançamento detalham as diferenças comportamentais que vale conhecer — principalmente em relação ao motivo de parada de recusa e parâmetros de pensamento adaptativo.
Amazon Bedrock, Vertex AI e Microsoft Foundry
Para equipes já em um provedor de nuvem, o Anthropic Fable 5 está disponível nativamente nas três principais plataformas de hiperscaladores. O Bedrock requer um fluxo único de habilitação de modelo. O Vertex AI precisa de consentimento do Advanced AI Safety Addendum e uma habilitação no nível do projeto por região. O Foundry segue o processo de integração padrão de modelos parceiros da Microsoft. Os detalhes do wrapper diferem. O modelo subjacente é o mesmo.
Vale verificar antes de assumir: a disponibilidade em plataformas de nuvem de um alias específico do Claude (por exemplo, para o que opus resolve no Bedrock versus a API da Anthropic) pode ficar uma geração atrás da API direta. Fixar na string explícita claude-fable-5 evita surpresas.
Acesso pelo Claude.ai versus acesso pela API
Na data de publicação, o Fable 5 está incluído gratuitamente nos planos Pro, Max, Team e Enterprise baseado em assentos durante uma janela introdutória de 9 de junho a 22 de junho de 2026. Após isso, o acesso nos planos de consumo muda para créditos de uso. A API é o caminho para desenvolvedores independentemente do nível do plano — o acesso por assinatura é para chat de usuário final, não para integração em produção. Verifique o estado atual na documentação oficial da Anthropic se estiver lendo isso depois. As janelas de preços introdutórios fecham rapidamente.
Requisitos de retenção de dados de Modelos Cobertos
Este ponto importa e é fácil de passar despercebido. Tanto o Fable 5 quanto o Mythos 5 são designados como Modelos Cobertos, o que significa que a retenção de dados por 30 dias se aplica e a retenção zero de dados (ZDR) não está disponível. Se um contrato ou postura de conformidade exige ZDR, o Fable 5 não é uma opção para essas cargas de trabalho — você permanece no Opus 4.8 ou anterior, onde o ZDR ainda é suportado. Consulte a documentação oficial da Anthropic para o estado atual das políticas de retenção de dados.
Preços e controles de custo
O controle de custos em um modelo tão caro não é opcional. O preço do modelo conta uma história, mas três números decidem a conta real: o preço oficial da API do Claude Fable 5, a configuração de cache de prompts e a disciplina de max_tokens. Cada um se multiplica.
Preço oficial de tokens e por que o custo de saída importa
No lançamento, o preço publicado na API é de $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída. Exatamente o dobro do Claude Opus 4.8 em ambos os lados. Vale refletir sobre o segundo número: a $50 por milhão de tokens de saída, uma única resposta de 30K tokens — que o Fable 5 produzirá facilmente em tarefas agênticas se não houver limite — custa $1,50 apenas na saída. Sessões longas de agentes acumulam saída rapidamente. Definir um limite em max_tokens em cada chamada à API é a intervenção de controle de custo mais barata disponível.
Contexto de 1M, cache de prompts e notas de inferência apenas nos EUA
A janela de contexto completa de 1M tokens está incluída no preço padrão — sem taxa adicional para contexto longo. O cache de prompts se aplica da mesma forma que em outros modelos Claude, com hits de cache a $1 por milhão de tokens (90% de desconto em relação à taxa de entrada padrão). Para harnesses de agentes que enviam o mesmo prompt de sistema e definições de ferramentas em cada turno, essa é a diferença entre uma conta rotineira e uma que sai do controle.
A inferência apenas nos EUA está disponível com um multiplicador de 1,1x em todas as categorias de tokens para necessidades de residência de dados. O roteamento padrão é global.
Esforço, pensamento adaptativo e orçamentos de tarefas
O Fable 5 usa pensamento adaptativo — o modelo decide sua própria profundidade de raciocínio por solicitação. Os orçamentos de pensamento estendido do Opus 4.8 não se aplicam. Em vez disso, um parâmetro effort equilibra minuciosidade versus gasto de tokens. A própria saída de pensamento é resumida em vez de completa. Para desenvolvedores portando prompts do Opus 4.8, essa é a mudança de parâmetro que mais provavelmente precisará de atenção.
Quando não usar o Fable 5 para tarefas leves
O Fable 5 a 2x o preço do modelo Opus não é o padrão. Para chat simples, classificação, conversão de formato ou qualquer tarefa onde o Opus 4.8 ou o Sonnet 4.6 já alcançam qualidade aceitável, esses modelos são a escolha correta. Reserve o Fable 5 para cargas de trabalho onde a diferença de capacidade realmente se paga — sessões agênticas longas, migrações complexas de código-base, tarefas de pesquisa em múltiplos estágios. Rotear por complexidade de tarefa é a alavanca de controle de custo que mais importa ao longo de um mês.
Recusas, fallback e filtros de segurança
Domínios sensíveis que podem acionar classificadores
Os classificadores de segurança que o Fable 5 executa têm como alvo trabalhos de cibersegurança ofensiva (criação de exploits, malware, ferramentas de ataque), design de armas biológicas, design de armas químicas e técnicas de extração de capacidades do modelo. Pesquisa de segurança defensiva, localização geral de bugs fora dessas categorias específicas e a maioria dos trabalhos profissionais relacionados à cibersegurança funcionam normalmente. Casos de borda existem, e o que conta como “borda” é refinado conforme a Anthropic coleta dados.
Tratando stop_reason: "refusal" em produção
Quando os classificadores são acionados, a resposta da API carrega stop_reason: "refusal" em vez de uma conclusão normal. Este é o novo campo que o código de integração precisa tratar. Para contexto independente sobre a arquitetura de segurança por trás do comportamento de recusa, a cobertura do lançamento pelo TechCrunch resume o raciocínio público da Anthropic para a divisão entre Fable e Mythos.
Mantenha os detalhes de implementação de fallback para o guia dedicado de fallback
Não vou detalhar padrões de fallback aqui. Detectar stop_reason: "refusal", repetir no Opus 4.8 versus outro modelo, implicações de cobrança para chamadas redirecionadas, tratamento estruturado de erros — esses merecem um artigo próprio. Para a visão geral de integração, os fatos relevantes são: o classificador existe, é restrito, a forma da resposta está documentada e as solicitações redirecionadas não são cobradas às taxas do Fable. Os padrões de integração mais profundos pertencem a um guia dedicado de fallback.
Casos de uso mais adequados para desenvolvedores
Migração de código-base e codificação agêntica
O caso de uso mais claro que vi é o trabalho de codificação de longo horizonte — migrações de múltiplos dias, refatoração em múltiplos estágios, harnesses de agentes que sustentam contexto e se auto-verificam ao longo de muitos turnos. O Claude Code Fable (a integração do Fable 5 documentada no guia de configuração de modelo do Claude Code da Anthropic) tem como alvo exatamente este cenário: tarefas “maiores do que uma única sessão de trabalho.” O Claude Code Fable se destaca na extremidade de múltiplos dias desse espectro, não na extremidade pontual. Para edições de arquivo único ou scripts rápidos, o Sonnet 4.6 ainda vence em custo e latência.
Raciocínio complexo e trabalho do conhecimento
Tarefas longas de pesquisa, análise de documentos na escala de 500K+ tokens, síntese de múltiplas fontes. A janela de contexto de 1M tokens importa aqui, mas a restrição vinculante geralmente é a profundidade de raciocínio em entradas ambíguas, em vez do tamanho bruto do contexto. É aqui que a diferença de capacidade em relação ao Opus 4.8 aparece com mais clareza, na minha observação até agora.
Prototipagem de aplicativos com uso intenso de visão
A Anthropic posiciona o Fable 5 como estado da arte em visão — leitura de figuras científicas, reconstrução do código-fonte de aplicativos web a partir de capturas de tela, navegação em interfaces com scaffolding mínimo. Para desenvolvedores prototipando aplicativos com foco em visão, esse é um ponto de partida significativo. A ser verificado para qualquer carga de trabalho específica — a generalização de benchmarks de visão é notoriamente irregular, e suas capturas de tela não são o benchmark.
Perguntas Frequentes
O Claude Fable 5 está disponível através da API?
Sim, desde 9 de junho de 2026. O ID do modelo da API do Claude Fable 5 é claude-fable-5, acessível através da API Claude diretamente, da Plataforma Claude na AWS, do Amazon Bedrock, do Vertex AI e do Microsoft Foundry. O Claude Code requer a versão v2.1.170 ou posterior.
Quais plataformas hospedam o Claude Fable 5?
Cinco no lançamento: a API Claude, a Plataforma Claude na AWS, o Amazon Bedrock, o Vertex AI e o Microsoft Foundry. Cada provedor de nuvem tem seu próprio fluxo de habilitação — o Bedrock precisa de uma habilitação única de modelo, o Vertex AI requer consentimento do Advanced AI Safety Addendum, o Foundry segue o processo de integração de modelos parceiros da Microsoft. O modelo subjacente é o mesmo em todos eles. Consulte a documentação oficial para o estado atual dos requisitos de acesso específicos de cada plataforma.
Como o Claude Fable 5 difere do Claude Mythos 5?
Mesmo modelo subjacente da classe Mythos. O Fable 5 é o lançamento público com classificadores de segurança ativos nos domínios de cibersegurança, biologia, química e extração de capacidades. O Mythos 5 é restrito a parceiros aprovados através do Project Glasswing e funciona sem esses classificadores. A comparação Fable versus Mythos tem mais dimensões que valem a pena explorar, e um artigo de comparação dedicado cobre isso em profundidade.
O que acontece se o Fable 5 recusar uma solicitação?
A resposta da API carrega stop_reason: "refusal" em vez de uma conclusão normal. A posição da Anthropic é que isso afeta menos de 5% das sessões, focado nos quatro domínios sensíveis acima. Os desenvolvedores precisam tratar o novo motivo de parada no código de produção — detectando-o e, opcionalmente, repetindo no Opus 4.8 ou outro modelo. Consulte a documentação mais recente da Anthropic para as especificações atuais de recusa e fallback.
Conclusão
O Claude Fable 5 é o primeiro modelo da classe Mythos que qualquer pessoa pode chamar diretamente, e a integração da API do Claude Fable 5 é simples — um ID de modelo, cinco plataformas de hospedagem, preço público de tokens. As decisões que importam não são sobre acesso; são sobre roteamento. Quando enviar uma tarefa ao Fable 5 versus um modelo mais barato. Quando absorver o custo 2x. Quando esperar uma recusa e como fazer fallback. Nenhuma dessas perguntas é respondida lendo um anúncio.
Execute-o você mesmo em uma carga de trabalho real. Isso vai te dizer mais do que qualquer coisa que eu possa dizer.
Mais a seguir sobre a comparação Fable versus Mythos e sobre padrões de fallback especificamente.
Posts anteriores:
