API Claude Fable 5 : Accès, Tarifs et Cas d'Usage
Claude Fable 5 est disponible en accès général via l'API. Découvrez les modalités d'accès, les tarifs, les mesures de sécurité et les cas d'usage pour les développeurs avant de router vos charges de travail.
Anthropic a publié Claude Fable 5 le 9 juin 2026. L’identifiant du modèle API est claude-fable-5. J’ai passé ces derniers jours à parcourir la documentation et à le tester sur quelques charges de travail réelles, et cet article est l’aperçu de l’accès API, de la tarification et des cas d’utilisation de Claude Fable 5 que j’aurais aimé avoir dès le premier jour.
Deux points importants à signaler d’emblée. Il s’agit du premier modèle publiquement disponible dans ce qu’Anthropic appelle la classe Mythos — le prix est le double de Claude Opus 4.8, le niveau de capacité est positionné un cran au-dessus. Et l’API Claude Fable 5 se comporte différemment des modèles Claude précédents sur certains points qui ont de l’importance pour l’intégration en production. Il vaut la peine de comprendre les différences essentielles avant de changer une seule ligne de code.
Ce que Claude Fable 5 représente pour les développeurs
L’annonce officielle d’Anthropic présente Anthropic Fable 5 comme le premier modèle de classe Mythos généralement disponible, conçu pour soutenir de longues tâches autonomes dans les domaines du génie logiciel, du travail de connaissance, de la vision et de la recherche scientifique. C’est le discours marketing. Ce qui suit, c’est ce que cela signifie en pratique.
Capacités de classe Mythos avec protections publiques
Fable 5 et Claude Mythos 5 sont le même modèle sous-jacent. La différence réside dans ce avec quoi chacun peut aider. Mythos 5 est réservé aux partenaires vérifiés via le Projet Glasswing et conserve l’ensemble complet des capacités, y compris les compétences offensives avancées en cybersécurité. Fable 5 est la version publique, qui exécute des classificateurs de sécurité qui redirigent les requêtes dans les domaines de la cybersécurité, de la biologie, de la chimie et de l’extraction des capacités du modèle vers Claude Opus 4.8 à la place.
La position d’Anthropic est que moins de 5 % des sessions déclenchent la redirection. En dehors de ces quatre domaines, les deux modèles se comportent de la même façon.
Identifiant du modèle API et plateformes prises en charge
L’identifiant du modèle API est claude-fable-5. Depuis le lancement du 9 juin, Fable 5 est disponible via l’API Claude, Claude Platform sur AWS, Amazon Bedrock, Vertex AI et Microsoft Foundry. La prise en charge par Claude Code nécessite la version v2.1.170 ou ultérieure — les versions plus anciennes n’affichent pas Fable 5 dans le sélecteur de modèles.
Pourquoi cela importe pour les charges de travail d’agents à long horizon
L’écart de capacité apparaît le plus clairement sur les tâches agentiques longues et multi-étapes. Le positionnement d’Anthropic — et la couverture des premiers benchmarks — indique une autonomie soutenue nettement supérieure à Opus 4.8 sur des tâches mesurées en heures ou en jours plutôt qu’en minutes. Pour les développeurs qui exécutent des harnais d’agents multi-étapes, cela se cumule. Pour les développeurs qui effectuent du chat en une seule passe, pas vraiment. La tarification reflète cet écart.
Accès API et disponibilité
Cinq chemins pour accéder au modèle au lancement. Chacun a ses propres particularités d’activation, mais la surface de l’API Claude Fable 5 est la même sur tous.
API Claude et Claude Platform sur AWS
L’accès direct via api.anthropic.com est simple — pointez votre SDK API Claude existant vers l’identifiant de modèle claude-fable-5, et la requête arrive sur le modèle. Le même identifiant fonctionne sur Claude Platform sur AWS via le déploiement d’Anthropic. Les notes d’intégration API publiées par Anthropic lors du lancement détaillent les différences comportementales importantes à connaître — principalement autour de la raison d’arrêt de refus et des paramètres de réflexion adaptative.
Amazon Bedrock, Vertex AI et Microsoft Foundry
Pour les équipes déjà sur un fournisseur cloud, Anthropic Fable 5 est disponible nativement sur les trois principales plateformes hyperscalaires. Bedrock nécessite un flux d’activation unique du modèle. Vertex AI requiert le consentement à l’Addendum de sécurité IA avancée et une activation au niveau du projet par région. Foundry suit l’intégration standard des modèles partenaires de Microsoft. Les détails du wrapper diffèrent. Le modèle sous-jacent est le même.
À vérifier avant de supposer : la disponibilité d’un alias Claude spécifique sur une plateforme cloud (par exemple, ce à quoi opus correspond sur Bedrock par rapport à l’API Anthropic) peut être en retard d’une génération par rapport à l’API directe. L’utilisation de la chaîne explicite claude-fable-5 évite les mauvaises surprises.
Accès Claude.ai vs accès API
À la date de publication, Fable 5 est inclus gratuitement dans les plans Pro, Max, Team et Enterprise basés sur les sièges pendant une fenêtre d’introduction du 9 juin au 22 juin 2026. Après cela, l’accès aux plans grand public passe aux crédits d’utilisation. L’API est le chemin pour les développeurs quel que soit le niveau de plan — l’accès par abonnement est destiné au chat utilisateur final, pas à l’intégration en production. Vérifiez l’état actuel dans la documentation officielle d’Anthropic si vous lisez ceci plus tard. Les fenêtres de tarification d’introduction se ferment rapidement.
Exigences de rétention des données pour les modèles couverts
Ce point est important et facile à manquer. Fable 5 et Mythos 5 sont tous deux désignés comme modèles couverts, ce qui signifie qu’une rétention des données de 30 jours s’applique et que la rétention zéro des données (ZDR) n’est pas disponible. Si un contrat ou une posture de conformité exige la ZDR, Fable 5 n’est pas une option pour ces charges de travail — vous restez sur Opus 4.8 ou antérieur, où la ZDR reste prise en charge. Veuillez consulter la documentation officielle d’Anthropic pour l’état actuel des politiques de rétention des données.
Tarification et contrôle des coûts
Le contrôle des coûts sur un modèle aussi coûteux n’est pas facultatif. La tarification du modèle raconte une histoire, mais trois chiffres déterminent la facture réelle : la tarification officielle de l’API Claude Fable 5, la configuration du cache de prompt, et la discipline sur max_tokens. Chacun se cumule.
Tarification officielle des tokens et pourquoi le coût de sortie est important
Au lancement, la tarification API publiée est de 10 $ par million de tokens d’entrée et de 50 $ par million de tokens de sortie. Exactement le double de Claude Opus 4.8 des deux côtés. Il vaut la peine de s’attarder sur le deuxième chiffre : à 50 $ par million de tokens de sortie, une seule réponse de 30 000 tokens — que Fable 5 produira volontiers sur des tâches agentiques si non plafonné — coûte 1,50 $ en sortie seulement. Les longues sessions d’agents accumulent rapidement les tokens de sortie. Plafonner max_tokens sur chaque appel API est l’intervention de contrôle des coûts la moins chère disponible.
Contexte de 1M tokens, cache de prompt et notes sur l’inférence US uniquement
La fenêtre de contexte complète de 1M tokens est incluse à la tarification standard — pas de supplément pour le contexte long. Le cache de prompt s’applique de la même façon que sur les autres modèles Claude, avec des hits de cache à 1 $ par million de tokens (90 % de réduction par rapport au tarif d’entrée standard). Pour les harnais d’agents qui envoient le même prompt système et les mêmes définitions d’outils à chaque tour, c’est la différence entre une facture courante et une facture incontrôlée.
L’inférence US uniquement est disponible avec un multiplicateur de 1,1x sur toutes les catégories de tokens pour les besoins de résidence des données. Le routage par défaut est global.
Effort, réflexion adaptative et budgets de tâches
Fable 5 utilise la réflexion adaptative — le modèle décide lui-même de la profondeur de raisonnement par requête. Les budgets de réflexion étendue d’Opus 4.8 ne s’appliquent pas. À la place, un paramètre effort équilibre la minutie par rapport aux dépenses en tokens. La sortie de réflexion elle-même est résumée plutôt que complète. Pour les développeurs qui portent des prompts depuis Opus 4.8, c’est le changement de paramètre le plus susceptible de nécessiter une attention particulière.
Quand ne pas utiliser Fable 5 pour les tâches légères
Fable 5 à 2x le prix du modèle Opus n’est pas la valeur par défaut. Pour le chat simple, la classification, la conversion de format, ou toute tâche où Opus 4.8 ou Sonnet 4.6 vous amène déjà à une qualité acceptable, ces modèles sont le bon choix. Réservez Fable 5 pour les charges de travail où l’écart de capacité justifie réellement le coût — les longues sessions agentiques, les migrations complexes de bases de code, les tâches de recherche multi-étapes. Le routage par complexité de tâche est le levier de contrôle des coûts qui compte le plus sur un mois.
Refus, repli et filtres de sécurité
Domaines sensibles pouvant déclencher les classificateurs
Les classificateurs de sécurité que Fable 5 exécute ciblent le travail de cybersécurité offensive (construction d’exploits, de logiciels malveillants, d’outils d’attaque), la conception d’armes biologiques, la conception d’armes chimiques et les techniques d’extraction des capacités du modèle. La recherche en sécurité défensive, la recherche générale de bugs en dehors de ces catégories spécifiques, et la plupart des travaux professionnels adjacents à la cybersécurité fonctionnent normalement. Des cas limites existent, et ce qui compte comme « limite » est affiné au fur et à mesure qu’Anthropic recueille des données.
Gestion de stop_reason: "refusal" en production
Lorsque les classificateurs se déclenchent, la réponse API comporte stop_reason: "refusal" plutôt qu’une complétion normale. C’est le nouveau champ que le code d’intégration doit gérer. Pour un contexte indépendant sur l’architecture de sécurité derrière le comportement de refus, la couverture du lancement par TechCrunch résume le raisonnement public d’Anthropic pour la séparation entre Fable et Mythos.
Conserver les détails d’implémentation du repli pour le guide dédié au repli
Je ne vais pas détailler les patterns de repli ici. La détection de stop_reason: "refusal", la relance sur Opus 4.8 ou un autre modèle, les implications de facturation pour les appels redirigés, la gestion structurée des erreurs — tout cela mérite son propre article. Pour l’aperçu de l’intégration, les faits pertinents sont : le classificateur existe, il est ciblé, la forme de la réponse est documentée, et les requêtes redirigées ne sont pas facturées aux tarifs Fable. Les patterns d’intégration plus profonds appartiennent à un guide dédié au repli.
Cas d’utilisation les mieux adaptés aux développeurs
Migration de base de code et codage agentique
Le cas d’utilisation le plus clair que j’ai vu est le travail de codage à long horizon — migrations sur plusieurs jours, refactorisation multi-étapes, harnais d’agents qui maintiennent le contexte et se vérifient automatiquement sur de nombreux tours. Claude Code Fable (l’intégration Fable 5 documentée dans le guide de configuration du modèle Claude Code d’Anthropic) cible exactement ce scénario : les tâches « plus grandes qu’une seule séance de travail ». Claude Code Fable brille sur l’extrémité multi-jours de ce spectre, pas sur l’extrémité ponctuelle. Pour les modifications de fichiers uniques ou les scripts rapides, Sonnet 4.6 l’emporte toujours sur le coût et la latence.
Raisonnement complexe et travail de connaissance
Les longues tâches de recherche, l’analyse de documents à l’échelle de 500 000 tokens et plus, la synthèse multi-sources. La fenêtre de contexte de 1M tokens est importante ici, mais la contrainte principale est généralement la profondeur de raisonnement sur les entrées ambiguës plutôt que la taille brute du contexte. C’est là que l’écart de capacité par rapport à Opus 4.8 se manifeste le plus clairement, d’après mes observations jusqu’à présent.
Prototypage d’applications à forte composante visuelle
Anthropic positionne Fable 5 comme à la pointe en vision — lecture de figures scientifiques, reconstruction du code source d’applications web à partir de captures d’écran, navigation dans les interfaces utilisateur avec un minimum d’échafaudage. Pour les développeurs qui prototypent des applications axées sur la vision, c’est un point de départ significatif. À vérifier pour toute charge de travail spécifique — la généralisation des benchmarks de vision est notoirement inégale, et vos captures d’écran ne sont pas le benchmark.
FAQ
L’API Claude Fable 5 est-elle disponible ?
Oui, depuis le 9 juin 2026. L’identifiant du modèle API Claude Fable 5 est claude-fable-5, accessible via l’API Claude directement, Claude Platform sur AWS, Amazon Bedrock, Vertex AI et Microsoft Foundry. Claude Code nécessite la version v2.1.170 ou ultérieure.
Quelles plateformes hébergent Claude Fable 5 ?
Cinq au lancement : l’API Claude, Claude Platform sur AWS, Amazon Bedrock, Vertex AI et Microsoft Foundry. Chaque fournisseur cloud a son propre flux d’activation — Bedrock nécessite une activation unique du modèle, Vertex AI requiert le consentement à l’Addendum de sécurité IA avancée, Foundry suit l’intégration des modèles partenaires de Microsoft. Le modèle sous-jacent est le même sur tous. Veuillez consulter la documentation officielle pour l’état actuel des exigences d’accès spécifiques à chaque plateforme.
En quoi Claude Fable 5 diffère-t-il de Claude Mythos 5 ?
Même modèle sous-jacent de classe Mythos. Fable 5 est la version publique avec les classificateurs de sécurité actifs dans les domaines de la cybersécurité, de la biologie, de la chimie et de l’extraction des capacités. Mythos 5 est réservé aux partenaires approuvés via le Projet Glasswing et fonctionne sans ces classificateurs. La comparaison Fable vs Mythos a plus de dimensions qui méritent d’être explorées, et un article de comparaison dédié couvre cela en profondeur.
Que se passe-t-il si Fable 5 refuse une requête ?
La réponse API comporte stop_reason: "refusal" au lieu d’une complétion normale. La position d’Anthropic est que cela affecte moins de 5 % des sessions, concentrées sur les quatre domaines sensibles mentionnés ci-dessus. Les développeurs doivent gérer la nouvelle raison d’arrêt dans le code de production — la détecter, et éventuellement réessayer sur Opus 4.8 ou un autre modèle. Veuillez consulter la dernière documentation d’Anthropic pour les spécifications actuelles de refus et de repli.
Conclusion
Claude Fable 5 est le premier modèle de classe Mythos que tout le monde peut appeler directement, et l’intégration de l’API Claude Fable 5 est simple — un identifiant de modèle, cinq plateformes d’hébergement, une tarification publique des tokens. Les décisions qui comptent ne portent pas sur l’accès ; elles portent sur le routage. Quand envoyer une tâche à Fable 5 plutôt qu’à un modèle moins coûteux. Quand absorber le coût 2x. Quand anticiper un refus et comment se replier. Aucune de ces questions n’est répondue en lisant une annonce.
Testez-le vous-même sur une vraie charge de travail. Cela vous en apprendra plus que tout ce que je pourrais dire.
Plus à venir sur la comparaison Fable vs Mythos et sur les patterns de repli en particulier.
Articles précédents :
