Tarifs de Claude Mythos 5 et compromis en production
Claude Mythos 5 et Fable 5 utilisent une tarification API premium. Découvrez les compromis de coûts, les limites d'accès et quand les développeurs devraient router les tâches ailleurs.
Un article sur la tarification qui s’est transformé en article sur l’approvisionnement à mi-chemin. Voici comment je budgéterais quand même.
J’ai essayé de router une tâche d’agent longue durée vers Fable 5 la semaine dernière et j’ai obtenu une erreur. Pas une limite de débit. Pas un blocage de facturation. Le modèle était tout simplement… disparu. Fable 5 et Mythos 5 avaient tous deux été retirés pour tous les clients deux jours plus tôt, le 12 juin, suite à une directive d’exportation du gouvernement américain. Donc avant de vous dire quoi que ce soit sur la tarification de Claude Mythos 5, je dois vous dire ce que le prix affiché ne dira pas : à partir de mi-juin 2026, vous ne pouvez pas réellement acheter l’accès pour l’utiliser. Cela change la façon dont vous devriez interpréter chaque chiffre ci-dessous.
C’est un article sur les coûts, mais c’est aussi un bilan de réalité. Je vous donnerai les tarifs par token, la distinction Fable vs Mythos, comment cela se compare à Opus 4.8, et les contrôles de production qui empêchent les dépenses de niveau frontier de dévorer votre mois. Je vous dirai aussi où les calculs cessent de s’appliquer. Parce qu’en ce moment, une bonne partie d’entre eux ne s’appliquent pas.
La version en 30 secondes
Si vous sautez tout le reste, voici l’essentiel pour décider :
- Prix catalogue pour Fable 5 et Mythos 5 : 10 $ par million de tokens en entrée, 50 $ par million de tokens en sortie. Même tarif. La différence de nom concerne les garde-fous, pas le coût.
- C’est exactement 2x Claude Opus 4.8 (5 $ / 25 $). La sortie est la moitié coûteuse — 5x le tarif d’entrée — donc la longueur des réponses impacte votre facture plus que la taille des prompts.
- Mythos 5 n’a jamais été quelque chose que vous pouviez simplement acheter. Il est réservé aux partenaires Project Glasswing. Fable 5 était la version publique.
- Et depuis le 12 juin 2026, les deux sont suspendus pour tous les clients dans l’attente d’une directive gouvernementale. Opus 4.8 et tout ce qui est en dessous ne sont pas affectés.
Donc la réponse honnête à « combien coûte Claude Mythos 5 » est en deux parties : le tarif est de 10 $/50 $, et l’accès est actuellement nul. Ne budgétisez pour ce modèle que si vous êtes prêt à ce que la date de restauration soit repoussée.
Ce que signifie vraiment la tarification de Claude Mythos 5
Tarification officielle pour Fable 5 et Mythos 5
Anthropic a tarifé les deux modèles de classe Mythos de manière identique. D’après l’annonce officielle de lancement, la tarification pour les deux modèles est de 10 $ par million de tokens en entrée et 50 $ par million de tokens en sortie, et les développeurs peuvent utiliser claude-fable-5 via l’API Claude. Les identifiants de modèle sont claude-fable-5 et claude-mythos-5.
Un détail important pour la budgétisation : le côté entrée bénéficie de la remise existante sur la mise en cache des prompts. Selon la page produit de Fable, Claude Fable 5 est tarifé à 10 $ par million de tokens en entrée et 50 $ par million de tokens en sortie, avec la remise existante de 90 % sur les tokens d’entrée pour la mise en cache des prompts, et l’inférence exclusivement américaine est disponible à un tarif de 1,1x pour les tokens d’entrée et de sortie. Si vous rejouez beaucoup de contexte statique — prompts système, documents récupérés, schémas d’outils — la mise en cache fait vraiment son travail ici. Plus de détails ci-dessous.
Comment la tarification actuelle se compare à Mythos Preview
Le tarif de 10 $/50 $ est en réalité une réduction. Le niveau frontier restreint d’origine, Claude Mythos Preview, était bien plus élevé. Anthropic présente le nouveau tarif comme inférieur à la moitié du prix de Claude Mythos Preview, et des rapports ont estimé que le Preview était à environ 25 $/125 $ par million de tokens. Donc la tendance est ce qui est intéressant — l’inférence de niveau frontier devient moins chère à mesure que la capacité augmente, pas plus chère. C’est la bonne chose à extrapoler. Le chiffre spécifique que vous devriez considérer comme provisoire, car il a déjà bougé une fois.
Pourquoi le statut d’accès change la question de tarification
C’est ici que je dois rompre le rythme habituel « voici le tarif, allez construire ». Mythos 5 a toujours été un modèle restreint, déployé via Project Glasswing. Claude Mythos 5 est réservé aux partenaires Glasswing, avec certains garde-fous levés, et bientôt à certains chercheurs en biologie, jusqu’à ce que le programme d’accès de confiance élargi soit disponible. Si vous n’êtes pas un défenseur cyber du gouvernement américain ou une organisation de recherche biomédicale approuvée, Mythos 5 n’allait jamais apparaître dans votre console. La version que vous auriez réellement utilisée était Fable 5.
Et ensuite les deux ont été retirés. Le 12 juin, Anthropic a déclaré que le gouvernement américain avait émis une directive de contrôle des exportations pour suspendre tout accès à Fable 5 et Mythos 5 par tout ressortissant étranger, et l’effet net est que l’accès doit être désactivé pour tous les clients, tandis que l’accès à tous les autres modèles Anthropic n’est pas affecté. Anthropic dit être en désaccord avec la directive et travaille à restaurer l’accès. Je n’ai aucune idée de quand cela arrivera, et personne en dehors de la salle non plus. Donc : le prix est réel, l’accès ne l’est pas — aujourd’hui.
Tarification vs coût réel de la charge de travail
Le tarif affiché est le chiffre le moins utile pour la planification. Ce que vous payez réellement, c’est tarif × tokens, et sur les modèles de classe Mythos, le nombre de tokens se comporte différemment que sur les modèles plus petits. Fable 5 est conçu pour le travail à long horizon — le genre de tâche qui s’exécute pendant des heures et génère beaucoup de sortie. C’est exactement le profil où un multiplicateur de sortie de 5x se cumule. Un modèle qui est « seulement » 2x Opus sur le papier peut être 3-4x sur la facture si vos tâches sont intensives en sortie et que vous les laissez s’exécuter sans contrainte.
Côté positif : Anthropic et les premiers clients rapportent que Fable 5 est plus efficace en tokens sur les raisonnements complexes. Un partenaire a déclaré que Fable 5 a accompli une tâche de recherche en physique frontier en 36 heures en utilisant un tiers des tokens de raisonnement qu’il a fallu à GPT-5.5 quatre jours pour égaler. Si vous utilisez genuinement moins de tokens pour atteindre le même résultat, l’écart de coût effectif se réduit ou s’inverse. Cette efficacité apparaît sur les raisonnements complexes multi-étapes, pas sur les requêtes courtes — donc le ROI est lié à la forme de la tâche, pas uniforme.
Fable 5 vs Mythos 5 : la réalité des coûts
Même prix affiché, modèle d’accès différent
Je vais le dire clairement car le nommage est déroutant : Fable 5 et Mythos 5 sont le même modèle sous-jacent au même prix. La propre formulation d’Anthropic est que Mythos 5 est le même modèle que Fable 5 mais avec certains garde-fous levés dans certains domaines. La distinction concerne les classificateurs de sécurité, pas les niveaux de capacité et pas un niveau de prix. Donc « lequel est moins cher » est la mauvaise question. Il n’y en a pas de moins cher.
Pourquoi la plupart des équipes évalueraient Fable 5 en premier
Pour quiconque n’est pas un partenaire Glasswing, le choix n’a jamais vraiment été un choix — Fable 5 était la seule porte. Ce qu’il faut comprendre sur le comportement de coût de Fable, c’est le mécanisme de repli, que la documentation API de Fable 5 détaille pour les intégrations. Lorsque ses classificateurs signalent une requête, la réponse est automatiquement gérée par Claude Opus 4.8 à la place, et plus de 95 % des sessions Fable n’impliquent aucun repli. Les classificateurs se déclenchent, en moyenne, dans moins de 5 % des sessions.
Qu’est-ce que cela signifie pour votre facture ? Sur un repli, vous payez pour une réponse Opus 4.8, pas Fable — et vous en êtes informé quand cela se produit. Pour la plupart des charges de travail, l’effet mixte est faible. Mais si votre domaine touche à la cybersécurité, la biologie ou la chimie, vous rencontrerez des replis plus souvent, et votre modèle effectif — et profil de prix effectif — se déplace vers Opus sans que vous l’ayez choisi. C’est un paramètre de planification, pas un piège.
Accès restreint et friction d’approvisionnement
Il y a aussi un coût qui n’apparaît sur aucune grille tarifaire : l’exigence de rétention des données de 30 jours. Anthropic exige désormais une rétention de 30 jours pour tout le trafic sur les modèles de classe Mythos, sur les surfaces propriétaires et tierces, et n’utilisera pas les données pour entraîner des modèles ni à des fins autres que la sécurité. Pour certains acheteurs réglementés, c’est en soi une conversation d’approvisionnement. Pas un montant en dollars, mais un vrai poste dans la colonne « pouvons-nous même utiliser ceci ». Combiné avec la suspension actuelle, l’histoire d’approvisionnement pour la classe Mythos est véritablement incertaine en ce moment. Je ne l’inscrirais pas dans un plan T3 sans un modèle de repli nommé dans la même phrase.
Comparaison des coûts avec Opus 4.8
C’est la comparaison qui décide réellement la plupart des routages, voici donc le tableau que je garde ouvert.
| Modèle | Entrée / 1M | Sortie / 1M | Relatif à Opus 4.8 | Accès (mi-juin 2026) |
|---|---|---|---|---|
| Claude Opus 4.8 | 5 $ | 25 $ | référence | Disponible |
| Claude Opus 4.8 (Fast) | 10 $ | 50 $ | 2x (vitesse, pas capacité) | Disponible |
| Claude Fable 5 | 10 $ | 50 $ | 2x | Suspendu |
| Claude Mythos 5 | 10 $ | 50 $ | 2x | Restreint + suspendu |
La tarification d’Opus 4.8 est confirmée à 5 $ par million de tokens en entrée et 25 $ par million de tokens en sortie en mode standard, avec le mode rapide à 10 $ et 50 $ pour une sortie environ 2,5x plus rapide. À noter : Opus 4.8 Fast Mode atteint le même tarif de 10 $/50 $ que Fable 5. Donc si votre raison de dépasser Opus était la latence plutôt que la capacité brute, Fast Mode vous y amène au même prix sans modèle de classe Mythos du tout.
Quand Opus 4.8 est encore suffisant
La plupart du temps. Je le pense vraiment. Opus 4.8 est un modèle solide en lui-même — Anthropic rapporte qu’il est environ quatre fois moins susceptible que son prédécesseur de laisser passer des failles dans le code qu’il a écrit sans les signaler, obtient 84 % sur Online-Mind2Web, et est le premier modèle à dépasser 10 % sur le Legal Agent Benchmark all-pass standard. Pour la rédaction, le codage standard, l’analyse, la plupart des boucles d’agents — vous ne sentirez pas le plafond. Et il est deux fois moins cher et réellement disponible à l’achat aujourd’hui, ce qui en ce moment n’est pas une petite chose.
Quand Fable 5 vaut la prime
La prime est rentable sur les tâches les plus longues, les plus difficiles et les plus multi-étapes — celles pour lesquelles Anthropic dit que plus la tâche est longue et complexe, plus l’avance de Fable 5 sur les autres modèles est grande. Stripe a rapporté que Fable 5 a comprimé des mois d’ingénierie en jours, effectuant une migration à l’échelle de la base de code dans une base de code Ruby de 50 millions de lignes en un jour, ce qui aurait autrement pris une équipe plus de deux mois. Si une tâche a cette forme — long horizon, ambiguë, haute valeur — payer 2x par token pour finir en une fraction du temps réel est évidemment rentable. Le tarif 2x est du bruit à côté du travail qu’il remplace.
Pourquoi les charges de travail intensives en sortie peuvent changer le ROI
Le levier qui fait le plus bouger votre facture n’est pas le tarif d’entrée — c’est la longueur de la sortie, car la sortie coûte 5x l’entrée sur ces modèles. Comme une analyse de coût l’a dit franchement : les tokens de sortie coûtent cinq fois plus cher que les tokens d’entrée, donc la longueur des réponses de Claude impacte votre facture, pas la taille de vos prompts. Une tâche Fable longue durée qui génère un raisonnement intermédiaire verbeux sur des heures peut silencieusement devenir votre poste de dépense le plus élevé. C’est toute la raison d’être de la section suivante.
Contrôles de coûts en production
Si vous récupérez l’accès et routez de vraies charges de travail vers un modèle de classe Mythos, voici les paramètres qui comptent. Ils comptent aussi sur Opus 4.8 — même famille, mêmes contrôles.
Paramètre d’effort et budgets de tâches
Le curseur d’effort est le plus grand levier de coût. Baissez l’effort sur les tâches plus simples, réservez l’effort maximal pour le travail qui en a besoin. Les conseils standard pour cette famille de modèles : baissez le niveau d’effort sur les tâches plus simples, mettez en cache le contenu de prompt répété, groupez les tâches non urgentes, et gardez max_tokens serré. Définir un max_tokens serré est l’assurance la moins chère que vous puissiez acheter contre une réponse qui s’emballe. Faites-le avant de déployer, pas après la facture.
Comportement de repli et de nouvelle tentative
Deux comportements de repli à planifier. Premièrement, le repli du classificateur vers Opus 4.8 que j’ai mentionné — c’est automatique et vous en êtes informé. Deuxièmement, votre propre logique de nouvelle tentative. Un agent longue durée qui réessaie une étape échouée trois fois paie pour trois exécutions. Sur un modèle à 50 $/M de sortie s’exécutant pendant des heures, une politique de nouvelle tentative négligente est là où les budgets meurent réellement. Limitez les nouvelles tentatives, journalisez la dépense en tokens par exécution, et alertez sur les valeurs aberrantes. La propre mise en garde d’Anthropic pour les flux de travail d’agents dynamiques mérite d’être citée : un plan mal configuré qui génère 500 sous-agents au lieu de 50 représente un pic de coût de 10x, donc définissez des limites de budget dans votre harnais avant d’activer les flux de travail dynamiques en production.
Routage par valeur de tâche et niveau de risque
C’est la partie en laquelle je crois vraiment. Ne routez pas tout par défaut vers le modèle le plus capable. Routez en fonction de ce que la tâche vaut et de combien elle coûtera à exécuter :
- Bon marché, simple, volume élevé → Opus 4.8 ou plus petit, faible effort. Jamais un modèle de classe Mythos.
- Sensible à la latence mais pas limité par la capacité → Opus 4.8 Fast Mode (même 10 $/50 $ que Fable, mais disponible).
- Vraiment frontier — long, ambigu, haute valeur → Fable 5, si et quand il revient, effort maximal, avec plafonds de budget.
Le modèle vers lequel vous vous tournez devrait être une fonction de la tâche, pas une habitude. Aller par défaut en haut du menu, c’est comment vous finissez à expliquer une facture 4x à quelqu’un qui demandait un modèle 2x.
FAQ
Combien coûte Claude Mythos 5 ? 10 $ par million de tokens en entrée et 50 $ par million de tokens en sortie — le même tarif que Claude Fable 5. Mais Mythos 5 est un modèle à accès restreint (partenaires Project Glasswing uniquement), et depuis le 12 juin 2026, lui et Fable 5 sont suspendus pour tous les clients dans l’attente d’une directive gouvernementale. Donc le tarif est fixé ; l’accès, pour l’instant, ne l’est pas. Vérifiez toujours la page de tarification officielle d’Anthropic avant de budgétiser, car cette situation évolue.
Claude Fable 5 est-il tarifé de la même façon que Mythos 5 ? Oui, de manière identique : 10 $/50 $ par million de tokens. Ce sont le même modèle sous-jacent. La différence concerne les garde-fous — Fable 5 est livré avec des classificateurs de sécurité pour un usage général ; Mythos 5 en a certains levés pour les partenaires vérifiés. Même capacité, même prix, accès et posture de risque différents.
Pourquoi Fable 5 peut-il devenir coûteux dans les tâches longue durée ? Parce que les tokens de sortie coûtent 5x les tokens d’entrée, et Fable 5 est conçu pour des tâches qui s’exécutent pendant des heures et génèrent beaucoup de sortie. Une longue boucle d’agent avec un raisonnement verbeux, plus des nouvelles tentatives, peut multiplier rapidement vos dépenses de sortie. Le tarif 2x-au-dessus-d’Opus sous-estime l’écart sur le travail intensif en sortie. Limitez max_tokens, contrôlez l’effort, et surveillez le comportement des nouvelles tentatives.
Quand les développeurs devraient-ils utiliser Opus 4.8 à la place ? La plupart du temps, honnêtement. Opus 4.8 est deux fois moins cher (5 $/25 $), entièrement disponible maintenant, et suffisamment solide pour la grande majorité du codage, de l’analyse et du travail d’agent. Allez au-delà seulement lorsque la tâche est genuinement à long horizon et suffisamment haute valeur que finir plus vite justifie 2x par token — et si vous avez seulement besoin de vitesse, Opus 4.8 Fast Mode atteint le point de prix de Fable (10 $/50 $) tout en restant disponible.
Alors où cela vous laisse-t-il ?
Le chiffre que vous cherchiez est 10 $/50 $ par million de tokens, identique pour Mythos 5 et Fable 5, 2x Opus 4.8. Cette partie est simple. La partie qui décide réellement si vous construisez dessus est l’accès — et en ce moment l’accès est suspendu, sans date de restauration ferme. Mon analyse : traitez la classe Mythos comme un modèle pour lequel vous concevez mais dont vous ne dépendez pas encore. Nommez Opus 4.8 comme votre valeur par défaut de travail, construisez votre routage de sorte que le niveau frontier soit un échange plutôt qu’une fondation, et gardez les plafonds de budget en place quel que soit le modèle qui répond.
Quand l’accès revient, la question de coût devient la question de routage que j’ai esquissée ci-dessus — valeur et risque par tâche, pas « le plus puissant par défaut ». En attendant, je pointerais votre charge de production vers quelque chose que vous pouvez réellement appeler. Consultez vous-même les docs de présentation des modèles d’Anthropic et la déclaration de suspension de Fable et Mythos avant de vous engager pour un seul token — celui-ci est encore en mouvement.
Chiffres vérifiés par rapport aux annonces officielles d’Anthropic au 13 juin 2026. Le statut d’accès en particulier est en train de changer ; confirmez avant de budgétiser.
Articles précédents :
- Accès API Claude Mythos 5 pour les développeurs
- Project Glasswing : Pourquoi Anthropic limite Mythos
- Performances de codage Claude Mythos : Ce que cela signifie pour les flux de travail de développement IA
- Claude Mythos vs Claude Opus 4.6 : Ce que la fuite révèle pour les développeurs
- Harnais d’agent Claude Code : Analyse de l’architecture
