Tarifs+7% bonus

Présentation de Claude Fable 5.1 et Claude Mythos 5.1 : même modèle, différents garde-fous

Claude Fable 5.1 et Mythos 5.1 partagent un même modèle mais diffèrent en matière d'accès. Consultez les tarifs, fonctionnalités, benchmarks, garde-fous et modifications de migration de l'API.

Présentation de Claude Fable 5.1 et Claude Mythos 5.1 : même modèle, différents garde-fous

Anthropic a présenté deux noms de modèles le 1er septembre 2026, mais un seul nouveau modèle sous-jacent. Claude Fable 5.1 est la version en disponibilité générale. Claude Mythos 5.1 est la version restreinte destinée aux organisations vérifiées de cybersécurité et des sciences de la vie. La différence ne tient pas à un réglage d’intelligence caché ni à un plus grand nombre de paramètres. Elle réside dans l’accès et les garde-fous.

Cette distinction est importante, car ce lancement est facile à mal interpréter. Fable 5.1 n’est pas simplement un Mythos 5.1 plus petit, et les clients API ordinaires ne peuvent pas transformer Fable en Mythos avec un paramètre de requête. Les deux partagent des capacités, mais Fable applique des contrôles supplémentaires aux requêtes risquées en cybersécurité, biologie et chimie.

Il y a une seconde complication. Anthropic affirme que Fable 5.1 peut réduire d’environ 25 % les coûts typiques des charges de travail facturées au token, les économies atteignant environ 45 % pour les travaux hautement agentiques. Pourtant, ses tarifs normaux d’entrée et de sortie n’ont pas changé par rapport à Fable 5. La réduction provient de lectures de cache moins coûteuses, et des tests indépendants montrent qu’un plus grand nombre de tokens de sortie peut encore rendre certaines tâches terminées plus coûteuses.

Ainsi, l’histoire utile n’est pas simplement « le nouveau Claude obtient de meilleurs scores ». Il s’agit de comprendre comment un modèle est devenu deux produits, ce qui est réellement devenu moins cher et ce que les développeurs doivent changer avant de migrer un agent existant.

Table des matières

Réponse courte : Que sont Claude Fable 5.1 et Mythos 5.1 ?

Claude Fable 5.1 et Claude Mythos 5.1 sont deux versions d’accès du même modèle Anthropic sous-jacent. Fable 5.1 est disponible pour les utilisateurs Claude classiques et les clients de l’API avec des garde-fous en cybersécurité et biologie. Mythos 5.1 est limité aux organisations approuvées dans les programmes d’accès de confiance d’Anthropic.

Détail Claude Fable 5.1 Claude Mythos 5.1
Date de sortie 1er septembre 2026 1er septembre 2026
Modèle sous-jacent Identique Identique
Accès général à l’API Oui Non
Voie d’accès Produits Claude, API et clouds partenaires Project Glasswing et programmes approuvés
Accès en cybersécurité et biologie Garde-fous supplémentaires et routage de repli Accès élargi pour la recherche vérifiée
ID de modèle de l’API Claude claude-fable-5-1 claude-mythos-5-1
Fenêtre de contexte 1 million de tokens 1 million de tokens
Sortie maximale 128 000 tokens 128 000 tokens

L’annonce de lancement d’Anthropic décrit la paire comme le même modèle avec différents niveaux de garde-fous. Sa documentation pour développeurs liste Fable 5.1 pour tous les clients de l’API Claude et Mythos 5.1 pour les participants à Project Glasswing uniquement.

Quelle est la relation entre Claude Fable 5.1 et Mythos 5.1 ?

Fable et Mythos ne sont pas des niveaux de capacité distincts comme l’étaient Sonnet, Opus et les familles Claude antérieures. Anthropic affirme qu’ils utilisent le même modèle sous-jacent. La séparation se fait au niveau des garde-fous et de l’accès.

Fable 5.1 est le produit public. Il est destiné au codage de longue durée, à la recherche, à l’utilisation de l’ordinateur et au travail de connaissance, mais des classificateurs surveillent les requêtes en cybersécurité et biologie. Une requête de cybersécurité signalée peut basculer vers Claude Opus 4.8, tandis qu’une requête de biologie signalée peut basculer vers Claude Opus 5. Les développeurs d’API doivent configurer ce comportement ; un refus peut aussi arriver sous forme de réponse HTTP 200 avec stop_reason: "refusal" plutôt que comme une erreur de requête classique.

Mythos 5.1 est destiné aux organisations qu’Anthropic a examinées et approuvées pour des travaux dans des domaines tels que la sécurité défensive et les sciences de la vie. Il offre un accès plus large aux capacités cyber et biologie du même modèle. Cela ne fait pas de Mythos un paramètre caché dans le point de terminaison public Fable. L’accès est contrôlé par Anthropic, et les clients approuvés doivent passer par des programmes tels que Project Glasswing.

Les garde-fous sont aussi plus précis que ceux lancés avec Fable 5. Anthropic rapporte que ses nouveaux contrôles de cybersécurité produisent 60 % de faux positifs en moins. Il indique que les garde-fous de biologie interviennent sur des requêtes bénignes 85 % moins souvent. Fable 5.1 peut désormais identifier des vulnérabilités dans le code source, mais les tests d’intrusion, la génération d’exploits et l’analyse de vulnérabilités basée sur des binaires peuvent encore être restreints. Ces pourcentages proviennent de l’évaluation d’Anthropic, et non d’un audit indépendant. Les pages produit Fable et Mythos expliquent les limites actuelles.

Les deux versions appliquent par défaut une conservation des données de 30 jours pour la surveillance de sécurité. Anthropic indique que ses prochains Enterprise Frontier Safeguards permettront aux clients entreprise éligibles de conserver les données dans une infrastructure cloud contrôlée par le client ; d’ici ce déploiement, les clients expressément autorisés peuvent recevoir un accès sans conservation des données. Il s’agit d’une condition d’accès, pas d’une valeur par défaut générale pour chaque compte API Fable 5.1.

En clair : Mythos 5.1 n’est pas « Fable 5.1 avec effort maximal ». C’est Fable 5.1 dans un dispositif d’accès et de sécurité différent.

Fonctionnalités de Claude Fable 5.1 : qu’est-ce qui a changé depuis Fable 5 ?

Fable 5.1 conserve la forme générale de Claude Fable 5 : une fenêtre de contexte d’un million de tokens, jusqu’à 128 000 tokens de sortie, une entrée image et texte, et un raisonnement adaptatif toujours activé. La mise à niveau 5.1 se concentre sur le travail de longue durée, l’effort contrôlable, la communication des agents et moins d’interventions inutiles des garde-fous.

Agents de longue durée plus capables

Anthropic positionne Fable 5.1 pour des missions qui peuvent occuper un agent pendant des heures ou des jours : implémentation à l’échelle d’un dépôt de code, analyse des causes racines, recherche multi-étapes, production de documents, utilisation du navigateur et travail qui traverse plusieurs applications. L’effort High est la valeur par défaut dans Claude Code, tandis que Medium est la valeur par défaut dans Claude.ai et Claude Cowork.

L’amélioration revendiquée n’est pas seulement plus de raisonnement au réglage le plus élevé. Anthropic affirme que Fable 5.1 en effort Low ou Medium peut égaler ou dépasser Fable 5 sur certaines tâches mesurées à moindre coût. Cela fait du choix de l’effort une partie de la conception du déploiement plutôt qu’un contrôle décoratif. La récupération routinière et le formatage peuvent ne pas nécessiter Max ; un diagnostic architectural difficile peut en avoir besoin.

L’effort peut changer au sein d’une conversation

Avec une fonctionnalité bêta, une application peut augmenter ou réduire l’effort en cours de conversation sans invalider le cache de prompt. Un agent pourrait utiliser l’effort High pour planifier une migration, puis passer à Low pour résumer les étapes terminées. Claude Opus 5 prend aussi en charge ce comportement.

Fable 5.1 prend en outre en charge les messages système limités au tour. Une instruction temporaire peut s’appliquer au tour actuel et s’effacer au message utilisateur suivant tout en restant dans l’historique de messages en ajout seul. C’est utile pour les boucles d’outils qui ont besoin de rappels de courte durée sans réécrire le contexte antérieur.

Mises à jour de progression et provenance du contenu

Les développeurs peuvent demander des mises à jour d’état lisibles entre les appels d’outils avec l’option bêta thinking.display: "updates". La chaîne de pensée brute n’est toujours pas renvoyée. La fonctionnalité expose de courts messages de progression tout en gardant le raisonnement privé caché.

Anthropic indique aussi que le texte généré par Fable 5.1 et Mythos 5.1 porte son filigrane textuel statistique. Les fichiers image et vidéo pris en charge produits via des outils peuvent recevoir des C2PA Content Credentials signés lorsqu’ils sont récupérés via l’API Files. Ces fonctionnalités n’ajoutent pas de caractères visibles ni de tokens facturables à la réponse texte.

Tous les changements de comportement ne sont pas des améliorations

Les notes de migration sont inhabituellement franches sur les régressions et les compromis :

  • L’appel d’outils en parallèle peut être plus variable. Fable 5.1 peut effectuer un appel par tour là où Fable 5 regroupait auparavant plusieurs appels indépendants. Des tours supplémentaires ajoutent des allers-retours, des tokens et du temps réel.

  • En effort Low, le modèle est plus susceptible de répondre de mémoire plutôt que d’appeler un outil de recherche ou de récupération. Les tâches qui nécessitent des informations actuelles ont besoin d’un niveau d’effort plus élevé ou d’une instruction de vérification explicite.

  • La narration de progression est moins fréquente pendant les longues exécutions, sauf si l’application la demande.

  • La prose peut être plus dense, avec des phrases plus longues et moins de sauts de paragraphe.

  • Pour une petite modification de fichier, le modèle peut réécrire tout le fichier au lieu de renvoyer un correctif ciblé, ce qui augmente le coût de sortie.

  • Les résumés de documents peuvent reproduire la formulation source sans toujours l’indiquer comme une citation.

Ce ne sont pas des raisons de rejeter la mise à niveau. Ce sont des raisons de relancer les évaluations propres à un agent au lieu de supposer qu’un numéro de modèle plus élevé préserve chaque comportement.

Claude Fable 5.1 vs Claude Fable 5

Domaine Claude Fable 5 Claude Fable 5.1
Entrée standard 10 $ / 1M tokens 10 $ / 1M tokens
Sortie standard 50 $ / 1M tokens 50 $ / 1M tokens
Lecture du cache 1 $ / 1M tokens 0,25 $ / 1M tokens
Fenêtre de contexte 1M tokens 1M tokens
Sortie maximale 128K tokens 128K tokens
Réflexion adaptative Toujours activée Toujours activée
Effort en cours de conversation Aucune fonctionnalité équivalente au lancement Pris en charge en bêta
Faux positifs des garde-fous Plus élevé Réduit lors des tests d’Anthropic
Choix d’outil nommé forcé Les intégrations existantes peuvent l’utiliser any et tool nommé renvoient une erreur
Provenance du contenu Comportement antérieur Filigrane textuel statistique et prise en charge C2PA

Un détail de facturation supplémentaire mérite attention. Fable 5.1 utilise le même tokeniseur que Fable 5, introduit avec Claude Opus 4.7. Anthropic indique que le même texte peut produire environ 30 % de tokens en plus qu’avec des modèles antérieurs à Opus 4.7. Les équipes migrant depuis Fable 5 ne verront pas ce saut de tokeniseur, mais les équipes qui comparent 5.1 à des générations Claude plus anciennes ne devraient pas estimer le coût à partir du seul nombre de caractères.

Tarification de Claude Fable 5.1 : cache moins cher, mais pas toujours une tâche moins chère

Fable 5.1 conserve les tarifs API affichés de Fable 5. Le changement se concentre sur la mise en cache des prompts.

Élément de facturation Prix officiel de Claude Fable 5.1
Entrée standard 10 $ / 1M tokens
Écriture de cache de 5 minutes 12,50 $ / 1M tokens
Écriture de cache d’1 heure 20 $ / 1M tokens
Lecture du cache 0,25 $ / 1M tokens
Sortie standard 50 $ / 1M tokens
Entrée par lots 5 $ / 1M tokens
Sortie par lots 25 $ / 1M tokens

Le tarif de lecture du cache est passé de 1 $ à 0,25 $ par million de tokens, soit une réduction de 75 %. C’est important pour les agents qui relisent de façon répétée un grand prompt système, une carte de dépôt, des définitions d’outils ou un contexte de travail accumulé. Anthropic estime que les charges de travail typiques facturées au token coûteront environ 25 % de moins que Fable 5, tandis que les charges de travail fortement agentiques pourraient économiser jusqu’à environ 45 %. Les tarifs complets et les multiplicateurs de cache figurent dans la documentation de tarification Claude.

Mais « un cache 75 % moins cher » n’est pas la même affirmation qu’« un modèle 75 % moins cher ». L’entrée fraîche reste à 10 $ et la sortie à 50 $. Si un nouveau réglage d’effort produit une trace de raisonnement ou une réponse plus longue, la facture de sortie peut effacer l’économie de cache.

C’est ce qui s’est produit dans l’évaluation avant sortie d’Artificial Analysis. Son analyse de lancement a constaté que Fable 5.1 en effort Max utilisait environ 1,7 fois plus de tokens de sortie que Fable 5 Max. Son coût mesuré était d’environ 3,7 $ par tâche de l’Intelligence Index, soit environ 20 % de plus que Fable 5 Max, même après la remise de cache. En effort Extra-élevé, le modèle a obtenu un point de moins que Max sur l’indice, mais a coûté sensiblement moins par tâche.

Voici la conclusion de coût la plus utile :

Fable 5.1 est moins cher pour relire un contexte mis en cache. S’il est moins cher pour accomplir votre tâche dépend des hits de cache, de l’effort, de la longueur de sortie, des tours d’outils et du comportement de repli.

Avant de basculer le trafic de production, comparez le coût par résultat accepté, pas le prix par million de tokens mis en cache.

Quelle est la force de Claude Fable 5.1 ? Benchmarks et leurs limites

Anthropic rapporte d’importantes améliorations par rapport à Fable 5 en recherche scientifique, travail en terminal, automatisation métier et codage agentique. Le tableau de lancement ci-dessous utilise la configuration de test d’Anthropic, il doit donc être lu comme une preuve de fournisseur plutôt qu’un verdict neutre.

Benchmark Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
Terminal-Bench-Science 0.1 52,6 % 24,7 % 29,0 % 22,4 %
Terminal-Bench 4.0 55,8 % 42,0 % 52,3 % 37,3 %
GDPval-AA v2 1 853 1 723 1 824 1 711
OSWorld 2.0, strict 41,7 % 36,1 % 39,6 % —
Humanity’s Last Exam, sans outils 60,9 % 57,8 % 56,6 % —
AutomationBench 31,4 % 17,1 % 26,9 % 19,6 %
CursorBench 3.2.0 73,4 % 70,5 % 70,0 % 67,2 %

Source : le rapport de lancement de Fable 5.1 et Mythos 5.1 d’Anthropic.

Sur Terminal-Bench 4.0, Mythos 5.1 a obtenu 60,9 % contre 55,8 % pour Fable 5.1. Anthropic attribue cet écart aux tâches où les garde-fous cyber de Fable sont intervenus, et non à un modèle de base différent. L’entreprise note aussi que certaines requêtes de benchmark ont été routées vers des modèles Opus lorsque les garde-fous se sont déclenchés.

Des tests indépendants placent Fable 5.1 en tête, avec une réserve

Artificial Analysis a évalué Fable 5.1 avant sa sortie et a attribué une note de 66 en effort Max sur son Intelligence Index. Au moment du lancement, cela le plaçait devant Opus 5 Max à 63, Fable 5 Max à 62, GPT-5.6 Sol Max à 61, et les configurations Max de Kimi K3 et GLM-5.3 à 60.

Modèle et réglage Intelligence Index d’Artificial Analysis
Claude Fable 5.1 Max 66
Claude Opus 5 Max 63
Claude Fable 5 Max 62
GPT-5.6 Sol Max 61
Kimi K3 Max 60
GLM-5.3 Max 60

La réserve est importante : Artificial Analysis a activé le repli côté serveur par défaut d’Anthropic. Opus 4.8 ou Opus 5 ont généré environ 4 % des tokens de sortie sur l’ensemble de l’indice lorsque les classificateurs de sécurité sont intervenus. Le score de 66 représente donc une configuration de production réaliste de Fable 5.1, et non une exécution en laboratoire où chaque token provenait uniquement de Fable.

Les résultats indépendants révèlent aussi un compromis moins flatteur. Sur AA-Omniscience, Fable 5.1 a tenté plus de questions et obtenu une précision brute supérieure à Fable 5. Mais lorsqu’il ne connaissait pas la bonne réponse, il était aussi plus susceptible d’en tenter une. Les deux effets se sont annulés sur l’indice de fiabilité du benchmark. Être plus enclin à répondre ne signifie pas automatiquement être moins susceptible d’halluciner.

Une lecture honnête des benchmarks est conditionnelle. Fable 5.1 obtient le meilleur résultat composite précoce, en particulier pour le travail agentique et de connaissance, mais il est coûteux et verbeux en Max. Une équipe qui choisit un modèle de production devrait comparer les niveaux d’effort à ses propres critères d’acceptation plutôt que de déployer Max partout.

Claude Fable 5.1 vs Opus 5, GPT-5.6 Sol, Kimi K3 et GLM-5.3

Les modèles ci-dessous se recoupent en codage, recherche et travail agentique, mais occupent des positions de prix et de déploiement très différentes. Les prix de ce tableau sont les tarifs catalogue directs des fournisseurs par million de tokens d’entrée et de sortie standard ; les pages de modèles GPT Proto liées peuvent proposer d’autres tarifs.

Modèle Intelligence Index AA, Max Prix direct entrée / sortie Raison pratique de le choisir
Claude Fable 5.1 66 10 $ / 50 $ Raisonnement de longue durée et travail agentique haut de gamme
Claude Opus 5 63 5 $ / 25 $ Valeur par défaut Anthropic moins coûteuse pour la plupart des charges de travail
GPT-5.6 Sol 61 5 $ / 30 $ Efficacité des agents, codage, utilisation de l’ordinateur et exécution multi-agents
Kimi K3 60 3 $ / 15 $ Poids ouverts, entrée d’images et coût API inférieur
GLM-5.3 60 1,40 $ / 4,40 $ Codage textuel et workflows agentiques moins coûteux

Sources des prix : Anthropic, OpenAI, Moonshot AI et Z.AI. Les résultats d’indice indépendants proviennent d’Artificial Analysis.

Claude Fable 5.1 vs Claude Opus 5

Fable 5.1 a le plafond mesuré le plus élevé, mais Opus 5 coûte moitié moins par token d’entrée et de sortie standard. Le guide pour développeurs d’Anthropic indique à la plupart des charges de travail de commencer avec Opus 5 et d’utiliser Fable 5.1 lorsque le raisonnement exigeant ou le travail à long horizon reste insuffisant à un effort Opus plus élevé. C’est un conseil inhabituellement direct : le modèle le plus récent et le mieux noté n’est pas la valeur par défaut recommandée.

Choisissez Fable 5.1 lorsque la valeur de résolution d’une tâche difficile justifie un coût d’inférence supplémentaire. Gardez Opus 5 lorsqu’il passe déjà l’évaluation, en particulier pour le trafic de production à fort volume.

Claude Fable 5.1 vs GPT-5.6 Sol

Fable 5.1 mène l’indice composite actuel d’Artificial Analysis, tandis que GPT-5.6 Sol a un prix catalogue inférieur et est conçu autour d’un usage d’outils économe en tokens, de l’utilisation de l’ordinateur et de l’exécution multi-agents. Le tableau de lancement d’Anthropic favorise Fable 5.1 sur plusieurs tests partagés, mais ces résultats utilisent le harnais d’Anthropic. Le rapport GPT-5.6 d’OpenAI publie différentes évaluations qui favorisent GPT-5.6 Sol par rapport au précédent Fable 5 en efficacité de codage.

La conclusion la plus sûre dépend de la charge de travail. Fable 5.1 est le meilleur candidat précoce pour une tâche de raisonnement unique, difficile et longue. GPT-5.6 Sol mérite la priorité lorsque le coût, les flux de travail parallèles et l’efficacité des appels d’outils comptent autant que l’intelligence composite de pointe.

Claude Fable 5.1 vs Kimi K3

Kimi K3 atteint 60 sur le même indice indépendant tout en facturant 3 $ par million de tokens d’entrée et 15 $ par million de tokens de sortie. Il offre aussi des poids ouverts, une fenêtre de contexte d’un million de tokens et une compréhension native des images. Fable 5.1 obtient un meilleur score, mais il est propriétaire et coûte plus de trois fois plus cher en entrée et sortie standard.

Utilisez Fable 5.1 pour les tâches où les derniers points de capacité mesurée ont une valeur commerciale claire. Kimi K3 est plus facile à justifier lorsque le déploiement privé, l’accès au modèle ou le budget d’inférence est central dans la décision.

Claude Fable 5.1 vs GLM-5.3

GLM-5.3 obtient aussi 60 sur l’indice Artificial Analysis et prend en charge une fenêtre de contexte d’un million de tokens. Ses tarifs directs sont de 1,40 $ par million de tokens d’entrée et 4,40 $ par million de tokens de sortie. Contrairement à Fable 5.1, le modèle standard GLM-5.3 est uniquement textuel.

Fable 5.1 convient mieux au travail difficile sur documents visuels et aux missions autonomes les plus haut de gamme. GLM-5.3 est l’option plus économique pour le codage textuel et les agents, surtout lorsqu’une équipe doit exécuter de nombreuses tâches plutôt que maximiser la probabilité de succès d’une tâche coûteuse.

Migration de Claude Fable 5 vers Fable 5.1

Changer l’ID du modèle est nécessaire, mais ce n’est pas toute la migration.

1. Mettre à jour l’ID de modèle de l’API Claude

Cet exemple Python exécutable utilise le SDK officiel d’Anthropic et l’ID de modèle public Fable 5.1 :

import os
from anthropic import Anthropic

client = Anthropic(api_key=os.environ["ANTHROPIC_API_KEY"])

response = client.messages.create(
    model="claude-fable-5-1",
    max_tokens=4096,
    messages=[
        {
            "role": "user",
            "content": "Review this migration plan and identify the three highest-risk assumptions.",
        }
    ],
)

for block in response.content:
    if block.type == "text":
        print(block.text)

Le code Fable 5 existant passe de :

model = "claude-fable-5"

à :

model = "claude-fable-5-1"

2. Supprimer le choix d’outil forcé

Fable 5.1 ne prend pas en charge les valeurs tool_choice de any ou d’un tool nommé. L’un ou l’autre renvoie une 400 invalid_request_error :

tool_choice : les types "tool" et "any" ne sont pas pris en charge pour ce modèle.

Utilisez plutôt la sélection automatique :

{
  "tool_choice": {"type": "auto"}
}

Si la sortie doit correspondre à un schéma JSON, combinez le choix automatique d’outil avec l’usage strict des outils ou les sorties structurées. Si le modèle doit appeler un outil particulier, énoncez explicitement la condition dans le prompt et validez l’action renvoyée.

3. Conserver l’historique des blocs de réflexion en ajout seul

Fable 5.1 peut lire les blocs de réflexion produits par des modèles Claude antérieurs. Les modèles antérieurs ne peuvent pas lire les blocs de réflexion produits par Fable 5.1. Une conversation peut passer d’Opus 5 ou Fable 5 à Fable 5.1 et préserver l’état de raisonnement, mais un retour en arrière supprime les blocs de réflexion plus récents.

Modifier un message antérieur, changer le prompt système de niveau supérieur, reconstruire le tableau d’outils ou servir des octets de fichier différents à la même URL de document peut aussi invalider les blocs de réflexion ultérieurs. Lorsque l’application est active, l’API peut renvoyer :

Le bloc est lié à une autre conversation

Traitez l’historique de conversation de longue durée comme en ajout seul. Ajoutez des instructions temporaires via des messages système en cours de conversation ou limités au tour, et utilisez la compaction côté serveur ou l’édition de contexte au lieu de réécrire silencieusement les tours antérieurs. Les notes de migration Fable 5.1 d’Anthropic documentent les modèles acceptés.

4. Relancer les évaluations de coût et de comportement

Au minimum, mesurez :

  • taux de résultats acceptés en effort Low, Medium, High et Max ;

  • tokens de sortie et de raisonnement par tâche terminée ;

  • taux de hits du cache de prompts ;

  • nombre de tours d’outils et d’appels d’outils parallèles ;

  • temps jusqu’à la première réponse utile ;

  • fréquence des refus et des replis ;

  • si l’effort Low déclenche encore une recherche lorsque des informations fraîches sont nécessaires ;

  • si les petites modifications de fichiers restent ciblées.

Un modèle peut obtenir un meilleur score tout en rendant un agent particulier plus lent ou plus coûteux. La migration n’est terminée que lorsque la nouvelle configuration passe les seuils de qualité et de coût propres à la charge de travail.

Évaluer le modèle Fable actuel via GPT Proto

La page de modèle actuelle de GPT Proto expose Claude Fable 5 via un point de terminaison de chat compatible OpenAI. L’appel suivant utilise l’ID claude-fable-5 listé ; il ne prétend pas que cet ID est Fable 5.1 :

curl --request POST "https://gptproto.com/v1/chat/completions" \
  --header "Authorization: Bearer $GPTPROTO_API_KEY" \
  --header "Content-Type: application/json" \
  --data '{
    "model": "claude-fable-5",
    "messages": [
      {
        "role": "user",
        "content": "Review this migration plan and identify the three highest-risk assumptions."
      }
    ]
  }'

Vous pouvez essayer Claude Fable 5 via GPT Proto ou utiliser les pages liées GPT-5.6 Sol, Kimi K3 et GLM-5.3 pour évaluer des alternatives moins coûteuses avec le même compte et solde. Avant d’utiliser une future route Fable 5.1, confirmez son ID de modèle exact sur la page du modèle plutôt que de le deviner à partir de l’ID d’Anthropic.

Ce que disent les premiers testeurs et développeurs

Les premières réactions sont partagées entre l’enthousiasme pour le travail de longue durée et la méfiance envers les benchmarks de lancement.

Every a testé Fable 5.1 pendant environ une semaine sur le codage, l’écriture et le travail de connaissance. Son équipe a rapporté que le modèle était plus facile à interagir que le Fable original, pouvait travailler pendant de longues périodes et utilisait moins de la moitié des tokens d’Opus 5 sur certaines tâches comparables. Leur revue pratique a aussi relevé des limites : Fable 5.1 dépassait encore les nombres de mots demandés, et à effort plus élevé, il continuait parfois à travailler après qu’un testeur l’ait interrompu pour demander ce qu’il faisait. L’équipe n’a pas mesuré directement les économies par rapport à Fable 5.

C’est une preuve utile, mais cela reste un rapport d’accès anticipé d’une seule équipe. Cela n’établit pas de résultat général de coût ou de fiabilité.

La discussion de lancement sur r/ClaudeAI était plus sceptique. Plusieurs commentateurs se sont demandé si les benchmarks publiés se traduiraient dans le codage quotidien et ont souligné l’absence d’un résultat DeepSWE dans le tableau principal d’Anthropic. D’autres ont considéré la réduction de lecture du cache comme la partie la plus importante de l’annonce, car le contexte mis en cache représente la majeure partie de leur usage d’agents.

Les deux réactions peuvent être vraies. Fable 5.1 peut être une mise à niveau significative pour le travail délégué difficile tout en étant surdimensionné et trop cher pour le chat ordinaire, le codage de routine ou les appels d’outils courts. Le sentiment du jour de lancement ne peut pas trancher ce choix ; des tests répétés sur la charge de travail le peuvent.

Devriez-vous passer à Claude Fable 5.1 ?

Choisissez Fable 5.1 lorsque :

  • une tâche dure des heures ou des jours et que l’échec coûte plus cher que l’inférence ;

  • Opus 5 à effort plus élevé n’atteint toujours pas votre seuil d’acceptation ;

  • la charge de travail combine code, documents visuels, recherche et plusieurs outils ;

  • l’agent lit de façon répétée un grand préfixe mis en cache ;

  • votre intégration peut gérer les refus, le repli, les blocs de réflexion en ajout seul et le choix automatique d’outils ;

  • vous réglerez l’effort par tâche au lieu d’envoyer chaque requête en Max.

Restez avec Opus 5 ou Fable 5 lorsque :

  • le modèle actuel passe déjà votre évaluation ;

  • les charges de travail sont courtes, prévisibles et à forte sortie ;

  • l’application dépend d’appels d’outils nommés forcés ;

  • l’historique de conversation est régulièrement réécrit côté client ;

  • l’équipe ne peut pas encore surveiller le comportement de repli et de refus ;

  • le coût compte plus que les derniers points sur un benchmark composite.

Envisagez Kimi K3 ou GLM-5.3 lorsque :

  • le coût de l’API est une contrainte forte ;

  • les poids ouverts ou l’auto-hébergement comptent ;

  • la charge de travail consiste principalement en codage textuel et tâches agentiques ;

  • vous devez traiter de nombreux jobs et pouvez tolérer un score de pointe de benchmark plus faible ;

  • router chaque job vers un modèle adapté est plus économique que de standardiser sur l’option la plus chère.

Claude Fable 5.1 est donc un spécialiste à haut plafond, pas un remplacement automatique de chaque déploiement Claude.

Verdict final

Claude Fable 5.1 et Claude Mythos 5.1 sont le même modèle sous-jacent proposé via deux dispositifs d’accès. Fable est la version publique avec des garde-fous supplémentaires en cybersécurité et biologie. Mythos est réservé aux organisations vérifiées qui ont besoin de capacités plus larges dans ces domaines. Les développeurs ordinaires ne peuvent pas activer Mythos via un paramètre de modèle.

La mise à niveau 5.1 apporte des résultats précoces plus solides sur le codage de longue durée, la recherche scientifique, le travail de connaissance et l’automatisation métier. Elle ajoute aussi des contrôles utiles pour changer l’effort, des instructions système temporaires, des mises à jour de progression et la provenance du contenu. L’histoire du coût est plus étroite que le titre le suggère : les lectures de cache sont 75 % moins chères, mais les tarifs de sortie sont inchangés, et des tests indépendants ont constaté que l’effort Max pouvait encore coûter plus cher par tâche d’évaluation terminée que Fable 5.

Si un déploiement Opus 5 ou Fable 5 existant fonctionne déjà, gardez-le jusqu’à ce que Fable 5.1 passe la même évaluation au niveau des tâches. Si le modèle actuel échoue sur des missions difficiles à plusieurs étapes, Fable 5.1 est l’un des premiers candidats à tester. Pour les agents textuels sensibles au prix, GLM-5.3 offre un tarif bien plus bas. Kimi K3 ajoute des poids ouverts et l’entrée d’images, tandis que GPT-5.6 Sol met l’accent sur l’usage efficace des outils et l’exécution multi-agents.

La bonne comparaison n’est pas un nom de modèle contre un autre. C’est le résultat accepté, le total de tokens, le temps et le coût sur le travail que votre application effectue réellement.

Questions fréquentes

Qu'est-ce que Claude Fable 5.1 ?

Claude Fable 5.1 est le modèle de classe Mythos d'Anthropic généralement disponible pour le codage, la recherche, l'utilisation d'un ordinateur et le travail intellectuel de longue durée. Il prend en charge les entrées texte et image, une fenêtre de contexte d'un million de tokens, jusqu'à 128 000 tokens de sortie et un raisonnement adaptatif toujours activé.

Qu'est-ce que Claude Mythos 5.1 ?

Claude Mythos 5.1 est la version à accès de confiance du même modèle sous-jacent que Fable 5.1. Il n'est disponible que pour les organisations vérifiées via des programmes tels que Project Glasswing, principalement pour des travaux approuvés en cybersécurité et en sciences de la vie.

Claude Fable 5.1 et Mythos 5.1 sont-ils le même modèle ?

Oui. Anthropic indique que Fable 5.1 et Mythos 5.1 sont le même modèle sous-jacent avec des garde-fous et des conditions d'accès différents. Mythos n'est pas un modèle plus grand, et les utilisateurs de Fable ne peuvent pas l'activer en modifiant le niveau d'effort.

Claude Mythos et Fable 5 sont-ils identiques ?

Pour chaque version correspondante, Anthropic utilise le même modèle sous-jacent pour la version publique Fable et la version restreinte Mythos. Fable 5 et Mythos 5 formaient la paire précédente ; Fable 5.1 et Mythos 5.1 sont leurs successeurs de septembre 2026. Fable 5 n'est pas la même version que Mythos 5.1.

Quand Claude Fable 5.1 a-t-il été publié ?

Anthropic a publié Claude Fable 5.1 et Claude Mythos 5.1 le 1er septembre 2026. Fable 5.1 est devenu disponible pour les clients standard de l'API Claude, tandis que Mythos 5.1 est resté réservé aux organisations approuvées.

Combien coûte Claude Fable 5.1 ?

La tarification directe de l'API Claude est de 10 $ par million de tokens d'entrée standard et de 50 $ par million de tokens de sortie. Les lectures de cache coûtent 0,25 $ par million de tokens. Les écritures de cache de cinq minutes coûtent 12,50 $, et les écritures de cache d'une heure coûtent 20 $ par million de tokens. Le traitement par lots coûte 5 $ en entrée et 25 $ en sortie par million de tokens.

Claude Fable 5.1 est-il moins cher que Fable 5 ?

Ses tarifs d'entrée et de sortie standard sont inchangés. Les lectures de cache sont 75 % moins chères, ce qui conduit Anthropic à estimer un coût inférieur d'environ 25 % pour les charges de travail typiques facturées au token et jusqu'à environ 45 % pour les travaux hautement agentiques. Le coût réel d'une tâche peut toutefois augmenter si Fable 5.1 génère plus de sortie ou effectue davantage de cycles d'outils.

Quoi de neuf dans Claude Fable 5.1 par rapport à Fable 5 ?

Les principaux changements sont de meilleurs résultats pour les agents et la recherche de longue durée, moins de faux positifs des garde-fous, des modifications de l'effort en milieu de conversation, des messages système limités à un tour, des mises à jour de progression lisibles et des fonctionnalités de provenance du contenu. Les développeurs doivent également tenir compte des changements incompatibles concernant le choix d'outil forcé et les blocs de réflexion préservés.

Les développeurs ordinaires peuvent-ils accéder à Claude Mythos 5.1 ?

Non. Claude Mythos 5.1 est limité aux organisations vérifiées dans les programmes à accès de confiance d'Anthropic. Les clients standard de l'API reçoivent Claude Fable 5.1, qui applique des garde-fous supplémentaires aux demandes risquées en cybersécurité, biologie et chimie.

Claude Fable 5.1 est-il meilleur que Claude Opus 5 ?

Fable 5.1 obtient un meilleur score sur l'indice précoce Artificial Analysis Intelligence Index et est conçu pour les tâches de longue durée les plus difficiles. Opus 5 coûte moitié moins par token d'entrée et de sortie standard, et Anthropic le recommande comme point de départ pour la plupart des charges de travail. Fable 5.1 n'est meilleur que lorsque sa capacité supplémentaire modifie suffisamment le résultat de la tâche pour justifier le coût.

Claude Fable 5.1 est-il meilleur que GPT-5.6 Sol ?

Fable 5.1 arrive en tête de l'actuel indice composite Artificial Analysis, tandis que GPT-5.6 Sol affiche des tarifs catalogue plus bas et met davantage l'accent sur l'utilisation efficace des outils et les agents parallèles. Le gagnant dépend de la charge de travail : testez Fable pour le raisonnement difficile à agent unique et GPT-5.6 Sol pour les exécutions sensibles aux coûts, fortement orientées outils ou multi-agents.

Claude Fable 5.1 prend-il en charge les entrées d'image ?

Oui. Claude Fable 5.1 accepte les entrées texte et image et peut analyser des graphiques, des diagrammes, des captures d'écran, des tableaux et du contenu visuel dans les documents pris en charge. Il produit une sortie texte plutôt que de générer directement des images.

Claude Fable 5.1 prend-il en charge l'utilisation forcée des outils ?

Non. Définir tool_choice sur any ou spécifier un outil nommé renvoie une erreur 400. Les développeurs doivent utiliser tool_choice : {"type": "auto"}, appliquer une validation stricte du schéma lorsque c'est nécessaire et indiquer clairement les conditions d'utilisation des outils dans le prompt.

Articles associés

Plus de blogs
DeepSeek Flash vs GLM 5.3 Flash : Lequel est le meilleur pour le codage et les agents ?

DeepSeek Flash vs GLM 5.3 Flash : Lequel est le meilleur pour le codage et les agents ?

DeepSeek Flash est le choix le plus rapide pour le codage interactif, tandis que GLM 5.3 Flash propose des prix standard des tokens plus bas et une légère avance dans les évaluations indépendantes globales. C'est la réponse courte. La réponse la plus utile dépend de la charge de travail. Les mesures indépendantes actuelles placent DeepSeek V4.1 Flash à environ 214 tokens de sortie par seconde, contre 114 tokens par seconde pour GLM 5.3 Flash. GLM, cependant, obtient 42 contre 40 pour DeepSeek sur le même Intelligence Index et coûte légèrement moins par tâche évaluée. La tarification ajoute une autre complication. GLM a les tarifs ordinaires d'entrée et de sortie plus bas, mais l'entrée mise en cache exceptionnellement bon marché de DeepSeek peut le rendre moins coûteux pour les agents à forte utilisation de cache fonctionnant pendant les heures creuses. Il n'y a pas de gagnant universel. Il y a un gagnant clair pour chaque type de travail. Obtenez la clé GLM-5.3 Flash Obtenez la clé Deepseek-Flash

Schuyler Stacy | 2026-09-01

Qwen3.8-Flash-Next vs GLM-5.3 Flash : Lequel est meilleur pour le codage, les agents et le prix ?

Qwen3.8-Flash-Next vs GLM-5.3 Flash : Lequel est meilleur pour le codage, les agents et le prix ?

Qwen3.8-Flash-Next et GLM-5.3 Flash sont arrivés le même jour avec un argumentaire similaire : conserver des capacités de codage et d’agent proches de la frontière tout en activant bien moins de paramètres qu’un modèle phare. Cela les fait passer pour des rivaux directs. Ils le sont — mais la comparaison est moins symétrique que leurs noms ne le suggèrent. Qwen3.8-Flash-Next est un aperçu expérimental à poids ouverts de l’architecture que Qwen prévoit de développer en direction de Qwen4. Qwen oriente les développeurs qui souhaitent son service géré et orienté production vers Qwen3.8-Flash, un modèle apparenté mais distinct doté de fonctionnalités de plateforme supplémentaires. GLM-5.3 Flash est déjà proposé à la fois comme checkpoint à poids ouverts et comme API de production. La réponse courte : choisissez GLM-5.3 Flash pour une API de production, un contexte natif d’un million de tokens, le codage visuel, les agents de longue durée et une licence MIT simple. Choisissez Qwen3.8-Flash-Next lorsque la vitesse d’inférence locale, la recherche sur l’architecture et le contrôle de la pile de service importent plus que la commodité de mise en production. Obtenir la clé GLM-5.3 Flash C’est ma recommandation par défaut. L’écart de benchmark est minime. L’écart de maturité produit ne l’est pas. Essayez GLM-5.3 Flash via GPTProto avec un accès compatible OpenAI à $0.135 par million de tokens d’entrée et $0.45 par million de tokens de sortie.

Michael Johnson | 2026-09-01

Les 7 meilleures passerelles IA pour les développeurs en 2026 : fonctionnalités, tarification et compromis de production

Les 7 meilleures passerelles IA pour les développeurs en 2026 : fonctionnalités, tarification et compromis de production

Tarifs et fonctionnalités vérifiés par rapport à la documentation produit publiée le 26 août 2026. L'erreur coûteuse en matière de passerelle IA n'est pas de choisir le deuxième meilleur produit. C'est de choisir une passerelle conçue pour un autre usage. Certaines passerelles IA vous donnent une seule clé API, un seul solde et un accès immédiat à des modèles hébergés. D'autres attendent de vous que vous apportiez les clés de vos fournisseurs et utilisent la passerelle pour le routage, la journalisation, la mise en cache et l'application des budgets. Un troisième groupe est conçu pour les équipes plateforme d'entreprise qui gèrent des API, des serveurs MCP et le trafic d'agent à agent. Ces produits ne doivent pas être jugés comme s'ils faisaient la même chose. Une clé pour votre équipe La réponse courte : GPTProto est la meilleure solution pour un accès abordable aux modèles de texte, d'image, de vidéo et d'audio sans exploiter d'infrastructure de passerelle. OpenRouter propose le catalogue de modèles et de fournisseurs le plus large publié dans cette comparaison. LiteLLM est le choix open source par défaut pour les équipes prêtes à l'auto-héberger. Cloudflare AI Gateway offre une mise en cache, des analyses et des contrôles des dépenses en dollars étonnamment accessibles. Vercel AI Gateway convient aux applications AI SDK et Next.js. Portkey, désormais rattaché à Prisma AIRS , se concentre sur l'observabilité, les garde-fous et la gouvernance à l'échelle de l'organisation. Kong AI Gateway est le choix le plus logique lorsqu'une entreprise utilise déjà Kong pour la gestion des API. Ce classement est basé sur les fonctionnalités documentées, les options de déploiement et les tarifs publiés des passerelles IA. Il ne s'agit pas d'un benchmark indépendant de latence ou de disponibilité. Lorsqu'une affirmation de performance provient uniquement d'un fournisseur, je la considère comme une affirmation de fournisseur—pas comme un résultat mesuré.

Schuyler Stacy | 2026-08-26

Qu'est-ce que DeepSeek V4 Flash Vision Exp ? Tarifs, fonctionnalités, benchmarks et limites

Qu'est-ce que DeepSeek V4 Flash Vision Exp ? Tarifs, fonctionnalités, benchmarks et limites

Plusieurs pages publiées immédiatement après le lancement de DeepSeek V4 Flash Vision Exp citent déjà le mauvais prix. C’est dire à quelle vitesse cette sortie évolue. DeepSeek V4 Flash Vision Exp est une version expérimentale de V4 Flash qui peut accepter des images en plus du texte. Il peut inspecter des captures d’écran, lire le texte dans les images, analyser des graphiques et transmettre le résultat à des outils. DeepSeek l’a publié le 21 août 2026 sous l’ID de modèle deepseek-v4-flash-vision-exp . Obtenir une clé V4 Flash Vision Exp La distinction importante, c’est ce qu’il n’est pas. Il ne s’agit pas d’un nouveau générateur d’images, ni d’une mise à niveau globale pour toutes les charges de travail V4 Flash. DeepSeek le positionne comme une branche expérimentale compatible avec la vision, avec à peu près les mêmes capacités de texte que V4 Flash. Si votre application n’envoie jamais d’image, le modèle texte standard reste le choix le plus simple. DeepSeek V4 Flash Vision Exp est désormais disponible via GPTProto . Les développeurs peuvent envoyer du texte et des images en entrée via la route GPTProto du modèle, en utilisant le même compte, la même clé API et le même solde partagé que pour les autres modèles pris en charge. La page du modèle en direct affiche actuellement le tarif standard de 0,44 $ par million de tokens d’entrée et de 1,32 $ par million de tokens de sortie, avec également des tarifs hors pointe basés sur les horaires. Le modèle reste expérimental. Avant d’acheminer le trafic de production vers lui, testez le format d’image exact, les limites de requêtes, la latence et le comportement de repli indiqués dans le guide de démarrage rapide en direct de GPTProto.

Schuyler Stacy | 2026-08-24