Travail agentique à long horizon
Gère des tâches à plusieurs étapes qui durent des heures, utilisent plusieurs outils, se remettent d’étapes échouées et progressent vers un résultat défini avec moins de supervision.
curl --request POST "https://gptproto.com/v1/chat/completions" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "claude-fable-5-1",
"messages": [
{
"role": "user",
"content": "Hello"
}
]
}'Chat, agents de codage et travail documentaire. Facturé par million de tokens — l'entrée, l'entrée en cache et la sortie sont facturées séparément. GPTProto est 10 % en dessous des tarifs officiels.
| Scénario | Liste Claude | OpenRouter | GPTProto | Économies / mois |
|---|---|---|---|---|
| Personnel10M tokens / mois (4.8M en cache) | $133.20 | $140.53 | $119.88 | −$13.32≈ $159.84 / an |
| Équipe100M tokens / mois (48M en cache) | $1332.00 | $1405.26 | $1198.80 | −$133.20≈ $1598.40 / an |
| Entreprise500M tokens / mois (240M en cache) | $6660.00 | $7026.30 | $5994.00 | −$666.00≈ $7992.00 / an |
Créez des agents de codage, des systèmes de recherche et des flux de travail documentaires complexes avec l’API Claude Fable 5.1. Elle combine une fenêtre de contexte de 1 M de tokens, jusqu’à 128 K de tokens de sortie et une réflexion adaptative toujours active. Accédez-y sur GPTProto à 10 % en dessous des tarifs standards d’entrée et de sortie d’Anthropic.
Travail agentique à long horizon
Gère des tâches à plusieurs étapes qui durent des heures, utilisent plusieurs outils, se remettent d’étapes échouées et progressent vers un résultat défini avec moins de supervision.
Ingénierie à l’échelle de la base de code
Prend en charge les fonctionnalités à l’échelle du dépôt, la revue de code, l’analyse de performances, la création de tests, le débogage des causes racines et l’implémentation sur plusieurs fichiers.
Contexte de 1 M et sortie de 128 K
Traite de grands dépôts et de la documentation technique dans une fenêtre de contexte de 1 M de tokens, puis renvoie jusqu’à 128 K de tokens en une seule réponse.
Réflexion adaptative toujours active
Le raisonnement reste activé. Ajustez l’effort de faible à maximum pour équilibrer la difficulté de la tâche, la latence et l’utilisation de tokens au lieu de désactiver la réflexion.
Claude Fable 5.1 est le modèle généralement disponible le plus performant d’Anthropic pour le raisonnement exigeant et le travail agentique à long horizon. Publié le 1er septembre 2026, il succède à Claude Fable 5 tout en conservant la même fenêtre de contexte de 1 M de tokens, une sortie maximale de 128 K et le prix catalogue de base. C’est un modèle hébergé propriétaire conçu pour les travaux difficiles qui doivent maintenir leur qualité sur de nombreuses étapes.
| Spécifications | Claude Fable 5.1 |
|---|---|
| Date de sortie | 1er septembre 2026 |
| ID de modèle API officiel | claude-fable-5-1 |
| Fenêtre de contexte | 1 000 000 tokens |
| Sortie maximale | 128 000 tokens |
| Réflexion | Adaptatif, toujours activé |
| Effort | Élevé par défaut ; de faible à maximal pris en charge |
| Date de coupure des connaissances | Juin 2026 |
Fable 5.1 s’améliore le plus nettement sur les tâches qui combinent raisonnement, outils et longues chaînes d’exécution. Anthropic rapporte 55,8 % sur Terminal-Bench 4.0 contre 42,0 % pour Fable 5. Son prix direct de lecture du cache est également passé de 1 $ à 0,25 $ par million de tokens, Anthropic estimant environ 25 % de coût en moins pour une charge de travail type et des économies pouvant atteindre environ 45 % pour les travaux fortement agentiques. Les économies réelles dépendent de la réutilisation du cache.
| Application | Pourquoi Fable 5.1 convient |
|---|---|
| Codage agentique | Planifie les modifications du dépôt, écrit des tests, vérifie les résultats et récupère après des étapes échouées. |
| Agents de longue durée | Maintient le cap sur de longues séquences d’outils et un travail asynchrone. |
| Recherche | Synthétise de vastes collections de sources et suit des instructions en plusieurs parties. |
| Travail intellectuel | Produit des livrables documentaires, tableurs, présentations et opérationnels à des fins de revue. |
L’ensemble de benchmarks publié par Anthropic indique que Fable 5.1 est destiné aux tâches où la qualité d’achèvement sur un long horizon importe plus que la latence minimale ou le prix des tokens.
| Évaluation publiée par Anthropic | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 55,8 % | 42,0 % | 52,3 % | 37,3 % |
| AutomationBench | 31,4 % | 17,1 % | 26,9 % | 19,6 % |
| CursorBench 3.2.0 | 73,4 % | 70,5 % | 70,0 % | 67,2 % |
Il s’agit de résultats exécutés par le fournisseur, et non de classements indépendants. Pour comparer avec GPT-5.6, Grok 4.6, Qwen3.8-Max-0902, Kimi K3 ou GLM-5.3 Flash, utilisez des outils, un contexte, des limites de temps et des tests d’acceptation identiques. Choisissez Fable 5.1 lorsque l’échec d’achèvement sur un long flux de travail coûte plus cher que son prix plus élevé par token.
Passer de Claude Fable 5 ou d’Opus 5 demande plus que de changer le nom du modèle :
Le choix forcé d’outil n’est pas pris en charge. tool_choice : les valeurs any et tool renvoient une erreur 400. Utilisez auto avec des instructions explicites et des schémas d’outils stricts, ou demandez du JSON structuré.
La réflexion ne peut pas être désactivée. Contrôlez les dépenses et la latence via effort ; testez medium pour les étapes routinières et réservez xhigh ou max aux gains prouvés par évaluation.
Conservez l’historique de conversation en ajout uniquement. Modifier des messages antérieurs peut invalider les blocs de réflexion conservés. Après une compaction côté client, supprimez les blocs de réflexion obsolètes ou repartez d’un résumé propre.
Utilisez Claude Fable 5.1 pour les travaux difficiles, de longue durée et coûteux à redémarrer : ingénierie à l’échelle d’un dépôt, débogage ouvert, recherche multi-documents ou agents coordonnant plusieurs outils. Utilisez un modèle moins coûteux pour le chat courant, l’extraction, la classification et la génération de code courte.
Guides, comparaisons et mises à jour liés à ce modèle.
Tous les articles
Claude Fable 5.1 et Mythos 5.1 partagent un même modèle mais diffèrent en termes d’accès. Découvrez les tarifs, fonctionnalités, benchmarks, garde-fous et changements de migration d’API.

Méta description : Comparez GLM 5.3 Flash vs DeepSeek V4 Flash pour le codage, le travail frontend, les agents, la vitesse, le contexte et la tarification API afin de choisir le meilleur modèle.

Qwen3.8-Flash-Next vs GLM-5.3 Flash comparés pour le codage, les agents, le travail frontend, la vitesse, la tarification, le contexte, les licences et l’utilisation en production.

Qu’est-ce que Tencent Hy4 Preview ? Découvrez son statut de publication, sa conception MoE 770B, son contexte de 1M, la tarification API, les benchmarks, les limites et les comparaisons de modèles.