Agentische Arbeit über lange Zeiträume
Bewältigt mehrstufige Aufgaben, die sich über Stunden erstrecken, mehrere Tools nutzen, sich von fehlgeschlagenen Schritten erholen und mit weniger Aufsicht auf ein definiertes Ergebnis hinarbeiten.
curl --request POST "https://gptproto.com/v1/chat/completions" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "claude-fable-5-1",
"messages": [
{
"role": "user",
"content": "Hello"
}
]
}'Chat, Coding-Agenten und Dokumentenarbeit. Preise pro 1 Mio. Tokens – Eingabe, gecachte Eingabe und Ausgabe werden separat abgerechnet. GPTProto liegt 10% unter den offiziellen Preisen.
| Szenario | Claude Liste | OpenRouter | GPTProto | Du sparst / Monat |
|---|---|---|---|---|
| Persönlich10 Mio. Tokens / Monat (4.8 Mio. im Cache) | $133.20 | $140.53 | $119.88 | −$13.32≈ $159.84 / Jahr |
| Team100 Mio. Tokens / Monat (48 Mio. im Cache) | $1332.00 | $1405.26 | $1198.80 | −$133.20≈ $1598.40 / Jahr |
| Business500 Mio. Tokens / Monat (240 Mio. im Cache) | $6660.00 | $7026.30 | $5994.00 | −$666.00≈ $7992.00 / Jahr |
Entwickle Coding-Agenten, Forschungssysteme und komplexe Dokumenten-Workflows mit der Claude Fable 5.1 API. Sie kombiniert ein Kontextfenster mit 1M Tokens, bis zu 128K Ausgabetokens und immer aktives adaptives Denken. Nutze sie auf GPTProto zu Preisen, die 10 % unter den Standardtarifen von Anthropic für Ein- und Ausgaben liegen.
Agentische Arbeit über lange Zeiträume
Bewältigt mehrstufige Aufgaben, die sich über Stunden erstrecken, mehrere Tools nutzen, sich von fehlgeschlagenen Schritten erholen und mit weniger Aufsicht auf ein definiertes Ergebnis hinarbeiten.
Engineering auf Codebase-Ebene
Unterstützt repositoryweite Features, Code-Reviews, Performance-Analysen, die Erstellung von Tests, Debugging zur Ursachenfindung und Implementierungen über mehrere Dateien hinweg.
1M Kontext und 128K Ausgabe
Verarbeitet große Repositories und technische Dokumentationen in einem Kontextfenster mit 1M Tokens und gibt anschließend bis zu 128K Tokens in einer Antwort aus.
Immer aktives adaptives Denken
Die Denkfunktion bleibt aktiviert. Passe den Aufwand von niedrig bis maximal an, um Aufgabenschwierigkeit, Latenz und Tokenverbrauch auszubalancieren, statt die Denkfunktion auszuschalten.
Claude Fable 5.1 ist Anthropics leistungsfähigstes allgemein verfügbares Modell für anspruchsvolles Schlussfolgern und lang andauernde agentische Aufgaben. Es wurde am 1. September 2026 veröffentlicht und folgt auf Claude Fable 5. Dabei behält es dasselbe Kontextfenster von 1 Mio. Tokens, eine maximale Ausgabe von 128.000 Tokens und den gleichen Grundlistenpreis bei. Das proprietäre, gehostete Modell wurde für schwierige Aufgaben entwickelt, bei denen die Qualität über viele Schritte hinweg erhalten bleiben muss.
| Spezifikationen | Claude Fable 5.1 |
|---|---|
| Veröffentlichungsdatum | 1. September 2026 |
| Offizielle API-Modell-ID | claude-fable-5-1 |
| Kontextfenster | 1.000.000 Tokens |
| Maximale Ausgabe | 128.000 Tokens |
| Denkmodus | Adaptiv, immer aktiviert |
| Aufwand | Standardmäßig hoch; von niedrig bis maximal unterstützt |
| Wissensstand bis | Juni 2026 |
Fable 5.1 zeigt die deutlichsten Verbesserungen bei Aufgaben, die Schlussfolgern, Tools und lange Ausführungsketten kombinieren. Anthropic gibt für Terminal-Bench 4.0 einen Wert von 55,8 % an, gegenüber 42,0 % für Fable 5. Auch der Preis für direkte Cache-Lesevorgänge sank von 1 $ auf 0,25 $ pro Million Tokens. Anthropic schätzt, dass typische Workloads dadurch etwa 25 % weniger kosten und bei stark agentischen Aufgaben Einsparungen von bis zu rund 45 % möglich sind. Die tatsächlichen Einsparungen hängen von der Cache-Wiederverwendung ab.
| Anwendung | Warum Fable 5.1 geeignet ist |
|---|---|
| Agentisches Programmieren | Plant Änderungen am Repository, schreibt Tests, überprüft Ergebnisse und fängt fehlgeschlagene Schritte ab. |
| Lang laufende Agenten | Behält bei längeren Tool-Sequenzen und asynchronen Aufgaben die Richtung bei. |
| Recherche | Führt umfangreiche Quellensammlungen zusammen und befolgt mehrteilige Anweisungen. |
| Wissensarbeit | Erstellt Dokumente, Tabellen, Präsentationen und operative Arbeitsergebnisse zur Überprüfung. |
Die von Anthropic veröffentlichten Benchmark-Ergebnisse deuten darauf hin, dass Fable 5.1 für Aufgaben gedacht ist, bei denen die Qualität der Ergebnisse über längere Abläufe wichtiger ist als minimale Latenz oder niedrige Tokenkosten.
| Von Anthropic veröffentlichte Evaluierung | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
Dies sind vom Anbieter durchgeführte Ergebnisse, keine unabhängigen Rankings. Für Vergleiche mit GPT-5.6, Grok 4.6, Qwen3.8-Max-0902, Kimi K3 oder GLM-5.3 Flash sollten dieselben Tools, derselbe Kontext, dieselben Zeitlimits und dieselben Abnahmetests verwendet werden. Wählen Sie Fable 5.1, wenn ein fehlgeschlagener Abschluss in einem langen Workflow teurer ist als der höhere Tokenpreis.
Der Wechsel von Claude Fable 5 oder Opus 5 erfordert mehr als nur eine Änderung des Modellnamens:
Die erzwungene Tool-Auswahl wird nicht unterstützt. tool_choice mit den Werten any und tool führen zu einem 400-Fehler. Verwenden Sie auto mit expliziten Anweisungen und strikten Tool-Schemas oder fordern Sie strukturiertes JSON an.
Der Denkmodus kann nicht deaktiviert werden. Steuern Sie Kosten und Latenz über effort; testen Sie für Routinephasen die mittlere Stufe und reservieren Sie xhigh oder max für nachweisliche Verbesserungen in Evaluierungen.
Der Gesprächsverlauf muss ausschließlich ergänzt werden. Änderungen an früheren Nachrichten können gespeicherte Denkblöcke ungültig machen. Entfernen Sie nach der clientseitigen Komprimierung veraltete Denkblöcke oder beginnen Sie erneut mit einer sauberen Zusammenfassung.
Verwenden Sie Claude Fable 5.1 für schwierige, lang andauernde Aufgaben, deren Neustart teuer wäre: technische Arbeit auf Repository-Ebene, offene Fehlersuche, Recherche über mehrere Dokumente oder Agenten, die mehrere Tools koordinieren. Für Routine-Chats, Extraktion, Klassifizierung und kurze Codegenerierung eignet sich ein kostengünstigeres Modell.
Anleitungen, Vergleiche und Updates zu diesem Modell.
Alle Artikel
Claude Fable 5.1 und Mythos 5.1 basieren auf demselben Modell, unterscheiden sich jedoch beim Zugang. Erfahre mehr über Preise, Funktionen, Benchmarks, Schutzmaßnahmen und Änderungen bei der API-Migration.

Meta-Beschreibung: Vergleiche GLM 5.3 Flash und DeepSeek V4 Flash für die Programmierung, Frontend-Arbeit, Agents, Geschwindigkeit, Kontext und API-Preise, um das bessere Modell auszuwählen.

Qwen3.8-Flash-Next und GLM-5.3 Flash im Vergleich für Programmierung, Agents, Frontend-Arbeit, Geschwindigkeit, Preise, Kontext, Lizenzen und den Einsatz in der Produktion.

Was ist Tencent Hy4 Preview? Erfahre mehr über den Veröffentlichungsstatus, das 770B-MoE-Design, den 1M-Kontext, API-Preise, Benchmarks, Einschränkungen und Modellvergleiche.