Preise+7% Bonus
Tiffany Layne2026-07-02

Die besten Claude-Alternativen im Jahr 2026: Günstigerer API-Zugriff, ehrlich verglichen

Claude-Alternativen für Entwickler verglichen: Nutze dasselbe Opus 4.8 und Sonnet 5 für etwa 20 % weniger oder wechsle zu DeepSeek, GLM und Grok. API-Preise für 2026 im Überblick.

Die besten Claude-Alternativen im Jahr 2026: Günstigerer API-Zugriff, ehrlich verglichen

Hier ist der unangenehme Teil, den ich gleich zu Beginn ansprechen muss, weil ihn die meisten Listen zu „Claude-Alternativen“ unterschlagen: Im neutralen Artificial Analysis Intelligence Index steht Claude Opus 4.8 mit rund 56 weiterhin an der Spitze — knapp vor GPT-5.5 (~55) und Claude Sonnet 5 (~53). Wenn du also nach einer Alternative suchst, weil du glaubst, dass es irgendwo etwas Intelligenteres gibt, lautet die ehrliche Antwort für die meisten Aufgaben: nein, nicht wirklich.

Das ist nicht der Grund, warum Entwickler wechseln. Ich schreibe beruflich API-Integrationsanleitungen, und die Wechsel, die ich ständig beobachte, haben nichts mit den Fähigkeiten zu tun. Es geht um die Rechnung, die Rate Limits und die Abhängigkeit von einem einzigen Anbieter. Diese Liste ist daher für genau diese Realität gedacht. Meine Regel für jedes unten aufgeführte Modell: zuerst mit einer Zahl nennen, wofür es gut ist, und dann die eine Sache nennen, die dir zum Verhängnis werden kann.

Kurzfassung: Wenn du erstklassige Qualität möchtest, musst du Claude nicht einmal verlassen — du kannst dasselbe Opus 4.8 oder Sonnet 5 über einen Aggregator für ungefähr 20 % weniger ausführen. Wenn die Kosten der entscheidende Faktor sind, machen DeepSeek, GLM, Grok, Qwen und Kimi jeweils Abstriche, um günstiger zu sein. Im Folgenden findest du die ehrliche Einschätzung dieses Kompromisses.

Inhaltsverzeichnis

Warum Entwickler über Claude hinausblicken

Vier Gründe tauchen immer wieder auf, und keiner davon lautet: „Claude ist dümmer geworden.“

Preis pro Token. Opus 4.8 kostet offiziell 5 $ / 25 $ pro Million Input-/Output-Tokens. Sonnet 5 ist günstiger — 2 $ / 10 $ als Einführungspreis bis zum 31. August 2026, danach steigt der Preis auf 3 $ / 15 $. Auf der Verbraucherseite kostet Claude Pro etwa 20 $ pro Monat, während Max 100–200 $ pro Monat kostet. Nutzer von Claude Code berichten regelmäßig, dass sie bereits zur Wochenmitte an ihre wöchentlichen Limits stoßen. Die Modelle sind hervorragend; nur der Zähler läuft schnell.

Die effektiven Kosten liegen über dem Listenpreis. Das ist der Teil, den die meisten Vergleichsartikel auslassen. Sonnet 5 wird mit einem überarbeiteten Tokenizer ausgeliefert, der dieselbe Eingabe in 1,0–1,35× so viele Tokens umwandeln kann. Der Tokenizer von Opus 4.7 konnte zuvor für identischen Text bis zu 35 % mehr Tokens erzeugen. Die Preise pro Token haben sich nicht geändert, aber deine tatsächliche Rechnung kann es trotzdem, weil mehr Tokens abgerechnet werden. Wenn du dein Budget anhand einer Preisliste geplant hast, ohne deinen eigenen Text zu testen, solltest du mit einer Abweichung rechnen.

Abhängigkeit von einem einzelnen Modell. Die Tools von Anthropic führen ausschließlich Anthropic-Modelle aus. Wenn Claude bei einer bestimmten Aufgabenart Schwierigkeiten hat, kannst du nicht einfach ein anderes Modell einsetzen, ohne deine Integration neu zu erstellen. Für ein Einzelprojekt ist das in Ordnung. Für ein Produkt ist es eine Abhängigkeit, für die du dich nicht bewusst entschieden hast.

Rate Limits unter Last. Selbst kostenpflichtige Tarife werden gedrosselt, und das Limit wird früher erreicht, als die meisten Teams einplanen.

Eine Aussage, die du dir merken solltest: Menschen verlassen Claude, um weniger auszugeben und die Abhängigkeit zu beenden — nicht, um ein besseres Modell zu bekommen.

Option 0: dasselbe Claude, etwa 20 % günstiger

Bevor du das Modell wechselst, solltest du überlegen, gar nicht zu wechseln. Wenn die Qualität von Claude genau das ist, was du möchtest, und nur der Preis das Problem darstellt, verkauft ein Aggregator wie GPT Proto die identischen Anthropic-Modelle über ein gemeinsames Prepaid-Guthaben zu einem Preis, der ungefähr 20 % unter den eigenen API-Tarifen von Anthropic liegt:

  • Claude Opus 4.8 — 4 $ / 20 $ gegenüber 5 $ / 25 $ bei Anthropic
  • Claude Sonnet 5 — 1,6 $ / 8 $ gegenüber dem Einführungspreis von 2 $ / 10 $
  • Claude Haiku 4.5 — 0,8 $ / 4 $ gegenüber 1 $ / 5 $
    Der Nachteil dieses Weges, damit er nicht verschwiegen wird: Es handelt sich weiterhin um ein Modell von Anthropic, daher bleiben Claudes Inhaltsrichtlinien und sein Ablehnungsverhalten unverändert bestehen — ein Aggregator lockert diese Regeln nicht. Außerdem fügst du eine weitere Ebene zwischen dir und dem Anbieter hinzu. Noch ein wichtiger Hinweis zur zeitlichen Planung des Budgets: Der obige Vergleich für Sonnet 5 bezieht sich auf den Einführungspreis von Anthropic. Nach dem 31. August 2026 beträgt der offizielle Tarif 3 $ / 15 $. Dann ist derselbe Preis von 1,6 $ / 8 $ zwar ein größerer Rabatt, aber die Formulierung „20 % günstiger“ beschreibt die Situation nicht mehr korrekt. (Die Details zu den einzelnen Modellen findest du in GPT Protos Übersicht zu Sonnet 5.)

Meine Einschätzung: Für Teams, deren einzige Beschwerde die Rechnung ist, ist dies der reibungsärmste Schritt auf der Liste. Du änderst nichts an deinen Prompts oder deinem Qualitätsanspruch.

Die alternativen Modelle, für die sich ein Wechsel lohnt

Wenn die Kosten wichtiger sind als die letzten Qualitätspunkte, sind dies die Modelle, die sich tatsächlich zu integrieren lohnen. Die angegebenen Preise stammen von GPT Proto und sind daher direkt über ein gemeinsames Guthaben vergleichbar.

GPT-5.5 — OpenAIs Flaggschiff, auf dem Intelligence Index mit etwa 55 an zweiter Stelle und meiner Erfahrung nach das stärkste Modell der Gruppe für kreatives Schreiben. Der Nachteil: Es ist keine Sparoption. Der offizielle Preis beträgt 5 $ / 30 $, mit einem Verhältnis von 6× Output zu Input und versteckten Reasoning-Tokens, die zum Output-Tarif abgerechnet werden. Dadurch kann eine kurze Antwort unsichtbare hohe Kosten verursachen. Am besten für Teams, die das breiteste Ökosystem und erstklassige Texte wünschen. Bei GPT Proto: 4 $ / 24 $. → gpt-5.5

DeepSeek V4 Flash / Pro — die beste Preis-Leistungs-Wahl, und zwar mit deutlichem Abstand. V4 Flash kostet offiziell 0,14 $ / 0,28 $, V4 Pro 1,74 $ / 3,48 $ (die Einführungsaktion endete am 31. Mai 2026, daher gilt dies nun als regulärer Preis). Beide Modelle sind unter MIT-Lizenz mit offenen Gewichten verfügbar und bieten einen Kontext von 1 Mio. Tokens. DeepSeek stellt neben der OpenAI-Schnittstelle auch einen Anthropic-kompatiblen Endpunkt bereit, sodass die Migration lediglich eine Änderung der Basis-URL erfordert. Der Kompromiss: Auf Artificial Analysis’ Messung von Wissen und Halluzinationen halluziniert DeepSeek V4 Pro merklich häufiger als vergleichbare Modelle mit offenen Gewichten. Außerdem stammt es nicht aus einem US-Labor, was für manche Richtlinien zur Datenverwaltung relevant sein wird. Am besten für volumenstarke, kostenempfindliche Produktion. Bei GPT Proto: Flash 0,11 $ / 0,22 $, Pro 1,39 $ / 2,78 $. → deepseek-v4-flash, deepseek-v4-pro

GLM-5.2 — das Modell mit offenen Gewichten von Z.ai und der höchstplatzierte Eintrag mit offenen Gewichten auf dem Intelligence Index (~51), entwickelt für langfristiges agentisches Programmieren, MIT-lizenziert und mit einem Kontext von 1 Mio. Tokens. Die ehrliche Einschränkung: Bei den schwierigsten Evaluierungen für Reasoning und agentisches Programmieren liegen die besten Modelle mit offenen Gewichten weiterhin deutlich hinter der geschlossenen Spitzenklasse. Am besten, wenn du eine Qualität nahe der Spitzenklasse plus die Option zum späteren Self-Hosting möchtest. Bei GPT Proto: 1,26 $ / 3,96 $. → glm-5.2 (GPT Proto bietet außerdem eine Erklärung zu GLM-5.2.)

Grok 4.3 — das Modell von xAI und das günstigste der vier geschlossenen Spitzenmodelle, mit konfigurierbarem Reasoning-Aufwand und Echtzeitfunktionen. Vorsicht: Einige Evaluierungen weisen bei Groks schnelleren Reasoning-Varianten auf höhere Halluzinationsraten hin. Es ist daher nicht die erste Wahl, wenn faktische Präzision die wichtigste Anforderung ist. Am besten für preisbewusste Teams, die trotzdem agentische Fähigkeiten und Tool-Nutzung auf Spitzenklasseniveau wünschen. Bei GPT Proto: 0,75 $ / 1,5 $. → grok-4.3

Gemini 3 Flash — Googles günstige multimodale Option, stark beim Preis-Leistungs-Verhältnis für Text-und-Medien-Aufgaben sowie die Verarbeitung langer Dokumente. Der Nachteil: Die günstige Flash-Stufe liegt bei den schwierigsten Reasoning-Aufgaben unterhalb der Spitzenklasse, und die Preise einiger Gemini-Tarife steigen bei sehr großen Kontexten. Am besten für günstige multimodale Workloads. Bei GPT Proto: 0,3 $ / 1,8 $. → gemini-3-flash-preview

Qwen 3.7 Max — Alibabas Reasoning-Modell der mittleren Klasse mit einem Kontext von 1 Mio. Tokens und einem soliden Preis-Leistungs-Verhältnis. Der Kompromiss: Es ist ausschließlich über die API verfügbar, hat keine Verbraucheroberfläche und ein dünneres Ökosystem als die US-Labore. Am besten für Produktion im mittleren Segment bei großem Maßstab. Bei GPT Proto: 0,36 $ / 1,44 $. → qwen3.7-max

Kimi K2.6 — das Modell von Moonshot, das auf dem Intelligence Index nahe der Spitze der Modelle mit offenen Gewichten liegt, wobei der Input-Preis etwa 50 % unter dem Referenzpreis liegt. Bei den schwierigsten Reasoning-Benchmarks liegt es hinter der geschlossenen Spitzenklasse. Am besten für Teams, die Modelle mit offenen Gewichten bevorzugen. Bei GPT Proto: Input 0,475 $, Output 2 $. → kimi-k2.6

Direktvergleich: Qualität und Preis über ein gemeinsames Guthaben

Der Grund, warum diese Tabelle anderswo schwer zu finden ist: Die meisten Listen zu Claude-Alternativen vergleichen Verbraucher-Chat-Apps oder Coding-CLIs, nicht API-Modelle auf einer einheitlichen Basis pro Token und über ein gemeinsames Guthaben. Genau diese Perspektive bietet die Tabelle. Die Werte des Intelligence Index sind ungefähre Artificial-Analysis-Werte; die Preise gelten pro Million Input-/Output-Tokens bei GPT Proto.

Modell Intelligence Index (ungefähr) Preis bei GPT Proto (Input / Output) Am besten für Worauf du achten solltest
Claude Opus 4.8 ~56 (#1) 4 $ / 20 $ Programmierung und Agenten der Spitzenklasse Premiumstufe; weiterhin das teuerste Modell hier
Claude Sonnet 5 ~53 1,6 $ / 8 $ Fast Opus-Qualität zu geringeren Kosten Einführungspreis endet am 31. Aug. 2026 → 3 $ / 15 $
GPT-5.5 ~55 4 $ / 24 $ Ökosystem, kreatives Schreiben 6× Output-Verhältnis + versteckte Reasoning-Tokens
DeepSeek V4 Flash Mittleres Open-Modelle-Segment 0,11 $ / 0,22 $ Großes Volumen, Kosten im Vordergrund Mehr Halluzinationen; kein US-Labor
DeepSeek V4 Pro ~44 (offen) 1,39 $ / 2,78 $ Günstiges Reasoning nahe der Spitzenklasse Dieselben Hinweise zu Governance und Halluzinationen
GLM-5.2 ~51 (führendes offenes Modell) 1,26 $ / 3,96 $ Agentisches Programmieren mit offenen Gewichten Liegt bei den schwierigsten Aufgaben hinter der geschlossenen Spitzenklasse
Grok 4.3 Spitzenklasse 0,75 $ / 1,5 $ Günstigstes Spitzenmodell, Tool-Nutzung Halluzinationen in schnellen Reasoning-Modi
Gemini 3 Flash Unterhalb der Spitzenklasse 0,3 $ / 1,8 $ Günstige Multimodalität Die Flash-Stufe erreicht nicht das maximale Reasoning-Niveau
Qwen 3.7 Max Mittlere Klasse 0,36 $ / 1,44 $ Skalierung im mittleren Segment Nur API, dünneres Ökosystem
Kimi K2.6 Führendes offenes Segment 0,475 $ / 2 $ Fürsprecher offener Gewichte Liegt beim schwierigsten Reasoning zurück

So wechselst du: eine API, ein Guthaben

Der praktische Vorteil eines Aggregators besteht nicht nur im Preis — der Wechsel zwischen Modellen wird zu einer Änderung in einer Zeile statt zu einer kompletten Neuentwicklung der Integration. Damit wird das Abhängigkeitsproblem direkt gelöst.

Zunächst die Voraussetzung: Erstelle ein kostenloses Konto, füge Guthaben hinzu und generiere im Dashboard einen API-Schlüssel. Ein Schlüssel funktioniert für jedes Modell auf der Plattform.

Für Aufrufe an Claude wird die Anthropic-kompatible Schnittstelle verwendet:

curl --request POST "https://gptproto.com/v1/messages" \
  --header "Authorization: Bearer $GPTPROTO_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "Content-Type: application/json" \
  --data '{
    "model": "claude-sonnet-5",
    "max_tokens": 1024,
    "messages": [
      { "role": "user", "content": "Summarize the tradeoffs of switching LLM providers." }
    ]
  }'

Jedes Nicht-Claude-Modell auf der Liste verwendet die OpenAI-kompatible Schnittstelle. Das bedeutet: Derselbe Code mit einer anderen Modell-Zeichenfolge. Hier ist ein Beispiel mit dem OpenAI-Python-SDK, das auf GPT Proto verweist:

from openai import OpenAI
 
client = OpenAI(
    api_key="YOUR_GPTPROTO_API_KEY",
    base_url="https://gptproto.com/v1",
)
 
resp = client.chat.completions.create(
    model="gpt-5.5",   # swap for "deepseek-v4-flash", "glm-5.2", "grok-4.3", "qwen3.7-max"
    messages=[
        {"role": "user", "content": "Explain what changed between DeepSeek V3.2 and V4."}
    ],
)
print(resp.choices[0].message.content)

Genau darum geht es bei der Zeile model=. Leite günstige Klassifizierungsaufgaben an DeepSeek V4 Flash, schwieriges Reasoning an GPT-5.5 oder Opus 4.8 und Aufgaben mit offenen Gewichten an GLM-5.2 weiter — derselbe Schlüssel, dasselbe Guthaben, kein zweites Abrechnungsportal. Durchsuche das gesamte Angebot im Modellkatalog.

Welches Modell solltest du wählen?

Es gibt keinen eindeutigen Gewinner. Ordne das Modell daher der jeweiligen Aufgabe zu:

  • Erstklassige Qualität, 20 % günstiger: Nutze Claude Opus 4.8 oder Sonnet 5 über einen Aggregator.
  • Bei großem Maßstab so wenig wie möglich ausgeben: DeepSeek V4 Flash für 0,11 $ / 0,22 $.
  • Offene Gewichte und keine Abhängigkeit: GLM-5.2 oder DeepSeek, wenn es noch günstiger sein soll.
  • Ökosystem und kreatives Schreiben: GPT-5.5.
  • Spitzenklassenfähigkeiten zum kleinen Preis: Grok 4.3.
  • Günstige Multimodalität: Gemini 3 Flash.
    Wenn ich ein Standardmodell für ein kostenbewusstes Produktionsteam wählen müsste, das bei schwierigen Aufgaben trotzdem auf das beste Modell zurückgreifen möchte, würde ich DeepSeek V4 Flash für den Großteil des Datenverkehrs einsetzen und Opus 4.8 als Reserve bereithalten — beide sind mit demselben Schlüssel erreichbar.

Creative Studio

Erstelle Bilder, Videos und mehr mit APIs für den Produktionseinsatz.

Mit dem Erstellen beginnen
Creative Studio
Verwandte Modelle
Alle Modelle
Claude
10% OFF
Claude
10% OFF
Claude
10% OFF
OpenAI
20% OFF

FAQ

Gibt es eine günstigere Möglichkeit, Claudes API zu nutzen?

Ja. Aggregatoren verkaufen Anthropics Modelle mit Rabatt weiter — zum Beispiel Opus 4.8 für 4 $ / 20 $ und Sonnet 5 für 1,6 $ / 8 $ gegenüber 5 $ / 25 $ bzw. 2 $ / 10 $ bei Anthropic, also ungefähr 20 % günstiger über ein gemeinsames Prepaid-Guthaben.

Was ist die günstigste Claude-Alternative für Entwickler?

DeepSeek V4 Flash ist mit offiziell 0,14 $ / 0,28 $ (und über einen Aggregator noch günstiger) die günstigste leistungsfähige Option. Der Kompromiss besteht in einer höheren Halluzinationsrate als bei der geschlossenen Spitzenklasse.

Gibt es Open-Source-Alternativen zu Claude?

Ja — GLM-5.2, DeepSeek V4 und Kimi K2.6 verfügen über offene Gewichte und freizügige Lizenzen. Du kannst sie daher jetzt über die API nutzen und später selbst hosten.

Muss ich meinen Code neu schreiben, um von Claude zu wechseln?

Nicht über eine einheitliche API. Nicht-Claude-Modelle verwenden den OpenAI-kompatiblen Endpunkt, sodass für den Wechsel nur die Modellzeichenfolge geändert werden muss. Claude selbst verwendet den Anthropic-kompatiblen Endpunkt mit demselben Schlüssel.

Ist Claude 2026 weiterhin das beste KI-Modell?

Im neutralen Artificial Analysis Intelligence Index liegt Claude Opus 4.8 derzeit an erster Stelle, knapp vor GPT-5.5. Die meisten Alternativen konkurrieren eher bei Kosten, Flexibilität oder offenen Gewichten als bei der reinen Leistungsfähigkeit.

Verwandte Artikel

Weitere Blogbeiträge
Claude Fable 5: Der vollständige Leitfaden und ehrliche Test (2026)

Claude Fable 5: Der vollständige Leitfaden und ehrliche Test (2026)

Anthropic warnte monatelang davor, dass seine leistungsfähigsten Modelle zu gefährlich würden, um sie allgemein zu veröffentlichen. Dann veröffentlichte das Unternehmen am 9. Juni 2026 doch eines – zumindest teilweise. Claude Fable 5 ist das erste Modell aus Anthropics oberster „Mythos“-Klasse, das die Öffentlichkeit tatsächlich aufrufen kann, und es steht eine ganze Stufe über der Opus-Familie. Der Haken ist ungewöhnlich: Bei einem Teil sensibler Fragen leitet die Version, für die Sie bezahlen, Ihre Anfrage unbemerkt an ein anderes, schwächeres Modell weiter und lässt dieses antworten. Diese eine Designentscheidung verrät bereits vieles darüber, was Fable 5 anders macht – und genau hier beginnt dieser Leitfaden. Dies ist ein Leitfaden für Entwickler aus der Praxis, keine Zusammenfassung zum Launch-Tag. Wir haben die Spezifikationen und das Verhalten aus Anthropics eigener Dokumentation, unabhängigen Benchmarks und den ersten Praxistests seit dem Launch zusammengetragen – und Zahlen, die wir nicht überprüfen konnten, bewusst weggelassen.

Schuyler Stacy | 2026-06-11

Was ist GLM 5.2? Open-Weight-Coding zum Sechstel des Preises

Was ist GLM 5.2? Open-Weight-Coding zum Sechstel des Preises

Ein chinesisches Labor hat ein Modell veröffentlicht, das du kostenlos herunterladen, auf deiner eigenen Hardware ausführen und für ungefähr ein Sechstel dessen betreiben kannst, was geschlossene Frontier-Modelle verlangen – und das bei realen Coding-Benchmarks nur wenige Punkte hinter Claude Opus 4.8 liegt. Dann wurde das Ganze ausgeliefert, ohne auch nur einen einzigen offiziellen Benchmark zu veröffentlichen. Das ist GLM 5.2, und der Abstand zwischen „keine Marketingzahlen“ und „innerhalb einer Woche fast an der Spitze jeder unabhängigen Rangliste“ ist der Hauptgrund, warum es sich lohnt, das Modell zu verstehen. Ich schreibe viele solcher Erklärartikel, und die meisten Beiträge zu neuen Modellen sind schnell vergessen, weil sie nur ein Datenblatt wiederholen. Dieser hier unterscheidet sich in einem Punkt, der für Entwickler tatsächlich wichtig ist: Die Gewichte stehen unter einer MIT-Lizenz offen zur Verfügung. Dadurch lässt sich die übliche Frage – „Ist der Benchmark echt oder nur Marketing?“ – ungewöhnlich klar beantworten. Die Menschen haben das Modell heruntergeladen und selbst getestet. Hier erfährst du, was GLM 5.2 ist, wie es funktioniert und wo seine Grenzen liegen.

Michael Johnson | 2026-07-15

Doubao API: Der vollständige Leitfaden (2026) – Welches Modell Sie aufrufen sollten und wie

Doubao API: Der vollständige Leitfaden (2026) – Welches Modell Sie aufrufen sollten und wie

Suchen Sie nach „doubao api“, stoßen Sie schnell auf eine Sackgasse. Die offizielle Konsole heißt Volcano Engine, die Seiten sind standardmäßig auf Chinesisch, und bei der Registrierung ist eine Identitätsprüfung erforderlich, die die meisten Entwickler außerhalb Chinas nicht an einem Nachmittag abschließen können. Dazu kommt die Namensgebung: Doubao, Dola, Cici, Seed, Seedream, Seedance, Volcengine – alles ByteDance, und keines davon ist offensichtlich das, wonach Sie gesucht haben. Ich schreibe Integrationsleitfäden für GPTProto, und nach Doubao werde ich am häufigsten gefragt. Deshalb ist dies der Leitfaden, den ich selbst gerne gehabt hätte: Welches Doubao-Modell welche Aufgabe übernimmt, was die einzelnen Modelle tatsächlich kosten und wie Sie sie per Copy-and-paste aufrufen – für Text, Bilder und Videos – über einen einzigen Endpunkt, ohne chinesische Telefonnummer. Hier sehen Sie ein Bild, das das Videomodell Seedance 2.0 aus einem Textprompt erzeugt hat – genau über die API aufgerufen, wie es der weiter unten stehende Code macht. Wir arbeiten uns Schritt für Schritt dorthin vor.

Schuyler Stacy | 2026-06-23

Claude Sonnet 5: Was neu ist, was es kostet und wie es sich mit Sonnet 4.6 vergleicht (Leitfaden 2026)

Claude Sonnet 5: Was neu ist, was es kostet und wie es sich mit Sonnet 4.6 vergleicht (Leitfaden 2026)

Anthropic hat Claude Sonnet 5 am 30. Juni 2026 veröffentlicht, und innerhalb einer Stunde war meine Feed voller derselben zwei Fragen: Sollte ich von Sonnet 4.6 wechseln, und stimmt die Aussage „derselbe Listenpreis wie 4.6“ tatsächlich, sobald man echten Traffic darüber laufen lässt? Genau diese Fragen interessieren auch mich. Deshalb dreht sich dieser Leitfaden um sie und nicht um die Höhepunkte des Launch-Posts. Alle technischen Angaben hier gehen auf den offiziellen Launch-Post und die Dokumentation von Anthropic zurück. Wenn eine Zahl aus der Presseberichterstattung statt aus einer Seite stammt, die ich direkt lesen konnte, sage ich das dazu. Eine Sache vorweg, weil viele frühe Berichte sie falsch darstellen: Der Vorgänger von Sonnet 5 ist Sonnet 4.6 (veröffentlicht im Februar 2026), nicht Sonnet 4.5. Wenn du mit 4.5 oder einem noch älteren 3.5 vergleichst, vergleichst du zwei Upgrades auf einmal, und die folgenden Zahlen werden nicht zusammenpassen. Darauf komme ich noch zurück.

Schuyler Stacy | 2026-07-01