Preise+7% Bonus

Eine kostengünstigere API fürCLI-Coding-Agenten

Behalten Sie die Coding-CLI bei, die Sie bereits verwenden. Vergleichen Sie die GPTProto-Preise für unterstützte Modelle, verbinden Sie sich über das Protokoll, das Ihr Client erwartet, und testen Sie das Setup anhand einer Aufgabe, bevor Sie einen vollständigen Workflow umstellen.

Betreibt Modelle von
Richte GPTProto für Claude Code ein.

1. Setze in ~/.claude/settings.json unter "env":
     ANTHROPIC_BASE_URL = "https://gptproto.com"
     ANTHROPIC_API_KEY  = "sk-gptproto-<your key>"
   Behalte es genau so bei - kein /v1, kein abschließender Schrägstrich. Claude Code hängt selbst /v1/messages an...
Get API Key
// Warum wechseln

Bei langen Coding-Sessionszählt jedes API-Detail.

Ein Refactoring kann viele Modellaufrufe umfassen. Bevor du den Anbieter wechselst, prüfe den Preis für dein Modell, das Client-Protokoll und den Umgang mit fehlgeschlagenen Anfragen.

01

Die Rechnung wächst über lange Sessions hinweg.

Repositoryweite Änderungen und wiederholte Testschleifen können mehr Input-, Output- und gecachte Tokens verbrauchen als ein kurzer Chat. Vergleiche den Preis für das Modell und die Token-Typen, die du tatsächlich verwendest.

Modellpreise vergleichen →
02

Ein 429 kann einen Durchlauf unterbrechen.

Rate-Limits und Upstream-Fehler können eine Coding-Session unterbrechen. Prüfe das Retry-Verhalten deines Clients und teste die von GPTProto unterstützten Routen, bevor du wichtige Arbeit verlagerst.

Wie Anfragen behandelt werden →
03

Ein nicht passender Endpoint kostet Zeit.

Claude Code, Codex CLI und OpenCode verwenden nicht alle dieselbe API-Struktur. Wähle zuerst deinen Client und folge dann dem passenden Endpoint- und Modell-Setup.

Lade $100 jetzt auf → Wan 3.0 kostenlose CreditsSep 29 – Oct 10 · Kontingent begrenzt · Wer zuerst kommt, mahlt zuerst
Jetzt Guthaben aufladen
// Live-Preise

Vergleichen Sie die Coding-Modelle,die Sie bereits nutzen.

Vergleichen Sie die aktuellen Input-, Output- und Cache-Read-Raten von GPTProto mit den veröffentlichten API-Preisen des Anbieters. Rabatte variieren je nach Modell; die Verfügbarkeit in einer bestimmten CLI hängt von deren Protokoll und den unterstützten Funktionen ab.

The models Claude Code, Codex CLI and their peers ship with — the ones you are most likely already sending. Rates are per 1M tokens, discounted from each vendor's list.

Tool-AufrufeLanger KontextCache-aware pricing
API-Schlüssel erhalten
ModellPreis: GPTProtoIm Vergleich zum offiziellen PreisIm Vergleich zu OpenRouterKontextModalitätenStabilitätAktion
Claude Opus 5Claude
$4.50 / $22.50$0.45 Cache-Lesezugriff · pro 1 Mio. Tokens−10%−15%1M→Testen
Claude Sonnet 5Claude
$1.80 / $9.00$0.18 Cache-Lesezugriff · pro 1 Mio. Tokens−10%−15%1M→Testen
Claude Haiku 4.5 (Build 20251001)Claude
$0.90 / $4.50$0.09 Cache-Lesezugriff · pro 1 Mio. Tokens−10%−15%200K→Testen
GPT 5.2 CodexOpenAI
$1.23 / $9.80$0.12 Cache-Lesezugriff · pro 1 Mio. Tokens−30%−34%400K→Testen
GPT 5.1 Codex MaxOpenAI
$0.88 / $7.00$0.09 Cache-Lesezugriff · pro 1 Mio. Tokens−30%−34%400K→Testen
GPT 5.4 MiniOpenAI
$0.60 / $3.60$0.06 Cache-Lesezugriff · pro 1 Mio. Tokens−20%−24%400K→Testen
GPT 5 NanoOpenAI
$0.035 / $0.28$0.00 Cache-Lesezugriff · pro 1 Mio. Tokens−30%−34%400K→Testen
// STARTEN SIE MIT IHREM WORKFLOW

Finden Sie ein Startguthaben für
Ihren Coding-Workload.

Wählen Sie die Art von CLI-Arbeit, die Sie ausführen, und wie oft Sie sie ausführen. Dies ist ein Ausgangspunkt; Ihre tatsächlichen Ausgaben hängen von der Modellwahl und der Token-Nutzung ab.

01 / Was macht Ihre CLI?
02 / Wie viel verbrauchen Sie pro Monat?

Batch-Arbeit und Long-Context-Läufe verbrauchen Credits schneller – die Empfehlung passt sich automatisch an, wenn Sie Workload oder Nutzungsstufe wechseln.

$100
Coding-Agent · Regelmäßig – jede Woche — Repo-weite Änderungen und Testschleifen – lange Tool-Call-Ketten, bei denen Input- und Cache-Tokens die Rechnung dominieren.
Erhalte $104.00 · +4% Bonusguthaben
16.5M–33M Tokens
Du sparst im Vergleich zum offiziellen Anbieter$30.00
Du sparst im Vergleich zu OpenRouter$37.15
Lade $100 jetzt auf → Wan 3.0 kostenlose CreditsSep 29 – Oct 10 · Kontingent begrenzt · Wer zuerst kommt, mahlt zuerst
Jetzt Guthaben aufladen
// Das Ergebnis

Behalte deine CLI.Nutze das Setup, das tatsächlich benötigt wird.

GPTProto bietet verschiedene API-Routen für verschiedene Clients. Wähle ein unterstütztes Modell, konfiguriere den passenden Endpunkt und Key und bestätige dann, dass eine kurze Programmieraufgabe wie erwartet funktioniert.

Vorher · Anbieter-Endpunkt
✕Claude Code → api.anthropic.com
✕Codex CLI → api.openai.com/v1
✕Zwei Keys, zwei Guthaben, zwei Rechnungen
✕Eigenes Rate Limit jedes Anbieters
Nachher · gptproto
✓Claude Code → gptproto.com (ohne /v1)
✓Codex CLI → gptproto.com/v1
✓Ein Key, ein Guthaben, eine Rechnung
✓10–30% unter dem Listenpreis beider Anbieter

2 geänderte Zeilen · 0 Code-Rewrites · 200+ Modelle mit einem Key · Modellnamen bleiben unverändert.

// Der Mechanismus

Behalten Sie Ihre CLI.
Nutzen Sie das Setup, das tatsächlich benötigt wird.

GPTProto stellt verschiedene API-Routen für verschiedene Clients bereit. Wählen Sie ein unterstütztes Modell, konfigurieren Sie den passenden Endpoint und Schlüssel und bestätigen Sie dann, dass eine kurze Programmieraufgabe wie erwartet funktioniert.

01

Zwei API-Formen, klar gekennzeichnet.

Sehen Sie, welcher Client die Anthropic-kompatible Messages-Route verwendet und welcher die OpenAI Responses-Route benötigt. Kopieren Sie nur das Setup für Ihre CLI.

02

Ein Konto für die Modelle, die Sie nutzen.

Verwalten Sie den Zugriff auf unterstützte Modelle und die API-Ausgaben in einem GPTProto-Konto. Prüfen Sie den Tarif und die verfügbaren Funktionen, bevor Sie ein Modell in Ihrer CLI ändern.

Unterstützte Modelle entdecken →
03

Unterbrechungen explizit behandeln.

Wenn ein unterstütztes Modell alternative Upstream-Routen hat, kann GPTProto geeignete Anfragen umleiten. Eine Anfrage kann trotzdem fehlschlagen; behalten Sie Retry und Backoff in Ihrem Client bei.

// KI-API-Ersparnisrechner

Schätzen Sie Ihre Coding-Agent-API-Rechnung.

Wählen Sie ein Modell und geben Sie Ihre monatlichen Input-, Output- und Cached-Input-Tokens ein. Wir vergleichen dieselbe Workload mit den veröffentlichten API-Preisen des Anbieters für dieses Modell.

Text · pro 1 Mio. Tokens
Tokens / Mon.
$816
pro Jahr gespart im Vergleich zu Claude & OpenRouter (geschätzt)
JAHRMONATTAG
Claude$6,000$500.00$16.44
OpenRouter (est.)$6,330$527.50$17.34
GPTProto$5,400$450.00$14.79
Modellrabatte ansehen
Lade $100 jetzt auf → Wan 3.0 kostenlose CreditsSep 29 – Oct 10 · Kontingent begrenzt · Wer zuerst kommt, mahlt zuerst
Jetzt Guthaben aufladen
// Stimmen anderer

Verlass dich nicht nur auf unser Wort.Nimm ihres.

Echte Beiträge von echten, öffentlichen Accounts – hier ist nichts erfunden.

BL
Blogstra
Reddit · r/Bloggers
#Routing

For a team already juggling DeepSeek, Kimi, Qwen, or other providers, a shared routing layer can be reasonable if it removes duplicated work and the fallback behavior is tested. GPTProto is one implementation of this approach.

K
K
X (Twitter) · @ChillaiKalan__
#Cost

I've been testing GPTProto recently, and it's honestly made my creative workflow much simpler. Instead of paying for multiple subscriptions, I can access several leading AI models from one place.

SN
Sanskriti Naruka
X (Twitter) · @snskritinaruka
#Video

I turned this single prompt into a cinematic fantasy video using GPTProto. "Continuous 15-second cinematic shot, 4K resolution, hyper-realistic dark fantasy photorealism…"

CF
Caden Flux
X (Twitter) · @Caden_Flux
#Video

I challenged myself to create a cinematic AI cooking short in just 15 seconds. I used GPTProto to bring the entire workflow together, from image generation to video, all in one place.

Z
Zara
X (Twitter) · @ZaraIrahh
#Creative

Made with Seedance 2.0 + GPT Image 2 on GPTProto. A Pixar-style commercial with the perfect glow.

MO
Many-Operation2625
Reddit · r/LLMDevs
#Integration

What worked for me was pointing the cloud connections at GPTProto so the frontend only sees one endpoint and I just change the model name to swap. I am not rebuilding a connection from scratch every time.

// Preise

Zahlen Sie für die Modellaufrufe,
die Ihre CLI ausführt.

Starten Sie mit einem kleinen Guthaben, testen Sie eine echte Sitzung und skalieren Sie, sobald Sie Ihre Nutzung kennen. Modellpreise und etwaige Aufladeboni werden separat angezeigt.

$10
Direktes Guthaben · kein Bonus

Genug, um eine CLI auf den Endpunkt auszurichten und eine echte Sitzung auszuführen. Laden Sie jederzeit 20 $+ auf, um Bonusguthaben freizuschalten.

Maximale Ersparnis · +6%
$1,000
+6 % Bonusguthaben

Entwickelt für eine Flotte von CLIs und Agent-Runnern. Bonusguthaben kommen zusätzlich zu bereits rabattierten Modellpreisen hinzu, sodass das gesamte Guthaben effektiv 10–30 % unter Listenpreis liegt.

Nutzt du 100 Mio. Tokens/Monat mit GPT 5.2 Codex? Bei den GPTProto-Preisen sparst du gegenüber den offiziellen Preisen ungefähr {eingespart} pro Jahr an Kosten. — vor Bonusguthaben.
// FAQ

Bevor dudein CLI-Setup änderst.

Die Antworten, die zählen, wenn du Modellpreise vergleichst und einen neuen Endpoint testest.

01Kann ich GPTProto mit Claude Code, Codex CLI und OpenCode verwenden?+

Diese Clients haben unterschiedliche Provider-Einstellungen und API-Anforderungen. GPTProto bietet Anthropic-kompatible Messages- und OpenAI-Responses-Routen für unterstützte Modelle. Wähle den Leitfaden für deinen Client und führe einen kurzen Test durch; ein im Katalog aufgeführtes Modell ist nicht automatisch mit jeder CLI-Funktion kompatibel.

02Warum unterscheiden sich die Einrichtungsschritte für Claude Code und Codex CLI?+

Claude Code verwendet eine Anthropic-kompatible Messages-Route, wenn es mit einem kompatiblen Gateway konfiguriert ist. Die benutzerdefinierten Provider von Codex CLI verwenden die Responses API. Jeder Client benötigt seine eigene Basis-URL, Authentifizierungseinstellungen und unterstützte Modell-ID; folge dem passenden Leitfaden, anstatt die Konfiguration einer CLI in eine andere zu kopieren.

03Kann ich meine Prompts, Tools und mein Repo-Setup behalten?+

Beginne damit, die Provider-Konfiguration zu ändern, und teste dann die Aufgaben, auf die du dich verlässt. Prompt- und Repository-Dateien können gleich bleiben, aber Streaming, Tool-Aufrufe, Modelloptionen und Ausgabeformate können sich anders verhalten. Prüfe einen echten Bearbeiten-und-Testen-Zyklus, bevor du deinen täglichen Workflow umstellst.

04Kann ich dieselbe Modell-ID verwenden, die ich beim offiziellen Anbieter nutze?+

Verwende die Modell-ID, die im GPTProto-Katalog für die von dir gewählte Route angezeigt wird. Modellverfügbarkeit und unterstützte Funktionen können je nach Endpoint variieren. Prüfe die Modellseite und deinen CLI-Einrichtungsleitfaden, bevor du einen langen Lauf startest.

05Entfernt der Wechsel des Endpoints Rate Limits oder verhindert er 429-Fehler?+

Keine API kann das versprechen. Limits und Upstream-Fehler können weiterhin auftreten. GPTProto kann geeignete Anfragen, sofern unterstützt, über alternative Kanäle leiten, aber deine CLI oder Anwendung sollte weiterhin Wiederholungsversuche und Backoff verarbeiten. Teste das Verhalten mit deinem gewählten Modell, bevor du wichtige Arbeit verlagerst.

06Wird mein CLI-Abonnement günstiger?+

Diese Seite vergleicht die Nutzung der Modell-API, abgerechnet nach Tokens und den geltenden Modellpreisen. Sie ändert weder ein Abonnement noch inkludierte Nutzung, die du möglicherweise beim CLI-Anbieter hast. Prüfe, ob dein aktueller Workflow ein Abonnement, einen API-Schlüssel des Anbieters oder beides verwendet, bevor du Kosten vergleichst.

07Wie werden die Einsparungen berechnet?+

Wir wenden die Input-, Output- und, sofern relevant, Cached-Input-Preise des ausgewählten Modells auf die von dir eingegebene monatliche Nutzung an. Der Vergleich verwendet dieselben Token-Mengen zu den veröffentlichten API-Preisen des Anbieters. Jeder Aufladebonus erscheint als separate Zeile, damit du den Modellrabatt separat sehen kannst.

08Gelten Bonusguthaben für bereits rabattierte Modellpreise?+

Wenn eine Aufladestufe Bonusguthaben enthält, zeigt die Checkout-Seite das gesamte Guthaben an, das du erhältst. Die Nutzung wird zum angezeigten GPTProto-Modellpreis abgerechnet. Bonushöhe, Berechtigung und Gültigkeit hängen vom aktuellen Angebot ab; prüfe sie, bevor du bezahlst.

09Kann ich zum vorherigen Anbieter zurückwechseln?+

Ja, du kannst deine vorherigen Provider-Einstellungen wiederherstellen. Bewahre eine Kopie der ursprünglichen Konfiguration auf und teste beide Wege mit einer kleinen Aufgabe. Nicht genutztes GPTProto-Guthaben unterliegt weiterhin den Kontobedingungen, die beim Checkout angezeigt werden.

10Hat GPTProto selbst Nutzungslimits?+

Dein Schlüssel, dein Konto, das gewählte Modell und die Upstream-Route können jeweils Limits haben. Prüfe die für dein Konto und Modell angezeigten Limits und kontaktiere den Support, bevor du eine Workload startest, die garantierte Kapazität benötigt. Die Seite sollte keine unbegrenzten Aufrufe ohne dokumentierte Zusage versprechen.

// EINRICHTUNGSANLEITUNGEN

Wähle deine CLI.Folge der passenden Einrichtung.

Jede Anleitung sollte die aktuelle Client-Version, die API-Route, die Modell-ID, die Authentifizierungsschritte, eine kurze Verifizierungsaufgabe und häufige Fehler auflisten.

Dokumentation öffnen →
// Loslegen

Dein nächstes Refactoringsollte nicht zum Listenpreis laufen.

Erstelle Bilder und Videos online oder integriere Text-, Bild- und Videomodelle mit einem API-Schlüssel in deine App. Entdecke vergünstigte Preise für ausgewählte Modelle.

  • ✓Beide Protokolle, ein Host
  • ✓200+ Modelle mit einem Schlüssel
  • ✓10–30 % unter offiziellen Preisen
  • ✓Hohe Verfügbarkeit, automatisches Failover
✓In die Zwischenablage kopiert