Preise+7% Bonus
Tiffany Layne2026-03-23

GPT-5.4 ist da: Alles, was Sie wissen müssen

GPT-5.4 ist das neueste KI-Modell von OpenAI und vereint fortgeschrittenes Schlussfolgern, Programmieren und integrierte Computersteuerung in einem Modell. Erfahren Sie, was neu ist, wie es sich mit GPT-5.2 vergleicht und wie Sie über GPT Proto kostengünstig darauf zugreifen.

GPT-5.4 ist da: Alles, was Sie wissen müssen

TL;DR:

GPT-5.4 ist das neueste Modell von OpenAI, das Schlussfolgern, Programmieren und die Steuerung von Desktops in einem Modell vereint. Es übertrifft GPT-5.2 bei den meisten Benchmarks, unterstützt ein Kontextfenster mit 1 Million Tokens und ist jetzt über Plattformen wie GPT Proto zu reduzierten API-Preisen verfügbar.

Inhaltsverzeichnis

 OpenAI veröffentlicht GPT-5.4

OpenAI hat GPT-5.4, sein bisher leistungsfähigstes Modell, sowie eine Pro-Variante für besonders anspruchsvolle Aufgaben veröffentlicht. Die Veröffentlichung ist jetzt in ChatGPT für Plus-, Team- und Pro-Nutzer sowie über die API verfügbar und stellt einen bedeutenden Fortschritt für den Einsatz von KI im beruflichen Alltag dar. GPT-5.4 ist das erste allgemeine OpenAI-Modell mit nativer Computersteuerung. Das bedeutet, dass es wie ein echter Nutzer mit Ihrem Desktop interagieren kann, anstatt nur Text zu generieren.

 OpenAI Just Released GPT-5.4

Dieser Leitfaden behandelt folgende Themen:

  • Was GPT-5.4 tatsächlich ist und wie es sich von GPT-5.2 unterscheidet

  • Die wichtigsten Leistungsverbesserungen beim Schreiben, Programmieren und Schlussfolgern

  • Die neuen Funktionen zur Computersteuerung und zum visuellen Verständnis

  • Wie GPT-5.4 mit langen Dokumenten und großen Codebasen umgeht

  • Die Preise für GPT-5.4 und GPT-5.4 Pro in ChatGPT und der API

  • Wie Sie über GPT Proto kostengünstig auf GPT-5.4 zugreifen

Was ist GPT-5.4 und wodurch unterscheidet es sich

GPT-5.4 ist nicht nur eine kleine Aktualisierung der vorherigen Version. Es vereint drei Funktionen, die zuvor in separaten Modellen verfügbar waren: allgemeines Schlussfolgern, Programmierfähigkeiten und Computersteuerung. Vor dieser Veröffentlichung mussten Entwickler, die alle drei Funktionen benötigten, Anfragen zwischen verschiedenen spezialisierten Modellen weiterleiten. Jetzt gibt es eine einheitliche Option.

Das Modell unterstützt ein Kontextfenster von 1 Million Tokens und kann bis zu 128.000 Tokens in einer einzelnen Antwort ausgeben. Der Wissensstand endet am 31. August 2025.

Drei Fähigkeiten in einem GPT-5.4-Modell

Zuvor waren dies separate Tools oder Modellvarianten. GPT-5.4 vereint sie in einem einzigen API-Endpunkt:

  • Allgemeines Schlussfolgern und Schreiben — einschließlich Dokumenterstellung, Analyse und Fragen und Antworten

  • Codegenerierung und Debugging — mit Fähigkeiten von GPT-5.3-Codex

  • Computersteuerung — direkte Steuerung von Desktop-Umgebungen über Screenshots sowie Maus- und Tastatureingaben

Diese Bündelung erleichtert die Entwicklung KI-gestützter Anwendungen erheblich, insbesondere für Entwickler, die über einen einzigen Integrationspunkt wie GPT Proto flexibel auf ein vielseitiges Modell zugreifen möchten.

Akademische und Reasoning-Benchmarks von GPT-5.4

Benchmark GPT-5.2 GPT-5.4 GPT-5.4 Pro
ARC-AGI-2 52.90% 73.30% 83.30%
GPQA Diamond — 92.80% —
FrontierMath Tier 4 18.80% 27.10% 38.00%
Die letzte Prüfung der Menschheit (ohne Tools) — 39.80% —
BrowseComp 65.80% 82.70% 89.30%
OSWorld-Verified 47.30% 75.00% —

ARC-AGI-2 verzeichnete von allen Benchmarks den größten Sprung: vom Standardmodell mit 52,9 % auf 73,3 % und bei Pro auf 83,3 %. Dieser Test misst die Erkennung abstrakter Muster, die Sprachmodellen traditionell Schwierigkeiten bereitet.

Eine bemerkenswerte Verschlechterung: GPT-5.4 erzielte im HealthBench mit 62,6 % ein etwas niedrigeres Ergebnis als GPT-5.2 mit 63,3 %. OpenAI legte dies in der Systemkarte offen, anstatt es herunterzuspielen, was erwähnenswert ist.

Zugriff auf GPT-5.4 über ChatGPT

GPT-5.4 Thinking wird derzeit für Plus-, Team- und Pro-Abonnenten eingeführt und ersetzt GPT-5.2 Thinking als Standardmodell. GPT-5.2 Thinking bleibt bis zum 5. Juni 2026 im Bereich „Legacy“ verfügbar. Kostenlose Nutzer können GPT-5.4 möglicherweise über die automatische Weiterleitung verwenden, es aber nicht manuell auswählen.

GPT-5.4-Preise: Standard vs. Pro

So vergleichen sich die API-Preise der Versionen:

Modell Eingabe (pro 1 Mio. Tokens) Ausgabe (pro 1 Mio. Tokens)
gpt-5.2 $1.75 $14.00
gpt-5.4 $2.50 $15.00
gpt-5.2 Pro $21.00 $168.00
gpt-5.4 Pro $30.00 $180.00

Einige wichtige Hinweise zu diesen Zahlen:

  • Batch- und Flex-Verarbeitung sind zum halben Preis verfügbar

  • Die Prioritätsverarbeitung kostet das Zweifache des Standardtarifs

  • Anfragen mit mehr als 272.000 Tokens in einer einzelnen Sitzung werden für die gesamte Sitzung mit dem Zweifachen des Eingabepreises und dem 1,5-Fachen des Ausgabepreises berechnet

  • Die Verarbeitung mit regionaler Datenresidenz verursacht einen Aufpreis von 10 %

GPT-5.4 Pro ist zwölfmal teurer als die Standardversion. Die Benchmarks zeigen jedoch, dass beide unterschiedliche Stärken haben. Die Standardversion erzielte bei GDPval sogar ein etwas höheres Ergebnis (83,0 % gegenüber 82,0 %), während die Pro-Version bei umfangreicher Webrecherche und komplexen Agentenaufgaben besser abschneidet.

Programmieren mit GPT-5.4

GPT-5.4 übernimmt die Programmierstärke von GPT-5.3-Codex und verbessert gleichzeitig seine Fähigkeit, bei langen, mehrstufigen Programmiersitzungen die Aufgabe im Blick zu behalten.

Auf SWE-Bench Pro, einem Benchmark auf Grundlage realer GitHub-Issues, erzielte GPT-5.4 57,7 % gegenüber 55,6 % bei GPT-5.2. Auf Terminal-Bench 2.0, das Befehlszeilenoperationen testet, erreichte GPT-5.4 75,1 % (GPT-5.3-Codex lag bei diesem speziellen Test mit 77,3 % etwas höher – eine kleine, erwähnenswerte Verschlechterung).

Neu in Codex: ein /fast-Modus, der die Geschwindigkeit der Tokengenerierung um bis zu das 1,5-Fache erhöht, ohne das zugrunde liegende Modell zu verändern. Außerdem gibt es einen experimentellen interaktiven Playwright-Modus, mit dem Codex während der Entwicklung ein Live-Browserfenster öffnen kann, um Web- oder Desktop-Apps zu schreiben und visuelle Tests in Echtzeit durchzuführen.

Wenn Sie GPT-5.4 für Programmierprojekte über Tools wie Codex oder Claude Code nutzen möchten, unterstützt GPT Proto die direkte API-Integration und bietet im Vergleich zu den Listenpreisen von OpenAI deutliche Rabatte.

Wie GPT-5.4 bei Aufgaben aus der Praxis abschneidet

OpenAI testete GPT-5.4 mit GDPval, einem internen Benchmark, der reale Arbeit in 44 Berufskategorien der neun größten US-Wirtschaftssektoren simuliert. Zu den Aufgaben gehören das Erstellen von Tabellen, Präsentationen und Diagrammen sowie die Terminplanung und vieles mehr.

GPT-5.4 GDPval

GPT-5.4 erzielte bei GDPval 83,0 %. GPT-5.2 erreichte 70,9 %. Das entspricht einem Sprung von 12 Punkten bei Aufgaben, die der tatsächlichen Arbeit von Berufstätigen sehr nahekommen.

Tabellen und Präsentationen

OpenAI führte zusätzliche Tests speziell zu Aufgaben der Büroproduktivität durch:

  • Bei einem Test zur Tabellenmodellierung, der die Analysearbeit im Investmentbanking nachbildet, erzielte GPT-5.4 87,3 % gegenüber 68,4 % bei GPT-5.2 – eine Verbesserung um 19 Punkte.

  • Bei Blindvergleichen von Präsentationen bevorzugten menschliche Prüfer in 68 % der Fälle die Ausgabe von GPT-5.4, insbesondere wegen der besseren Bildnutzung und abwechslungsreicheren visuellen Layouts.

Zusammen mit dem Modell wurde ein ChatGPT-for-Excel-Plugin veröffentlicht. Außerdem wurden die Skill-Pakete zur Erstellung von Tabellen und Präsentationen in Codex und der API aktualisiert.

ChatGPT for Excel

Genauigkeit und Halluzinationen

GPT-5.4 ist derzeit das faktisch genaueste Modell von OpenAI. Anhand einer Reihe von Prompts, die Nutzer zuvor wegen enthaltenen Fehlern gemeldet hatten, stellte OpenAI fest, dass GPT-5.4 33 % seltener einzelne falsche Aussagen produzierte als GPT-5.2 und 18 % seltener vollständige Antworten mit mindestens einem Fehler generierte.

Computersteuerung: GPT-5.4 kann jetzt Ihren Desktop steuern

Dies ist eine der wichtigsten Neuerungen dieser Veröffentlichung. GPT-5.4 erzielte bei OSWorld-Verified 75,0 %, einem Benchmark, der misst, wie gut ein Modell eine echte Desktop-Umgebung anhand von Screenshots steuern kann. Der menschliche Referenzwert bei demselben Test liegt bei 72,4 %. GPT-5.4 hat bei dieser Aufgabe die Leistung von Menschen übertroffen.

GPT-5.4 OSWorld-Verified

So funktioniert die Computersteuerung in GPT-5.4

Entwickler können diese Funktion auf zwei Arten nutzen:

  1. Screenshot-gesteuerte Steuerung — Das Modell erhält einen Screenshot und gibt Mauskoordinaten sowie Tastaturbefehle aus, um mit der Benutzeroberfläche zu interagieren

  2. Browserautomatisierung per Code — Das Modell schreibt Playwright-Skripte, um einen Browser programmgesteuert zu steuern – nützlich zum Ausfüllen von Formularen, zur Dateneingabe und für Webtests

Diese Funktion ist direkt über die Standard-API mit dem integrierten computer-Tool verfügbar. Eine spezielle Modellweiterleitung ist nicht erforderlich. Sie können außerdem Bestätigungsrichtlinien konfigurieren, die eine menschliche Genehmigung erfordern, bevor das Modell risikoreiche Aktionen ausführt.

Für Teams, die Agenten-Workflows oder Automatisierungstools entwickeln, ermöglichen Plattformen wie GPT Proto einen unkomplizierten Zugriff auf die Computersteuerungsfunktion von GPT-5.4 über eine einheitliche API zu wettbewerbsfähigen Preisen.

Bessere Tool-Nutzung und Agentenfunktionen

GPT-5.4 führt einen intelligenteren Umgang mit großen Tool-Bibliotheken ein. Zuvor musste jeder API-Aufruf die vollständigen Definitionen aller verfügbaren Tools enthalten, was bei vielen konfigurierten Tools teuer war. Nun verwendet das Modell einen Retrieval-Ansatz: Es sieht eine kurze Liste verfügbarer Tools und ruft anschließend die vollständige Definition jedes tatsächlich benötigten Tools ab.

Diese Änderung allein reduzierte den Tokenverbrauch bei toolintensiven Aufgaben im MCP-Atlas-Benchmark um 47 %, ohne die Genauigkeit zu beeinträchtigen. GPT-5.4 erzielte bei diesem Benchmark 67,2 %, gegenüber 60,6 % bei GPT-5.2.

Bei BrowseComp, einem Test für Webrecherche und das Abrufen von Informationen über mehrere Seiten, erzielte GPT-5.4 82,7 % und die Pro-Variante 89,3 % – beide deutlich mehr als die 65,8 % von GPT-5.2.

Sie können die Websuch- und Recherchefunktionen von GPT-5.4 direkt über die Websuchoberfläche von GPT Proto ausprobieren, die auch dateibasierte Abfragen über die Dateianalyse-Seite von GPT Proto unterstützt.

So erhalten Sie über GPT Proto kostengünstigeren Zugriff auf GPT-5.4

Wenn die direkten API-Preise von OpenAI zu hoch erscheinen, insbesondere für Teams mit hohem Volumen oder für die Entwicklung von Produktionsanwendungen, bietet die GPT Proto AI API Platform eine praktische Alternative. GPT Proto ist eine einheitliche KI-API-Plattform, die Zugriff auf führende Modelle wie GPT-5.4 zu vergünstigten Preisen bündelt – typischerweise 30 bis 40 % unter den Marktpreisen für GPT-Modelle.

Access GPT-5.4 More Affordably with GPT Proto

Statt separate API-Schlüssel für jeden Anbieter zu verwalten, verbinden sich Entwickler einmal mit GPT Proto und erhalten über einen einzigen standardisierten API-Endpunkt Zugriff auf GPT-5.4 und Hunderte weiterer Modelle. Die Plattform verwendet intelligentes Routing und automatisches Failover, sodass Ihre Anfragen bei einem Ausfall des Anbieters ohne Unterbrechung umgeleitet werden.

GPT Proto unterstützt auch die multimodalen Funktionen von GPT-5.4. Die Bild-zu-Text-Verarbeitung können Sie unter der Bild-zu-Text-Seite von GPT Proto erkunden. Sie eignet sich besonders für die Dokumentenanalyse, die Verarbeitung hochauflösender Screenshots und Computersteuerungs-Workflows, bei denen visuelles Verständnis entscheidend ist.

Für Einzelpersonen und Teams, die bereits mehrere KI-Tools verwalten oder deren aktueller Anbieter unvorhersehbare Preise oder Zuverlässigkeit bietet, stellt GPT Proto eine stabile und kostengünstige Möglichkeit dar, GPT-5.4 ohne Bindung an einen Anbieter oder langfristige Verträge zu nutzen.

Häufig gestellte Fragen zu GPT-5.4

Was ist GPT-5.4 und wie unterscheidet es sich von GPT-5.2?

GPT-5.4 ist das neueste Modell von OpenAI und wurde als Weiterentwicklung von GPT-5.2 veröffentlicht. Die wichtigsten Unterschiede bestehen darin, dass GPT-5.4 über native Computersteuerung verfügt, bei den meisten professionellen und Reasoning-Benchmarks besser abschneidet und Programmieren, Schlussfolgern und visuelle Steuerung in einem einzigen Modell vereint, anstatt für jede Funktion separate Tools zu benötigen.

Was bewirkt die Computersteuerungsfunktion von GPT-5.4 tatsächlich?

Sie ermöglicht es dem Modell, einen Screenshot Ihres Computerbildschirms zu betrachten und anschließend Mausklicks sowie Tastatureingaben zu senden, um mit Software zu interagieren. Dies funktioniert mit Webbrowsern, Desktopanwendungen und formularbasierten Workflows. Entwickler können die Funktion über die Standard-API nutzen, ohne ein separates spezialisiertes Modell zu benötigen.

Wie viel kostet GPT-5.4 über die API?

Das Standardmodell GPT-5.4 kostet 2,50 $ pro Million Eingabetokens und 15,00 $ pro Million Ausgabetokens. GPT-5.4 Pro ist mit 30,00 $ pro Million Eingabetokens und 180,00 $ pro Million Ausgabetokens deutlich teurer. Plattformen wie GPT Proto bieten über ihre einheitliche API Zugriff auf GPT-5.4 zu reduzierten Preisen.

Wer kann GPT-5.4 in ChatGPT nutzen?

GPT-5.4 Thinking ist für ChatGPT-Plus-, Team- und Pro-Abonnenten verfügbar. Enterprise- und Education-Nutzer können von Administratoren freigeschaltet werden. Kostenlose Nutzer können das Modell möglicherweise über die automatische Weiterleitung verwenden, es aber nicht manuell auswählen. GPT-5.4 Pro ist auf Pro- und Enterprise-Konten beschränkt.

Fazit

GPT-5.4 ist eine bedeutende Weiterentwicklung, insbesondere für alle, die ein Modell benötigen, das in einem einzigen Workflow schlussfolgern, programmieren und mit Software interagieren kann. Dass die Computersteuerungsfunktion beim OSWorld-Benchmark die menschliche Referenzleistung übertrifft, ist ein wirklich wichtiger Meilenstein. Die Verbesserungen bei Tabellen, Codegenerierung und der Verarbeitung langer Kontexte sind praxisnah und gut dokumentiert.

Die Preise liegen über denen von GPT-5.2, doch für die meisten professionellen Anwendungsfälle rechtfertigen die Leistungssteigerungen die Kosten. Wenn Sie Ihre Kosten kontrollieren möchten, ohne auf den Zugriff auf das Modell zu verzichten, ist GPT Proto als kostengünstiger Einstieg in das GPT-5.4-Ökosystem eine interessante Option.

 

Creative Studio

Erstelle Bilder, Videos und mehr mit APIs für den Produktionseinsatz.

Mit dem Erstellen beginnen
Creative Studio
Verwandte Modelle
Alle Modelle
OpenAI
20% OFF
Google
40% OFF
OpenAI
20% OFF
Claude
10% OFF

Verwandte Artikel

Weitere Blogbeiträge
Alles, was Sie über Nano Banana 2 wissen müssen

Alles, was Sie über Nano Banana 2 wissen müssen

Einleitung Am 26. Februar 2026 hat Google DeepMind Nano Banana 2 still und leise veröffentlicht — und die KI-Community hat es sofort bemerkt. Innerhalb weniger Stunden stieg das Modell an die Spitze der Arena-Rangliste für Text-zu-Bild-Generierung und übertraf sowohl GPT-image-1 als auch Nano Banana Pro mit einer Punktzahl von 1.279. Der offizielle technische Name lautet Gemini 3.1 Flash Image (auch bekannt als Gemini 3.1 Flash Image Preview). Für Entwickler, Designer und Content-Ersteller, die eine schnelle, hochwertige Bildgenerierung im großen Maßstab benötigen, beantwortet Nano Banana 2 eine Frage, die schon länger im Raum steht: Kann man Bildqualität auf Pro-Niveau erhalten, ohne die Geschwindigkeitsbegrenzungen und Kosten von Pro in Kauf nehmen zu müssen? Die Antwort lautet offenbar: ja.

Tiffany Layne | 2026-03-05

Seedance 2.0 vs. Disney: Was der Urheberrechtsstreit bedeutet

Seedance 2.0 vs. Disney: Was der Urheberrechtsstreit bedeutet

TL;DR Seedance 2.0 ist ByteDances leistungsstarkes neues KI-Videomodell, das filmreife Clips mit nativem Audio erzeugt. Sein Start löste Unterlassungsschreiben von Disney und anderen Hollywood-Studios wegen Urheberrechtsbedenken aus. Entwickler können heute über Plattformen wie GPT Proto auf frühere Seedance-Versionen zugreifen; die Unterstützung der Seedance-2.0-API folgt in Kürze.

Tiffany Layne | 2026-02-26

Seedance 2.0-Leitfaden: Funktionen, Anwendungsfälle und API-Zugriff

Seedance 2.0-Leitfaden: Funktionen, Anwendungsfälle und API-Zugriff

Der neue Standard für KI-Videos ByteDance hat mit der Veröffentlichung von Seedance 2.0 die Landschaft generativer Medien grundlegend neu definiert. Dieses Modell geht weit über die Fähigkeiten seiner Vorgänger hinaus und bietet filmische 15-Sekunden-Clips, native 2K-Auflösung sowie komplexe multimodale Eingaben, weshalb Creator und Entwickler Schlange stehen, um Zugang zu erhalten. Ganz gleich, ob Sie als Filmemacher komplexe Kampfszenen als Storyboard umsetzen möchten oder als Entwickler robuste Seedance 2.0 -API-Lösungen über GPT Proto suchen – dieser Leitfaden zeigt Ihnen alles, was Sie über das neue Schwergewicht der Branche wissen müssen.

Tiffany Layne | 2026-02-25