Heim
GPT-5.4 startet mit transparentem Denkmodus, einem Kontextumfang von einer Million Token und nativer Computersteuerung
OpenAI hat die GPT-5.4-Serie am 5. März 2026 offiziell vorgestellt. Diese Version stellt einen bedeutenden Fortschritt dar und vereint auf einzigartige Weise Fähigkeiten in den Bereichen logisches Denken, Programmierung und agentenbasierte Arbeitsabläufe.
Innerhalb der ChatGPT-Weboberfläche und der mobilen App führt der neue „Thinking“-Modus (Logikmodus) eine revolutionäre Art der Interaktion ein:
Vorschau des Denkprozesses: Bevor die KI eine endgültige Antwort liefert, skizziert sie zunächst ihren „Denkplan“. Nutzer können in Echtzeit beobachten, wie sie ihren Lösungsansatz entwirft, und jederzeit in den Prozess eingreifen, um die Richtung anzupassen.
Verbesserte Deep Search: Für hochspezialisierte und komplexe Anfragen bietet der Thinking-Modus robustere Multi-Turn-Websuchfunktionen. Er kann Quellen miteinander verknüpfen und hochwertige Antworten mit dem Urteilsvermögen eines menschlichen Experten zusammenstellen.

Die Produktivitäts-Engine: Codex-Erbe trifft auf professionelle Optimierung
GPT-5.4 integriert die herausragenden Programmierfähigkeiten von GPT-5.3-Codex vollständig und etabliert sich als OpenAIs führendes „Mainstream-Schlussfolgerungsmodell“.
Office-Suite-Integration: Es wurde speziell für Produktivitätsszenarien wie Tabellenkalkulationen (Excel), Präsentationen (PPT) und Dokumentenverarbeitung optimiert und reduziert logische Fehler bei der Inhaltserstellung drastisch.
Niedrige Fehlerquote und hohe sachliche Genauigkeit: Daten zeigen, dass die sachliche Fehlerquote von GPT-5.4 um 18 % niedriger ist als die von GPT-5.2, wobei falsche Aussagen um 33 % zurückgegangen sind. Seine Leistung in Spezialgebieten wie Finanz- und Rechtsanalyse kann nun mit der von menschlichen Fachleuten mithalten.
Der Agent-Sprung: Native „Computersteuerung“ und Millionen-Token-Kontext
GPT-5.4 entwickelt sich über eine einfache Chat-Oberfläche hinaus und erlangt echte native Computerbedienungsfähigkeiten:
Ausführung mehrerer Anwendungen: Das Modell kann Aktionen wie Klicken, Ziehen und Tippen direkt ausführen, indem es Screenshots und Anweisungen in virtuellen Umgebungen oder lokaler Software interpretiert, was komplexe anwendungsübergreifende Arbeitsabläufe ermöglicht.
Million-Token-Kontext: Es unterstützt ein extrem langes Kontextfenster von bis zu 1 Million Token (1M Token). Dies ermöglicht es einem Agenten, eine gesamte große Codebasis oder mehrere Quartalsfinanzberichte auf einmal zu „lesen“ und anschließend langfristige Aufgaben zu planen und zu überprüfen, die sich über Stunden oder sogar Tage erstrecken.
Versionen und Preise
Mit dieser Version wurde auch die Stufe GPT-5.4Pro eingeführt, die in erster Linie für intensive professionelle Entwickler und Unternehmenskunden konzipiert ist:
Exklusive Funktionen der Pro-Version: Unterstützt höhere Einstellungen für die Denkintensität (Reasoning Effort: High/X-High) und zielt damit auf besonders anspruchsvolle Aufgaben in der wissenschaftlichen Forschung oder im Architekturdesign ab.
Verfügbarkeit
Verwandter Artikel
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation
Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen
Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools
Alibaba hat offiziell Qwen3.8-Max vorgestellt, ein hochmodernes Foundation-Modell mit 2,4 Billionen Parametern. Diese bedeutende KI-Entwicklung bietet erhebliche Leistungssteigerungen in Kernbereichen wie Programmierung und professionelle Büroaufgabe
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
OpenAI hat die GPT-5.4-Serie am 5. März 2026 offiziell vorgestellt. Diese Version stellt einen bedeutenden Fortschritt dar und vereint auf einzigartige Weise Fähigkeiten in den Bereichen logisches Denken, Programmierung und agentenbasierte Arbeitsabläufe.
Innerhalb der ChatGPT-Weboberfläche und der mobilen App führt der neue „Thinking“-Modus (Logikmodus) eine revolutionäre Art der Interaktion ein:
Vorschau des Denkprozesses: Bevor die KI eine endgültige Antwort liefert, skizziert sie zunächst ihren „Denkplan“. Nutzer können in Echtzeit beobachten, wie sie ihren Lösungsansatz entwirft, und jederzeit in den Prozess eingreifen, um die Richtung anzupassen.
Verbesserte Deep Search: Für hochspezialisierte und komplexe Anfragen bietet der Thinking-Modus robustere Multi-Turn-Websuchfunktionen. Er kann Quellen miteinander verknüpfen und hochwertige Antworten mit dem Urteilsvermögen eines menschlichen Experten zusammenstellen.

Die Produktivitäts-Engine: Codex-Erbe trifft auf professionelle Optimierung
GPT-5.4 integriert die herausragenden Programmierfähigkeiten von GPT-5.3-Codex vollständig und etabliert sich als OpenAIs führendes „Mainstream-Schlussfolgerungsmodell“.
Office-Suite-Integration: Es wurde speziell für Produktivitätsszenarien wie Tabellenkalkulationen (Excel), Präsentationen (PPT) und Dokumentenverarbeitung optimiert und reduziert logische Fehler bei der Inhaltserstellung drastisch.
Niedrige Fehlerquote und hohe sachliche Genauigkeit: Daten zeigen, dass die sachliche Fehlerquote von GPT-5.4 um 18 % niedriger ist als die von GPT-5.2, wobei falsche Aussagen um 33 % zurückgegangen sind. Seine Leistung in Spezialgebieten wie Finanz- und Rechtsanalyse kann nun mit der von menschlichen Fachleuten mithalten.
Der Agent-Sprung: Native „Computersteuerung“ und Millionen-Token-Kontext
GPT-5.4 entwickelt sich über eine einfache Chat-Oberfläche hinaus und erlangt echte native Computerbedienungsfähigkeiten:
Ausführung mehrerer Anwendungen: Das Modell kann Aktionen wie Klicken, Ziehen und Tippen direkt ausführen, indem es Screenshots und Anweisungen in virtuellen Umgebungen oder lokaler Software interpretiert, was komplexe anwendungsübergreifende Arbeitsabläufe ermöglicht.
Million-Token-Kontext: Es unterstützt ein extrem langes Kontextfenster von bis zu 1 Million Token (1M Token). Dies ermöglicht es einem Agenten, eine gesamte große Codebasis oder mehrere Quartalsfinanzberichte auf einmal zu „lesen“ und anschließend langfristige Aufgaben zu planen und zu überprüfen, die sich über Stunden oder sogar Tage erstrecken.
Versionen und Preise
Mit dieser Version wurde auch die Stufe GPT-5.4Pro eingeführt, die in erster Linie für intensive professionelle Entwickler und Unternehmenskunden konzipiert ist:
Exklusive Funktionen der Pro-Version: Unterstützt höhere Einstellungen für die Denkintensität (Reasoning Effort: High/X-High) und zielt damit auf besonders anspruchsvolle Aufgaben in der wissenschaftlichen Forschung oder im Architekturdesign ab.
Verfügbarkeit
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation
Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen
Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools
Alibaba hat offiziell Qwen3.8-Max vorgestellt, ein hochmodernes Foundation-Modell mit 2,4 Billionen Parametern. Diese bedeutende KI-Entwicklung bietet erhebliche Leistungssteigerungen in Kernbereichen wie Programmierung und professionelle Büroaufgabe











