Heim
GPT-5.4 startet mit transparentem Denkmodus, einem Kontextumfang von einer Million Token und nativer Computersteuerung
OpenAI hat die GPT-5.4-Serie am 5. März 2026 offiziell vorgestellt. Diese Version stellt einen bedeutenden Fortschritt dar und vereint auf einzigartige Weise Fähigkeiten in den Bereichen logisches Denken, Programmierung und agentenbasierte Arbeitsabläufe.
Innerhalb der ChatGPT-Weboberfläche und der mobilen App führt der neue „Thinking“-Modus (Logikmodus) eine revolutionäre Art der Interaktion ein:
Vorschau des Denkprozesses: Bevor die KI eine endgültige Antwort liefert, skizziert sie zunächst ihren „Denkplan“. Nutzer können in Echtzeit beobachten, wie sie ihren Lösungsansatz entwirft, und jederzeit in den Prozess eingreifen, um die Richtung anzupassen.
Verbesserte Deep Search: Für hochspezialisierte und komplexe Anfragen bietet der Thinking-Modus robustere Multi-Turn-Websuchfunktionen. Er kann Quellen miteinander verknüpfen und hochwertige Antworten mit dem Urteilsvermögen eines menschlichen Experten zusammenstellen.

Die Produktivitäts-Engine: Codex-Erbe trifft auf professionelle Optimierung
GPT-5.4 integriert die herausragenden Programmierfähigkeiten von GPT-5.3-Codex vollständig und etabliert sich als OpenAIs führendes „Mainstream-Schlussfolgerungsmodell“.
Office-Suite-Integration: Es wurde speziell für Produktivitätsszenarien wie Tabellenkalkulationen (Excel), Präsentationen (PPT) und Dokumentenverarbeitung optimiert und reduziert logische Fehler bei der Inhaltserstellung drastisch.
Niedrige Fehlerquote und hohe sachliche Genauigkeit: Daten zeigen, dass die sachliche Fehlerquote von GPT-5.4 um 18 % niedriger ist als die von GPT-5.2, wobei falsche Aussagen um 33 % zurückgegangen sind. Seine Leistung in Spezialgebieten wie Finanz- und Rechtsanalyse kann nun mit der von menschlichen Fachleuten mithalten.
Der Agent-Sprung: Native „Computersteuerung“ und Millionen-Token-Kontext
GPT-5.4 entwickelt sich über eine einfache Chat-Oberfläche hinaus und erlangt echte native Computerbedienungsfähigkeiten:
Ausführung mehrerer Anwendungen: Das Modell kann Aktionen wie Klicken, Ziehen und Tippen direkt ausführen, indem es Screenshots und Anweisungen in virtuellen Umgebungen oder lokaler Software interpretiert, was komplexe anwendungsübergreifende Arbeitsabläufe ermöglicht.
Million-Token-Kontext: Es unterstützt ein extrem langes Kontextfenster von bis zu 1 Million Token (1M Token). Dies ermöglicht es einem Agenten, eine gesamte große Codebasis oder mehrere Quartalsfinanzberichte auf einmal zu „lesen“ und anschließend langfristige Aufgaben zu planen und zu überprüfen, die sich über Stunden oder sogar Tage erstrecken.
Versionen und Preise
Mit dieser Version wurde auch die Stufe GPT-5.4Pro eingeführt, die in erster Linie für intensive professionelle Entwickler und Unternehmenskunden konzipiert ist:
Exklusive Funktionen der Pro-Version: Unterstützt höhere Einstellungen für die Denkintensität (Reasoning Effort: High/X-High) und zielt damit auf besonders anspruchsvolle Aufgaben in der wissenschaftlichen Forschung oder im Architekturdesign ab.
Verfügbarkeit
Verwandter Artikel
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Einhaltung der Vorschriften für autonome Fahrzeuge in Kalifornien: Eine neue Ära von Bußgeldern, Geofences und 1 Million Meilen
Guident betreibt einen AuveTech-Shuttle in Südflorida und verwaltet mithilfe seiner Fernüberwachungstechnologie eine vier Meilen lange Strecke in West Palm Beach sowie eine eine Meile lange Strecke in
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
OpenAI hat die GPT-5.4-Serie am 5. März 2026 offiziell vorgestellt. Diese Version stellt einen bedeutenden Fortschritt dar und vereint auf einzigartige Weise Fähigkeiten in den Bereichen logisches Denken, Programmierung und agentenbasierte Arbeitsabläufe.
Innerhalb der ChatGPT-Weboberfläche und der mobilen App führt der neue „Thinking“-Modus (Logikmodus) eine revolutionäre Art der Interaktion ein:
Vorschau des Denkprozesses: Bevor die KI eine endgültige Antwort liefert, skizziert sie zunächst ihren „Denkplan“. Nutzer können in Echtzeit beobachten, wie sie ihren Lösungsansatz entwirft, und jederzeit in den Prozess eingreifen, um die Richtung anzupassen.
Verbesserte Deep Search: Für hochspezialisierte und komplexe Anfragen bietet der Thinking-Modus robustere Multi-Turn-Websuchfunktionen. Er kann Quellen miteinander verknüpfen und hochwertige Antworten mit dem Urteilsvermögen eines menschlichen Experten zusammenstellen.

Die Produktivitäts-Engine: Codex-Erbe trifft auf professionelle Optimierung
GPT-5.4 integriert die herausragenden Programmierfähigkeiten von GPT-5.3-Codex vollständig und etabliert sich als OpenAIs führendes „Mainstream-Schlussfolgerungsmodell“.
Office-Suite-Integration: Es wurde speziell für Produktivitätsszenarien wie Tabellenkalkulationen (Excel), Präsentationen (PPT) und Dokumentenverarbeitung optimiert und reduziert logische Fehler bei der Inhaltserstellung drastisch.
Niedrige Fehlerquote und hohe sachliche Genauigkeit: Daten zeigen, dass die sachliche Fehlerquote von GPT-5.4 um 18 % niedriger ist als die von GPT-5.2, wobei falsche Aussagen um 33 % zurückgegangen sind. Seine Leistung in Spezialgebieten wie Finanz- und Rechtsanalyse kann nun mit der von menschlichen Fachleuten mithalten.
Der Agent-Sprung: Native „Computersteuerung“ und Millionen-Token-Kontext
GPT-5.4 entwickelt sich über eine einfache Chat-Oberfläche hinaus und erlangt echte native Computerbedienungsfähigkeiten:
Ausführung mehrerer Anwendungen: Das Modell kann Aktionen wie Klicken, Ziehen und Tippen direkt ausführen, indem es Screenshots und Anweisungen in virtuellen Umgebungen oder lokaler Software interpretiert, was komplexe anwendungsübergreifende Arbeitsabläufe ermöglicht.
Million-Token-Kontext: Es unterstützt ein extrem langes Kontextfenster von bis zu 1 Million Token (1M Token). Dies ermöglicht es einem Agenten, eine gesamte große Codebasis oder mehrere Quartalsfinanzberichte auf einmal zu „lesen“ und anschließend langfristige Aufgaben zu planen und zu überprüfen, die sich über Stunden oder sogar Tage erstrecken.
Versionen und Preise
Mit dieser Version wurde auch die Stufe GPT-5.4Pro eingeführt, die in erster Linie für intensive professionelle Entwickler und Unternehmenskunden konzipiert ist:
Exklusive Funktionen der Pro-Version: Unterstützt höhere Einstellungen für die Denkintensität (Reasoning Effort: High/X-High) und zielt damit auf besonders anspruchsvolle Aufgaben in der wissenschaftlichen Forschung oder im Architekturdesign ab.
Verfügbarkeit
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter











