Option
Heim
Nachricht
OpenAI-Mitbegründer drängt auf branchenweite KI-Sicherheitstests

OpenAI-Mitbegründer drängt auf branchenweite KI-Sicherheitstests

24. Dezember 2025
135

OpenAI-Mitbegründer drängt auf branchenweite KI-Sicherheitstests

Zwei der weltweit führenden KI-Labors, OpenAI und Anthropic, gewährten vorübergehend Zugang zu ihren streng gehüteten KI-Modellen für gemeinsame Sicherheitstests - ein seltener Fall von unternehmensübergreifender Zusammenarbeit inmitten des intensiven Wettbewerbs in der Branche. Die Initiative sollte blinde Flecken in den internen Bewertungen der beiden Unternehmen aufdecken und aufzeigen, wie führende KI-Unternehmen gemeinsam die Sicherheit und die Angleichung ihrer Anstrengungen in Zukunft vorantreiben können.

In einem Interview mit TechCrunch erklärte OpenAI-Mitbegründer Wojciech Zaremba, dass eine solche Zusammenarbeit immer wichtiger wird, je weiter KI in eine "folgenreichere" Phase eintritt, in der Millionen von Nutzern täglich mit KI-Modellen interagieren.

"Eine größere Herausforderung für die Branche ist die Festlegung von Sicherheits- und Kooperationsstandards, auch wenn Milliarden von Dollar investiert werden und ein harter Kampf um Talente, Nutzer und herausragende Produkte entbrennt", so Zaremba.

Die gemeinsame Sicherheitsstudie, die am Mittwoch von beiden Unternehmen veröffentlicht wurde, kommt zu einem Zeitpunkt, an dem sich führende KI-Unternehmen wie OpenAI und Anthropic in einem technologischen Wettrüsten befinden. Angesichts milliardenschwerer Investitionen in Rechenzentren und Vergütungspaketen von über 100 Millionen Dollar für Spitzenforscher warnen einige Analysten, dass der Druck, Spitzenprodukte zu liefern, zu Kompromissen bei den Sicherheitsprotokollen führen könnte.

Um diese Forschung zu ermöglichen, tauschten OpenAI und Anthropic speziellen API-Zugang zu weniger eingeschränkten Versionen ihrer Modelle aus (OpenAI stellte klar, dass GPT-5 nicht getestet wurde, da es noch nicht auf dem Markt war). Kurz nach Abschluss der Untersuchungen entzog Anthropic jedoch einem anderen OpenAI-Team den API-Zugang. Anthropic behauptete, OpenAI habe gegen seine Nutzungsbedingungen verstoßen, die die Verwendung von Claude zur Verbesserung konkurrierender Produkte untersagen.

Zaremba behauptet, dass die beiden Vorfälle nichts miteinander zu tun haben, und erwartet, dass der Wettbewerb stark bleiben wird, auch wenn die KI-Sicherheitsteams eine Zusammenarbeit anstreben. Nicholas Carlini, ein Sicherheitsforscher bei Anthropic, sagte gegenüber TechCrunch, dass er hofft, dem Sicherheitsteam von OpenAI auch in Zukunft Zugang zu Claude-Modellen zu gewähren.

"Wir wollen die Zusammenarbeit, wo immer es möglich ist, über die Grenzen der Sicherheit hinweg ausweiten und solche Partnerschaften zur Routine werden lassen", so Carlini.

Tech- und VC-Schwergewichte auf der Agenda der Disrupt 2025

Netflix, ElevenLabs, Wayve, Sequoia Capital, Elad Gil - dies sind nur einige der prominenten Namen, die an der Disrupt 2025 teilnehmen. Sie sind hier, um Einblicke zu geben, die das Wachstum von Start-ups fördern und Ihren Wettbewerbsvorteil stärken. Verpassen Sie nicht das 20-jährige Jubiläum der TechCrunch Disrupt, eine Gelegenheit, von führenden Stimmen aus der Tech-Branche zu lernen - sichern Sie sich jetzt Ihr Ticket und sparen Sie über 600 US-Dollar, bevor die Preise steigen.

Tech- und VC-Schwergewichte auf der Agenda der Disrupt 2025

Netflix, ElevenLabs, Wayve, Sequoia Capital - nur eine Handvoll einflussreicher Führungskräfte, die auf der Agenda der Disrupt 2025 stehen. Sie werden wertvolle Perspektiven liefern, die Startups dabei helfen, zu wachsen und ihre Strategien zu verfeinern. Seien Sie beim 20-jährigen Jubiläum der TechCrunch Disrupt dabei - buchen Sie Ihr Ticket noch heute und sparen Sie bis zu 675 US-Dollar, bevor die Preise steigen.

San Francisco | 27. bis 29. Oktober 2025 JETZT ANMELDEN

Eines der bemerkenswertesten Ergebnisse der Studie betraf Halluzinationstests. Die Modelle Claude Opus 4 und Sonnet 4 von Anthropic weigerten sich, bis zu 70 % der Fragen zu beantworten, wenn sie unsicher waren, und entschieden sich für Antworten wie "Ich habe keine zuverlässigen Informationen". Im Gegensatz dazu verweigerten die o3- und o4-mini-Modelle von OpenAI weitaus weniger Fragen, wiesen aber viel höhere Halluzinationsraten auf und versuchten, auch bei unzureichenden Informationen zu antworten.

Zaremba glaubt, dass der ideale Ansatz irgendwo dazwischen liegt: Die Modelle von OpenAI sollten mehr unsichere Anfragen ablehnen, während die Systeme von Anthropic versuchen könnten, häufiger zu antworten.

Kriecherei - die Tendenz von KI-Modellen, schädliches Nutzerverhalten zu verstärken, um Zustimmung zu erhalten - hat sich als kritisches Sicherheitsproblem herausgestellt.

In seinem Forschungsbericht nennt Anthropic Fälle von "extremer" Kriecherei bei GPT-4.1 und Claude Opus 4, bei denen sich die Modelle zunächst gegen psychotisches oder manisches Verhalten wehrten, später aber beunruhigende Entscheidungen unterstützten. Bei anderen Modellen von OpenAI und Anthropic stellten die Forscher ein geringeres Maß an Kriechertum fest.

Am Dienstag reichten die Eltern des 16-jährigen Adam Raine Klage gegen OpenAI ein und behaupteten, dass eine mit GPT-4o betriebene Version von ChatGPT den Selbstmord ihres Sohnes gefördert habe, anstatt seine schädlichen Gedanken zu bekämpfen. Die Klage wirft die Möglichkeit auf, dass dies ein weiterer tragischer Fall von KI-Schmeichelei ist.

"Es ist herzzerreißend, sich vorzustellen, was die Familie durchmacht", sagte Zaremba auf die Frage nach dem Vorfall. "Es wäre zutiefst beunruhigend, wenn wir eine KI erschaffen würden, die in der Lage ist, Probleme auf Doktoranden-Niveau zu lösen und die Wissenschaft voranzubringen, aber gleichzeitig zu psychischen Krisen beiträgt. Das ist ein dystopisches Ergebnis, mit dem ich nichts zu tun haben möchte."

In einem Blog-Beitrag berichtete OpenAI, dass es mit GPT-5 im Vergleich zu GPT-4o wesentliche Verbesserungen zur Verringerung der Kriecherei vorgenommen hat und dass das neuere Modell bei psychischen Krisen angemessener reagiert.

Mit Blick auf die Zukunft äußerten Zaremba und Carlini den Wunsch, dass Anthropic und OpenAI ihre Zusammenarbeit bei den Sicherheitstests vertiefen - und weitere Themen und neue Modelle evaluieren - und hoffen, dass andere KI-Labors einen ähnlich kooperativen Ansatz verfolgen.

Aktualisiert um 14:00 Uhr: Dieser Artikel wurde überarbeitet, um zusätzliche Forschungsergebnisse von Anthropic aufzunehmen, die TechCrunch vor der ursprünglichen Veröffentlichung nicht zur Verfügung standen.


Sie haben einen sensiblen Hinweis oder vertrauliche Dokumente? Wir untersuchen das Innenleben der KI-Industrie - von den Organisationen, die ihre Entwicklung gestalten, bis hin zu den Menschen, die von ihren Entscheidungen betroffen sind. Kontaktieren Sie Rebecca Bellan unter [email protected] und Maxwell Zeff unter [email protected]. Für eine sichere Kommunikation erreichen Sie uns über Signal unter @rebeccabellan.491 und @mzeff.88.

Verwandter Artikel
Anthropic bringt Opus 4.8 mit einem neuen dynamischen Workflow-Tool auf den Markt Anthropic bringt Opus 4.8 mit einem neuen dynamischen Workflow-Tool auf den Markt Anthropic hat am Donnerstag Opus 4.8 vorgestellt, die neueste Version seines führenden öffentlichen Modells. Das Update kostet genauso viel wie sein Vorgänger und ist nun auf allen Plattformen verfügb
OpenAI bringt eine sicherere Version von ChatGPT für Jugendliche auf den Markt, Jahre nachdem diese begonnen hatten, die Plattform zu nutzen OpenAI bringt eine sicherere Version von ChatGPT für Jugendliche auf den Markt, Jahre nachdem diese begonnen hatten, die Plattform zu nutzen Nach einer Reihe von Gerichtsverfahren wegen fehlender Sicherheitsvorkehrungen bei KI-Chatbots – die zu Selbstmorden unter Jugendlichen und anderen psychischen Krisen beigetragen hatten – stellte Open
Frontier AI Labs weigert sich, Eindämmungsstrategien für außer Kontrolle geratene Modelle offenzulegen Frontier AI Labs weigert sich, Eindämmungsstrategien für außer Kontrolle geratene Modelle offenzulegen Jüngste Untersuchungen zeigen, dass nur sehr wenige führende KI-Forschungslabore Maßnahmenpläne zur Eindämmung veröffentlicht oder vorgeführt haben. Ein solcher Eindämmungsplan legt die Vorgehensweise
Empfehlungen zu verwandten Spezialthemen
Schreiben KI-Tools zur Gliederung von Artikeln für das Verfassen langer Texte
KI-Tools zur Gliederung von Artikeln für das Verfassen langer Texte

2026: Die neuesten, besten und am besten bewerteten KI-Tools zur Erstellung von Gliederungen für lange Texte! Diese sorgfältig zusammengestellte Sammlung umfasst leistungsstarke, bahnbrechende Tools, die präzise, strukturierte Gliederungen liefern – getestet unter realen Bedingungen –, um die Effizienz beim Schreiben deutlich zu steigern. XIX.AI gehört zu dieser Eliteauswahl. Holen Sie sich einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, der Ihnen bei der Auswahl des perfekten Tools hilft. Entdecken Sie die Tools jetzt und sichern Sie sich Ihren KI-Vorteil!

9 Tools
xix.ai
Chatbot Die besten KI-Rollenspiel-Chat-Apps für Sprachpraxis, Vorstellungsgesprächsvorbereitung und tägliche Sprechflüssigkeit
Die besten KI-Rollenspiel-Chat-Apps für Sprachpraxis, Vorstellungsgesprächsvorbereitung und tägliche Sprechflüssigkeit

2026 Neueste Besten Top-bewerteten KI-Rollenspiel-Chat-Apps für Sprachpraxis, Vorstellungsgesprächsvorbereitung und tägliche Sprachflüssigkeit! XIX.AI kuratiert eine leistungsstarke, spielfeldverändernde Sammlung, die kostenlose gegen kostenpflichtige Vergleiche, reale Tests und wöchentlich aktualisierte Rankings bietet. Diese unbedingt auszuprobierenden Tools helfen Ihnen, Ihre Schreibfähigkeiten zu verbessern, Hürden der Sprachflüssigkeit zu überwinden und die Kommunikationseffizienz in allen alltäglichen Szenarien zu steigern. Entdecken Sie jetzt Ihr perfektes Werkzeug für Ihre Sprachentwicklung!

10 Tools
xix.ai
Musikkomposition KI-Tools zur Stim-Trennung für die Remix-Produktion, die Vorbereitung von Samples und Karaoke-Master
KI-Tools zur Stim-Trennung für die Remix-Produktion, die Vorbereitung von Samples und Karaoke-Master

Die besten und am besten bewerteten KI-Tools zur Stem-Trennung des Jahres 2026 – speziell ausgewählt für Remix-Produktionen, die Vorbereitung von Samples und Karaoke-Masters. Diese leistungsstarken, bahnbrechenden Tools haben sich in der Praxis bewährt und bieten präzise Audioisolierung, wodurch die Produktivität erheblich gesteigert wird. XIX.AI stellt einen wöchentlich aktualisierten Vergleichsleitfaden zwischen kostenlosen und kostenpflichtigen Lösungen bereit, der Ihnen hilft, die für Ihre Anforderungen passende Lösung zu finden, die Sie unbedingt ausprobieren sollten. Entdecken Sie ihn jetzt und sichern Sie sich Ihren KI-Vorteil.

8 Tools
xix.ai
Datenanalyse KI-basierte SQL-Copiloten für Umsatz-Dashboards, Kanalanalysen sowie Produktmetriken
KI-basierte SQL-Copiloten für Umsatz-Dashboards, Kanalanalysen sowie Produktmetriken

2026: Die neuesten und besten AI-SQL-Copiloten – alle in der Rangliste ganz oben! XIX.AI sammelt eine leistungsstarke Auswahl an Tools, die wöchentlich mit aktualisierten Tests aus der Praxis erweitert wird. Mit diesen unverzichtbaren Werkzeugen können Sie präzise Umsatzübersichten erstellen, Verkaufsprozesse analysieren sowie Produktmetriken schnell überwachen und so Ihre Produktivität erheblich steigern. Entdecken Sie jetzt das perfekte Tool für datenbasierte Entscheidungsfindung! 238 Zeichen

9 Tools
xix.ai
Musikkomposition Die besten KI-Tools zum Komponieren von Melodien für Songentwürfe
Die besten KI-Tools zum Komponieren von Melodien für Songentwürfe

2026 Neueste Besten Top-Bewerteten KI-Melodie-Schreibtools für Songentwürfe! XIX.AI hat eine hochleistungsfähige, bahnbrechende Kollektion zusammengestellt, die strengen Praxistests unterzogen wurde, um das beste Schreiberlebnis zu liefern. Sie finden detaillierte kostenlose versus kostenpflichtige Vergleiche, präzise Ranglisten und unbedingt auszuprobierende Optionen, die darauf ausgelegt sind, Ihnen zu helfen, beeindruckende Songentwürfe mühelos zu erstellen und Ihre kreative Produktivität erheblich zu steigern. Entdecken Sie jetzt Ihr perfektes Tool!

8 Tools
xix.ai
Chatbot Die besten KI-gestützten Gesprächstrainingstools für Vorstellungsgesprächspraxis
Die besten KI-gestützten Gesprächstrainingstools für Vorstellungsgesprächspraxis

2026 Neueste Besten Top-bewerteten KI-Konversationstrainer-Tools für Vorstellungsgesprächspraxis sind hier auf XIX.AI! Diese kuratierte Sammlung enthält leistungsstarke, bahnbrechende Tools, die strengen Praxistests unterzogen wurden, um präzises Feedback zu liefern. Sie finden einen Vergleich zwischen kostenlosen und kostenpflichtigen Optionen sowie detaillierte Rankings, die Ihnen helfen, die empfehlenswerte Option zu wählen, die Ihr Selbstvertrauen und Ihre Fähigkeiten verbessert. Entdecken Sie jetzt Ihr perfektes Tool für den Erfolg im Vorstellungsgespräch!

12 Tools
xix.ai
Kommentare (3)
0/500
WillWalker
WillWalker 21. Juli 2026 18:00:18 MESZ

Interesting to see competitors collaborate on safety. But is it just a PR stunt? 🤔

IsabellaLevis
IsabellaLevis 4. März 2026 03:00:50 MEZ

AIの安全性テストを業界全体で実施する必要があるって主張、すごく共感します。競争が激しい中でOpenAIとAnthropicが協力したのは意外だけど、こういう連携がもっと増えると良いですね。ただ、本当に効果的なテストができるのか少し不安… 🤔

GeorgeWilliams
GeorgeWilliams 20. Februar 2026 01:01:46 MEZ

So OpenAI and Anthropic are actually sharing their secret sauce for safety checks? That's pretty refreshing to see amidst all the cutthroat AI race. Hope this kind of collaboration becomes the norm, not just a rare exception. The real question is, will this testing be transparent enough for the public to trust the results? 🤔

OR