Option
Heim
Nachricht
Deepseeks R1- und V3 -Codierungsfähigkeiten getestet: Wir sind noch nicht zum Scheitern verurteilt

Deepseeks R1- und V3 -Codierungsfähigkeiten getestet: Wir sind noch nicht zum Scheitern verurteilt

17. April 2025
344

Einführung in DeepSeek: Ein neuer Akteur in der KI-Arena

DeepSeek hat am Wochenende die Bühne betreten und weltweit Aufmerksamkeit aus drei überzeugenden Gründen erregt:

  • Es ist ein KI-Chatbot aus China, eine bemerkenswerte Abweichung von den üblichen Angeboten aus den USA.
  • Es ist Open Source, was in der Tech-Community eine große Sache ist.
  • Es läuft auf deutlich weniger Infrastruktur als seine schwergewichtigen Pendants, was es für viele zu einer interessanten Option macht.

Während die genaue Prüfung der US-Regierung bezüglich TikTok und einer möglichen Beteiligung der chinesischen Regierung an dessen Code für Aufsehen gesorgt hat, zieht DeepSeeks Herkunft aus China natürlich ähnliche Aufmerksamkeit auf sich. Wir halten uns hier jedoch von der Politik fern. Stattdessen tauchen wir ein in die Frage, wie DeepSeek V3 und DeepSeek R1 im Vergleich zu anderen KI-Modellen bei Programmieraufgaben abschneiden.

Laut den eigenen Richtlinien von DeepSeek:

  • Wählen Sie V3 für Aufgaben, die Tiefe und Genauigkeit erfordern, wie das Lösen komplexer mathematischer Probleme oder das Generieren komplizierter Codes.
  • Entscheiden Sie sich für R1, wenn Sie schnelle, hochvolumige Anwendungen benötigen, wie z. B. die Automatisierung des Kundensupports oder einfache Textverarbeitung.

Sie können zwischen R1 und V3 über einen kleinen Button in der Chat-Oberfläche wechseln. Wenn er blau ist, verwenden Sie R1.

Screenshot von David Gewirtz/ZDNET

Screenshot von David Gewirtz/ZDNET

Wie haben sie abgeschnitten? Beide Modelle zeigten Potenzial, waren aber nicht fehlerfrei. Lassen Sie uns die Ergebnisse untersuchen.

Test 1: Erstellen eines WordPress-https://img.xix.aiplugins

Mein erster Test, inspiriert von dem Bedarf meiner Frau nach einem WordPress-https://img.xix.aiplugin zur Verwaltung eines Beteiligungsgeräts für ihre Online-Gruppe, ist ein Klassiker. Das https://img.xix.aiplugin musste eine Liste von Namen akzeptieren, sie sortieren und sicherstellen, dass Duplikate nicht nebeneinander stehen. Ich habe diese Herausforderung zahlreichen KIs gestellt, und sie ist schwierig.

Screenshot von David Gewirtz/ZDNET

Screenshot von David Gewirtz/ZDNET

DeepSeek V3 hat es perfekt gemeistert und eine Benutzeroberfläche sowie Programmlogik erstellt, die die Vorgaben exakt erfüllten. R1 verfolgte einen anderen Ansatz und lieferte satte 4502 Wörter Analyse, bevor der Code geteilt wurde. Die Benutzeroberfläche war umfassender, aber sowohl die Benutzeroberfläche als auch die Logik funktionierten, sodass R1 ebenfalls bestand.

Screenshot von David Gewirtz/ZDNET

Screenshot von David Gewirtz/ZDNET

Screenshot von David Gewirtz/ZDNET

Screenshot von David Gewirtz/ZDNET

Bis jetzt haben sowohl V3 als auch R1 einen von vier Tests bestanden.

Test 2: Umschreiben einer String-Funktion

Ein Benutzer hatte Probleme, Dollar und Cent in ein Spendenfeld einzugeben, was mein ursprünglicher Code nicht erlaubte. Die Aufgabe war, die Routine so anzupassen, dass beides akzeptiert wird. DeepSeek generierte funktionalen Code, aber es gibt Verbesserungspotenzial.

Der Code von V3 war übermäßig lang und repetitiv, während die Argumentation von R1 vor der Codegenerierung ebenfalls ausführlich war. Beide Modelle validierten bis zu zwei Dezimalstellen, aber sie kamen mit sehr großen Zahlen nicht gut zurecht. R1s Nutzung der JavaScript-Number-Konvertierung ohne Prüfung von Randfällen könnte zu Abstürzen führen.

Interessanterweise lieferte R1 eine schöne Liste von Testfällen:

Screenshot von David Gewirtz/ZDNET

Screenshot von David Gewirtz/ZDNET

Ich gebe den Punkt an V3, weil sein Code nicht abstürzt und die erwarteten Ergebnisse liefert. R1 fällt durch mögliche Abstürze bei Nicht-String-Eingaben durch. Das macht zwei Siege von vier für V3 und einen für R1.

Test 3: Aufspüren eines lästigen Fehlers

Dieser Test basierte auf einem Fehler, den ich nur schwer finden konnte. Die Herausforderung war, dass die offensichtliche Antwort basierend auf der Fehlermeldung falsch war, was KIs oft täuscht. Das Lösen erfordert ein Verständnis der WordPress-API-Aufrufe, das Hinaussehen über die Fehlermeldung und das genaue Lokalisieren des Fehlers.

Beide, V3 und R1, bestanden diesen Test mit nahezu identischen Antworten, was V3 auf drei von vier Siegen und R1 auf zwei von vier bringt. DeepSeek übertrifft bereits Gemini, Copilot, Claude und Meta.

Test 4: Erstellen eines Skripts

Dieser Test ist schwierig, weil er drei Umgebungen umfasst: AppleScript, das Chrome-Objektmodell und Keyboard Maestro. ChatGPT hat es gemeistert, aber DeepSeek V3 und R1 blieben zurück. Keines der Modelle verstand die Notwendigkeit, Aufgaben zwischen Keyboard Maestro und Chrome aufzuteilen, und ihr AppleScript-Wissen war schwach.

R1 machte falsche Annahmen, wie dass immer ein vorderes Fenster existiert und dass das laufende Programm immer Chrome sein würde. Dies ließ V3 mit drei korrekten Tests und einem Fehlschlag sowie R1 mit zwei korrekten Tests und zwei Fehlschlägen zurück.

Schlussgedanken

DeepSeeks Beharren darauf, eine öffentliche Cloud-E-Mail wie Gmail anstelle meiner Unternehmensdomäne zu verwenden, war frustrierend. Es gab auch einige Reaktionsprobleme, die die Tests länger als erwartet dauern ließen.

Ich hatte zunächst Schwierigkeiten, mich anzumelden, aufgrund dieses Fehlers:

Die Online-Dienste von DeepSeek waren kürzlich groß angelegten bösartigen Angriffen ausgesetzt. Um den fortlaufenden Dienst zu gewährleisten, ist die Registrierung vorübergehend auf +86 Telefonnummern beschränkt. Bestehende Benutzer können sich wie gewohnt einloggen. Vielen Dank für Ihr Verständnis und Ihre Unterstützung.

Nach dem Einloggen konnte ich die Tests durchführen. DeepSeek neigt dazu, mit seinem Code wortreich zu sein. Das AppleScript in Test 4 war sowohl falsch als auch unnötig lang. Der reguläre Ausdruck in Test 2 hätte wartungsfreundlicher sein können, obwohl V3 es richtig gemacht hat.

Ich bin beeindruckt, dass V3 Gemini, Copilot und Meta geschlagen hat, aber es liegt immer noch auf dem alten GPT-3.5-Niveau, was Raum für Wachstum andeutet. Die Leistung von R1 war enttäuschend. Wenn ich wählen müsste, würde ich für Programmierhilfe bei ChatGPT bleiben.

Trotzdem ist DeepSeek für ein neues Tool, das auf viel weniger Infrastruktur läuft, definitiv eines, das man im Auge behalten sollte.

Was sind Ihre Gedanken? Haben Sie DeepSeek ausprobiert? Nutzen Sie KIs für Programmierunterstützung? Lassen Sie es uns in den Kommentaren unten wissen.

Folgen Sie meinen täglichen Projekt-Updates auf Social Media, abonnieren Sie meinen wöchentlichen Newsletter und verbinden Sie sich mit mir auf Twitter/X unter @DavidGewirtz, Facebook unter Facebook.com/DavidGewirtz, Instagram unter Instagram.com/DavidGewirtz, Bluesky unter @DavidGewirtz.com und YouTube unter YouTube.com/DavidGewirtzTV.

Verwandter Artikel
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools Alibaba hat offiziell Qwen3.8-Max vorgestellt, ein hochmodernes Foundation-Modell mit 2,4 Billionen Parametern. Diese bedeutende KI-Entwicklung bietet erhebliche Leistungssteigerungen in Kernbereichen wie Programmierung und professionelle Büroaufgabe
Empfehlungen zu verwandten Spezialthemen
Musikkomposition Die besten KI-Tools zum Komponieren von Melodien für Songentwürfe
Die besten KI-Tools zum Komponieren von Melodien für Songentwürfe

2026 Neueste Besten Top-Bewerteten KI-Melodie-Schreibtools für Songentwürfe! XIX.AI hat eine hochleistungsfähige, bahnbrechende Kollektion zusammengestellt, die strengen Praxistests unterzogen wurde, um das beste Schreiberlebnis zu liefern. Sie finden detaillierte kostenlose versus kostenpflichtige Vergleiche, präzise Ranglisten und unbedingt auszuprobierende Optionen, die darauf ausgelegt sind, Ihnen zu helfen, beeindruckende Songentwürfe mühelos zu erstellen und Ihre kreative Produktivität erheblich zu steigern. Entdecken Sie jetzt Ihr perfektes Tool!

8 Tools
xix.ai
Chatbot Die besten KI-gestützten Gesprächstrainingstools für Vorstellungsgesprächspraxis
Die besten KI-gestützten Gesprächstrainingstools für Vorstellungsgesprächspraxis

2026 Neueste Besten Top-bewerteten KI-Konversationstrainer-Tools für Vorstellungsgesprächspraxis sind hier auf XIX.AI! Diese kuratierte Sammlung enthält leistungsstarke, bahnbrechende Tools, die strengen Praxistests unterzogen wurden, um präzises Feedback zu liefern. Sie finden einen Vergleich zwischen kostenlosen und kostenpflichtigen Optionen sowie detaillierte Rankings, die Ihnen helfen, die empfehlenswerte Option zu wählen, die Ihr Selbstvertrauen und Ihre Fähigkeiten verbessert. Entdecken Sie jetzt Ihr perfektes Tool für den Erfolg im Vorstellungsgespräch!

12 Tools
xix.ai
Design & Kunst Die besten KI-Tools für den Stiltransfer für kreative Experimente
Die besten KI-Tools für den Stiltransfer für kreative Experimente

Die besten und am besten bewerteten KI-Tools für den Stiltransfer im Jahr 2026 – ideal für kreative Experimente! XIX.AI hat eine leistungsstarke, bahnbrechende Sammlung unverzichtbarer Tools zusammengestellt, die in Praxistests und strengen Bewertungen außergewöhnliche Ergebnisse liefern. Diese Top-Lösungen helfen Kreativen dabei, ihre Produktivität deutlich zu steigern, indem sie die Erstellung von Inhalten beschleunigen und unendliche kreative Möglichkeiten eröffnen. Entdecken Sie jetzt Ihr perfektes Tool und legen Sie noch heute los!

9 Tools
xix.ai
Comic-Erstellung Die besten KI-Tools für Sprechblasen zum visuellen Geschichtenerzählen
Die besten KI-Tools für Sprechblasen zum visuellen Geschichtenerzählen

Die besten und am besten bewerteten KI-Tools für Sprechblasen zum visuellen Storytelling des Jahres 2026 finden Sie hier auf XIX.AI! Diese sorgfältig zusammengestellte Sammlung umfasst leistungsstarke, bahnbrechende Tools, die Kreativen dabei helfen, ihre Produktivität zu steigern und kreative Blockaden zu überwinden. Holen Sie sich einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, sehen Sie sich Praxistests an und werfen Sie einen Blick auf die aktuellen Rankings, um die unverzichtbaren Lösungen zu finden, die sich perfekt für die Gestaltung fesselnder visueller Erzählungen eignen. Stöbern Sie jetzt und entdecken Sie Ihr ideales Tool!

10 Tools
xix.ai
Besprechungsassistent Die besten Tools zur Zusammenfassung von KI-Meetings: Entscheidungen und Folgemaßnahmen übersichtlich nachverfolgen
Die besten Tools zur Zusammenfassung von KI-Meetings: Entscheidungen und Folgemaßnahmen übersichtlich nachverfolgen

Die besten und am besten bewerteten KI-Tools zur Zusammenfassung von Besprechungen im Jahr 2026 für eine übersichtliche Nachverfolgung von Entscheidungen und müheloses Follow-up. Diese sorgfältig zusammengestellte Liste präsentiert leistungsstarke, bahnbrechende Lösungen, die die Produktivität drastisch steigern, indem sie Besprechungsnotizen automatisieren, wichtige Aktionspunkte identifizieren und die Teamkoordination projektübergreifend optimieren. Erhalten Sie einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten sowie Praxistests und wöchentlich aktualisierte Rankings, die Ihnen helfen, das perfekte Tool zu finden. Entdecken Sie es jetzt und nutzen Sie Ihren KI-Vorteil!

9 Tools
xix.ai
Datenanalyse Die besten Tools für die KI-gestützte Datenreinigung: Fehlende Werte und Duplikate schnell beheben
Die besten Tools für die KI-gestützte Datenreinigung: Fehlende Werte und Duplikate schnell beheben

2026 – Die neuesten, besten und am höchsten bewerteten Tools für die Reinigung von KI-Daten, um fehlende Werte sowie Duplikate schnell zu beheben. Diese sorgfältig zusammengestellte Liste präsentiert leistungsstarke Lösungen, die die Produktivität erheblich steigern. Jedes Tool wurde in der Praxis gründlich getestet, um seine Zuverlässigkeit zu gewährleisten. Holen Sie sich einen kostenlosen Vergleich zwischen kostenloser und kostenpflichtiger Variante und entdecken Sie das für Ihre Bedürfnisse beste Tool. Entdecken Sie es jetzt auf XIX.AI, um Ihren Vorteil in der KI-Branche zu erlangen.

11 Tools
xix.ai
Kommentare (16)
0/500
JonathanJackson
JonathanJackson 4. September 2026 12:00:12 MESZ

DeepSeek's open-source approach is a game-changer for the AI landscape, challenging the US monopoly. It's refreshing to see innovation from China that prioritizes accessibility. While the coding skills are impressive, we must remain vigilant about potential security risks and ethical implications. This isn't the end of the world, but a new chapter in AI competition. Exciting times ahead!

PaulHernández
PaulHernández 22. Juli 2026 12:00:23 MESZ

Interesting take! I've been messing around with DeepSeek's R1 and V3 for a few days, and honestly, the coding output is surprisingly solid for an open-source model. The fact that it's from China and not the usual US big players makes me wonder if we're entering a new phase of AI democratization. Still, I'm not ready to throw away my GPT-4 subscription just yet — let's see how it handles edge cases and long context. 😅

KennethRoberts
KennethRoberts 27. Mai 2026 10:00:19 MESZ

Als Entwickler finde ich es super, dass jetzt auch China mit DeepSeek in den Open-Source-AI-Markt einsteigt. Die Coding-Tests klingen vielversprechend – vielleicht wird die Konkurrenz zwischen den Modellen ja endlich mal die Preise drücken. Hoffentlich bleibt das Projekt langfristig unabhängig und wird nicht von irgendwelchen Firmen vereinnahmt. 🤔

CarlCarter
CarlCarter 5. September 2025 22:30:30 MESZ

DeepSeek这波操作有点东西啊!中国本土AI终于不再只擅长写诗和做饭了,居然在代码能力上也能和国外大模型掰手腕👏 不过开源这事...希望别过两天就变成'部分开源'吧😂

BruceGonzalez
BruceGonzalez 25. August 2025 09:01:02 MESZ

DeepSeek's open-source approach is a game-changer! I'm stoked to see a Chinese AI shaking things up. The coding skills are solid, but I wonder how it’ll stack against giants like GPT in the long run. Exciting times! 🚀

JoseGonzalez
JoseGonzalez 7. August 2025 08:33:00 MESZ

DeepSeek's open-source approach is super cool! It's wild to see a Chinese AI shaking up the game like this. I wonder how it'll stack up against ChatGPT in real-world coding tasks. Excited to try it out! 😄

OR