Option
Modellparametermenge
671B
Modellparametermenge
Angehörige Organisation
DeepSeek
Angehörige Organisation
Open Source
Lizenztyp
Freigabezeit
26. Dezember 2024
Freigabezeit

Modelleinführung
DeepSeek-V3 hat höhere Bewertungsergebnisse als andere Open-Source-Modelle wie Qwen2.5-72B und Llama-3.1-405B erreicht, und seine Leistung ist dem Niveau der weltweit führenden proprietären Modelle wie GPT-4o und Claude-3.5-Sonnet vergleichbar.
Nach links und rechts swipen, um mehr anzuzeigen
Sprachverständnisfähigkeit Sprachverständnisfähigkeit
Sprachverständnisfähigkeit
Fehleinschätzt häufig semantische Fehleinschätzungen, was zu offensichtlichen logischen Trennungen in Antworten führt.
6.8
Wissensabdeckung Wissensabdeckung
Wissensabdeckung
Besitzt Kernwissen über Mainstream-Disziplinen, hat jedoch nur eine begrenzte Abdeckung der modernen interdisziplinären Bereiche.
8.8
Argumentationsfähigkeit Argumentationsfähigkeit
Argumentationsfähigkeit
Es ist nicht möglich, kohärente Argumentationsketten aufrechtzuerhalten und häufig invertierte Kausalität oder Fehlkalkulationen zu verursachen.
6.7
Verwandter Modell
DeepSeek-V4-Flash DeepSeek-V4-Flash ist das effizienzorientierte, ressourcenschonende Modell von DeepSeek für Interaktionen mit geringer Latenz, den Einsatz bei hoher Parallelität und intelligente Alltagsanwendungen.
DeepSeek-V4-Pro DeepSeek-V4-Pro ist das Flaggschiff-Modell von DeepSeek mit hoher Leistungsfähigkeit, das die Fähigkeiten im logischen Denken, beim Programmieren, bei der Verarbeitung langer Texte sowie in der Gesamtleistung bei Aufgaben weiter verbessert.
DeepSeek-V3.2 Die neueste Version der Deepseek V3-Modellreihe.
DeepSeek-V3.2-Exp Die neueste experimentelle Version der Modelle der Deepseek V3-Serie.
DeepSeek-R1-0528 Die neueste Version von Deepseek R1.
Relevante Dokumente
DeepSeek-V3 Enthüllt: Wie Hardware-bewusstes KI-Design Kosten senkt und Leistung steigert DeepSeek-V3: Ein kosteneffizienter Sprung in der KI-EntwicklungDie KI-Branche steht an einem Scheideweg. Während große Sprachmodelle (LLMs) leistungsfähiger werden, sind ihre Rechenanforderungen explo
Anthropic erweitert die Claude KI-Coding-Tools in Japan im Rahmen der Bemühungen um internationales Wachstum Anthropic, ein führendes US-amerikalisches Unternehmen für künstliche Intelligenz, intensiviert seine globalen Outreach-Bemühungen. Am Mittwoch veranstaltete das Unternehmen in Tokio eine große Entwicklerkonferenz namens „Code with Claude“, an der kn
Indiens Software-Riese stellt weniger ein, verspricht aber keine Entlassungen, während KI-Agenten ausgebaut werden Während die künstliche Intelligenz traditionelle, arbeitsintensive Geschäftsmodelle neu gestaltet, hat Tata Consultancy Services (TCS), ein führendes indisches Software-Outsourcing-Unternehmen, seine strategische Antwort vorgestellt. Während der jähr
China sperrt KI-Modelle während des Gaokam, um sofortige Hausaufgabenhilfe zu blockieren Mit dem sich dem 2026-Gaokao schnell nähernden Termin haben Gerüchte über die Sperrung von KI-Tools während der Prüfungsphase eine intensive Online-Debatte entfacht. Als Reaktion auf die öffentlichen Bedenken haben große KI-Plattformen und Bildungs-A
Umfrage zeigt: Von der FDA zugelassenes KI-Diagnosetool für Brustkrebs bleibt hinter den Erwartungen der Radiologen zurück Eine kürzlich in der Fachzeitschrift „Clinical Imaging“ veröffentlichte Studie von Forschern des UC San Diego Health Center befragte 215 Mitglieder der American Society of Breast Imaging. Die Ergebnis
Modellvergleich
Starten Sie den Vergleich
OR