Option
Heim
Liste der Al -Modelle
DeepSeek-V2-Chat
Modellparametermenge
236B
Modellparametermenge
Angehörige Organisation
DeepSeek
Angehörige Organisation
Open Source
Lizenztyp
Freigabezeit
6. Mai 2024
Freigabezeit

Modelleinführung
DeepSeek-V2 ist ein starkes Mixture-of-Experts (MoE)-Sprachmodell, das durch kostengünstiges Training und effizientes Inferenz gekennzeichnet ist. Es besteht aus insgesamt 236 Billionen Parametern, wovon für jeden Token 21 Milliarden aktiviert sind. Im Vergleich zum DeepSeek 67B erreicht DeepSeek-V2 stärkere Leistungen und spart dabei 42,5 % der Trainingskosten, reduziert den KV-Cache um 93,3 % und steigert die maximale Generierungsdurchsatz bis zu 5,76-mal.
Nach links und rechts swipen, um mehr anzuzeigen
Sprachverständnisfähigkeit Sprachverständnisfähigkeit
Sprachverständnisfähigkeit
Fehleinschätzt häufig semantische Fehleinschätzungen, was zu offensichtlichen logischen Trennungen in Antworten führt.
5.0
Wissensabdeckung Wissensabdeckung
Wissensabdeckung
Hat bedeutende kenntnisgebende Flecken, die häufig sachliche Fehler zeigt und veraltete Informationen wiederholt.
6.3
Argumentationsfähigkeit Argumentationsfähigkeit
Argumentationsfähigkeit
Es ist nicht möglich, kohärente Argumentationsketten aufrechtzuerhalten und häufig invertierte Kausalität oder Fehlkalkulationen zu verursachen.
4.1
Verwandter Modell
DeepSeek-V4-Flash DeepSeek-V4-Flash ist das effizienzorientierte, ressourcenschonende Modell von DeepSeek für Interaktionen mit geringer Latenz, den Einsatz bei hoher Parallelität und intelligente Alltagsanwendungen.
DeepSeek-V4-Pro DeepSeek-V4-Pro ist das Flaggschiff-Modell von DeepSeek mit hoher Leistungsfähigkeit, das die Fähigkeiten im logischen Denken, beim Programmieren, bei der Verarbeitung langer Texte sowie in der Gesamtleistung bei Aufgaben weiter verbessert.
DeepSeek-V3.2 Die neueste Version der Deepseek V3-Modellreihe.
DeepSeek-V3.2-Exp Die neueste experimentelle Version der Modelle der Deepseek V3-Serie.
DeepSeek-R1-0528 Die neueste Version von Deepseek R1.
Relevante Dokumente
Apple Smart Glasses könnten auf der WWDC27 vorgestellt werden und dabei den Schutz der Privatsphäre in den Mittelpunkt stellen Bloombergs Mark Gurman berichtet, dass Apples Smart Glasses mit dem Codenamen N50 im Juni 2027 auf der WWDC27 vorgestellt werden sollen, wobei ein Verkaufsstart im Herbst 2027 erwartet wird. Ursprünglich für Ende dieses Jahres und Anfang 2027 geplant
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools Alibaba hat offiziell Qwen3.8-Max vorgestellt, ein hochmodernes Foundation-Modell mit 2,4 Billionen Parametern. Diese bedeutende KI-Entwicklung bietet erhebliche Leistungssteigerungen in Kernbereichen wie Programmierung und professionelle Büroaufgabe
Indischer Tech-Milliardär investiert 30 Millionen US-Dollar in KI-Wettbewerber zu Microsoft Office Der Serial-Entrepreneur Bhavin Turakhia investiert 30 Millionen US-Dollar seines eigenen Kapitals und setzt darauf, dass der Enterprise-AI-Sektor noch Platz für neue Akteure bietet. Sein neuestes Startup, Neo, basiert auf der Kernüberzeugung: Legacy-
Modellvergleich
Starten Sie den Vergleich
OR