Heim
DeepSeek V4.1 Flash startet mit nativer multimodaler Bilderkennung und übertrifft die Pro-Version, während die Preise sinken
DeepSeek hat heute offiziell das kleinste Modell seiner neuesten Architekturserie gestartet: DeepSeek V4.1Flash. Als leichtgewichtiges Modell mit nativer multimodaler visueller Verständnisfähigkeit konzipiert, zielt es darauf ab, höhere Leistung, schnellere Inferenz, größeren Durchsatz und Skalierbarkeit auf größere Parametergrößen zu bieten.
Im Kern nutzt DeepSeek V4.1Flash eine Mixture-of-Experts-(MoE)-Architektur mit 552 Milliarden Parametern, die durch eine innovative kausale Encoder-Decoder-Struktur gekennzeichnet ist. Sein asymmetrisches Design führt zu nur 8 Milliarden Eingabe-Aktivierungen und 16 Milliarden Ausgabe-Aktivierungen, was die Kosten im Vergleich zu ähnlich großen Modellen erheblich senkt. Verbessert durch einen neuen Pretraining-Ansatz und großskaliges Verstärkungslernen übertrifft dieses Modell Flaggschiffmodelle wie DeepSeek V4Pro in verschiedenen Benchmarks.

In Bezug auf Effizienz und Kostenkontrolle reduziert das neue Modell die Größe des KV-Cache drastisch. Im Vergleich zu seinem Vorgänger benötigt V4.1Flash nur 1/4 des High-Bandwidth-Speichers (HBM) und 1/8 der Festkapazität von Solid-State-Drives (SSD). Diese Komprimierung ist besonders vorteilhaft für Agent-Szenarien, in denen die Kosten für Kontextspeicherung und Cache-Treffer hoch sind, was die Betriebskosten erheblich senkt. Statistiken zeigen, dass der KV-Cache auf 1/437 der Größe des ursprünglichen Modells geschrumpft ist.
Mit der Veröffentlichung des neuen Modells hat DeepSeek seine Produktlinie und Abrechnungsstrategie aktualisiert. DeepSeek V4.1Flash ist nun über die DeepSeek-API unter dem Modellnamen deepseek-flash verfügbar. Vorherige Versionen, V4Flash und V4Flash Vision Exp, wurden eingestellt, wobei alte Namen (deepseek-v4-flash und deepseek-v4-flash-vision-exp) vorübergehend auf V4.1Flash umgeleitet werden. Da V4.1Flash V4Pro in Bezug auf Leistung, Kosten, Geschwindigkeit und Nutzungsdauer übertrifft, plant das Unternehmen, V4Pro schrittweise außer Betrieb zu setzen: Nach 12:00 Uhr am 14. September 2026 werden Anfragen an deepseek-v4-pro auf V4.1Flash umgeleitet und nach dessen Tarif abgerechnet. Offizielle Partner wie WorkBuddy, CodeBuddy und Tencent's OpenCode haben dieses Modell bereits integriert.
Verwandter Artikel
Einführung der Aliyun Qwen Open Platform: KI auf Smartphones, PCs und Brillen – vom Leihen über den Versand bis hin zu weiteren Anwendungen
Da sich KI-Anwendungen rasch ausweiten, hat Qwen seinen Ökosystembereich erheblich ausgebaut. Die am 10. August gestartete Qwen Open Platform bietet nun mobilen Geräten, PCs und KI-Brillen einen breiten Zugang für Ökosystempartner und Entwickler.In
Dou Bao plant, die kostenpflichtigen Stufen Mitte Juni einzuführen; für das dritte Quartal ist ein E-Commerce-Push geplant.
Douyin, die Flaggschiff-Anwendung des großen Modells von ByteDance, wird bis Ende Juni kostenpflichtige Inhaltsfunktionen einführen, wobei Updates für die Force-Konferenz geplant sind. Dieser Schritt markiert einen wichtigen Meilenstein bei der Monet
CCTV deckt KI-Dating-Betrug auf, der sich an mittlere und ältere Frauen richtet, 28 Festnahmen
Aktuelle Berichte von CCTV News heben eine neue Welle von KI-gesteuerten Dating-Betrugsfällen hervor, die sich an mittlere und ältere Frauen richten. Kriminelle nutzen KI-generierte Personas, um Opfer in finanzielle Betrugshandlungen zu locken. Die B
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
DeepSeek hat heute offiziell das kleinste Modell seiner neuesten Architekturserie gestartet: DeepSeek V4.1Flash. Als leichtgewichtiges Modell mit nativer multimodaler visueller Verständnisfähigkeit konzipiert, zielt es darauf ab, höhere Leistung, schnellere Inferenz, größeren Durchsatz und Skalierbarkeit auf größere Parametergrößen zu bieten.
Im Kern nutzt DeepSeek V4.1Flash eine Mixture-of-Experts-(MoE)-Architektur mit 552 Milliarden Parametern, die durch eine innovative kausale Encoder-Decoder-Struktur gekennzeichnet ist. Sein asymmetrisches Design führt zu nur 8 Milliarden Eingabe-Aktivierungen und 16 Milliarden Ausgabe-Aktivierungen, was die Kosten im Vergleich zu ähnlich großen Modellen erheblich senkt. Verbessert durch einen neuen Pretraining-Ansatz und großskaliges Verstärkungslernen übertrifft dieses Modell Flaggschiffmodelle wie DeepSeek V4Pro in verschiedenen Benchmarks.

In Bezug auf Effizienz und Kostenkontrolle reduziert das neue Modell die Größe des KV-Cache drastisch. Im Vergleich zu seinem Vorgänger benötigt V4.1Flash nur 1/4 des High-Bandwidth-Speichers (HBM) und 1/8 der Festkapazität von Solid-State-Drives (SSD). Diese Komprimierung ist besonders vorteilhaft für Agent-Szenarien, in denen die Kosten für Kontextspeicherung und Cache-Treffer hoch sind, was die Betriebskosten erheblich senkt. Statistiken zeigen, dass der KV-Cache auf 1/437 der Größe des ursprünglichen Modells geschrumpft ist.
Mit der Veröffentlichung des neuen Modells hat DeepSeek seine Produktlinie und Abrechnungsstrategie aktualisiert. DeepSeek V4.1Flash ist nun über die DeepSeek-API unter dem Modellnamen deepseek-flash verfügbar. Vorherige Versionen, V4Flash und V4Flash Vision Exp, wurden eingestellt, wobei alte Namen (deepseek-v4-flash und deepseek-v4-flash-vision-exp) vorübergehend auf V4.1Flash umgeleitet werden. Da V4.1Flash V4Pro in Bezug auf Leistung, Kosten, Geschwindigkeit und Nutzungsdauer übertrifft, plant das Unternehmen, V4Pro schrittweise außer Betrieb zu setzen: Nach 12:00 Uhr am 14. September 2026 werden Anfragen an deepseek-v4-pro auf V4.1Flash umgeleitet und nach dessen Tarif abgerechnet. Offizielle Partner wie WorkBuddy, CodeBuddy und Tencent's OpenCode haben dieses Modell bereits integriert.
Einführung der Aliyun Qwen Open Platform: KI auf Smartphones, PCs und Brillen – vom Leihen über den Versand bis hin zu weiteren Anwendungen
Da sich KI-Anwendungen rasch ausweiten, hat Qwen seinen Ökosystembereich erheblich ausgebaut. Die am 10. August gestartete Qwen Open Platform bietet nun mobilen Geräten, PCs und KI-Brillen einen breiten Zugang für Ökosystempartner und Entwickler.In
Dou Bao plant, die kostenpflichtigen Stufen Mitte Juni einzuführen; für das dritte Quartal ist ein E-Commerce-Push geplant.
Douyin, die Flaggschiff-Anwendung des großen Modells von ByteDance, wird bis Ende Juni kostenpflichtige Inhaltsfunktionen einführen, wobei Updates für die Force-Konferenz geplant sind. Dieser Schritt markiert einen wichtigen Meilenstein bei der Monet
CCTV deckt KI-Dating-Betrug auf, der sich an mittlere und ältere Frauen richtet, 28 Festnahmen
Aktuelle Berichte von CCTV News heben eine neue Welle von KI-gesteuerten Dating-Betrugsfällen hervor, die sich an mittlere und ältere Frauen richten. Kriminelle nutzen KI-generierte Personas, um Opfer in finanzielle Betrugshandlungen zu locken. Die B











