Heim
Preis für den DeepSeek-API-Eingabecache auf ein Zehntel des ursprünglichen Preises gesenkt
DeepSeek, das führende inländische große Sprachmodell, hat kürzlich eine erhebliche Preissenkung angekündigt und den Preis für Cache-Treffer bei der Eingabe für alle API-Serien auf ein Zehntel des ursprünglichen Tarifs gesenkt. Dieser Schritt markiert eine neue Phase im Kostenmanagement für die heimische KI und zielt darauf ab, durch ein außergewöhnliches Preis-Leistungs-Verhältnis mehr Entwickler und Unternehmen anzuziehen.
Kernpreisnachlässe beheben Schwachstellen der Branche
Diese Preisanpassung gilt für die gesamte V4-Pro- und V4-Flash-Serie. Der Preis für den Input-Cache bei V4-Pro wurde auf 0,1 RMB pro Million Token gesenkt, und im Rahmen einer zeitlich begrenzten Aktion beträgt der tatsächliche Preis nur 0,025 RMB. Im Vergleich zu ausländischen Wettbewerbern beträgt der Preis für den Eingabecache nur 1/700 des Preises von GPT-5.5 Pro, was eine starke Wettbewerbsfähigkeit auf dem Markt demonstriert.
Neben Szenarien mit Cache-Treffern wurden auch die Preise für Cache-Fehltreffer und Ausgabeszenarien auf ein Viertel des ursprünglichen Preises gesenkt. Diese Preisstrategie zielt gezielt auf Anwendungsfälle mit hoher Nutzungsfrequenz ab, wie RAG-Wissensdatenbanken, intelligenten Kundenservice und Dokumentenanalyse, und kann die Betriebskosten von Unternehmen um über 90 % senken.

Die Fähigkeit von DeepSeek, die Preise deutlich zu senken, beruht auf seiner selbst entwickelten Sparse-Attention-Architektur. Diese Technologie unterstützt die Verarbeitung extrem langer Kontexte von bis zu 160.000 Zeichen, verbessert die Effizienz bei der Verarbeitung langer Texte und senkt gleichzeitig effektiv den zugrunde liegenden Rechenleistungsbedarf und die Speicherkosten.
Verwandter Artikel
Apple Smart Glasses könnten auf der WWDC27 vorgestellt werden und dabei den Schutz der Privatsphäre in den Mittelpunkt stellen
Bloombergs Mark Gurman berichtet, dass Apples Smart Glasses mit dem Codenamen N50 im Juni 2027 auf der WWDC27 vorgestellt werden sollen, wobei ein Verkaufsstart im Herbst 2027 erwartet wird. Ursprünglich für Ende dieses Jahres und Anfang 2027 geplant
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation
Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen
Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
DeepSeek, das führende inländische große Sprachmodell, hat kürzlich eine erhebliche Preissenkung angekündigt und den Preis für Cache-Treffer bei der Eingabe für alle API-Serien auf ein Zehntel des ursprünglichen Tarifs gesenkt. Dieser Schritt markiert eine neue Phase im Kostenmanagement für die heimische KI und zielt darauf ab, durch ein außergewöhnliches Preis-Leistungs-Verhältnis mehr Entwickler und Unternehmen anzuziehen.
Kernpreisnachlässe beheben Schwachstellen der Branche
Diese Preisanpassung gilt für die gesamte V4-Pro- und V4-Flash-Serie. Der Preis für den Input-Cache bei V4-Pro wurde auf 0,1 RMB pro Million Token gesenkt, und im Rahmen einer zeitlich begrenzten Aktion beträgt der tatsächliche Preis nur 0,025 RMB. Im Vergleich zu ausländischen Wettbewerbern beträgt der Preis für den Eingabecache nur 1/700 des Preises von GPT-5.5 Pro, was eine starke Wettbewerbsfähigkeit auf dem Markt demonstriert.
Neben Szenarien mit Cache-Treffern wurden auch die Preise für Cache-Fehltreffer und Ausgabeszenarien auf ein Viertel des ursprünglichen Preises gesenkt. Diese Preisstrategie zielt gezielt auf Anwendungsfälle mit hoher Nutzungsfrequenz ab, wie RAG-Wissensdatenbanken, intelligenten Kundenservice und Dokumentenanalyse, und kann die Betriebskosten von Unternehmen um über 90 % senken.

Die Fähigkeit von DeepSeek, die Preise deutlich zu senken, beruht auf seiner selbst entwickelten Sparse-Attention-Architektur. Diese Technologie unterstützt die Verarbeitung extrem langer Kontexte von bis zu 160.000 Zeichen, verbessert die Effizienz bei der Verarbeitung langer Texte und senkt gleichzeitig effektiv den zugrunde liegenden Rechenleistungsbedarf und die Speicherkosten.
Apple Smart Glasses könnten auf der WWDC27 vorgestellt werden und dabei den Schutz der Privatsphäre in den Mittelpunkt stellen
Bloombergs Mark Gurman berichtet, dass Apples Smart Glasses mit dem Codenamen N50 im Juni 2027 auf der WWDC27 vorgestellt werden sollen, wobei ein Verkaufsstart im Herbst 2027 erwartet wird. Ursprünglich für Ende dieses Jahres und Anfang 2027 geplant
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation
Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen
Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch











