Heim
Moonshot bringt das Hochgeschwindigkeitsmodell „Kimi 2.7 Code“ auf den Markt und versechsfacht damit die Ausgabegeschwindigkeit
Nach der Einführung des Modells „Kimi 2.7 Code“ in der vergangenen Woche hat Moonshot AI heute Abend eine Hochgeschwindigkeitsvariante veröffentlicht. Diese Version bietet eine deutliche Steigerung der Ausgabegeschwindigkeit bei gleichbleibender Kernfunktionalität des Originals und soll Entwicklern dabei helfen, Code effizienter zu schreiben.

Hohe Geschwindigkeit reduziert Wartezeiten drastisch
Offiziellen Angaben zufolge arbeitet das Hochgeschwindigkeitsmodell „Kimi 2.7 Code“ fünf- bis sechsmal schneller als die Standardversion. In typischen Programmierszenarien erreicht es etwa 180 Token pro Sekunde, während bei Aufgaben mit kurzem Kontext die maximale Geschwindigkeit bei 260 Token pro Sekunde liegen kann.
Was die Preisgestaltung angeht, kostet die Hochgeschwindigkeits-API nur doppelt so viel wie die reguläre Version und bietet damit eine um ein Vielfaches höhere Effizienz zu einem moderaten Aufpreis. Nutzer des Kimi Code-Tarifs können am Early-Access-Programm teilnehmen, um dies als Erste in Kimi Code zu erleben.
Der „Thinking Mode“ schaltet die volle Leistung frei
Um sicherzustellen, dass das Modell seine beste Leistung erbringt, müssen Nutzer bei der Verwendung von Modellen der Kimi 2.7 Code-Serie den „Thinking Mode“ aktivieren. Bei der Kimi-API und in Kimi Code ist diese Funktion standardmäßig aktiviert. Wenn Nutzer sie manuell deaktivieren, gibt die API eine Fehlermeldung aus und das System wechselt automatisch zur Version K2.6 zurück.
Da die Rechenleistung stetig zunimmt, wird Moonshot AI den Zugang zu diesem Hochgeschwindigkeitsmodell ausweiten. Ab Juli dieses Jahres wird es schrittweise für Mitglieder der Stufe „Allegretto“ und höher freigeschaltet. Zu diesem Zeitpunkt werden die Nutzungskosten im Kimi Code Plan auf das Dreifache der regulären Version angepasst.
Verwandter Artikel
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation
Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen
Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools
Alibaba hat offiziell Qwen3.8-Max vorgestellt, ein hochmodernes Foundation-Modell mit 2,4 Billionen Parametern. Diese bedeutende KI-Entwicklung bietet erhebliche Leistungssteigerungen in Kernbereichen wie Programmierung und professionelle Büroaufgabe
Empfehlungen zu verwandten Spezialthemen
Kommentare (1)
Nach der Einführung des Modells „Kimi 2.7 Code“ in der vergangenen Woche hat Moonshot AI heute Abend eine Hochgeschwindigkeitsvariante veröffentlicht. Diese Version bietet eine deutliche Steigerung der Ausgabegeschwindigkeit bei gleichbleibender Kernfunktionalität des Originals und soll Entwicklern dabei helfen, Code effizienter zu schreiben.

Hohe Geschwindigkeit reduziert Wartezeiten drastisch
Offiziellen Angaben zufolge arbeitet das Hochgeschwindigkeitsmodell „Kimi 2.7 Code“ fünf- bis sechsmal schneller als die Standardversion. In typischen Programmierszenarien erreicht es etwa 180 Token pro Sekunde, während bei Aufgaben mit kurzem Kontext die maximale Geschwindigkeit bei 260 Token pro Sekunde liegen kann.
Was die Preisgestaltung angeht, kostet die Hochgeschwindigkeits-API nur doppelt so viel wie die reguläre Version und bietet damit eine um ein Vielfaches höhere Effizienz zu einem moderaten Aufpreis. Nutzer des Kimi Code-Tarifs können am Early-Access-Programm teilnehmen, um dies als Erste in Kimi Code zu erleben.
Der „Thinking Mode“ schaltet die volle Leistung frei
Um sicherzustellen, dass das Modell seine beste Leistung erbringt, müssen Nutzer bei der Verwendung von Modellen der Kimi 2.7 Code-Serie den „Thinking Mode“ aktivieren. Bei der Kimi-API und in Kimi Code ist diese Funktion standardmäßig aktiviert. Wenn Nutzer sie manuell deaktivieren, gibt die API eine Fehlermeldung aus und das System wechselt automatisch zur Version K2.6 zurück.
Da die Rechenleistung stetig zunimmt, wird Moonshot AI den Zugang zu diesem Hochgeschwindigkeitsmodell ausweiten. Ab Juli dieses Jahres wird es schrittweise für Mitglieder der Stufe „Allegretto“ und höher freigeschaltet. Zu diesem Zeitpunkt werden die Nutzungskosten im Kimi Code Plan auf das Dreifache der regulären Version angepasst.
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation
Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen
Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools
Alibaba hat offiziell Qwen3.8-Max vorgestellt, ein hochmodernes Foundation-Modell mit 2,4 Billionen Parametern. Diese bedeutende KI-Entwicklung bietet erhebliche Leistungssteigerungen in Kernbereichen wie Programmierung und professionelle Büroaufgabe











