Heim
Senspeech X2.5 Twin Stars: Erster Million-Token-Kontext am Edge, vollständig mit inländischer Rechenleistung trainiert
Am 1. September hat die hundertprozentige Tochtergesellschaft von iFLYTEK, Ciyuan Xinghuo, offiziell zwei allgemeine Großmodelle für Edge-Geräte gestartet und als Open Source veröffentlicht: Xinghuo X2.5-4B und Xinghuo X2.5-1.7B. Diese Modelle sind die ersten ihrer Art, die nativ eine Kontextlänge von bis zu 1 Million Tokens unterstützen, wobei der vollständige Zugriff auf Modellgewichte, Code-Repositorys und Bereitstellungsunterlagen gewährt wird.
Unterstützung für Millionen von Tokens, kleine Modelle können „das ganze Buch lesen“
Beide Modelle nutzen eine hybride Aufmerksamkeitsarchitektur und sind auf Kernfähigkeiten wie Agenten, Code, Mathematik und Anweisungsbefolgung optimiert, wodurch sie eine umfassende Leistung erbringen, die unter Open-Source-Modellen ähnlicher Größe in der Branche führend ist.
Hinsichtlich der Kontextfähigkeit wurden Xinghuo X2.5-4B und Xinghuo X2.5-1.7B mit hochwertigen Daten auf der Ebene von Billionen von Tokens trainiert, die Szenarien wie lange Dokumente und technisches Material abdecken. Sie unterstützen nativ ein Kontextfenster von 1 Million Tokens, wodurch sie große Informationsmengen auf einmal empfangen und verstehen können.

Beispielsweise im Produktnachverkauf: Nutzer können das vollständige Nachhandbuch in Xinghuo X2.5-4B importieren. Das Modell ordnet zunächst Nachverkaufsregeln für verschiedene Szenarien zu und markiert die entsprechenden Kapitel. Bei der Frage „Qualifiziert sich ein Geräteausfall innerhalb von 10 Tagen nach dem Kauf unter Verwendung von Drittkomponenten für einen Austausch?“ kann es eine umfassende Beurteilung liefern, indem es Vorschriften zu Rückgaben, Fehlerbehandlungen und Ausnahmen über die Kapitel hinweg verknüpft. Selbst wenn später neue Bedingungen wie abgelegene Gebiete oder Geräte mit Familienkarten hinzugefügt werden, kann das Modell den vorherigen Kontext beibehalten und weiterhin Beratung anbieten, indem es Logistik-, Datenlöschungs- und Kostenübernahmeregeln kombiniert.
Der lange Kontext löst das Problem, „ob Informationen vollständig eingesehen werden können“, während die Fähigkeiten von Agenten und Werkzeugaufrufen lösen, „ob nach dem Einsehen Handlungen unternommen werden können“. Xinghuo X2.5-Edge-Modelle bieten lokalisierte intelligente Fähigkeiten für Szenarien wie persönliches Büro, Code-Entwicklung, intelligente Hardware und Robotik. In Szenarien der Code-Entwicklung kann Xinghuo X2.5-4B Cloud-Modellen mit 2 bis 3 Mal größeren Parametern bei Aufgaben wie Algorithmenimplementierung, Code-Vervollständigung und -Generierung entsprechen; im Domux-Smart-Home-Testset erreicht die End-to-End-Ausführungspräzision von Xinghuo X2.5-1.7B für Steueranweisungen 90,3 %, bei einer durchschnittlichen Reaktionszeit von nur 0,85 Sekunden; in Robotik-Szenarien können beide Modelle auf Roboterkörpern oder Edge-Geräten bereitgestellt werden und unterstützen Aufgaben wie Betriebssteuerung, Zielverfolgung und Navigationsentscheidungen, wodurch die Abhängigkeit von Cloud-Verbindungen und fest vordefinierten Programmen reduziert wird.
Völlig inländische Rechenleistung beim Training, sofortiger Download und Erfahrung
Xinghuo X2.5-4B und Xinghuo X2.5-1.7B wurden vollständig auf inländischen Rechenplattformen trainiert, wobei etwa 20 Billionen verschiedene Tokens für das Pre-Training verwendet wurden, und die Leistung durch hochwertige überwachte Feinabstimmung und Verstärkungslernen kontinuierlich verbessert wurde.
Hinsichtlich der Bereitstellung unterstützen beide Modelle Hardwareplattformen einschließlich NVIDIA, Huawei, Hai Guang und Hemo und sind mit gängigen Inferenz-Frameworks wie vLLM, SGLang und llama.cpp kompatibel. Sie können schnell über Tools wie Ollama und LM Studio bereitgestellt werden und unterstützen inkrementelles Training mit LLaMA-Factory. Ab heute sind Modellgewichte auf Plattformen wie Hugging Face und GitHub verfügbar, und entsprechende Modell-APIs wurden auf iFLYTEKs Starry MaaS-Plattform gestartet, die für begrenzte Zeit kostenlos ist. Am 7. September wird iFLYTEK das nächste Generation Flaggschiff-allgemeine Großmodell Xinghuo X2.5 offiziell veröffentlichen, wodurch Kernfähigkeiten wie Code und Agenten weiter verbessert werden.
Verwandter Artikel
OpenAI startet Mathematik- und KI-Beratungsgremium; mysteriöses Modell löst 100 Weltklasse-Probleme in 24 Tagen
Am 22. September kündigte OpenAI die Gründung einer „Beratergruppe für Mathematik und Künstliche Intelligenz“ an. Mit Sitz am Institute for Advanced Study in Princeton besteht diese unabhängige Gremium aus neun Mathematikern, die unabhängig von OpenA
Meitun LongCat startet LoHoSearch, während die BrowseComp-Werte unter 30 % fallen
Die Fähigkeiten von Search Agents wurden im letzten Jahr maßgeblich durch BrowseComp definiert. Doch dieses Benchmark-Verfahren verliert an Relevanz – es trieb die Modellleistung in nur zehn Monaten von 30 % auf 90 %, und sein Wert schwindet rasch. A
MiniMax stellt M3 vor, ein inländisches KI-Großmodell, das GPT-5.5 übertrifft.
Chinas KI-Branche hat einen bedeutenden technologischen Sprung vollzogen, mit der offiziellen Einführung des neuesten Large-Language-Modells von Xiyu Technology, MiniMax M3. Dieses fortschrittliche System kombiniert modernste Programmierfähigkeiten m
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Am 1. September hat die hundertprozentige Tochtergesellschaft von iFLYTEK, Ciyuan Xinghuo, offiziell zwei allgemeine Großmodelle für Edge-Geräte gestartet und als Open Source veröffentlicht: Xinghuo X2.5-4B und Xinghuo X2.5-1.7B. Diese Modelle sind die ersten ihrer Art, die nativ eine Kontextlänge von bis zu 1 Million Tokens unterstützen, wobei der vollständige Zugriff auf Modellgewichte, Code-Repositorys und Bereitstellungsunterlagen gewährt wird.
Unterstützung für Millionen von Tokens, kleine Modelle können „das ganze Buch lesen“
Beide Modelle nutzen eine hybride Aufmerksamkeitsarchitektur und sind auf Kernfähigkeiten wie Agenten, Code, Mathematik und Anweisungsbefolgung optimiert, wodurch sie eine umfassende Leistung erbringen, die unter Open-Source-Modellen ähnlicher Größe in der Branche führend ist.
Hinsichtlich der Kontextfähigkeit wurden Xinghuo X2.5-4B und Xinghuo X2.5-1.7B mit hochwertigen Daten auf der Ebene von Billionen von Tokens trainiert, die Szenarien wie lange Dokumente und technisches Material abdecken. Sie unterstützen nativ ein Kontextfenster von 1 Million Tokens, wodurch sie große Informationsmengen auf einmal empfangen und verstehen können.

Beispielsweise im Produktnachverkauf: Nutzer können das vollständige Nachhandbuch in Xinghuo X2.5-4B importieren. Das Modell ordnet zunächst Nachverkaufsregeln für verschiedene Szenarien zu und markiert die entsprechenden Kapitel. Bei der Frage „Qualifiziert sich ein Geräteausfall innerhalb von 10 Tagen nach dem Kauf unter Verwendung von Drittkomponenten für einen Austausch?“ kann es eine umfassende Beurteilung liefern, indem es Vorschriften zu Rückgaben, Fehlerbehandlungen und Ausnahmen über die Kapitel hinweg verknüpft. Selbst wenn später neue Bedingungen wie abgelegene Gebiete oder Geräte mit Familienkarten hinzugefügt werden, kann das Modell den vorherigen Kontext beibehalten und weiterhin Beratung anbieten, indem es Logistik-, Datenlöschungs- und Kostenübernahmeregeln kombiniert.
Der lange Kontext löst das Problem, „ob Informationen vollständig eingesehen werden können“, während die Fähigkeiten von Agenten und Werkzeugaufrufen lösen, „ob nach dem Einsehen Handlungen unternommen werden können“. Xinghuo X2.5-Edge-Modelle bieten lokalisierte intelligente Fähigkeiten für Szenarien wie persönliches Büro, Code-Entwicklung, intelligente Hardware und Robotik. In Szenarien der Code-Entwicklung kann Xinghuo X2.5-4B Cloud-Modellen mit 2 bis 3 Mal größeren Parametern bei Aufgaben wie Algorithmenimplementierung, Code-Vervollständigung und -Generierung entsprechen; im Domux-Smart-Home-Testset erreicht die End-to-End-Ausführungspräzision von Xinghuo X2.5-1.7B für Steueranweisungen 90,3 %, bei einer durchschnittlichen Reaktionszeit von nur 0,85 Sekunden; in Robotik-Szenarien können beide Modelle auf Roboterkörpern oder Edge-Geräten bereitgestellt werden und unterstützen Aufgaben wie Betriebssteuerung, Zielverfolgung und Navigationsentscheidungen, wodurch die Abhängigkeit von Cloud-Verbindungen und fest vordefinierten Programmen reduziert wird.
Völlig inländische Rechenleistung beim Training, sofortiger Download und Erfahrung
Xinghuo X2.5-4B und Xinghuo X2.5-1.7B wurden vollständig auf inländischen Rechenplattformen trainiert, wobei etwa 20 Billionen verschiedene Tokens für das Pre-Training verwendet wurden, und die Leistung durch hochwertige überwachte Feinabstimmung und Verstärkungslernen kontinuierlich verbessert wurde.
Hinsichtlich der Bereitstellung unterstützen beide Modelle Hardwareplattformen einschließlich NVIDIA, Huawei, Hai Guang und Hemo und sind mit gängigen Inferenz-Frameworks wie vLLM, SGLang und llama.cpp kompatibel. Sie können schnell über Tools wie Ollama und LM Studio bereitgestellt werden und unterstützen inkrementelles Training mit LLaMA-Factory. Ab heute sind Modellgewichte auf Plattformen wie Hugging Face und GitHub verfügbar, und entsprechende Modell-APIs wurden auf iFLYTEKs Starry MaaS-Plattform gestartet, die für begrenzte Zeit kostenlos ist. Am 7. September wird iFLYTEK das nächste Generation Flaggschiff-allgemeine Großmodell Xinghuo X2.5 offiziell veröffentlichen, wodurch Kernfähigkeiten wie Code und Agenten weiter verbessert werden.
OpenAI startet Mathematik- und KI-Beratungsgremium; mysteriöses Modell löst 100 Weltklasse-Probleme in 24 Tagen
Am 22. September kündigte OpenAI die Gründung einer „Beratergruppe für Mathematik und Künstliche Intelligenz“ an. Mit Sitz am Institute for Advanced Study in Princeton besteht diese unabhängige Gremium aus neun Mathematikern, die unabhängig von OpenA
Meitun LongCat startet LoHoSearch, während die BrowseComp-Werte unter 30 % fallen
Die Fähigkeiten von Search Agents wurden im letzten Jahr maßgeblich durch BrowseComp definiert. Doch dieses Benchmark-Verfahren verliert an Relevanz – es trieb die Modellleistung in nur zehn Monaten von 30 % auf 90 %, und sein Wert schwindet rasch. A
MiniMax stellt M3 vor, ein inländisches KI-Großmodell, das GPT-5.5 übertrifft.
Chinas KI-Branche hat einen bedeutenden technologischen Sprung vollzogen, mit der offiziellen Einführung des neuesten Large-Language-Modells von Xiyu Technology, MiniMax M3. Dieses fortschrittliche System kombiniert modernste Programmierfähigkeiten m











