Heim
Alibaba stellt Qwen3.7-Plus vor – eine verbesserte Version des multimodalen Agents mit erweiterten visuellen Funktionen und effizienteren Arbeitsabläufen

Der globale Drang, dass sich Großmodelltechnologien in Richtung körperlicher Intelligenz und fortschrittlicher Agenten weiterentwickeln, nimmt zu. Am 2. Juni kündigte Alibaba über den offiziellen Kanal des Qwen-Großmodells die offizielle Einführung von Qwen3.7-Plus an, einem neuen multimodalen Agentenmodell. Dies markiert nicht nur einen weiteren technologischen Durchbruch in den multimodalen Fähigkeiten der Tongyi Qianwen-Serie, sondern auch eine Verbesserung der Grundlagen für inländische Großmodelle in Edge-Bereichen und komplexen Arbeitsabläufen.
Als Höhepunkt dieser Verbesserung baut Qwen3.7-Plus auf den starken nativen Textverarbeitungsfähigkeiten von Qwen3.7 auf und durchläuft eine umfassende Weiterentwicklung in den visuell-verbalen Fähigkeiten. Das bedeutet, dass das Modell nicht nur komplexe Bild- und Videoinhalte besser interpretieren kann, sondern diese verbesserte visuelle Wahrnehmung auch in tiefgreifendes logisches Denken umwandeln kann, wodurch die praktischen Grenzen der multimodalen Interaktion erheblich erweitert werden.
Neben dieser Veränderung in den visuellen Fähigkeiten behält das Modell auch seine Spitzenpositionen in den Kernfunktionen eines Agenten bei. In Bereichen wie der Erstellung von Programmcode, dem Einsatz komplexer Werkzeuge und hochgradigen Produktivitätsarbeitsabläufen zeigt Qwen3.7-Plus eine starke Kontinuität bei Aufgaben und Robustheit bei Entscheidungen, was eine reibungslose Anpassung an unternehmensweite Automatisierungsaufgaben sowie langfristige intelligente Planungsszenarien ermöglicht.
Branchenanalysten weisen darauf hin, dass sich der Wettbewerb in der zweiten Hälfte der Ära der Großmodelle deutlich auf multimodale und agentenbasierte Lösungen verlagert hat. Durch die tiefe Integration von visueller Verständnisfähigkeiten mit der Planung von Agentenaktionen hebt Alibaba’s Qwen3.7-Plus nicht nur die Leistungsgrenzen für Open-Source- und kommerzielle Modelle, sondern bietet auch eine fantasievollere Rechenbasis für breitere Anwendungen der industriellen Intelligenz und körperlichen Roboter in der Zukunft.
Verwandter Artikel
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Einhaltung der Vorschriften für autonome Fahrzeuge in Kalifornien: Eine neue Ära von Bußgeldern, Geofences und 1 Million Meilen
Guident betreibt einen AuveTech-Shuttle in Südflorida und verwaltet mithilfe seiner Fernüberwachungstechnologie eine vier Meilen lange Strecke in West Palm Beach sowie eine eine Meile lange Strecke in
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)

Der globale Drang, dass sich Großmodelltechnologien in Richtung körperlicher Intelligenz und fortschrittlicher Agenten weiterentwickeln, nimmt zu. Am 2. Juni kündigte Alibaba über den offiziellen Kanal des Qwen-Großmodells die offizielle Einführung von Qwen3.7-Plus an, einem neuen multimodalen Agentenmodell. Dies markiert nicht nur einen weiteren technologischen Durchbruch in den multimodalen Fähigkeiten der Tongyi Qianwen-Serie, sondern auch eine Verbesserung der Grundlagen für inländische Großmodelle in Edge-Bereichen und komplexen Arbeitsabläufen.
Als Höhepunkt dieser Verbesserung baut Qwen3.7-Plus auf den starken nativen Textverarbeitungsfähigkeiten von Qwen3.7 auf und durchläuft eine umfassende Weiterentwicklung in den visuell-verbalen Fähigkeiten. Das bedeutet, dass das Modell nicht nur komplexe Bild- und Videoinhalte besser interpretieren kann, sondern diese verbesserte visuelle Wahrnehmung auch in tiefgreifendes logisches Denken umwandeln kann, wodurch die praktischen Grenzen der multimodalen Interaktion erheblich erweitert werden.
Neben dieser Veränderung in den visuellen Fähigkeiten behält das Modell auch seine Spitzenpositionen in den Kernfunktionen eines Agenten bei. In Bereichen wie der Erstellung von Programmcode, dem Einsatz komplexer Werkzeuge und hochgradigen Produktivitätsarbeitsabläufen zeigt Qwen3.7-Plus eine starke Kontinuität bei Aufgaben und Robustheit bei Entscheidungen, was eine reibungslose Anpassung an unternehmensweite Automatisierungsaufgaben sowie langfristige intelligente Planungsszenarien ermöglicht.
Branchenanalysten weisen darauf hin, dass sich der Wettbewerb in der zweiten Hälfte der Ära der Großmodelle deutlich auf multimodale und agentenbasierte Lösungen verlagert hat. Durch die tiefe Integration von visueller Verständnisfähigkeiten mit der Planung von Agentenaktionen hebt Alibaba’s Qwen3.7-Plus nicht nur die Leistungsgrenzen für Open-Source- und kommerzielle Modelle, sondern bietet auch eine fantasievollere Rechenbasis für breitere Anwendungen der industriellen Intelligenz und körperlichen Roboter in der Zukunft.
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter











