Heim
Alibaba stellt „Wan2.7-Image“ vor, um der Ära der generischen KI-Gesichter ein Ende zu setzen
Das offizielle Team für große Modelle von Ali hat heute das einheitliche Modell zur Bildgenerierung und -bearbeitung „Wan2.7-Image“ vorgestellt. Dieses Modell stellt einen qualitativen Sprung gegenüber seinem Vorgänger in den Bereichen Porträtanpassung, Farbsteuerung und Darstellung langer Texte dar und zielt darauf ab, die generische „Einheitlichkeit“ zu überwinden, die bei KI-generierten Bildern häufig zu beobachten ist.
Das Modell ist ab sofort über die API auf der Alibaba Cloud BaiLian-Plattform verfügbar und steht zudem auf der WanXiang-Website zur öffentlichen Testnutzung bereit.

Kernverbesserungen: Virtuelles „Facial Sculpting“ und präzise Farbsteuerung
Wan2.7-Image führt mehrere branchenführende, differenzierte Funktionen ein, die die kreativen Möglichkeiten erheblich erweitern:
Einzigartige Gesichter für jedes Motiv: Es bietet verbesserte Funktionen zur virtuellen „Gesichtsformung“. Nutzer können Knochenstruktur, Augenform (wie Mandel- oder Phönixaugen) und andere Gesichtsdetails über Textbefehle präzise steuern und so standardisierte, KI-generierte Gesichter effektiv vermeiden.
Präzise Farbpalette: Es verfügt nun über eine erweiterte Farbsteuerung. Nutzer können Farbverhältnisse aus Referenzbildern extrahieren, um bestimmte Farbtöne – wie Van Goghs leuchtendes Gelb oder Picassos kühles Blau – in neuen Kreationen exakt nachzubilden.
3K-Token-Rendering extrem langer Texte: Es behebt häufige Probleme bei der KI-Textgenerierung und unterstützt bis zu 12 Sprachen. Das Modell kann komplexe Texte, Tabellen oder Formeln, die eine ganze A4-Seite umfassen, in druckfertiger Qualität rendern.
Im Bereich der Bildbearbeitung führt Wan2.7-Image eine „interaktive Bearbeitungsfunktion“ ein. Benutzer können einfach einen bestimmten Bereich auswählen, um Elemente hinzuzufügen, auszurichten, zu verschieben oder sogar logische Ersetzungen auf Pixelebene vorzunehmen – wie zum Beispiel das Austauschen von Eiswürfeln gegen Früchte, während die ursprüngliche Beleuchtung der Szene perfekt erhalten bleibt.

Darüber hinaus unterstützt das Modell die Erzeugung zusammenhängender Bilderserien mit bis zu 12 Bildern, wobei eine hohe Konsistenz in Stil und Motivmerkmalen über verschiedene Szenen hinweg gewahrt bleibt – ideal für Gruppenporträts oder aufeinander abgestimmte Produktkombinationen.
Ali erklärt, dass Wan2.7-Image eine einheitliche Architektur sowohl für die Generierung als auch für das Verständnis verwendet. Durch die Erzielung einer semantischen Zuordnung innerhalb eines gemeinsamen latenten Raums geht das Modell über das Erraten von Pixelmustern hinaus und entwickelt ein echtes zugrunde liegendes Verständnis der Semantik.
Mit seiner für die visuelle Kreativlandschaft des Jahres 2026 geplanten Veröffentlichung signalisiert Wan2.7-Image einen Wandel in der KI-Bildgenerierung: vom „zufälligen Kartenziehen“ hin zu einer Präzisionssteuerung auf „industriellem Niveau“. Diese hochpräzise Bearbeitungsfähigkeit wird die Hürden für die professionelle Erstellung von Inhalten drastisch senken, sei es für Film-Storyboards, E-Commerce-Werbung oder die Umgestaltung von Social-Media-Inhalten.
Verwandter Artikel
iFLYTEK stellt das allgemeine Großmodell Spark X2.5 vor
Am 1. September wird iFlytek zwei kantenorientierte Large-Language-Modelle, Xinghuo X2.5-4B und Xinghuo X2.5-1.7B, open-source veröffentlichen, wie aus der neuesten offiziellen Ankündigung hervorgeht. Beide Modelle unterstützen nativ ein Kontextfenst
Meta entfernt KI-Fotobearbeitungsfunktion nach Nutzerprotesten
Meta, der Social-Media-Riese, ist erneut in eine öffentliche Debatte über die heikle Balance zwischen künstlicher Intelligenz und dem Schutz der Privatsphäre der Nutzer verwickelt. Laut TechCrunch hat Meta’s Superintelligence Labs diese Woche einen n
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Das offizielle Team für große Modelle von Ali hat heute das einheitliche Modell zur Bildgenerierung und -bearbeitung „Wan2.7-Image“ vorgestellt. Dieses Modell stellt einen qualitativen Sprung gegenüber seinem Vorgänger in den Bereichen Porträtanpassung, Farbsteuerung und Darstellung langer Texte dar und zielt darauf ab, die generische „Einheitlichkeit“ zu überwinden, die bei KI-generierten Bildern häufig zu beobachten ist.
Das Modell ist ab sofort über die API auf der Alibaba Cloud BaiLian-Plattform verfügbar und steht zudem auf der WanXiang-Website zur öffentlichen Testnutzung bereit.

Kernverbesserungen: Virtuelles „Facial Sculpting“ und präzise Farbsteuerung
Wan2.7-Image führt mehrere branchenführende, differenzierte Funktionen ein, die die kreativen Möglichkeiten erheblich erweitern:
Einzigartige Gesichter für jedes Motiv: Es bietet verbesserte Funktionen zur virtuellen „Gesichtsformung“. Nutzer können Knochenstruktur, Augenform (wie Mandel- oder Phönixaugen) und andere Gesichtsdetails über Textbefehle präzise steuern und so standardisierte, KI-generierte Gesichter effektiv vermeiden.
Präzise Farbpalette: Es verfügt nun über eine erweiterte Farbsteuerung. Nutzer können Farbverhältnisse aus Referenzbildern extrahieren, um bestimmte Farbtöne – wie Van Goghs leuchtendes Gelb oder Picassos kühles Blau – in neuen Kreationen exakt nachzubilden.
3K-Token-Rendering extrem langer Texte: Es behebt häufige Probleme bei der KI-Textgenerierung und unterstützt bis zu 12 Sprachen. Das Modell kann komplexe Texte, Tabellen oder Formeln, die eine ganze A4-Seite umfassen, in druckfertiger Qualität rendern.
Im Bereich der Bildbearbeitung führt Wan2.7-Image eine „interaktive Bearbeitungsfunktion“ ein. Benutzer können einfach einen bestimmten Bereich auswählen, um Elemente hinzuzufügen, auszurichten, zu verschieben oder sogar logische Ersetzungen auf Pixelebene vorzunehmen – wie zum Beispiel das Austauschen von Eiswürfeln gegen Früchte, während die ursprüngliche Beleuchtung der Szene perfekt erhalten bleibt.

Darüber hinaus unterstützt das Modell die Erzeugung zusammenhängender Bilderserien mit bis zu 12 Bildern, wobei eine hohe Konsistenz in Stil und Motivmerkmalen über verschiedene Szenen hinweg gewahrt bleibt – ideal für Gruppenporträts oder aufeinander abgestimmte Produktkombinationen.
Ali erklärt, dass Wan2.7-Image eine einheitliche Architektur sowohl für die Generierung als auch für das Verständnis verwendet. Durch die Erzielung einer semantischen Zuordnung innerhalb eines gemeinsamen latenten Raums geht das Modell über das Erraten von Pixelmustern hinaus und entwickelt ein echtes zugrunde liegendes Verständnis der Semantik.
Mit seiner für die visuelle Kreativlandschaft des Jahres 2026 geplanten Veröffentlichung signalisiert Wan2.7-Image einen Wandel in der KI-Bildgenerierung: vom „zufälligen Kartenziehen“ hin zu einer Präzisionssteuerung auf „industriellem Niveau“. Diese hochpräzise Bearbeitungsfähigkeit wird die Hürden für die professionelle Erstellung von Inhalten drastisch senken, sei es für Film-Storyboards, E-Commerce-Werbung oder die Umgestaltung von Social-Media-Inhalten.
iFLYTEK stellt das allgemeine Großmodell Spark X2.5 vor
Am 1. September wird iFlytek zwei kantenorientierte Large-Language-Modelle, Xinghuo X2.5-4B und Xinghuo X2.5-1.7B, open-source veröffentlichen, wie aus der neuesten offiziellen Ankündigung hervorgeht. Beide Modelle unterstützen nativ ein Kontextfenst
Meta entfernt KI-Fotobearbeitungsfunktion nach Nutzerprotesten
Meta, der Social-Media-Riese, ist erneut in eine öffentliche Debatte über die heikle Balance zwischen künstlicher Intelligenz und dem Schutz der Privatsphäre der Nutzer verwickelt. Laut TechCrunch hat Meta’s Superintelligence Labs diese Woche einen n
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden











