Heim
Alibaba stellt „Wan2.7-Image“ vor, um der Ära der generischen KI-Gesichter ein Ende zu setzen
Das offizielle Team für große Modelle von Ali hat heute das einheitliche Modell zur Bildgenerierung und -bearbeitung „Wan2.7-Image“ vorgestellt. Dieses Modell stellt einen qualitativen Sprung gegenüber seinem Vorgänger in den Bereichen Porträtanpassung, Farbsteuerung und Darstellung langer Texte dar und zielt darauf ab, die generische „Einheitlichkeit“ zu überwinden, die bei KI-generierten Bildern häufig zu beobachten ist.
Das Modell ist ab sofort über die API auf der Alibaba Cloud BaiLian-Plattform verfügbar und steht zudem auf der WanXiang-Website zur öffentlichen Testnutzung bereit.

Kernverbesserungen: Virtuelles „Facial Sculpting“ und präzise Farbsteuerung
Wan2.7-Image führt mehrere branchenführende, differenzierte Funktionen ein, die die kreativen Möglichkeiten erheblich erweitern:
Einzigartige Gesichter für jedes Motiv: Es bietet verbesserte Funktionen zur virtuellen „Gesichtsformung“. Nutzer können Knochenstruktur, Augenform (wie Mandel- oder Phönixaugen) und andere Gesichtsdetails über Textbefehle präzise steuern und so standardisierte, KI-generierte Gesichter effektiv vermeiden.
Präzise Farbpalette: Es verfügt nun über eine erweiterte Farbsteuerung. Nutzer können Farbverhältnisse aus Referenzbildern extrahieren, um bestimmte Farbtöne – wie Van Goghs leuchtendes Gelb oder Picassos kühles Blau – in neuen Kreationen exakt nachzubilden.
3K-Token-Rendering extrem langer Texte: Es behebt häufige Probleme bei der KI-Textgenerierung und unterstützt bis zu 12 Sprachen. Das Modell kann komplexe Texte, Tabellen oder Formeln, die eine ganze A4-Seite umfassen, in druckfertiger Qualität rendern.
Im Bereich der Bildbearbeitung führt Wan2.7-Image eine „interaktive Bearbeitungsfunktion“ ein. Benutzer können einfach einen bestimmten Bereich auswählen, um Elemente hinzuzufügen, auszurichten, zu verschieben oder sogar logische Ersetzungen auf Pixelebene vorzunehmen – wie zum Beispiel das Austauschen von Eiswürfeln gegen Früchte, während die ursprüngliche Beleuchtung der Szene perfekt erhalten bleibt.

Darüber hinaus unterstützt das Modell die Erzeugung zusammenhängender Bilderserien mit bis zu 12 Bildern, wobei eine hohe Konsistenz in Stil und Motivmerkmalen über verschiedene Szenen hinweg gewahrt bleibt – ideal für Gruppenporträts oder aufeinander abgestimmte Produktkombinationen.
Ali erklärt, dass Wan2.7-Image eine einheitliche Architektur sowohl für die Generierung als auch für das Verständnis verwendet. Durch die Erzielung einer semantischen Zuordnung innerhalb eines gemeinsamen latenten Raums geht das Modell über das Erraten von Pixelmustern hinaus und entwickelt ein echtes zugrunde liegendes Verständnis der Semantik.
Mit seiner für die visuelle Kreativlandschaft des Jahres 2026 geplanten Veröffentlichung signalisiert Wan2.7-Image einen Wandel in der KI-Bildgenerierung: vom „zufälligen Kartenziehen“ hin zu einer Präzisionssteuerung auf „industriellem Niveau“. Diese hochpräzise Bearbeitungsfähigkeit wird die Hürden für die professionelle Erstellung von Inhalten drastisch senken, sei es für Film-Storyboards, E-Commerce-Werbung oder die Umgestaltung von Social-Media-Inhalten.
Verwandter Artikel
U.S.-Aktien erreichen historischen Meilenstein, während KI- und Luft- und Raumfahrtriesen auf ihr Debüt als Billionen-Dollar-Unternehmen vorbereiten
Elon Musk, Sam Altman und Dario Amodei, drei Giganten des Technologiesektors, schreiten den Börsengängen ihrer jeweiligen Unternehmen voran. Mit SpaceX, OpenAI und Anthropic – drei Branchenriesen, die einer Bewertung von einer Billion US-Dollar nahek
Schwedisches KI-Startup Lovable Eyes: Bewertung von 13,2 Milliarden US-Dollar nach großer Finanzierungsrunde
Während KI-gestützte Coding-Tools an Popularität gewinnen, hat das schwedische Startup Lovable eine bedeutende Finanzierungsrunde abgeschlossen. Das Unternehmen strebt danach, 3 Milliarden US-Dollar einzusammeln, was seine Bewertung potenziell auf 13
Google testet den Remy AI Agent für Gemini, da der Fokus auf die Benutzerkontrolle verlagert wird
Laut Business Insider testet Google Remy, einen neuen KI-Personalagenten für Gemini. Dieses Tool soll Aufgaben im Auftrag von Nutzern ausführen und sowohl professionelle Arbeitsabläufe als auch tägliche Routinen optimieren.Derzeit wird Remy in einer
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Das offizielle Team für große Modelle von Ali hat heute das einheitliche Modell zur Bildgenerierung und -bearbeitung „Wan2.7-Image“ vorgestellt. Dieses Modell stellt einen qualitativen Sprung gegenüber seinem Vorgänger in den Bereichen Porträtanpassung, Farbsteuerung und Darstellung langer Texte dar und zielt darauf ab, die generische „Einheitlichkeit“ zu überwinden, die bei KI-generierten Bildern häufig zu beobachten ist.
Das Modell ist ab sofort über die API auf der Alibaba Cloud BaiLian-Plattform verfügbar und steht zudem auf der WanXiang-Website zur öffentlichen Testnutzung bereit.

Kernverbesserungen: Virtuelles „Facial Sculpting“ und präzise Farbsteuerung
Wan2.7-Image führt mehrere branchenführende, differenzierte Funktionen ein, die die kreativen Möglichkeiten erheblich erweitern:
Einzigartige Gesichter für jedes Motiv: Es bietet verbesserte Funktionen zur virtuellen „Gesichtsformung“. Nutzer können Knochenstruktur, Augenform (wie Mandel- oder Phönixaugen) und andere Gesichtsdetails über Textbefehle präzise steuern und so standardisierte, KI-generierte Gesichter effektiv vermeiden.
Präzise Farbpalette: Es verfügt nun über eine erweiterte Farbsteuerung. Nutzer können Farbverhältnisse aus Referenzbildern extrahieren, um bestimmte Farbtöne – wie Van Goghs leuchtendes Gelb oder Picassos kühles Blau – in neuen Kreationen exakt nachzubilden.
3K-Token-Rendering extrem langer Texte: Es behebt häufige Probleme bei der KI-Textgenerierung und unterstützt bis zu 12 Sprachen. Das Modell kann komplexe Texte, Tabellen oder Formeln, die eine ganze A4-Seite umfassen, in druckfertiger Qualität rendern.
Im Bereich der Bildbearbeitung führt Wan2.7-Image eine „interaktive Bearbeitungsfunktion“ ein. Benutzer können einfach einen bestimmten Bereich auswählen, um Elemente hinzuzufügen, auszurichten, zu verschieben oder sogar logische Ersetzungen auf Pixelebene vorzunehmen – wie zum Beispiel das Austauschen von Eiswürfeln gegen Früchte, während die ursprüngliche Beleuchtung der Szene perfekt erhalten bleibt.

Darüber hinaus unterstützt das Modell die Erzeugung zusammenhängender Bilderserien mit bis zu 12 Bildern, wobei eine hohe Konsistenz in Stil und Motivmerkmalen über verschiedene Szenen hinweg gewahrt bleibt – ideal für Gruppenporträts oder aufeinander abgestimmte Produktkombinationen.
Ali erklärt, dass Wan2.7-Image eine einheitliche Architektur sowohl für die Generierung als auch für das Verständnis verwendet. Durch die Erzielung einer semantischen Zuordnung innerhalb eines gemeinsamen latenten Raums geht das Modell über das Erraten von Pixelmustern hinaus und entwickelt ein echtes zugrunde liegendes Verständnis der Semantik.
Mit seiner für die visuelle Kreativlandschaft des Jahres 2026 geplanten Veröffentlichung signalisiert Wan2.7-Image einen Wandel in der KI-Bildgenerierung: vom „zufälligen Kartenziehen“ hin zu einer Präzisionssteuerung auf „industriellem Niveau“. Diese hochpräzise Bearbeitungsfähigkeit wird die Hürden für die professionelle Erstellung von Inhalten drastisch senken, sei es für Film-Storyboards, E-Commerce-Werbung oder die Umgestaltung von Social-Media-Inhalten.
U.S.-Aktien erreichen historischen Meilenstein, während KI- und Luft- und Raumfahrtriesen auf ihr Debüt als Billionen-Dollar-Unternehmen vorbereiten
Elon Musk, Sam Altman und Dario Amodei, drei Giganten des Technologiesektors, schreiten den Börsengängen ihrer jeweiligen Unternehmen voran. Mit SpaceX, OpenAI und Anthropic – drei Branchenriesen, die einer Bewertung von einer Billion US-Dollar nahek
Schwedisches KI-Startup Lovable Eyes: Bewertung von 13,2 Milliarden US-Dollar nach großer Finanzierungsrunde
Während KI-gestützte Coding-Tools an Popularität gewinnen, hat das schwedische Startup Lovable eine bedeutende Finanzierungsrunde abgeschlossen. Das Unternehmen strebt danach, 3 Milliarden US-Dollar einzusammeln, was seine Bewertung potenziell auf 13











