Alibabas KI „Wan2.7-Image“ generiert individuelle Gesichter und verfasst Aufsätze
Heute hat Alibaba offiziell sein einheitliches Großmodell für die Bildgenerierung und -bearbeitung, Wan2.7-Image, vorgestellt. Dieses Modell erzielt nicht nur einen qualitativen Sprung in der Bildqualität, sondern überwindet durch umfassende Funktionserweiterungen auch die traditionellen Grenzen der KI-Bildgenerierung, wie etwa „generische Gesichter“ und „Prompt-Fehlanpassungen“.
Abschied von KI-generierten Gesichtern: Der Eintritt in die Ära von „Eine Person, ein Gesicht“
Wan2.7-Image verbessert seine Funktion zur Anpassung virtueller Charaktere erheblich. Nutzer können alles von der Knochenstruktur und den Augen bis hin zu subtilen Gesichtsmerkmalen anpassen und bestimmte Merkmale wie ein ovales Gesicht, Phönixaugen oder tiefliegende Augenhöhlen präzise steuern. Dieser Fortschritt geht über die mechanische Gleichförmigkeit früherer KI-Porträts hinaus und ermöglicht echte persönliche Ausdruckskraft.

„Farbpalette“-Funktion und Textdarstellung in „Druckqualität“
Im Bereich des künstlerischen Ausdrucks unterstützt das Modell nun eine „Farbpalette“-Funktion. Damit können Nutzer die Farbkomposition aus einem Referenzbild – wie beispielsweise Matisses rote Serie oder Van Goghs gelbe Serie – mit einem einzigen Klick extrahieren und präzise auf neue Kreationen anwenden. Darüber hinaus zeichnet sich Wan2.7-Image durch die Darstellung langer Texte aus und unterstützt Eingaben von bis zu 3.000 Tokens. Es kann eine ganze A4-Seite mit Inhalten, die komplexe Formeln und Tabellen enthalten, stabil ausgeben und erfüllt dabei die Standards für Druckqualität in 12 unterstützten Sprachen.

Interaktive Bearbeitung und themenübergreifende Konsistenz
Das Modell verfügt über leistungsstarke interaktive Bearbeitungsfunktionen und unterstützt die Ausrichtung, Verschiebung oder den Austausch von Elementen durch präzise Auswahl. So können Nutzer beispielsweise Zeichen in einem Bild auswählen, um ihre Positionen zu tauschen, oder Eiswürfel durch Früchte ersetzen, wobei eine pixelgenaue Kontrolle möglich ist. Gleichzeitig unterstützt das Modell die Konsistenz über mehrere Motive hinweg bei bis zu 9 Bildern und sorgt so für einen einheitlichen Stil und einheitliche Merkmale bei der Generierung von KI-Girlgroups oder Möbelsets.

Technologische Kerninnovationen und industrielle Anwendungen
Wan2.7-Image nutzt eine führende einheitliche Architektur sowohl für die Generierung als auch für das Verständnis und erreicht so eine semantische Zuordnung innerhalb eines gemeinsamen latenten Raums. Das bedeutet, dass das Modell nicht mehr nur Text erraten muss, um Pixel abzugleichen, sondern über ein grundlegendes semantisches Verständnis verfügt. Das Modell wurde zusammen mit der Version Wan2.7-Image-pro eingeführt, die eine stabilere Komposition und präzises Verständnis bietet.

Dieses Modell findet mittlerweile breite Anwendung in der Produktion von Kurzvideos (ein Darsteller in mehreren Rollen), in der E-Commerce-Werbung (ein Modellbild für vielfältige Verwendungszwecke), in Bildung, Forschung und im Bereich Social Entertainment. Nutzer können über die Alibaba Cloud BaiLian-Plattform auf die API zugreifen oder sie direkt auf der offiziellen Website von Wanxiang erleben.
Verwandter Artikel
U.S.-Aktien erreichen historischen Meilenstein, während KI- und Luft- und Raumfahrtriesen auf ihr Debüt als Billionen-Dollar-Unternehmen vorbereiten
Elon Musk, Sam Altman und Dario Amodei, drei Giganten des Technologiesektors, schreiten den Börsengängen ihrer jeweiligen Unternehmen voran. Mit SpaceX, OpenAI und Anthropic – drei Branchenriesen, die einer Bewertung von einer Billion US-Dollar nahek
Schwedisches KI-Startup Lovable Eyes: Bewertung von 13,2 Milliarden US-Dollar nach großer Finanzierungsrunde
Während KI-gestützte Coding-Tools an Popularität gewinnen, hat das schwedische Startup Lovable eine bedeutende Finanzierungsrunde abgeschlossen. Das Unternehmen strebt danach, 3 Milliarden US-Dollar einzusammeln, was seine Bewertung potenziell auf 13
Google testet den Remy AI Agent für Gemini, da der Fokus auf die Benutzerkontrolle verlagert wird
Laut Business Insider testet Google Remy, einen neuen KI-Personalagenten für Gemini. Dieses Tool soll Aufgaben im Auftrag von Nutzern ausführen und sowohl professionelle Arbeitsabläufe als auch tägliche Routinen optimieren.Derzeit wird Remy in einer
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Heute hat Alibaba offiziell sein einheitliches Großmodell für die Bildgenerierung und -bearbeitung, Wan2.7-Image, vorgestellt. Dieses Modell erzielt nicht nur einen qualitativen Sprung in der Bildqualität, sondern überwindet durch umfassende Funktionserweiterungen auch die traditionellen Grenzen der KI-Bildgenerierung, wie etwa „generische Gesichter“ und „Prompt-Fehlanpassungen“.
Abschied von KI-generierten Gesichtern: Der Eintritt in die Ära von „Eine Person, ein Gesicht“
Wan2.7-Image verbessert seine Funktion zur Anpassung virtueller Charaktere erheblich. Nutzer können alles von der Knochenstruktur und den Augen bis hin zu subtilen Gesichtsmerkmalen anpassen und bestimmte Merkmale wie ein ovales Gesicht, Phönixaugen oder tiefliegende Augenhöhlen präzise steuern. Dieser Fortschritt geht über die mechanische Gleichförmigkeit früherer KI-Porträts hinaus und ermöglicht echte persönliche Ausdruckskraft.

„Farbpalette“-Funktion und Textdarstellung in „Druckqualität“
Im Bereich des künstlerischen Ausdrucks unterstützt das Modell nun eine „Farbpalette“-Funktion. Damit können Nutzer die Farbkomposition aus einem Referenzbild – wie beispielsweise Matisses rote Serie oder Van Goghs gelbe Serie – mit einem einzigen Klick extrahieren und präzise auf neue Kreationen anwenden. Darüber hinaus zeichnet sich Wan2.7-Image durch die Darstellung langer Texte aus und unterstützt Eingaben von bis zu 3.000 Tokens. Es kann eine ganze A4-Seite mit Inhalten, die komplexe Formeln und Tabellen enthalten, stabil ausgeben und erfüllt dabei die Standards für Druckqualität in 12 unterstützten Sprachen.

Interaktive Bearbeitung und themenübergreifende Konsistenz
Das Modell verfügt über leistungsstarke interaktive Bearbeitungsfunktionen und unterstützt die Ausrichtung, Verschiebung oder den Austausch von Elementen durch präzise Auswahl. So können Nutzer beispielsweise Zeichen in einem Bild auswählen, um ihre Positionen zu tauschen, oder Eiswürfel durch Früchte ersetzen, wobei eine pixelgenaue Kontrolle möglich ist. Gleichzeitig unterstützt das Modell die Konsistenz über mehrere Motive hinweg bei bis zu 9 Bildern und sorgt so für einen einheitlichen Stil und einheitliche Merkmale bei der Generierung von KI-Girlgroups oder Möbelsets.

Technologische Kerninnovationen und industrielle Anwendungen
Wan2.7-Image nutzt eine führende einheitliche Architektur sowohl für die Generierung als auch für das Verständnis und erreicht so eine semantische Zuordnung innerhalb eines gemeinsamen latenten Raums. Das bedeutet, dass das Modell nicht mehr nur Text erraten muss, um Pixel abzugleichen, sondern über ein grundlegendes semantisches Verständnis verfügt. Das Modell wurde zusammen mit der Version Wan2.7-Image-pro eingeführt, die eine stabilere Komposition und präzises Verständnis bietet.

Dieses Modell findet mittlerweile breite Anwendung in der Produktion von Kurzvideos (ein Darsteller in mehreren Rollen), in der E-Commerce-Werbung (ein Modellbild für vielfältige Verwendungszwecke), in Bildung, Forschung und im Bereich Social Entertainment. Nutzer können über die
U.S.-Aktien erreichen historischen Meilenstein, während KI- und Luft- und Raumfahrtriesen auf ihr Debüt als Billionen-Dollar-Unternehmen vorbereiten
Elon Musk, Sam Altman und Dario Amodei, drei Giganten des Technologiesektors, schreiten den Börsengängen ihrer jeweiligen Unternehmen voran. Mit SpaceX, OpenAI und Anthropic – drei Branchenriesen, die einer Bewertung von einer Billion US-Dollar nahek
Schwedisches KI-Startup Lovable Eyes: Bewertung von 13,2 Milliarden US-Dollar nach großer Finanzierungsrunde
Während KI-gestützte Coding-Tools an Popularität gewinnen, hat das schwedische Startup Lovable eine bedeutende Finanzierungsrunde abgeschlossen. Das Unternehmen strebt danach, 3 Milliarden US-Dollar einzusammeln, was seine Bewertung potenziell auf 13





Heim






