A IA Wan2.7-Image, da Alibaba, gera rostos personalizados e redige ensaios
Hoje, a Alibaba lançou oficialmente seu modelo unificado de grande porte para geração e edição de imagens, o Wan2.7-Image. Esse modelo não apenas alcança um salto qualitativo na qualidade visual, mas também supera as limitações tradicionais da geração de imagens por IA, como “rostos genéricos” e “desalinhamento de prompts”, por meio de melhorias abrangentes em suas capacidades.
Adeus aos rostos gerados por IA: entrando na era de “uma pessoa, um rosto”
O Wan2.7-Image aprimora significativamente sua função de personalização de personagens virtuais. Os usuários podem personalizar tudo, desde a estrutura óssea e os olhos até traços faciais sutis, controlando com precisão características específicas como rosto oval, olhos de fênix ou órbitas oculares profundas. Esse avanço vai além da uniformidade mecânica dos retratos de IA do passado, permitindo uma verdadeira expressão pessoal.

Recurso “Paleta de Cores” e renderização de texto com “qualidade de impressão”
Na expressão artística, o modelo agora oferece o recurso “Paleta de cores”. Isso permite que os usuários extraiam a composição de cores de uma imagem de referência — como a série vermelha de Matisse ou a série amarela de Van Gogh — com um único clique e a apliquem com precisão a novas criações. Além disso, o Wan2.7-Image se destaca na renderização de textos longos, suportando entradas de até 3 mil tokens. Ele pode gerar de forma estável uma página A4 inteira de conteúdo contendo fórmulas e tabelas complexas, atendendo aos padrões de qualidade de impressão em 12 idiomas suportados.

Edição interativa e consistência entre temas
O modelo possui poderosos recursos de edição interativa, suportando o alinhamento, movimento ou substituição de elementos por meio de seleção precisa. Por exemplo, os usuários podem selecionar personagens em uma imagem para trocar suas posições ou substituir cubos de gelo por frutas, alcançando controle em nível de pixel. Simultaneamente, o modelo suporta consistência entre múltiplos temas em até 9 imagens, mantendo um estilo e características uniformes ao gerar grupos de garotas de IA ou conjuntos de móveis.

Avanços tecnológicos essenciais e aplicações na indústria
O Wan2.7-Image emprega uma arquitetura unificada de ponta tanto para geração quanto para compreensão, alcançando mapeamento semântico dentro de um espaço latente compartilhado. Isso significa que o modelo não se limita mais a adivinhar textos para corresponder aos pixels, mas possui uma compreensão semântica fundamental. O modelo foi lançado juntamente com a versão Wan2.7-Image-pro, que oferece composição mais estável e compreensão precisa.

Este modelo é agora amplamente aplicado na produção de vídeos curtos (um ator desempenhando vários papéis), publicidade de comércio eletrônico (uma imagem de modelo para múltiplos usos), educação, pesquisa e entretenimento social. Os usuários podem acessar a API por meio da Plataforma BaiLian da Alibaba Cloud ou experimentá-la diretamente no site oficial da Wanxiang .
Artigo relacionado
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr
O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário
De acordo com o Business Insider, o Google está testando o Remy, um novo agente pessoal de IA para o Gemini. Esta ferramenta tem como objetivo executar tarefas em nome dos usuários, simplificando tanto os fluxos de trabalho profissionais quanto as ro
Recomendações de tópicos especiais relacionados
Comentários (0)
Hoje, a Alibaba lançou oficialmente seu modelo unificado de grande porte para geração e edição de imagens, o Wan2.7-Image. Esse modelo não apenas alcança um salto qualitativo na qualidade visual, mas também supera as limitações tradicionais da geração de imagens por IA, como “rostos genéricos” e “desalinhamento de prompts”, por meio de melhorias abrangentes em suas capacidades.
Adeus aos rostos gerados por IA: entrando na era de “uma pessoa, um rosto”
O Wan2.7-Image aprimora significativamente sua função de personalização de personagens virtuais. Os usuários podem personalizar tudo, desde a estrutura óssea e os olhos até traços faciais sutis, controlando com precisão características específicas como rosto oval, olhos de fênix ou órbitas oculares profundas. Esse avanço vai além da uniformidade mecânica dos retratos de IA do passado, permitindo uma verdadeira expressão pessoal.

Recurso “Paleta de Cores” e renderização de texto com “qualidade de impressão”
Na expressão artística, o modelo agora oferece o recurso “Paleta de cores”. Isso permite que os usuários extraiam a composição de cores de uma imagem de referência — como a série vermelha de Matisse ou a série amarela de Van Gogh — com um único clique e a apliquem com precisão a novas criações. Além disso, o Wan2.7-Image se destaca na renderização de textos longos, suportando entradas de até 3 mil tokens. Ele pode gerar de forma estável uma página A4 inteira de conteúdo contendo fórmulas e tabelas complexas, atendendo aos padrões de qualidade de impressão em 12 idiomas suportados.

Edição interativa e consistência entre temas
O modelo possui poderosos recursos de edição interativa, suportando o alinhamento, movimento ou substituição de elementos por meio de seleção precisa. Por exemplo, os usuários podem selecionar personagens em uma imagem para trocar suas posições ou substituir cubos de gelo por frutas, alcançando controle em nível de pixel. Simultaneamente, o modelo suporta consistência entre múltiplos temas em até 9 imagens, mantendo um estilo e características uniformes ao gerar grupos de garotas de IA ou conjuntos de móveis.

Avanços tecnológicos essenciais e aplicações na indústria
O Wan2.7-Image emprega uma arquitetura unificada de ponta tanto para geração quanto para compreensão, alcançando mapeamento semântico dentro de um espaço latente compartilhado. Isso significa que o modelo não se limita mais a adivinhar textos para corresponder aos pixels, mas possui uma compreensão semântica fundamental. O modelo foi lançado juntamente com a versão Wan2.7-Image-pro, que oferece composição mais estável e compreensão precisa.

Este modelo é agora amplamente aplicado na produção de vídeos curtos (um ator desempenhando vários papéis), publicidade de comércio eletrônico (uma imagem de modelo para múltiplos usos), educação, pesquisa e entretenimento social. Os usuários podem acessar a API por meio da
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr





Lar






