Bata: Remix de imagem e ferramenta de visualização movidas a IA

Hoje, estamos entusiasmados em apresentar o Whisk, nossa mais recente aventura no universo da IA generativa, lançada exclusivamente nos EUA. Diferente dos métodos tradicionais em que você precisava criar prompts de texto longos para gerar imagens, o Whisk simplifica o processo permitindo que você use imagens como prompts. Basta arrastar e soltar suas imagens na ferramenta e começar a criar.
Com o Whisk, você pode inserir três imagens diferentes: uma para o sujeito, outra para a cena e uma terceira para o estilo. Isso permite misturar e combinar esses elementos para produzir algo completamente único, seja um pelúcia digital, um alfinete esmaltado ou um adesivo. Trata-se de remixar para criar algo que seja distintamente seu.
Whisk - peixe fantástico - exemplo de imagem gerada
Whisk - morsa caprichosa - exemplo de imagem gerada
Whisk - rosquinha glaceada com granulado - exemplo de alfinete esmaltado gerado
Whisk - gato fantástico com chifres - exemplo de imagem gerada
Nos bastidores, o Whisk aproveita o poder do modelo Gemini para gerar automaticamente legendas detalhadas das suas imagens de entrada. Essas legendas são então alimentadas no modelo de geração de imagens de ponta da Google, Imagen 3. Esse método foca em capturar a essência do seu sujeito, em vez de criar uma réplica exata, permitindo que você remixe seus sujeitos, cenas e estilos de maneiras inovadoras.
Como o Whisk foca em extrair apenas algumas características-chave das suas imagens, as criações resultantes nem sempre podem corresponder às suas expectativas iniciais. Por exemplo, o sujeito gerado pode variar em altura, peso, penteado ou tom de pele. Reconhecemos que esses detalhes podem ser vitais para o seu projeto, e às vezes o Whisk pode não acertar. Por isso, permitimos que você visualize e ajuste os prompts subjacentes a qualquer momento.
Durante nossos testes iniciais com artistas e criativos, o Whisk foi descrito como um novo tipo de ferramenta criativa, distinta dos editores de imagem tradicionais. Projetamos para facilitar a exploração visual rápida, não para edições precisas e perfeitas em pixels. Trata-se de despertar novas ideias e permitir que você explore várias opções até encontrar aquelas que ressoam com você.
Se você está nos EUA, pode experimentar o Whisk hoje em labs.google/whisk e compartilhar suas impressões conosco.
Google Labs é nosso playground para experimentar o que há de mais recente em IA generativa, incluindo modelos como Gemini, Imagen e Veo. Nosso objetivo é coletar feedback sobre esses novos produtos e recursos enquanto moldamos colaborativamente o futuro da tecnologia. Acompanhe o Whisk e outros experimentos empolgantes assinando nossa newsletter e seguindo o Google Labs no X, Reddit e Discord.
Artigo relacionado
O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário
De acordo com o Business Insider, o Google está testando o Remy, um novo agente pessoal de IA para o Gemini. Esta ferramenta tem como objetivo executar tarefas em nome dos usuários, simplificando tanto os fluxos de trabalho profissionais quanto as ro
Ollie aposta na privacidade para vencer a corrida dos assistentes de IA
Para ser realmente útil, um assistente de IA precisa compreender profundamente seu usuário. O Ollie, um assistente pessoal projetado para o dia a dia, opera com base na premissa de que isso não exige
Como o AI LIVE: Londres explorará a IA e a automação industrial
A cúpula reunirá executivos de alto escalão de todo o mundo para discutir os desafios urgentes enfrentados pelos setores globais, que vão desde as transformações impulsionadas pela IA até a volatilida
Recomendações de tópicos especiais relacionados
Comentários (26)
So you're telling me I can finally stop writing those novel-length prompts? 😂 This is a game-changer for visual thinkers like me. The US-only launch is a bummer though—hope it goes global soon! The image-as-prompt approach could really shake up how we prototype ideas.
Интересный подход — использовать изображения вместо текстовых подсказок! Это кажется гораздо более интуитивным способом для творчества. Но вот вопрос: как сервис справляется с авторскими правами на исходные картинки? Тема всегда скользкая в AI-индустрии. Хотелось бы попробовать, но пока только для США... Ждём расширения доступности 🌍
Parece interesante la idea de usar imágenes como prompts en lugar de texto, pero me preocupa cómo esto podría afectar los derechos de autor 😬. ¿Podrían las imágenes generadas terminar siendo usadas sin permiso de los creadores originales? La herramienta suena divertida, pero las implicaciones legales podrían ser complicadas.
Finde die Idee echt erfrischend! 🎨 Endlich muss man nicht mehr ellenlange Textbeschreibungen verfassen, um coole Bilder zu generieren. Aber frage mich, wie gut das mit komplexen Konzepten klappt – kann ein Bild wirklich so präzise sein wie ein detaillierter Prompt? Hoffe, das Tool kommt bald auch nach Europa!
Enfin un outil qui comprend qu'on est tous fatigués des prompts interminables ! 😅 Whisk a l'air super intuitif, mais est-ce que ça marche aussi bien avec des photos mal cadrées ? Vivement la version européenne !

Hoje, estamos entusiasmados em apresentar o Whisk, nossa mais recente aventura no universo da IA generativa, lançada exclusivamente nos EUA. Diferente dos métodos tradicionais em que você precisava criar prompts de texto longos para gerar imagens, o Whisk simplifica o processo permitindo que você use imagens como prompts. Basta arrastar e soltar suas imagens na ferramenta e começar a criar.
Com o Whisk, você pode inserir três imagens diferentes: uma para o sujeito, outra para a cena e uma terceira para o estilo. Isso permite misturar e combinar esses elementos para produzir algo completamente único, seja um pelúcia digital, um alfinete esmaltado ou um adesivo. Trata-se de remixar para criar algo que seja distintamente seu.
Whisk - morsa caprichosa - exemplo de imagem gerada
Whisk - rosquinha glaceada com granulado - exemplo de alfinete esmaltado gerado
Whisk - gato fantástico com chifres - exemplo de imagem gerada
Nos bastidores, o Whisk aproveita o poder do modelo Gemini para gerar automaticamente legendas detalhadas das suas imagens de entrada. Essas legendas são então alimentadas no modelo de geração de imagens de ponta da Google, Imagen 3. Esse método foca em capturar a essência do seu sujeito, em vez de criar uma réplica exata, permitindo que você remixe seus sujeitos, cenas e estilos de maneiras inovadoras.
Durante nossos testes iniciais com artistas e criativos, o Whisk foi descrito como um novo tipo de ferramenta criativa, distinta dos editores de imagem tradicionais. Projetamos para facilitar a exploração visual rápida, não para edições precisas e perfeitas em pixels. Trata-se de despertar novas ideias e permitir que você explore várias opções até encontrar aquelas que ressoam com você.
Se você está nos EUA, pode experimentar o Whisk hoje em labs.google/whisk e compartilhar suas impressões conosco.
Google Labs é nosso playground para experimentar o que há de mais recente em IA generativa, incluindo modelos como Gemini, Imagen e Veo. Nosso objetivo é coletar feedback sobre esses novos produtos e recursos enquanto moldamos colaborativamente o futuro da tecnologia. Acompanhe o Whisk e outros experimentos empolgantes assinando nossa newsletter e seguindo o Google Labs no X, Reddit e Discord.
Ollie aposta na privacidade para vencer a corrida dos assistentes de IA
Para ser realmente útil, um assistente de IA precisa compreender profundamente seu usuário. O Ollie, um assistente pessoal projetado para o dia a dia, opera com base na premissa de que isso não exige
Como o AI LIVE: Londres explorará a IA e a automação industrial
A cúpula reunirá executivos de alto escalão de todo o mundo para discutir os desafios urgentes enfrentados pelos setores globais, que vão desde as transformações impulsionadas pela IA até a volatilida
So you're telling me I can finally stop writing those novel-length prompts? 😂 This is a game-changer for visual thinkers like me. The US-only launch is a bummer though—hope it goes global soon! The image-as-prompt approach could really shake up how we prototype ideas.
Интересный подход — использовать изображения вместо текстовых подсказок! Это кажется гораздо более интуитивным способом для творчества. Но вот вопрос: как сервис справляется с авторскими правами на исходные картинки? Тема всегда скользкая в AI-индустрии. Хотелось бы попробовать, но пока только для США... Ждём расширения доступности 🌍
Parece interesante la idea de usar imágenes como prompts en lugar de texto, pero me preocupa cómo esto podría afectar los derechos de autor 😬. ¿Podrían las imágenes generadas terminar siendo usadas sin permiso de los creadores originales? La herramienta suena divertida, pero las implicaciones legales podrían ser complicadas.
Finde die Idee echt erfrischend! 🎨 Endlich muss man nicht mehr ellenlange Textbeschreibungen verfassen, um coole Bilder zu generieren. Aber frage mich, wie gut das mit komplexen Konzepten klappt – kann ein Bild wirklich so präzise sein wie ein detaillierter Prompt? Hoffe, das Tool kommt bald auch nach Europa!
Enfin un outil qui comprend qu'on est tous fatigués des prompts interminables ! 😅 Whisk a l'air super intuitif, mais est-ce que ça marche aussi bien avec des photos mal cadrées ? Vivement la version européenne !





Lar






