Batir: Remix de imágenes y visualización de AI con alimentación de IA

Hoy, estamos emocionados de presentar Whisk, nuestra última incursión en el ámbito de la IA generativa, que se lanza exclusivamente en EE. UU. A diferencia de los métodos tradicionales en los que necesitarías crear prompts de texto extensos para generar imágenes, Whisk simplifica el proceso al permitirte usar imágenes como prompts. Todo lo que necesitas hacer es arrastrar y soltar tus imágenes en la herramienta y comenzar a crear.
Con Whisk, puedes ingresar tres imágenes diferentes: una para el sujeto, otra para la escena y una tercera para el estilo. Esto te permite mezclar y combinar estos elementos para producir algo completamente único, ya sea un peluche digital, un pin de esmalte o una pegatina. Se trata de remezclar para crear algo que sea distintivamente tuyo.
Whisk - pez fantástico - ejemplo de imagen generada
Whisk - morsa caprichosa - ejemplo de imagen generada
Whisk - dona glaseada con chispas - ejemplo de pin de esmalte generado
Whisk - gato fantástico con cuernos - ejemplo de imagen generada
Detrás de escena, Whisk aprovecha el poder del modelo Gemini para generar automáticamente subtítulos detallados de tus imágenes de entrada. Estos subtítulos se introducen luego en el modelo de generación de imágenes de vanguardia de Google, Imagen 3. Este método se centra en capturar la esencia de tu sujeto en lugar de crear una réplica exacta, permitiéndote remezclar tus sujetos, escenas y estilos de manera innovadora.
Dado que Whisk se enfoca en extraer solo algunas características clave de tus imágenes, las creaciones resultantes podrían no siempre coincidir con tus expectativas iniciales. Por ejemplo, el sujeto generado podría variar en altura, peso, peinado o tono de piel. Reconocemos que estos detalles pueden ser vitales para tu proyecto, y a veces Whisk podría no dar en el blanco. Por eso, te permitimos ver y ajustar los prompts subyacentes en cualquier momento.
Durante nuestras pruebas iniciales con artistas y creativos, Whisk ha sido descrito como un tipo novedoso de herramienta creativa, distinta de los editores de imágenes tradicionales. Lo diseñamos para facilitar la exploración visual rápida, no para ediciones precisas y perfectas a nivel de píxeles. Se trata de despertar nuevas ideas y permitirte explorar numerosas opciones hasta que encuentres las que resuenen contigo.
Si estás en EE. UU., puedes sumergirte en Whisk hoy en labs.google/whisk y compartir tus opiniones con nosotros.
Google Labs es nuestro espacio para experimentar con lo último en IA generativa, incluyendo modelos como Gemini, Imagen y Veo. Nuestro objetivo es recopilar retroalimentación sobre estos nuevos productos y funciones mientras damos forma al futuro de la tecnología de manera colaborativa. Mantente al día con Whisk y otros experimentos emocionantes suscribiéndote a nuestro boletín y siguiendo a Google Labs en X, Reddit y Discord.
Artículo relacionado
Google prueba el agente Remy AI para Gemini a medida que el enfoque se desplaza hacia el control del usuario
Según Business Insider, Google está probando Remy, un nuevo agente personal de IA para Gemini. Esta herramienta tiene como objetivo ejecutar tareas en nombre de los usuarios, optimizando tanto los flujos de trabajo profesionales como las rutinas diar
Ollie apuesta por la privacidad para ganar la carrera de los asistentes de IA
Para resultar realmente útil, un asistente de IA debe comprender a fondo a su usuario. Ollie, un asistente personal diseñado para la vida cotidiana, parte de la premisa de que esto no implica ceder tu
Cómo AI LIVE: Londres explorará la inteligencia artificial y la automatización industrial
La cumbre reunirá a altos directivos de todo el mundo para abordar los retos más acuciantes de los sectores industriales a nivel global, que van desde la disrupción impulsada por la inteligencia artif
Recomendaciones de temas especiales relacionados
comentario (26)
0/500
So you're telling me I can finally stop writing those novel-length prompts? 😂 This is a game-changer for visual thinkers like me. The US-only launch is a bummer though—hope it goes global soon! The image-as-prompt approach could really shake up how we prototype ideas.
Интересный подход — использовать изображения вместо текстовых подсказок! Это кажется гораздо более интуитивным способом для творчества. Но вот вопрос: как сервис справляется с авторскими правами на исходные картинки? Тема всегда скользкая в AI-индустрии. Хотелось бы попробовать, но пока только для США... Ждём расширения доступности 🌍
Parece interesante la idea de usar imágenes como prompts en lugar de texto, pero me preocupa cómo esto podría afectar los derechos de autor 😬. ¿Podrían las imágenes generadas terminar siendo usadas sin permiso de los creadores originales? La herramienta suena divertida, pero las implicaciones legales podrían ser complicadas.
Finde die Idee echt erfrischend! 🎨 Endlich muss man nicht mehr ellenlange Textbeschreibungen verfassen, um coole Bilder zu generieren. Aber frage mich, wie gut das mit komplexen Konzepten klappt – kann ein Bild wirklich so präzise sein wie ein detaillierter Prompt? Hoffe, das Tool kommt bald auch nach Europa!
Enfin un outil qui comprend qu'on est tous fatigués des prompts interminables ! 😅 Whisk a l'air super intuitif, mais est-ce que ça marche aussi bien avec des photos mal cadrées ? Vivement la version européenne !

Hoy, estamos emocionados de presentar Whisk, nuestra última incursión en el ámbito de la IA generativa, que se lanza exclusivamente en EE. UU. A diferencia de los métodos tradicionales en los que necesitarías crear prompts de texto extensos para generar imágenes, Whisk simplifica el proceso al permitirte usar imágenes como prompts. Todo lo que necesitas hacer es arrastrar y soltar tus imágenes en la herramienta y comenzar a crear.
Con Whisk, puedes ingresar tres imágenes diferentes: una para el sujeto, otra para la escena y una tercera para el estilo. Esto te permite mezclar y combinar estos elementos para producir algo completamente único, ya sea un peluche digital, un pin de esmalte o una pegatina. Se trata de remezclar para crear algo que sea distintivamente tuyo.
Whisk - morsa caprichosa - ejemplo de imagen generada
Whisk - dona glaseada con chispas - ejemplo de pin de esmalte generado
Whisk - gato fantástico con cuernos - ejemplo de imagen generada
Detrás de escena, Whisk aprovecha el poder del modelo Gemini para generar automáticamente subtítulos detallados de tus imágenes de entrada. Estos subtítulos se introducen luego en el modelo de generación de imágenes de vanguardia de Google, Imagen 3. Este método se centra en capturar la esencia de tu sujeto en lugar de crear una réplica exacta, permitiéndote remezclar tus sujetos, escenas y estilos de manera innovadora.
Durante nuestras pruebas iniciales con artistas y creativos, Whisk ha sido descrito como un tipo novedoso de herramienta creativa, distinta de los editores de imágenes tradicionales. Lo diseñamos para facilitar la exploración visual rápida, no para ediciones precisas y perfectas a nivel de píxeles. Se trata de despertar nuevas ideas y permitirte explorar numerosas opciones hasta que encuentres las que resuenen contigo.
Si estás en EE. UU., puedes sumergirte en Whisk hoy en labs.google/whisk y compartir tus opiniones con nosotros.
Google Labs es nuestro espacio para experimentar con lo último en IA generativa, incluyendo modelos como Gemini, Imagen y Veo. Nuestro objetivo es recopilar retroalimentación sobre estos nuevos productos y funciones mientras damos forma al futuro de la tecnología de manera colaborativa. Mantente al día con Whisk y otros experimentos emocionantes suscribiéndote a nuestro boletín y siguiendo a Google Labs en X, Reddit y Discord.
Ollie apuesta por la privacidad para ganar la carrera de los asistentes de IA
Para resultar realmente útil, un asistente de IA debe comprender a fondo a su usuario. Ollie, un asistente personal diseñado para la vida cotidiana, parte de la premisa de que esto no implica ceder tu
Cómo AI LIVE: Londres explorará la inteligencia artificial y la automatización industrial
La cumbre reunirá a altos directivos de todo el mundo para abordar los retos más acuciantes de los sectores industriales a nivel global, que van desde la disrupción impulsada por la inteligencia artif
So you're telling me I can finally stop writing those novel-length prompts? 😂 This is a game-changer for visual thinkers like me. The US-only launch is a bummer though—hope it goes global soon! The image-as-prompt approach could really shake up how we prototype ideas.
Интересный подход — использовать изображения вместо текстовых подсказок! Это кажется гораздо более интуитивным способом для творчества. Но вот вопрос: как сервис справляется с авторскими правами на исходные картинки? Тема всегда скользкая в AI-индустрии. Хотелось бы попробовать, но пока только для США... Ждём расширения доступности 🌍
Parece interesante la idea de usar imágenes como prompts en lugar de texto, pero me preocupa cómo esto podría afectar los derechos de autor 😬. ¿Podrían las imágenes generadas terminar siendo usadas sin permiso de los creadores originales? La herramienta suena divertida, pero las implicaciones legales podrían ser complicadas.
Finde die Idee echt erfrischend! 🎨 Endlich muss man nicht mehr ellenlange Textbeschreibungen verfassen, um coole Bilder zu generieren. Aber frage mich, wie gut das mit komplexen Konzepten klappt – kann ein Bild wirklich so präzise sein wie ein detaillierter Prompt? Hoffe, das Tool kommt bald auch nach Europa!
Enfin un outil qui comprend qu'on est tous fatigués des prompts interminables ! 😅 Whisk a l'air super intuitif, mais est-ce que ça marche aussi bien avec des photos mal cadrées ? Vivement la version européenne !





Hogar






