「Whisk:AI搭載の画像リミックスと視覚化ツール」

今日、私たちは生成AIの領域への最新の挑戦であるWhiskを紹介します。米国でのみ独占的にローンチされます。従来の方法では画像生成のために長編のテキストプロンプトを作成する必要がありましたが、Whiskは画像をプロンプトとして使用することでプロセスを簡素化します。ツールに画像をドラッグ&ドロップするだけで、作成を開始できます。
Whiskでは、被写体、シーン、スタイルの3つの異なる画像を入力できます。これらの要素を組み合わせることで、デジタルプラシエ、琺瑯ピン、ステッカーなど、完全にユニークなものを生み出せます。自分だけのものを創り出すためのリミックスがすべてです。
Whisk - 幻想的な魚 - 生成画像例
Whisk - 奇抜なセイウチ - 生成画像例
Whisk - スプリンクル付きのグレーズドドーナツ - 生成琺瑯ピン例
Whisk - 角を持つ幻想的な猫 - 生成画像例
裏では、WhiskはGeminiモデルの力を活用して、入力画像の詳細なキャプションを自動生成します。これらのキャプションは、Googleの最先端の画像生成モデル、Imagen 3に供給されます。この方法は、被写体の「本質」を捉えることに重点を置き、正確なレプリカを作成するのではなく、被写体、シーン、スタイルを革新的な方法でリミックスできるようにします。
Whiskは画像からいくつかの主要な特徴を抽出することに重点を置いているため、生成された作品は常に初期の期待と一致するとは限りません。たとえば、生成された被写体は身長、体重、髪型、肌の色が異なる場合があります。これらの詳細がプロジェクトにとって重要であることを認識しており、Whiskが目標に達しない場合もあります。そのため、いつでも基盤となるプロンプトを確認し、調整できるようにしています。
アーティストやクリエイティブとの初期テストでは、Whiskは従来の画像エディターとは異なる新しいタイプのクリエイティブツールとして評価されています。私たちは、精密なピクセル単位の編集ではなく、迅速な視覚的探求を促進するように設計しました。新しいアイデアを刺激し、共感できるオプションが見つかるまで多くの選択肢をふるいにかけることがすべてです。
米国にいる場合、今日からlabs.google/whiskでWhiskを体験し、感想をシェアできます。
Google Labsは、Gemini、Imagen、Veoなどのモデルを含む最新の生成AIを試すための遊び場です。新しい製品や機能に関するフィードバックを収集し、技術の未来を共同で形作ることを目指しています。ニュースレターを購読し、X、Reddit、DiscordでGoogle Labsをフォローして、Whiskや他のエキサイティングな実験を追いかけましょう。
関連記事
オリー社、AIアシスタント競争で優位に立つためプライバシー重視を掲げる
真に役立つAIアシスタントであるためには、ユーザーを深く理解する必要があります。日常生活向けに設計されたパーソナルアシスタント「Ollie」は、そのためにデータを明け渡したり、プライバシーを犠牲にしたりする必要はないという前提で動作します。一部のエンタープライズ向けAIツールにはデータプライバシー保護措置が講じられていますが、OllieはSOC 2準拠を達成した、一般家庭向けのAIサービスとしては
「AI LIVE: London」がAIと産業オートメーションをどのように掘り下げるか
このサミットには、世界中から経営幹部が集まり、AIによる変革から経済の変動性に至るまで、世界の産業が直面する喫緊の課題について議論します。「AI LIVE: The London Summit」では、「テクノロジー+人間の目的」をテーマに、2,000名を超える国際的なリーダーが一堂に会し、人工知能の新たな時代について検討を行います。BizClik傘下の『AI Magazine』は、「AI LIVE
Anthropic、AI法テック市場に参入、競争激化
Anthropicは火曜日、法律実務に自動化されたサポートを提供することを目的とした一連の新しいチャットボットの機能を公開した。これらの強化機能は、今年初めに導入された企業固有のプラットフォーム「Claude for Legal」を拡張し、異なる法律分野に特化した専門的な法律プラグインとMCPコネクタを追加するものである。これらのツールは、法律AI分野での競争が激化する中で登場した。3月、エージェント型AIを活用して法律ワークフローを効率化するAI法律スタートアップのHarveyは、110億ド
関連特集おすすめ
コメント (26)
0/500
So you're telling me I can finally stop writing those novel-length prompts? 😂 This is a game-changer for visual thinkers like me. The US-only launch is a bummer though—hope it goes global soon! The image-as-prompt approach could really shake up how we prototype ideas.
Интересный подход — использовать изображения вместо текстовых подсказок! Это кажется гораздо более интуитивным способом для творчества. Но вот вопрос: как сервис справляется с авторскими правами на исходные картинки? Тема всегда скользкая в AI-индустрии. Хотелось бы попробовать, но пока только для США... Ждём расширения доступности 🌍
Parece interesante la idea de usar imágenes como prompts en lugar de texto, pero me preocupa cómo esto podría afectar los derechos de autor 😬. ¿Podrían las imágenes generadas terminar siendo usadas sin permiso de los creadores originales? La herramienta suena divertida, pero las implicaciones legales podrían ser complicadas.
Finde die Idee echt erfrischend! 🎨 Endlich muss man nicht mehr ellenlange Textbeschreibungen verfassen, um coole Bilder zu generieren. Aber frage mich, wie gut das mit komplexen Konzepten klappt – kann ein Bild wirklich so präzise sein wie ein detaillierter Prompt? Hoffe, das Tool kommt bald auch nach Europa!
Enfin un outil qui comprend qu'on est tous fatigués des prompts interminables ! 😅 Whisk a l'air super intuitif, mais est-ce que ça marche aussi bien avec des photos mal cadrées ? Vivement la version européenne !

今日、私たちは生成AIの領域への最新の挑戦であるWhiskを紹介します。米国でのみ独占的にローンチされます。従来の方法では画像生成のために長編のテキストプロンプトを作成する必要がありましたが、Whiskは画像をプロンプトとして使用することでプロセスを簡素化します。ツールに画像をドラッグ&ドロップするだけで、作成を開始できます。
Whiskでは、被写体、シーン、スタイルの3つの異なる画像を入力できます。これらの要素を組み合わせることで、デジタルプラシエ、琺瑯ピン、ステッカーなど、完全にユニークなものを生み出せます。自分だけのものを創り出すためのリミックスがすべてです。
Whisk - 奇抜なセイウチ - 生成画像例
Whisk - スプリンクル付きのグレーズドドーナツ - 生成琺瑯ピン例
Whisk - 角を持つ幻想的な猫 - 生成画像例
裏では、WhiskはGeminiモデルの力を活用して、入力画像の詳細なキャプションを自動生成します。これらのキャプションは、Googleの最先端の画像生成モデル、Imagen 3に供給されます。この方法は、被写体の「本質」を捉えることに重点を置き、正確なレプリカを作成するのではなく、被写体、シーン、スタイルを革新的な方法でリミックスできるようにします。
アーティストやクリエイティブとの初期テストでは、Whiskは従来の画像エディターとは異なる新しいタイプのクリエイティブツールとして評価されています。私たちは、精密なピクセル単位の編集ではなく、迅速な視覚的探求を促進するように設計しました。新しいアイデアを刺激し、共感できるオプションが見つかるまで多くの選択肢をふるいにかけることがすべてです。
米国にいる場合、今日からlabs.google/whiskでWhiskを体験し、感想をシェアできます。
Google Labsは、Gemini、Imagen、Veoなどのモデルを含む最新の生成AIを試すための遊び場です。新しい製品や機能に関するフィードバックを収集し、技術の未来を共同で形作ることを目指しています。ニュースレターを購読し、X、Reddit、DiscordでGoogle Labsをフォローして、Whiskや他のエキサイティングな実験を追いかけましょう。
オリー社、AIアシスタント競争で優位に立つためプライバシー重視を掲げる
真に役立つAIアシスタントであるためには、ユーザーを深く理解する必要があります。日常生活向けに設計されたパーソナルアシスタント「Ollie」は、そのためにデータを明け渡したり、プライバシーを犠牲にしたりする必要はないという前提で動作します。一部のエンタープライズ向けAIツールにはデータプライバシー保護措置が講じられていますが、OllieはSOC 2準拠を達成した、一般家庭向けのAIサービスとしては
「AI LIVE: London」がAIと産業オートメーションをどのように掘り下げるか
このサミットには、世界中から経営幹部が集まり、AIによる変革から経済の変動性に至るまで、世界の産業が直面する喫緊の課題について議論します。「AI LIVE: The London Summit」では、「テクノロジー+人間の目的」をテーマに、2,000名を超える国際的なリーダーが一堂に会し、人工知能の新たな時代について検討を行います。BizClik傘下の『AI Magazine』は、「AI LIVE
Anthropic、AI法テック市場に参入、競争激化
Anthropicは火曜日、法律実務に自動化されたサポートを提供することを目的とした一連の新しいチャットボットの機能を公開した。これらの強化機能は、今年初めに導入された企業固有のプラットフォーム「Claude for Legal」を拡張し、異なる法律分野に特化した専門的な法律プラグインとMCPコネクタを追加するものである。これらのツールは、法律AI分野での競争が激化する中で登場した。3月、エージェント型AIを活用して法律ワークフローを効率化するAI法律スタートアップのHarveyは、110億ド
So you're telling me I can finally stop writing those novel-length prompts? 😂 This is a game-changer for visual thinkers like me. The US-only launch is a bummer though—hope it goes global soon! The image-as-prompt approach could really shake up how we prototype ideas.
Интересный подход — использовать изображения вместо текстовых подсказок! Это кажется гораздо более интуитивным способом для творчества. Но вот вопрос: как сервис справляется с авторскими правами на исходные картинки? Тема всегда скользкая в AI-индустрии. Хотелось бы попробовать, но пока только для США... Ждём расширения доступности 🌍
Parece interesante la idea de usar imágenes como prompts en lugar de texto, pero me preocupa cómo esto podría afectar los derechos de autor 😬. ¿Podrían las imágenes generadas terminar siendo usadas sin permiso de los creadores originales? La herramienta suena divertida, pero las implicaciones legales podrían ser complicadas.
Finde die Idee echt erfrischend! 🎨 Endlich muss man nicht mehr ellenlange Textbeschreibungen verfassen, um coole Bilder zu generieren. Aber frage mich, wie gut das mit komplexen Konzepten klappt – kann ein Bild wirklich so präzise sein wie ein detaillierter Prompt? Hoffe, das Tool kommt bald auch nach Europa!
Enfin un outil qui comprend qu'on est tous fatigués des prompts interminables ! 😅 Whisk a l'air super intuitif, mais est-ce que ça marche aussi bien avec des photos mal cadrées ? Vivement la version européenne !





家






