アリババの「Wan2.7-Image」AIは、オリジナルの顔画像を生成し、エッセイを執筆する
本日、アリババは画像生成・編集用の統合型大規模モデル「Wan2.7-Image」を正式にリリースしました。このモデルは、画質の飛躍的な向上を実現しただけでなく、包括的な機能強化により、「画一的な顔」や「プロンプトとの不整合」といった従来のAI画像生成の課題を克服しています。
AI生成の顔に別れを告げ、「一人一顔」の時代へ
Wan2.7-Imageは、バーチャルキャラクターのカスタマイズ機能を大幅に強化しました。ユーザーは骨格や目から微細な顔の特徴に至るまであらゆる要素をカスタマイズでき、卵型の顔、鳳眼、深い眼窩といった特定の特徴を精密に制御できます。この進歩により、従来のAIポートレートに見られた機械的な画一性を脱却し、真の個性を表現することが可能になりました。

「カラーパレット」機能と「印刷品質」レベルのテキストレンダリング
芸術的表現において、本モデルは「カラーパレット」機能をサポートするようになりました。これにより、ユーザーはマティスの「赤のシリーズ」やゴッホの「黄のシリーズ」といった参照画像から、ワンクリックで色彩構成を抽出し、新しい作品に正確に適用することが可能です。 さらに、Wan2.7-Imageは長文のレンダリングに優れており、最大3,000トークンの入力に対応しています。複雑な数式や表を含むA4用紙1ページ分のコンテンツを安定して出力でき、対応する12言語すべてにおいて印刷品質の基準を満たしています。

インタラクティブな編集と多分野にわたる一貫性
本モデルは強力なインタラクティブ編集機能を備えており、精密な選択操作を通じて要素の位置合わせ、移動、置換が可能です。例えば、画像内の文字を選択して位置を入れ替えたり、氷のキューブを果物に置き換えたりするなど、ピクセル単位での制御を実現します。同時に、最大9枚の画像にわたるマルチサブジェクトの一貫性をサポートしており、AIガールズグループや家具セットを生成する際にも、統一されたスタイルと特徴を維持します。

中核となる技術的ブレークスルーと産業応用
Wan2.7-Imageは、生成と理解の両方に対応する最先端の統合アーキテクチャを採用し、共有された潜在空間内での意味的マッピングを実現しています。これは、モデルが単にピクセルに合わせるためにテキストを推測するだけでなく、基礎的な意味理解を備えていることを意味します。本モデルは、より安定した構成と正確な理解を提供するWan2.7-Image-proバージョンと共にリリースされました。

本モデルは現在、ショート動画制作(1人の俳優が複数の役を演じる)、EC広告(1枚のモデル画像を多目的に活用)、教育、研究、ソーシャルエンターテインメントなど、幅広い分野で活用されています。ユーザーはAlibaba Cloud BaiLianプラットフォーム経由で APIにアクセスするか、Wanxiang公式サイト で直接体験することができます。
関連記事
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める
エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始
スウェーデンのAIスタートアップ「Lovable」が主要な資金調達ラウンド終了後、132億ドルの評価額を達成
AI駆動のコーディングツールが注目を集める中、スウェーデンのスタートアップ企業Lovableは大型の資金調達ラウンドを獲得した。同社は30億ドルの調達を目指しており、これにより評価額が昨年12月に記録された66億ドルの倍となる132億ドルに達する可能性がある。この投資をリードするのはMenlo Venturesと見られている。Lovableの魅力は、複雑なコーディングスキルを不要とし、ソフトウェア作成を簡素化する中核の「ヴァイブコーディング」技術に由来する。ユーザーは自然言語で要件を記述するだ
Google、Geminiへの焦点がユーザー制御へシフトする中で、Remy AIエージェントをテスト
『Business Insider』によると、GoogleはGemini向けの新しいAIパーソナルエージェント「Remy」をテスト中である。このツールはユーザーに代わってタスクを実行することを目的としており、業務フローと日常のルーチンの両方を効率化する。現在、RemyはGeminiアプリケーションの社内限定版においてテストが行われている。この報道は社内文書と、プロジェクトに精通した2人の人物へのインタビューを引用している。社内資料では、Remyを「24時間365日のパーソナルエージェント」と位
関連特集おすすめ
コメント (0)
0/500
本日、アリババは画像生成・編集用の統合型大規模モデル「Wan2.7-Image」を正式にリリースしました。このモデルは、画質の飛躍的な向上を実現しただけでなく、包括的な機能強化により、「画一的な顔」や「プロンプトとの不整合」といった従来のAI画像生成の課題を克服しています。
AI生成の顔に別れを告げ、「一人一顔」の時代へ
Wan2.7-Imageは、バーチャルキャラクターのカスタマイズ機能を大幅に強化しました。ユーザーは骨格や目から微細な顔の特徴に至るまであらゆる要素をカスタマイズでき、卵型の顔、鳳眼、深い眼窩といった特定の特徴を精密に制御できます。この進歩により、従来のAIポートレートに見られた機械的な画一性を脱却し、真の個性を表現することが可能になりました。

「カラーパレット」機能と「印刷品質」レベルのテキストレンダリング
芸術的表現において、本モデルは「カラーパレット」機能をサポートするようになりました。これにより、ユーザーはマティスの「赤のシリーズ」やゴッホの「黄のシリーズ」といった参照画像から、ワンクリックで色彩構成を抽出し、新しい作品に正確に適用することが可能です。 さらに、Wan2.7-Imageは長文のレンダリングに優れており、最大3,000トークンの入力に対応しています。複雑な数式や表を含むA4用紙1ページ分のコンテンツを安定して出力でき、対応する12言語すべてにおいて印刷品質の基準を満たしています。

インタラクティブな編集と多分野にわたる一貫性
本モデルは強力なインタラクティブ編集機能を備えており、精密な選択操作を通じて要素の位置合わせ、移動、置換が可能です。例えば、画像内の文字を選択して位置を入れ替えたり、氷のキューブを果物に置き換えたりするなど、ピクセル単位での制御を実現します。同時に、最大9枚の画像にわたるマルチサブジェクトの一貫性をサポートしており、AIガールズグループや家具セットを生成する際にも、統一されたスタイルと特徴を維持します。

中核となる技術的ブレークスルーと産業応用
Wan2.7-Imageは、生成と理解の両方に対応する最先端の統合アーキテクチャを採用し、共有された潜在空間内での意味的マッピングを実現しています。これは、モデルが単にピクセルに合わせるためにテキストを推測するだけでなく、基礎的な意味理解を備えていることを意味します。本モデルは、より安定した構成と正確な理解を提供するWan2.7-Image-proバージョンと共にリリースされました。

本モデルは現在、ショート動画制作(1人の俳優が複数の役を演じる)、EC広告(1枚のモデル画像を多目的に活用)、教育、研究、ソーシャルエンターテインメントなど、幅広い分野で活用されています。ユーザー
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める
エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始
スウェーデンのAIスタートアップ「Lovable」が主要な資金調達ラウンド終了後、132億ドルの評価額を達成
AI駆動のコーディングツールが注目を集める中、スウェーデンのスタートアップ企業Lovableは大型の資金調達ラウンドを獲得した。同社は30億ドルの調達を目指しており、これにより評価額が昨年12月に記録された66億ドルの倍となる132億ドルに達する可能性がある。この投資をリードするのはMenlo Venturesと見られている。Lovableの魅力は、複雑なコーディングスキルを不要とし、ソフトウェア作成を簡素化する中核の「ヴァイブコーディング」技術に由来する。ユーザーは自然言語で要件を記述するだ





家






