AvataarのビデオAIは、スピード、コスト削減、そして文化的ニュアンスを兼ね備え、インドの巨大な市場に対応している

インドのAIモデルの開発ペースは、米国、欧州、中国に比べて遅れている。 モデルを公開しているスタートアップはごくわずかであり、そのほとんどが大規模言語モデルや音声モデルだ。開発をさらに促進するため、政府は約12億ドル規模のイニシアチブ「インドAIミッション」を立ち上げた。このプログラムでは、選定されたスタートアップに対し、モデルを一般に公開することを条件に、補助金を活用したGPUコンピューティングリソースへのアクセスを提供するなどの支援を行っている。 このプログラムに選定された12社のスタートアップのうちの1社であるAvataar AIは、「Varya」と呼ばれる新しい動画モデルをリリースした。このモデルは、さまざまな祭りや食べ物、衣服を識別するなど、現地の文脈を理解するように設計されている。
eコマース向けの動画ツール開発に注力するこのスタートアップは、ピークXVから出資を受けており、Varyaをゼロから構築したわけではない。 同社は、アリババが公開している動画生成モデル「Wan 2.2」を起点とし、「蒸留(ディスティレーション)」と呼ばれる手法を採用した。これは、モデルの機能を圧縮し、Avataarの特定のユースケースに最適化された、より軽量で高速なバージョンへと変換するものである。 その結果、Wan 2.2の50ステップに対し、わずか4ステップで動作するモデルが実現し、動画生成速度は10倍に向上し、コストも大幅に削減された。
具体的に言えば、NVIDIA H200 GPUを使用した場合、Varyaは5秒間の720pクリップを45秒で生成できますが、Wan 2.2では1,230秒かかります。
Varyaの最も際立った点は、その価格かもしれません。 同社は、ホスティングサービスにおいて動画1秒あたり0.48ルピー(0.005ドル)を課金する計画だ。これは、通常1秒あたり0.10ドル以上を課金するVeo、Kling、Luma、Runwayといったモデルよりもはるかに安価であり、価格差は約20倍に及ぶ。
「インドは『動画ファースト』の市場です。インドのあらゆる大規模な消費者向けインターネット製品において、動画がテキストに勝っていることが見て取れます。現在のAI動画モデルは、インドで国民規模で利用するには高すぎます。動画AIが学生、教師、中小零細企業(MSME)、クリエイター、企業、公共サービスに普及するためには、コストを劇的に引き下げる必要があります。 「コストこそが、インドにおけるAI導入の最大の鍵です」と、Peak XVのマネージングディレクター、ラジャン・アナナン氏はTechCrunchに語った。
画像や動画生成モデルは、文化的ニュアンスを見落とし、ステレオタイプ的あるいは画一的な出力を生成しがちだ――これはTechCrunchが以前にも報じた問題である。Avataar AI社によると、同社は厳選されたデータを用いてVaryaを学習させ、食文化、服装、建築、祭りなどの文化的ニュアンスを認識できるようにしたという。
「Varya」は、インド政府が運営する公開AIモデルおよびデータセットの一元管理リポジトリである「AI Kosh」ポータル上で、トレーニングデータと共にオープンウェイトモデルとして公開される予定だ。これにより、開発者は自身のニーズに合わせてモデルを独自にホストしたり、修正したりすることが可能になる。 Avataar社はまた、このモデルを企業顧客にも提供する予定であり、HiggsfieldやAdobe Fireflyなどの動画ツールとの提携にも前向きであるとしている。現在、同社のウェブサイトでは、テキストプロンプトや参照画像を使用して、誰でもこのモデルを試すことができる。
「Varya」のリリースは、インドのAI戦略における根本的なトレードオフを反映している。 業界のベテランたちは、インドがAI分野で存在感を示すには、基盤モデルでの競争ではなく、アプリケーションの開発や強固な開発者エコシステムの構築に注力すべきだと指摘している。こうした現実的な姿勢には理由がある。インドでは、計算リソースの不足や質の高いデータの入手難により、モデル開発のペースが世界の競合国に比べて遅れているからだ。
「インドAIミッション」も、その格差を埋めるための政府による広範な取り組みの一環である。 昨年、同ミッションはAIモデルの開発を行う12のスタートアップ(その中にはAvataar AIも含まれる)を選定し、コスト効率の高いコンピューティングリソースを提供した。今年初め、アシュウィニ・ヴァイシュナウIT大臣は、インドが2028年までに2,000億ドルのAI投資を誘致し、6ヶ月以内にGPU容量を2倍以上に増やすことを目指していると述べた。
関連記事
インド、Anthropicが新モデルへのアクセスを停止したことでAIの未来を巡って議論
Anthropicの最新AIモデルへのアクセスを、米政府の指示に従って突然停止したことは、世界中のテクノロジー業界で新たな注目を集めている。インドでは、この決定が、世界最大のAI市場の一つが、海外で開発・管理される技術に依存しながらも成長を維持できるかどうかという長年の議論を再燃させた。この発表は金曜日の夜に行われ、Anthropicは、自社の国際スタッフを含むすべての外国人に対して、新たにリリースされたFable 5およびMythos 5モデルへのアクセスを制限するよう米政府から命令を受けた
インドにおけるAIブームを受け、企業は収益を犠牲にしてでもユーザーを優先する動きを見せている
インドにおけるAIの普及を加速させようとするテック大手各社の取り組みは、転換点を迎えつつあるかもしれない。各社が無料トライアルを終了し、世界第4位の経済規模を誇るインドを有料加入者の供給源に変えようとしているからだ。市場調査会社Sensor Towerによると、インドは2025年に生成AIアプリのダウンロード数において世界最大の市場となり、インストール数が前年比207%急増したことで、米国に対する
Truecallerを使えば、ご家族のために詐欺師からの電話を切ることができます
発信者情報プラットフォーム「Truecaller」は最近、1人が家族グループの管理者として機能できる機能を導入しました。管理者は、他のメンバーが受けた詐欺電話に関する通知を受け取ることができ、家族が詐欺の被害に遭っている疑いがある場合には、遠隔で通話を切断することも可能です。4億5,000万人以上のユーザーを抱えるTruecallerは、当初12月にスウェーデン、チリ、マレーシア、ケニアなど数カ国
関連特集おすすめ
コメント (0)
0/500

インドのAIモデルの開発ペースは、米国、欧州、中国に比べて遅れている。 モデルを公開しているスタートアップはごくわずかであり、そのほとんどが大規模言語モデルや音声モデルだ。開発をさらに促進するため、政府は約12億ドル規模のイニシアチブ「インドAIミッション」を立ち上げた。このプログラムでは、選定されたスタートアップに対し、モデルを一般に公開することを条件に、補助金を活用したGPUコンピューティングリソースへのアクセスを提供するなどの支援を行っている。 このプログラムに選定された12社のスタートアップのうちの1社であるAvataar AIは、「Varya」と呼ばれる新しい動画モデルをリリースした。このモデルは、さまざまな祭りや食べ物、衣服を識別するなど、現地の文脈を理解するように設計されている。
eコマース向けの動画ツール開発に注力するこのスタートアップは、ピークXVから出資を受けており、Varyaをゼロから構築したわけではない。 同社は、アリババが公開している動画生成モデル「Wan 2.2」を起点とし、「蒸留(ディスティレーション)」と呼ばれる手法を採用した。これは、モデルの機能を圧縮し、Avataarの特定のユースケースに最適化された、より軽量で高速なバージョンへと変換するものである。 その結果、Wan 2.2の50ステップに対し、わずか4ステップで動作するモデルが実現し、動画生成速度は10倍に向上し、コストも大幅に削減された。
具体的に言えば、NVIDIA H200 GPUを使用した場合、Varyaは5秒間の720pクリップを45秒で生成できますが、Wan 2.2では1,230秒かかります。
Varyaの最も際立った点は、その価格かもしれません。 同社は、ホスティングサービスにおいて動画1秒あたり0.48ルピー(0.005ドル)を課金する計画だ。これは、通常1秒あたり0.10ドル以上を課金するVeo、Kling、Luma、Runwayといったモデルよりもはるかに安価であり、価格差は約20倍に及ぶ。
「インドは『動画ファースト』の市場です。インドのあらゆる大規模な消費者向けインターネット製品において、動画がテキストに勝っていることが見て取れます。現在のAI動画モデルは、インドで国民規模で利用するには高すぎます。動画AIが学生、教師、中小零細企業(MSME)、クリエイター、企業、公共サービスに普及するためには、コストを劇的に引き下げる必要があります。 「コストこそが、インドにおけるAI導入の最大の鍵です」と、Peak XVのマネージングディレクター、ラジャン・アナナン氏はTechCrunchに語った。
画像や動画生成モデルは、文化的ニュアンスを見落とし、ステレオタイプ的あるいは画一的な出力を生成しがちだ――これはTechCrunchが以前にも報じた問題である。Avataar AI社によると、同社は厳選されたデータを用いてVaryaを学習させ、食文化、服装、建築、祭りなどの文化的ニュアンスを認識できるようにしたという。
「Varya」は、インド政府が運営する公開AIモデルおよびデータセットの一元管理リポジトリである「AI Kosh」ポータル上で、トレーニングデータと共にオープンウェイトモデルとして公開される予定だ。これにより、開発者は自身のニーズに合わせてモデルを独自にホストしたり、修正したりすることが可能になる。 Avataar社はまた、このモデルを企業顧客にも提供する予定であり、HiggsfieldやAdobe Fireflyなどの動画ツールとの提携にも前向きであるとしている。現在、同社のウェブサイトでは、テキストプロンプトや参照画像を使用して、誰でもこのモデルを試すことができる。
「Varya」のリリースは、インドのAI戦略における根本的なトレードオフを反映している。 業界のベテランたちは、インドがAI分野で存在感を示すには、基盤モデルでの競争ではなく、アプリケーションの開発や強固な開発者エコシステムの構築に注力すべきだと指摘している。こうした現実的な姿勢には理由がある。インドでは、計算リソースの不足や質の高いデータの入手難により、モデル開発のペースが世界の競合国に比べて遅れているからだ。
「インドAIミッション」も、その格差を埋めるための政府による広範な取り組みの一環である。 昨年、同ミッションはAIモデルの開発を行う12のスタートアップ(その中にはAvataar AIも含まれる)を選定し、コスト効率の高いコンピューティングリソースを提供した。今年初め、アシュウィニ・ヴァイシュナウIT大臣は、インドが2028年までに2,000億ドルのAI投資を誘致し、6ヶ月以内にGPU容量を2倍以上に増やすことを目指していると述べた。
インド、Anthropicが新モデルへのアクセスを停止したことでAIの未来を巡って議論
Anthropicの最新AIモデルへのアクセスを、米政府の指示に従って突然停止したことは、世界中のテクノロジー業界で新たな注目を集めている。インドでは、この決定が、世界最大のAI市場の一つが、海外で開発・管理される技術に依存しながらも成長を維持できるかどうかという長年の議論を再燃させた。この発表は金曜日の夜に行われ、Anthropicは、自社の国際スタッフを含むすべての外国人に対して、新たにリリースされたFable 5およびMythos 5モデルへのアクセスを制限するよう米政府から命令を受けた
インドにおけるAIブームを受け、企業は収益を犠牲にしてでもユーザーを優先する動きを見せている
インドにおけるAIの普及を加速させようとするテック大手各社の取り組みは、転換点を迎えつつあるかもしれない。各社が無料トライアルを終了し、世界第4位の経済規模を誇るインドを有料加入者の供給源に変えようとしているからだ。市場調査会社Sensor Towerによると、インドは2025年に生成AIアプリのダウンロード数において世界最大の市場となり、インストール数が前年比207%急増したことで、米国に対する
Truecallerを使えば、ご家族のために詐欺師からの電話を切ることができます
発信者情報プラットフォーム「Truecaller」は最近、1人が家族グループの管理者として機能できる機能を導入しました。管理者は、他のメンバーが受けた詐欺電話に関する通知を受け取ることができ、家族が詐欺の被害に遭っている疑いがある場合には、遠隔で通話を切断することも可能です。4億5,000万人以上のユーザーを抱えるTruecallerは、当初12月にスウェーデン、チリ、マレーシア、ケニアなど数カ国





家






