Дом
Видео-ИИ компании Avataar решает задачи, связанные с масштабами индийского рынка, обеспечивая высокую скорость, экономию средств и учет культурных нюансов

Темпы разработки моделей искусственного интеллекта в Индии остаются низкими по сравнению с США, Европой и Китаем. Лишь несколько стартапов выпускают модели, и большинство из них представляют собой крупные языковые или голосовые модели. С целью стимулирования дальнейшего развития правительство запустило программу «India AI Mission» — инициативу с бюджетом около 1,2 млрд долларов, которая, помимо прочего, предоставляет отобранным стартапам доступ к субсидированным вычислительным ресурсам на базе графических процессоров (GPU) в обмен на публичный выпуск их моделей. Один из 12 стартапов, отобранных для участия в программе, — Avataar AI — запустил новую видеомодель под названием Varya, разработанную для понимания местного контекста, например, для распознавания различных фестивалей, блюд и одежды.
Этот стартап, поддерживаемый фондом Peak XV и специализирующийся на создании видеоинструментов для электронной коммерции, не разрабатывал Varya с нуля. Он взял за основу Wan 2.2 — общедоступную модель генерации видео, выпущенную Alibaba, — и использовал технику, называемую «дистилляцией», которая, по сути, сводит возможности модели к более компактной и быстрой версии, оптимизированной для конкретных сценариев использования Avataar. В результате получилась модель, работающая за четыре шага вместо 50 в Wan 2.2, которая создает видео в 10 раз быстрее и с гораздо меньшими затратами.
Если говорить конкретно: с использованием графического процессора NVIDIA H200 Varya может сгенерировать 5-секундный клип с разрешением 720p за 45 секунд, тогда как Wan 2.2 на это уходит 1 230 секунд.
Пожалуй, самым поразительным аспектом Varya является её цена. Компания планирует взимать 0,48 рупии ($0,005) за секунду видео в рамках своего хостингового сервиса — это намного дешевле, чем у таких моделей, как Veo, Kling, Luma и Runway, которые обычно берут 0,10 доллара или более за секунду. Разница в цене составляет примерно 20 раз.
«Индия — это рынок, где видео занимает первое место. Мы видим это во всех крупных потребительских интернет-продуктах в Индии: видео превосходит текст. Существующие модели ИИ для работы с видео слишком дороги для использования в Индии на массовом уровне. Если ИИ для работы с видео должен стать доступным для студентов, учителей, микро-, малых и средних предприятий, авторов контента, крупных компаний и государственных служб, его стоимость должна резко снизиться. Стоимость — главный фактор, сдерживающий внедрение ИИ в Индии», — заявил TechCrunch управляющий директор Peak XV Раджан Анандан.
Модели генерации изображений и видео часто упускают культурные нюансы и создают стереотипные или общие результаты — о этой проблеме TechCrunch уже сообщал ранее. Компания Avataar AI заявляет, что использовала тщательно отобранные данные для обучения Varya распознаванию культурных нюансов, включая еду, одежду, архитектуру и фестивали.
Varya будет выпущена в качестве модели с открытым весом на индийском портале AI Kosh — централизованном хранилище индийского правительства для общедоступных моделей ИИ и наборов данных — вместе с данными для обучения, что означает, что разработчики смогут самостоятельно размещать модель на своих серверах или модифицировать её под свои нужды. Avataar также планирует предоставить модель своим корпоративным клиентам и заявляет о готовности к партнерству с разработчиками видеоинструментов, включая Higgsfield и Adobe Firefly. Любой желающий может опробовать модель прямо сейчас на веб-сайте компании, используя текстовые подсказки или эталонные изображения.
Запуск Varya отражает фундаментальный компромисс в амбициях Индии в области ИИ. Опытные специалисты отрасли отмечают, что Индия может заявить о себе в сфере ИИ, создавая приложения и развивая надежную экосистему разработчиков, а не пытаясь конкурировать в области базовых моделей. И у такого прагматичного подхода есть своё обоснование: разработка моделей в Индии идет медленнее, чем у глобальных конкурентов, из-за нехватки вычислительных ресурсов и ограниченной доступности качественных данных.
Программа «India AI Mission» также является частью более широких усилий правительства по устранению этого разрыва. В прошлом году в рамках этой программы было отобрано 12 стартапов — в том числе Avataar AI — для разработки моделей ИИ, которым были предоставлены экономичные вычислительные ресурсы. Ранее в этом году министр информационных технологий Ашвини Вайшнау заявил, что Индия намерена привлечь 200 млрд долларов инвестиций в сферу ИИ к 2028 году и более чем удвоить мощность своих графических процессоров (GPU) в течение шести месяцев.
Связанная статья
Индия обсуждает будущее ИИ, пока Anthropic приостанавливает доступ к новым моделям
Внезапное приостановление доступа Anthropic к своим последним моделям искусственного интеллекта по указанию правительства США вызвало новое пристальное внимание со стороны глобального технологического сектора. В Индии это решение вновь разожгло давни
Бум искусственного интеллекта в Индии побуждает компании пожертвовать доходами ради пользователей
Усилия технологических гигантов по ускорению внедрения ИИ в Индии, возможно, приближаются к переломному моменту, поскольку компании прекращают бесплатные пробные версии и стремятся превратить четверту
Truecaller позволяет вам повесить трубку на мошенников, чтобы защитить свою семью
Truecaller, платформа для идентификации звонящих, недавно представила функцию, позволяющую одному человеку выступать в роли администратора семейной группы. Администратор получает уведомления о мошенни
Рекомендации по связанным специальным темам
Комментарии (0)

Темпы разработки моделей искусственного интеллекта в Индии остаются низкими по сравнению с США, Европой и Китаем. Лишь несколько стартапов выпускают модели, и большинство из них представляют собой крупные языковые или голосовые модели. С целью стимулирования дальнейшего развития правительство запустило программу «India AI Mission» — инициативу с бюджетом около 1,2 млрд долларов, которая, помимо прочего, предоставляет отобранным стартапам доступ к субсидированным вычислительным ресурсам на базе графических процессоров (GPU) в обмен на публичный выпуск их моделей. Один из 12 стартапов, отобранных для участия в программе, — Avataar AI — запустил новую видеомодель под названием Varya, разработанную для понимания местного контекста, например, для распознавания различных фестивалей, блюд и одежды.
Этот стартап, поддерживаемый фондом Peak XV и специализирующийся на создании видеоинструментов для электронной коммерции, не разрабатывал Varya с нуля. Он взял за основу Wan 2.2 — общедоступную модель генерации видео, выпущенную Alibaba, — и использовал технику, называемую «дистилляцией», которая, по сути, сводит возможности модели к более компактной и быстрой версии, оптимизированной для конкретных сценариев использования Avataar. В результате получилась модель, работающая за четыре шага вместо 50 в Wan 2.2, которая создает видео в 10 раз быстрее и с гораздо меньшими затратами.
Если говорить конкретно: с использованием графического процессора NVIDIA H200 Varya может сгенерировать 5-секундный клип с разрешением 720p за 45 секунд, тогда как Wan 2.2 на это уходит 1 230 секунд.
Пожалуй, самым поразительным аспектом Varya является её цена. Компания планирует взимать 0,48 рупии ($0,005) за секунду видео в рамках своего хостингового сервиса — это намного дешевле, чем у таких моделей, как Veo, Kling, Luma и Runway, которые обычно берут 0,10 доллара или более за секунду. Разница в цене составляет примерно 20 раз.
«Индия — это рынок, где видео занимает первое место. Мы видим это во всех крупных потребительских интернет-продуктах в Индии: видео превосходит текст. Существующие модели ИИ для работы с видео слишком дороги для использования в Индии на массовом уровне. Если ИИ для работы с видео должен стать доступным для студентов, учителей, микро-, малых и средних предприятий, авторов контента, крупных компаний и государственных служб, его стоимость должна резко снизиться. Стоимость — главный фактор, сдерживающий внедрение ИИ в Индии», — заявил TechCrunch управляющий директор Peak XV Раджан Анандан.
Модели генерации изображений и видео часто упускают культурные нюансы и создают стереотипные или общие результаты — о этой проблеме TechCrunch уже сообщал ранее. Компания Avataar AI заявляет, что использовала тщательно отобранные данные для обучения Varya распознаванию культурных нюансов, включая еду, одежду, архитектуру и фестивали.
Varya будет выпущена в качестве модели с открытым весом на индийском портале AI Kosh — централизованном хранилище индийского правительства для общедоступных моделей ИИ и наборов данных — вместе с данными для обучения, что означает, что разработчики смогут самостоятельно размещать модель на своих серверах или модифицировать её под свои нужды. Avataar также планирует предоставить модель своим корпоративным клиентам и заявляет о готовности к партнерству с разработчиками видеоинструментов, включая Higgsfield и Adobe Firefly. Любой желающий может опробовать модель прямо сейчас на веб-сайте компании, используя текстовые подсказки или эталонные изображения.
Запуск Varya отражает фундаментальный компромисс в амбициях Индии в области ИИ. Опытные специалисты отрасли отмечают, что Индия может заявить о себе в сфере ИИ, создавая приложения и развивая надежную экосистему разработчиков, а не пытаясь конкурировать в области базовых моделей. И у такого прагматичного подхода есть своё обоснование: разработка моделей в Индии идет медленнее, чем у глобальных конкурентов, из-за нехватки вычислительных ресурсов и ограниченной доступности качественных данных.
Программа «India AI Mission» также является частью более широких усилий правительства по устранению этого разрыва. В прошлом году в рамках этой программы было отобрано 12 стартапов — в том числе Avataar AI — для разработки моделей ИИ, которым были предоставлены экономичные вычислительные ресурсы. Ранее в этом году министр информационных технологий Ашвини Вайшнау заявил, что Индия намерена привлечь 200 млрд долларов инвестиций в сферу ИИ к 2028 году и более чем удвоить мощность своих графических процессоров (GPU) в течение шести месяцев.
Индия обсуждает будущее ИИ, пока Anthropic приостанавливает доступ к новым моделям
Внезапное приостановление доступа Anthropic к своим последним моделям искусственного интеллекта по указанию правительства США вызвало новое пристальное внимание со стороны глобального технологического сектора. В Индии это решение вновь разожгло давни
Бум искусственного интеллекта в Индии побуждает компании пожертвовать доходами ради пользователей
Усилия технологических гигантов по ускорению внедрения ИИ в Индии, возможно, приближаются к переломному моменту, поскольку компании прекращают бесплатные пробные версии и стремятся превратить четверту
Truecaller позволяет вам повесить трубку на мошенников, чтобы защитить свою семью
Truecaller, платформа для идентификации звонящих, недавно представила функцию, позволяющую одному человеку выступать в роли администратора семейной группы. Администратор получает уведомления о мошенни











