Дом
Doubao заняла лидирующую позицию в мире по эффективности систем искусственного зрения, обогнав модели Google
Согласно последнему отчету об оценке, опубликованному SuperCLUE-VLM в апреле 2026 года, в области китайских мультимодальных моделей «зрение-язык» произошли значительные изменения. После тщательной оценки 17 ведущих мировых крупномасштабных моделей было установлено, что отечественные разработчики ИИ демонстрируют значительный прогресс. Эти модели не только отлично справляются с интерпретацией контента на китайском языке, но и превосходят лучшие международные аналоги по всем показателям оценки.
ByteDance возглавляет рейтинг, а несколько отечественных моделей вошли в верхнюю часть таблицы
Результаты оценки показывают, что модель Doubao-Seed-2.0-Pro-260215 от ByteDance набрала 90,66 балла, заняв первую строчку в общем рейтинге. Этот результат превзошёл показатель модели Google Gemini-3.1-Pro-Preview, которая ранее считалась сильным конкурентом с результатом 89,35 баллов. Кроме того, другие отечественные модели, такие как серия Qwen3.5 от Alibaba, SenseNova от SenseTime и GLM от Zhipu, также продемонстрировали исключительно высокие результаты, прочно закрепившись в числе лидеров. Напротив, известные зарубежные модели, такие как GPT-5.4 от OpenAI и Grok от X.AI, оказались в средней части рейтинга в ходе этой китайской мультимодальной оценки.

Углубленная оценка по трем ключевым направлениям, подтверждающая наличие развитых базовых когнитивных навыков
Система оценки была комплексной и охватывала три основные области: базовое познание, визуальное мышление и визуальное применение. Оценка включала 25 различных сценариев, таких как общее распознавание объектов, анализ диаграмм и медицинская визуализация. Китайские модели продемонстрировали особенно высокие результаты в категориях базового познания и анализа данных, стабильно набирая более 90 баллов, что свидетельствует о высоком уровне технической зрелости и сильной адаптируемости к контекстам на китайском языке.
В специализированных областях по-прежнему существуют проблемы, при этом промышленное и медицинское логическое мышление определены в качестве приоритетных направлений на будущее
Несмотря на лидерство в общем зачёте, данные оценки также выявили области, в которых отечественные модели по-прежнему требуют совершенствования. В высокоспециализированных задачах визуального мышления, таких как промышленный контроль и высокоточная медицинская визуализация, эти модели отстают от мировых лидеров, причём в некоторых конкретных сценариях наблюдаются значительные колебания результатов.
Эксперты отрасли считают, что недавние изменения в рейтинге знаменуют важный поворотный момент в развитии китайского мультимодального ИИ. Крупномасштабные отечественные модели к настоящему моменту обеспечили себе прочное конкурентное преимущество благодаря способности глубоко понимать и применять контент на китайском языке, что знаменует начало новой эры, в которой они смогут соперничать с международными гигантами и даже занять лидирующую роль в этой области.
Связанная статья
Акции США достигли исторической отметки, поскольку гиганты искусственного интеллекта и аэрокосмической отрасли готовятся к дебюту с оценкой в триллион долларов
Илон Маск, Сэм Алтман и Дарио Амодэй, три титана технологического сектора, продвигаются к первичным публичным предложениям акций своих respective компаний. Благодаря SpaceX, OpenAI и Anthropic — трем отраслевым гигантам, чья оценка приближается к три
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями
Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Рекомендации по связанным специальным темам
Комментарии (0)
Согласно последнему отчету об оценке, опубликованному SuperCLUE-VLM в апреле 2026 года, в области китайских мультимодальных моделей «зрение-язык» произошли значительные изменения. После тщательной оценки 17 ведущих мировых крупномасштабных моделей было установлено, что отечественные разработчики ИИ демонстрируют значительный прогресс. Эти модели не только отлично справляются с интерпретацией контента на китайском языке, но и превосходят лучшие международные аналоги по всем показателям оценки.
ByteDance возглавляет рейтинг, а несколько отечественных моделей вошли в верхнюю часть таблицы
Результаты оценки показывают, что модель Doubao-Seed-2.0-Pro-260215 от ByteDance набрала 90,66 балла, заняв первую строчку в общем рейтинге. Этот результат превзошёл показатель модели Google Gemini-3.1-Pro-Preview, которая ранее считалась сильным конкурентом с результатом 89,35 баллов. Кроме того, другие отечественные модели, такие как серия Qwen3.5 от Alibaba, SenseNova от SenseTime и GLM от Zhipu, также продемонстрировали исключительно высокие результаты, прочно закрепившись в числе лидеров. Напротив, известные зарубежные модели, такие как GPT-5.4 от OpenAI и Grok от X.AI, оказались в средней части рейтинга в ходе этой китайской мультимодальной оценки.

Углубленная оценка по трем ключевым направлениям, подтверждающая наличие развитых базовых когнитивных навыков
Система оценки была комплексной и охватывала три основные области: базовое познание, визуальное мышление и визуальное применение. Оценка включала 25 различных сценариев, таких как общее распознавание объектов, анализ диаграмм и медицинская визуализация. Китайские модели продемонстрировали особенно высокие результаты в категориях базового познания и анализа данных, стабильно набирая более 90 баллов, что свидетельствует о высоком уровне технической зрелости и сильной адаптируемости к контекстам на китайском языке.
В специализированных областях по-прежнему существуют проблемы, при этом промышленное и медицинское логическое мышление определены в качестве приоритетных направлений на будущее
Несмотря на лидерство в общем зачёте, данные оценки также выявили области, в которых отечественные модели по-прежнему требуют совершенствования. В высокоспециализированных задачах визуального мышления, таких как промышленный контроль и высокоточная медицинская визуализация, эти модели отстают от мировых лидеров, причём в некоторых конкретных сценариях наблюдаются значительные колебания результатов.
Эксперты отрасли считают, что недавние изменения в рейтинге знаменуют важный поворотный момент в развитии китайского мультимодального ИИ. Крупномасштабные отечественные модели к настоящему моменту обеспечили себе прочное конкурентное преимущество благодаря способности глубоко понимать и применять контент на китайском языке, что знаменует начало новой эры, в которой они смогут соперничать с международными гигантами и даже занять лидирующую роль в этой области.
Акции США достигли исторической отметки, поскольку гиганты искусственного интеллекта и аэрокосмической отрасли готовятся к дебюту с оценкой в триллион долларов
Илон Маск, Сэм Алтман и Дарио Амодэй, три титана технологического сектора, продвигаются к первичным публичным предложениям акций своих respective компаний. Благодаря SpaceX, OpenAI и Anthropic — трем отраслевым гигантам, чья оценка приближается к три
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её











