Lar
A Doubao assume a liderança global em desempenho de visão por IA, superando os modelos do Google
De acordo com o mais recente relatório de avaliação publicado pelo SuperCLUE-VLM em abril de 2026, ocorreram avanços significativos no campo dos modelos multimodais de visão e linguagem em chinês. Após uma avaliação minuciosa de 17 dos principais modelos de grande escala do mundo, constatou-se que os desenvolvedores nacionais de IA estão demonstrando um forte progresso. Esses modelos não apenas se destacam na interpretação de conteúdos em chinês, mas também superam os principais modelos internacionais em todas as métricas de avaliação.
A ByteDance lidera o ranking, com vários modelos nacionais figurando entre os melhores
Os resultados da avaliação mostram que o Doubao-Seed-2.0-Pro-260215, da ByteDance, obteve 90,66 pontos, garantindo a primeira posição no ranking geral. Essa pontuação superou a do Google Gemini-3.1-Pro-Preview, que antes era considerado um forte concorrente com 89,35 pontos. Além disso, outros modelos nacionais, como a série Qwen3.5 do Alibaba, o SenseNova da SenseTime e o GLM da Zhipu, também tiveram um desempenho excepcional, consolidando-se firmemente entre os líderes. Em contrapartida, modelos internacionais bem conhecidos, como o GPT-5.4 da OpenAI e o Grok da X.AI, ficaram na faixa intermediária durante essa avaliação multimodal chinesa.

Avaliação aprofundada em três áreas-chave: evidências de habilidades cognitivas básicas avançadas
A estrutura de avaliação foi abrangente, cobrindo três áreas centrais: cognição básica, raciocínio visual e aplicação visual. A avaliação incluiu 25 cenários diferentes, como reconhecimento geral de objetos, análise de gráficos e imagens médicas. Os modelos nacionais tiveram um desempenho particularmente bom nas categorias de cognição básica e análise de dados, alcançando pontuações consistentemente acima de 90 pontos, o que reflete um alto nível de maturidade técnica e forte adaptabilidade aos contextos da língua chinesa.
Persistem desafios em áreas especializadas, com o raciocínio industrial e médico identificados como áreas de foco futuro
Embora liderem no geral, os dados da avaliação também destacaram áreas em que os modelos nacionais ainda precisam de melhorias. Em tarefas de raciocínio visual altamente especializadas, como inspeção industrial e imagens médicas de alta precisão, esses modelos ficam atrás dos líderes globais, com alguns cenários específicos apresentando variações consideráveis nas pontuações.
Especialistas do setor acreditam que essas recentes mudanças no ranking representam um ponto de inflexão crucial para o desenvolvimento da IA multimodal chinesa. Os modelos nacionais de grande escala estabeleceram agora uma sólida vantagem competitiva em sua capacidade de compreender profundamente e aplicar conteúdos em chinês, marcando o início de uma nova era em que podem competir com gigantes internacionais e até mesmo assumir um papel de liderança nesse campo.
Artigo relacionado
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Recomendações de tópicos especiais relacionados
Comentários (0)
De acordo com o mais recente relatório de avaliação publicado pelo SuperCLUE-VLM em abril de 2026, ocorreram avanços significativos no campo dos modelos multimodais de visão e linguagem em chinês. Após uma avaliação minuciosa de 17 dos principais modelos de grande escala do mundo, constatou-se que os desenvolvedores nacionais de IA estão demonstrando um forte progresso. Esses modelos não apenas se destacam na interpretação de conteúdos em chinês, mas também superam os principais modelos internacionais em todas as métricas de avaliação.
A ByteDance lidera o ranking, com vários modelos nacionais figurando entre os melhores
Os resultados da avaliação mostram que o Doubao-Seed-2.0-Pro-260215, da ByteDance, obteve 90,66 pontos, garantindo a primeira posição no ranking geral. Essa pontuação superou a do Google Gemini-3.1-Pro-Preview, que antes era considerado um forte concorrente com 89,35 pontos. Além disso, outros modelos nacionais, como a série Qwen3.5 do Alibaba, o SenseNova da SenseTime e o GLM da Zhipu, também tiveram um desempenho excepcional, consolidando-se firmemente entre os líderes. Em contrapartida, modelos internacionais bem conhecidos, como o GPT-5.4 da OpenAI e o Grok da X.AI, ficaram na faixa intermediária durante essa avaliação multimodal chinesa.

Avaliação aprofundada em três áreas-chave: evidências de habilidades cognitivas básicas avançadas
A estrutura de avaliação foi abrangente, cobrindo três áreas centrais: cognição básica, raciocínio visual e aplicação visual. A avaliação incluiu 25 cenários diferentes, como reconhecimento geral de objetos, análise de gráficos e imagens médicas. Os modelos nacionais tiveram um desempenho particularmente bom nas categorias de cognição básica e análise de dados, alcançando pontuações consistentemente acima de 90 pontos, o que reflete um alto nível de maturidade técnica e forte adaptabilidade aos contextos da língua chinesa.
Persistem desafios em áreas especializadas, com o raciocínio industrial e médico identificados como áreas de foco futuro
Embora liderem no geral, os dados da avaliação também destacaram áreas em que os modelos nacionais ainda precisam de melhorias. Em tarefas de raciocínio visual altamente especializadas, como inspeção industrial e imagens médicas de alta precisão, esses modelos ficam atrás dos líderes globais, com alguns cenários específicos apresentando variações consideráveis nas pontuações.
Especialistas do setor acreditam que essas recentes mudanças no ranking representam um ponto de inflexão crucial para o desenvolvimento da IA multimodal chinesa. Os modelos nacionais de grande escala estabeleceram agora uma sólida vantagem competitiva em sua capacidade de compreender profundamente e aplicar conteúdos em chinês, marcando o início de uma nova era em que podem competir com gigantes internacionais e até mesmo assumir um papel de liderança nesse campo.
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava











