Doubao在AI视觉性能方面位居全球领先地位,超越了谷歌的模型
根据SuperCLUE-VLM于2026年4月发布的最新评估报告,中文多模态视觉语言模型领域已取得显著进展。 在对全球17款领先的大型模型进行全面评估后发现,国内人工智能开发者正展现出强劲的进步势头。这些模型不仅在解读中文内容方面表现出色,而且在所有评估指标上均优于国际顶尖同类模型。
字节跳动位居榜首,多款国内模型跻身顶尖行列
评估结果显示,字节跳动旗下的“Doubao-Seed-2.0-Pro-260215”模型以90.66分的成绩位居综合排名榜首。 这一分数超越了此前被视为强有力竞争者的谷歌Gemini-3.1-Pro-Preview(89.35分)。 此外,阿里巴巴的Qwen 3.5系列、商汤科技的SenseNova以及智普的GLM等其他国内模型也表现优异,稳居领先行列。 相比之下,OpenAI的GPT-5.4和X.AI的Grok等知名海外模型,在此项中国多模态评估中则跌至中游水平。

横跨三大关键领域的深度评估,展现出先进的基础认知能力
评估框架全面,涵盖三大核心领域:基础认知、视觉推理和视觉应用。评估包含25种不同场景,例如通用物体识别、图表分析和医学影像等。 国产模型在基础认知和数据分析类别中表现尤为突出,得分始终保持在90分以上,这反映出其技术成熟度高,且对中文语境具有很强的适应性。
专业领域仍面临挑战,工业与医疗推理被确定为未来重点发展方向
尽管在整体上处于领先地位,但评估数据也突显了国内模型仍需改进的领域。在工业检测和高精度医学影像等高度专业化的视觉推理任务中,这些模型仍落后于全球领先者,某些具体场景的得分波动较大。
行业专家认为,近期排名的变动标志着中国多模态AI发展的重要转折点。国内大型模型在深度理解和应用中文内容的能力上已确立了坚实的竞争优势,这标志着一个新时代的开始——它们不仅能够与国际巨头竞争,甚至有望在该领域发挥引领作用。
相关文章
字节跳动旗下 Seed 启动全球校园招聘,以虚拟股份争夺顶尖大模型人才
在大型语言模型的竞争格局中,争夺顶尖人才仍然是最关键的战略资产。4月1日,字节跳动宣布启动Seed全球校园招聘计划,作为其大模型人才培养项目的一部分。该活动面向2027届毕业生及现有实习生,旨在全球范围内发掘并锁定AI领域的精英研发与工程人才。规模扩张:全球甄选100名“AI种子”在技术快速进步的背景下,字节跳动有限公司今年大幅增加了对基础AI人才的投入:招聘范围: 该计划旨在从全球范围内招聘约100名专注于大模型的杰出候选人,对象为2027届毕业生。发展路径: Seed计划将核心业务
Suno 在法律诉讼中为歌曲添加水印
Suno,这个允许用户生成由人工智能创作的音乐的平台,近日推出了新功能,包括为平台制作的曲目添加标签、限制下载,并更新社区标准以遏制未经授权的复制品。这些更新是在Suno面临多家唱片公司和艺术家组织提起的多起诉讼之际推出的。在博客文章中,联合创始人兼首席执行官Mikey Shulman概述了核心原则,强调该平台旨在促进原创创作,同时扩大更广泛受众对人工智能音乐工具的访问权限。一个主要的争议点在于,用户将人工智能生成的歌曲上传到其他流媒体服务并通过操纵系统获取收入。Suno表示,现在将采用音频
马斯克承认 Grok 构建过程中泄露了用户代码,并承诺清除所有历史数据
埃隆·马斯克直接回应了围绕 Grok Build 的隐私争议,首先以简单的“True”(属实)确认了该事件的有效性。他承诺,此前上传至 SpaceXAI 的所有用户数据将被永久删除,并表示“不留一个字节”。这是人工智能行业首次由主要科技领袖公开承认错误并主动删除用户数据。安全研究人员的“钓鱼”测试揭示了数据泄露的具体证据此次争议源于独立人工智能安全研究人员 @cereblab 的一份报告。SpaceXAI 推出的 AI 编程助手 Grok Build 在其官方网站上声称其“优先本地运行,代码
相关专题推荐
评论 (0)
0/500
根据SuperCLUE-VLM于2026年4月发布的最新评估报告,中文多模态视觉语言模型领域已取得显著进展。 在对全球17款领先的大型模型进行全面评估后发现,国内人工智能开发者正展现出强劲的进步势头。这些模型不仅在解读中文内容方面表现出色,而且在所有评估指标上均优于国际顶尖同类模型。
字节跳动位居榜首,多款国内模型跻身顶尖行列
评估结果显示,字节跳动旗下的“Doubao-Seed-2.0-Pro-260215”模型以90.66分的成绩位居综合排名榜首。 这一分数超越了此前被视为强有力竞争者的谷歌Gemini-3.1-Pro-Preview(89.35分)。 此外,阿里巴巴的Qwen 3.5系列、商汤科技的SenseNova以及智普的GLM等其他国内模型也表现优异,稳居领先行列。 相比之下,OpenAI的GPT-5.4和X.AI的Grok等知名海外模型,在此项中国多模态评估中则跌至中游水平。

横跨三大关键领域的深度评估,展现出先进的基础认知能力
评估框架全面,涵盖三大核心领域:基础认知、视觉推理和视觉应用。评估包含25种不同场景,例如通用物体识别、图表分析和医学影像等。 国产模型在基础认知和数据分析类别中表现尤为突出,得分始终保持在90分以上,这反映出其技术成熟度高,且对中文语境具有很强的适应性。
专业领域仍面临挑战,工业与医疗推理被确定为未来重点发展方向
尽管在整体上处于领先地位,但评估数据也突显了国内模型仍需改进的领域。在工业检测和高精度医学影像等高度专业化的视觉推理任务中,这些模型仍落后于全球领先者,某些具体场景的得分波动较大。
行业专家认为,近期排名的变动标志着中国多模态AI发展的重要转折点。国内大型模型在深度理解和应用中文内容的能力上已确立了坚实的竞争优势,这标志着一个新时代的开始——它们不仅能够与国际巨头竞争,甚至有望在该领域发挥引领作用。
字节跳动旗下 Seed 启动全球校园招聘,以虚拟股份争夺顶尖大模型人才
在大型语言模型的竞争格局中,争夺顶尖人才仍然是最关键的战略资产。4月1日,字节跳动宣布启动Seed全球校园招聘计划,作为其大模型人才培养项目的一部分。该活动面向2027届毕业生及现有实习生,旨在全球范围内发掘并锁定AI领域的精英研发与工程人才。规模扩张:全球甄选100名“AI种子”在技术快速进步的背景下,字节跳动有限公司今年大幅增加了对基础AI人才的投入:招聘范围: 该计划旨在从全球范围内招聘约100名专注于大模型的杰出候选人,对象为2027届毕业生。发展路径: Seed计划将核心业务
Suno 在法律诉讼中为歌曲添加水印
Suno,这个允许用户生成由人工智能创作的音乐的平台,近日推出了新功能,包括为平台制作的曲目添加标签、限制下载,并更新社区标准以遏制未经授权的复制品。这些更新是在Suno面临多家唱片公司和艺术家组织提起的多起诉讼之际推出的。在博客文章中,联合创始人兼首席执行官Mikey Shulman概述了核心原则,强调该平台旨在促进原创创作,同时扩大更广泛受众对人工智能音乐工具的访问权限。一个主要的争议点在于,用户将人工智能生成的歌曲上传到其他流媒体服务并通过操纵系统获取收入。Suno表示,现在将采用音频
马斯克承认 Grok 构建过程中泄露了用户代码,并承诺清除所有历史数据
埃隆·马斯克直接回应了围绕 Grok Build 的隐私争议,首先以简单的“True”(属实)确认了该事件的有效性。他承诺,此前上传至 SpaceXAI 的所有用户数据将被永久删除,并表示“不留一个字节”。这是人工智能行业首次由主要科技领袖公开承认错误并主动删除用户数据。安全研究人员的“钓鱼”测试揭示了数据泄露的具体证据此次争议源于独立人工智能安全研究人员 @cereblab 的一份报告。SpaceXAI 推出的 AI 编程助手 Grok Build 在其官方网站上声称其“优先本地运行,代码





首页






