Qwen 3.7 预览版现已发布:数学、编程和多模态能力得到增强
大型语言模型的快速演进不断突破界限。阿里巴巴已在Qwen Chat和Arena AI(原LMArena)上悄然推出了其通一Qwen 3.7系列的两个预览版本——Qwen3.7-Max-Preview和Qwen3.7-Plus-Preview。 预计这些版本将在5月20日即将举行的阿里云峰会上正式发布。
这些新的预览版各有侧重:
Qwen3.7-Max-Preview 作为旗舰模型,专注于顶级综合性能。目前该模型仅支持思考模式,搜索和代码解析等高级工具尚未启用。
Qwen3.7-Plus-Preview 提供均衡的高性能体验,侧重推理能力与逻辑清晰度。其全套工具将在未来的更新中逐步推出。

尽管仍处于预览阶段,这些模型已引起广泛关注。在 Arena AI 的文本能力排行榜上,Qwen3.7-Max-Preview 位列总榜第 13 名,推动阿里巴巴的 Tongyi Qwen 在同类实验室中跃居全球第六位。 在专项领域,其表现更为突出:数学推理排名第7位,专家级应用排名第9位,软件与IT领域排名第9位,编程能力排名第10位,展现出强大的多任务泛化能力。
在视觉能力方面,Qwen3.7-Plus-Preview 位列总排名第 16 位,助力 Tongyi Qwen 在视觉基准测试中跻身所有实验室第 5 名。 此外,在专为高级提示词设计的独家“专家竞技场”中,Qwen3.7-Max-Preview 位列第 9 名,彰显了其在大难度任务中日益提升的稳定性和精准度。
相关文章
IDC发布《中国生成式人工智能安全评估平台报告》;蚂蚁数字荣登“领导者”行列
随着企业越来越多地将人工智能融入客户服务和管理等核心运营中,安全风险也变得日益复杂。除了模型越狱和数据泄露等传统威胁外,工具滥用、代理权限提升以及多代理攻击等新挑战也正在涌现。8月20日,国际数据公司(IDC)发布了《IDC MarketScape:2026年中国生成式AI安全评估平台供应商评估报告》。 该报告对中国的生成式人工智能安全平台市场进行了评估,并凭借其技术实力、产品成熟度以及在金融、医
Meta 测试 AI 睡前故事应用 StoryKit,旨在解决家长讲故事时的难题
为了帮助忙碌的父母,Meta正在测试一款名为StoryKit的AI驱动应用,该应用能为孩子们生成个性化的睡前故事,其中包含定制的角色、场景和音乐。家长只需上传孩子最喜欢的玩具照片,即可生成生动的人物形象,无需自己动手撰写任何内容。该应用还融入了“勇敢”和“善良”等教育主题,帮助孩子们通过引人入胜的故事汲取积极的价值观。安全至上:非社交体验Meta目前正在部分地区测试StoryKit,以评估实际用户
OpenAI 推出 GPT-5.3 Instant,将幻觉生成率降低 27%
就在谷歌DeepMind发布Gemini 3.1 Flash-Lite仅两小时后,OpenAI以史无前例的速度迅速跟进,正式发布了其迄今为止最成熟的对话模型:GPT-5.3Instant。与此前优先追求各项最先进水平(SOTA)基准的版本不同,OpenAI此次采取了高度务实的策略——摒弃了排名竞赛,转而直接解决用户交互中最顽固的痛点。1. 消除“说教”语气:优先保证对话连贯性而非强行收尾许多 Ch
相关专题推荐
评论 (0)
0/500
大型语言模型的快速演进不断突破界限。阿里巴巴已在Qwen Chat和Arena AI(原LMArena)上悄然推出了其通一Qwen 3.7系列的两个预览版本——Qwen3.7-Max-Preview和Qwen3.7-Plus-Preview。 预计这些版本将在5月20日即将举行的阿里云峰会上正式发布。
这些新的预览版各有侧重:
Qwen3.7-Max-Preview 作为旗舰模型,专注于顶级综合性能。目前该模型仅支持思考模式,搜索和代码解析等高级工具尚未启用。
Qwen3.7-Plus-Preview 提供均衡的高性能体验,侧重推理能力与逻辑清晰度。其全套工具将在未来的更新中逐步推出。

尽管仍处于预览阶段,这些模型已引起广泛关注。在 Arena AI 的文本能力排行榜上,Qwen3.7-Max-Preview 位列总榜第 13 名,推动阿里巴巴的 Tongyi Qwen 在同类实验室中跃居全球第六位。 在专项领域,其表现更为突出:数学推理排名第7位,专家级应用排名第9位,软件与IT领域排名第9位,编程能力排名第10位,展现出强大的多任务泛化能力。
在视觉能力方面,Qwen3.7-Plus-Preview 位列总排名第 16 位,助力 Tongyi Qwen 在视觉基准测试中跻身所有实验室第 5 名。 此外,在专为高级提示词设计的独家“专家竞技场”中,Qwen3.7-Max-Preview 位列第 9 名,彰显了其在大难度任务中日益提升的稳定性和精准度。
IDC发布《中国生成式人工智能安全评估平台报告》;蚂蚁数字荣登“领导者”行列
随着企业越来越多地将人工智能融入客户服务和管理等核心运营中,安全风险也变得日益复杂。除了模型越狱和数据泄露等传统威胁外,工具滥用、代理权限提升以及多代理攻击等新挑战也正在涌现。8月20日,国际数据公司(IDC)发布了《IDC MarketScape:2026年中国生成式AI安全评估平台供应商评估报告》。 该报告对中国的生成式人工智能安全平台市场进行了评估,并凭借其技术实力、产品成熟度以及在金融、医
Meta 测试 AI 睡前故事应用 StoryKit,旨在解决家长讲故事时的难题
为了帮助忙碌的父母,Meta正在测试一款名为StoryKit的AI驱动应用,该应用能为孩子们生成个性化的睡前故事,其中包含定制的角色、场景和音乐。家长只需上传孩子最喜欢的玩具照片,即可生成生动的人物形象,无需自己动手撰写任何内容。该应用还融入了“勇敢”和“善良”等教育主题,帮助孩子们通过引人入胜的故事汲取积极的价值观。安全至上:非社交体验Meta目前正在部分地区测试StoryKit,以评估实际用户
OpenAI 推出 GPT-5.3 Instant,将幻觉生成率降低 27%
就在谷歌DeepMind发布Gemini 3.1 Flash-Lite仅两小时后,OpenAI以史无前例的速度迅速跟进,正式发布了其迄今为止最成熟的对话模型:GPT-5.3Instant。与此前优先追求各项最先进水平(SOTA)基准的版本不同,OpenAI此次采取了高度务实的策略——摒弃了排名竞赛,转而直接解决用户交互中最顽固的痛点。1. 消除“说教”语气:优先保证对话连贯性而非强行收尾许多 Ch





首页






