Qwen 3.7 預覽版模型現已推出:強化數學、程式設計及多模態功能
大型語言模型的快速演進持續突破界限。阿里巴巴已低調地在 Qwen Chat 和 Arena AI(前身為 LMArena)上推出了其 Tongyi Qwen 3.7 系列的兩款預覽版本——Qwen3.7-Max-Preview 和 Qwen3.7-Plus-Preview。 預計這些版本將於 5 月 20 日舉行的「阿里雲峰會」上正式亮相。
這兩款新預覽版本各有其獨特用途:
Qwen3.7-Max-Preview 作為旗艦模型,專注於頂級的綜合性能表現。目前該模型僅支援「思考模式」,搜尋與程式碼解析等進階工具尚未啟用。
Qwen3.7-Plus-Preview 則提供均衡且高效能的使用體驗,著重於推理能力與邏輯清晰度。其全套工具將於未來的更新中逐步推出。

儘管仍處於預覽階段,這些模型已引起廣泛關注。在 Arena AI 的文本能力排行榜上,Qwen3.7-Max-Preview 總排名第 13 位,推動阿里巴巴的 Tongyi Qwen 在全球同類實驗室中躍居第 6 位。 在專業領域中,其表現更為亮眼:數學推理排名第 7 名、專家級應用排名第 9 名、軟體與 IT 領域排名第 9 名,以及程式設計能力排名第 10 名,展現出強大的多任務泛化能力。
在視覺能力方面,Qwen3.7-Plus-Preview 總排名第 16 名,助力 Tongyi Qwen 在所有實驗室的視覺基準測試中奪得第 5 名。 此外,在專為進階提示詞設計的獨家「專家競技場」中,Qwen3.7-Max-Preview 榮獲第 9 名,凸顯其在大難度任務中日益提升的穩定性與精準度。
相關文章
IDC 發布《中國生成式 AI 安全評估平台報告》;螞蟻數位躋身領導者之列
隨著企業日益將人工智慧整合至客戶服務與管理等核心營運環節,資安風險也變得愈發複雜。除了模型越獄和資料外洩等傳統威脅之外,工具濫用、代理權限提升以及多代理攻擊等新挑戰正逐漸浮現。8月20日,國際數據公司(IDC)發布了《IDC MarketScape:2026年中國生成式人工智慧安全評估平台供應商評估報告》。 該報告針對中國生成式 AI 安全平台市場進行評估,並憑藉其技術實力、產品成熟度,以及在金融
Meta 測試 AI 睡前故事應用程式 StoryKit,以解決家長在講故事時面臨的挑戰
為了協助忙碌的家長,Meta 正在測試一款名為「StoryKit」的 AI 驅動應用程式,該應用程式能為孩子生成包含客製化角色、場景和音樂的個人化睡前故事。家長只需上傳孩子最喜愛的玩具照片,即可創造生動的角色,無需親自動筆撰寫任何內容。該應用程式還融入了「勇敢」與「善良」等教育主題,透過引人入勝的故事幫助孩子吸收正向價值觀。安全至上:非社交體驗Meta 目前正在特定地區測試 StoryKit,以評
OpenAI 推出 GPT-5.3 Instant,將「幻覺」現象減少 27 %
就在 Google DeepMind 發表 Gemini 3.1 Flash-Lite 僅兩小時後,OpenAI 以史無前例的速度迅速跟進,正式推出迄今為止最精緻的對話模型:GPT-5.3Instant。有別於先前版本優先追求各項「最先進技術」(SOTA)基準的作法,OpenAI 此次採取了極具務實性的策略——捨棄排名競逐,轉而直接解決使用者互動中最頑固的痛點。1. 消除「說教」口吻:優先確保對話
相關專題推薦
評論 (0)
0/500
大型語言模型的快速演進持續突破界限。阿里巴巴已低調地在 Qwen Chat 和 Arena AI(前身為 LMArena)上推出了其 Tongyi Qwen 3.7 系列的兩款預覽版本——Qwen3.7-Max-Preview 和 Qwen3.7-Plus-Preview。 預計這些版本將於 5 月 20 日舉行的「阿里雲峰會」上正式亮相。
這兩款新預覽版本各有其獨特用途:
Qwen3.7-Max-Preview 作為旗艦模型,專注於頂級的綜合性能表現。目前該模型僅支援「思考模式」,搜尋與程式碼解析等進階工具尚未啟用。
Qwen3.7-Plus-Preview 則提供均衡且高效能的使用體驗,著重於推理能力與邏輯清晰度。其全套工具將於未來的更新中逐步推出。

儘管仍處於預覽階段,這些模型已引起廣泛關注。在 Arena AI 的文本能力排行榜上,Qwen3.7-Max-Preview 總排名第 13 位,推動阿里巴巴的 Tongyi Qwen 在全球同類實驗室中躍居第 6 位。 在專業領域中,其表現更為亮眼:數學推理排名第 7 名、專家級應用排名第 9 名、軟體與 IT 領域排名第 9 名,以及程式設計能力排名第 10 名,展現出強大的多任務泛化能力。
在視覺能力方面,Qwen3.7-Plus-Preview 總排名第 16 名,助力 Tongyi Qwen 在所有實驗室的視覺基準測試中奪得第 5 名。 此外,在專為進階提示詞設計的獨家「專家競技場」中,Qwen3.7-Max-Preview 榮獲第 9 名,凸顯其在大難度任務中日益提升的穩定性與精準度。
IDC 發布《中國生成式 AI 安全評估平台報告》;螞蟻數位躋身領導者之列
隨著企業日益將人工智慧整合至客戶服務與管理等核心營運環節,資安風險也變得愈發複雜。除了模型越獄和資料外洩等傳統威脅之外,工具濫用、代理權限提升以及多代理攻擊等新挑戰正逐漸浮現。8月20日,國際數據公司(IDC)發布了《IDC MarketScape:2026年中國生成式人工智慧安全評估平台供應商評估報告》。 該報告針對中國生成式 AI 安全平台市場進行評估,並憑藉其技術實力、產品成熟度,以及在金融
Meta 測試 AI 睡前故事應用程式 StoryKit,以解決家長在講故事時面臨的挑戰
為了協助忙碌的家長,Meta 正在測試一款名為「StoryKit」的 AI 驅動應用程式,該應用程式能為孩子生成包含客製化角色、場景和音樂的個人化睡前故事。家長只需上傳孩子最喜愛的玩具照片,即可創造生動的角色,無需親自動筆撰寫任何內容。該應用程式還融入了「勇敢」與「善良」等教育主題,透過引人入勝的故事幫助孩子吸收正向價值觀。安全至上:非社交體驗Meta 目前正在特定地區測試 StoryKit,以評
OpenAI 推出 GPT-5.3 Instant,將「幻覺」現象減少 27 %
就在 Google DeepMind 發表 Gemini 3.1 Flash-Lite 僅兩小時後,OpenAI 以史無前例的速度迅速跟進,正式推出迄今為止最精緻的對話模型:GPT-5.3Instant。有別於先前版本優先追求各項「最先進技術」(SOTA)基準的作法,OpenAI 此次採取了極具務實性的策略——捨棄排名競逐,轉而直接解決使用者互動中最頑固的痛點。1. 消除「說教」口吻:優先確保對話





首頁






