微軟的 MAI-Image-2 人工智慧模型在全球文字轉圖像領域中名列前三
微軟人工智慧總監穆斯塔法·蘇萊曼(Mustafa Suleiman)宣布推出第二代影像生成模型 MAI-Image-2。這款新模型在權威的 LMArena 基準測試中表現亮眼,一舉躍居全球第三名。

在常被稱為人工智慧圖像生成「終極試金石」的 LMArena 排行榜上,MAI-Image-2 迅速引起了廣泛關注。目前其排名僅次於 Google 的 Gemini-3.1-flash-image-preview 以及 OpenAI 的 GPT-image-1.5-high-fidelity。 相較於2025年10月推出的第一代模型(最初排名第九),此第二代版本在整體輸出品質上實現了根本性的飛躍。

技術突破:解決「文字混亂」問題
MAI-Image-2 在視覺表現上取得顯著提升,同時解決了業界長期面臨的挑戰:在 AI 生成的圖像中精準呈現文字。
精準文字渲染:該模型在處理資訊圖表、簡報投影片及含文字的複雜邏輯圖表方面展現重大升級,能生成清晰可讀且無損的文字。
超寫實細節:它能精準重現自然光線、逼真的肌膚紋理,並建構遵循物理定律的栩栩如生環境。
電影級構圖:支援生成具備超現實概念、精緻構圖及宏大視覺敘事的超高解析度影像。

微軟正迅速將這項頂尖功能提供給使用者:
立即體驗:使用者現可登入 MAI Playground 平台進行免費試用。
廣泛整合:MAI-Image-2 正逐步整合至 Copilot 和 Bing Image Creator,這將使數百萬一般用戶很快就能直接透過這些工具,將其應用於工作與創意專案中。
此次發布鞏固了微軟在多模態 AI 領域的頂尖地位。透過解決文字渲染的核心難題,它顯著擴展了 AI 圖像生成在專業及辦公應用場景中的應用範圍。
相關文章
位元組跳動旗下 Seed 啟動全球校園招聘,以虛擬股份爭奪頂尖大模型人才
在大型語言模型的競爭格局中,爭奪頂尖人才仍然是最關鍵的戰略資產。4月1日,位元組跳動宣佈啟動Seed全球校園招聘計劃,作為其大模型人才培養專案的一部分。該活動面向2027屆畢業生及現有實習生,旨在全球範圍內發掘並鎖定AI領域的精英研發與工程人才。規模擴張:全球甄選100名“AI種子”在技術快速進步的背景下,位元組跳動有限公司今年大幅增加了對基礎AI人才的投入:招聘範圍: 該計劃旨在從全球範圍內招聘約100名專注於大模型的傑出候選人,物件為2027屆畢業生。發展路徑: Seed計劃將核心
Suno 在法律訴訟中為歌曲新增水印
Suno,這個允許使用者生成由人工智慧創作的音樂的平臺,近日推出了新功能,包括為平臺製作的曲目新增標籤、限制下載,並更新社羣標準以遏制未經授權的複製品。這些更新是在Suno面臨多家唱片公司和藝術家組織提起的多起訴訟之際推出的。在部落格文章中,聯合創始人兼執行長Mikey Shulman概述了核心原則,強調該平臺旨在促進原創創作,同時擴大更廣泛受眾對人工智慧音樂工具的訪問許可權。一個主要的爭議點在於,使用者將人工智慧生成的歌曲上傳到其他流媒體服務並透過操縱系統獲取收入。Suno表示,現在將採用音訊
馬斯克承認 Grok 構建過程中洩露了使用者程式碼,並承諾清除所有歷史資料
埃隆·馬斯克直接回應了圍繞 Grok Build 的隱私爭議,首先以簡單的“True”(屬實)確認了該事件的有效性。他承諾,此前上傳至 SpaceXAI 的所有使用者資料將被永久刪除,並表示“不留一個位元組”。這是人工智慧行業首次由主要科技領袖公開承認錯誤並主動刪除使用者資料。安全研究人員的“釣魚”測試揭示了資料洩露的具體證據此次爭議源於獨立人工智慧安全研究人員 @cereblab 的一份報告。SpaceXAI 推出的 AI 程式設計助手 Grok Build 在其官方網站上聲稱其“優先本地執行,程式碼
相關專題推薦
評論 (2)
0/500
Interesting to see Microsoft climbing the leaderboard, but I can't help feeling like these benchmark rankings are a bit like beauty contests—impressive stats don't always translate to real-world creativity. 🤔
Just read about Microsoft's MAI-Image-2 hitting top 3 on LMArena. As a hobbyist who dabbles with DALL-E and Midjourney, this direct benchmark climb is wild! 😲 Makes me wonder how this shakes up the 'Big Model' race... are we heading for a costly quality war, or will this push open-source models further behind? The compute costs alone must be staggering.
微軟人工智慧總監穆斯塔法·蘇萊曼(Mustafa Suleiman)宣布推出第二代影像生成模型 MAI-Image-2。這款新模型在權威的 LMArena 基準測試中表現亮眼,一舉躍居全球第三名。

在常被稱為人工智慧圖像生成「終極試金石」的 LMArena 排行榜上,MAI-Image-2 迅速引起了廣泛關注。目前其排名僅次於 Google 的 Gemini-3.1-flash-image-preview 以及 OpenAI 的 GPT-image-1.5-high-fidelity。 相較於2025年10月推出的第一代模型(最初排名第九),此第二代版本在整體輸出品質上實現了根本性的飛躍。

技術突破:解決「文字混亂」問題
MAI-Image-2 在視覺表現上取得顯著提升,同時解決了業界長期面臨的挑戰:在 AI 生成的圖像中精準呈現文字。
精準文字渲染:該模型在處理資訊圖表、簡報投影片及含文字的複雜邏輯圖表方面展現重大升級,能生成清晰可讀且無損的文字。
超寫實細節:它能精準重現自然光線、逼真的肌膚紋理,並建構遵循物理定律的栩栩如生環境。
電影級構圖:支援生成具備超現實概念、精緻構圖及宏大視覺敘事的超高解析度影像。

微軟正迅速將這項頂尖功能提供給使用者:
立即體驗:使用者現可登入 MAI Playground 平台進行免費試用。
廣泛整合:MAI-Image-2 正逐步整合至 Copilot 和 Bing Image Creator,這將使數百萬一般用戶很快就能直接透過這些工具,將其應用於工作與創意專案中。
此次發布鞏固了微軟在多模態 AI 領域的頂尖地位。透過解決文字渲染的核心難題,它顯著擴展了 AI 圖像生成在專業及辦公應用場景中的應用範圍。
位元組跳動旗下 Seed 啟動全球校園招聘,以虛擬股份爭奪頂尖大模型人才
在大型語言模型的競爭格局中,爭奪頂尖人才仍然是最關鍵的戰略資產。4月1日,位元組跳動宣佈啟動Seed全球校園招聘計劃,作為其大模型人才培養專案的一部分。該活動面向2027屆畢業生及現有實習生,旨在全球範圍內發掘並鎖定AI領域的精英研發與工程人才。規模擴張:全球甄選100名“AI種子”在技術快速進步的背景下,位元組跳動有限公司今年大幅增加了對基礎AI人才的投入:招聘範圍: 該計劃旨在從全球範圍內招聘約100名專注於大模型的傑出候選人,物件為2027屆畢業生。發展路徑: Seed計劃將核心
Suno 在法律訴訟中為歌曲新增水印
Suno,這個允許使用者生成由人工智慧創作的音樂的平臺,近日推出了新功能,包括為平臺製作的曲目新增標籤、限制下載,並更新社羣標準以遏制未經授權的複製品。這些更新是在Suno面臨多家唱片公司和藝術家組織提起的多起訴訟之際推出的。在部落格文章中,聯合創始人兼執行長Mikey Shulman概述了核心原則,強調該平臺旨在促進原創創作,同時擴大更廣泛受眾對人工智慧音樂工具的訪問許可權。一個主要的爭議點在於,使用者將人工智慧生成的歌曲上傳到其他流媒體服務並透過操縱系統獲取收入。Suno表示,現在將採用音訊
馬斯克承認 Grok 構建過程中洩露了使用者程式碼,並承諾清除所有歷史資料
埃隆·馬斯克直接回應了圍繞 Grok Build 的隱私爭議,首先以簡單的“True”(屬實)確認了該事件的有效性。他承諾,此前上傳至 SpaceXAI 的所有使用者資料將被永久刪除,並表示“不留一個位元組”。這是人工智慧行業首次由主要科技領袖公開承認錯誤並主動刪除使用者資料。安全研究人員的“釣魚”測試揭示了資料洩露的具體證據此次爭議源於獨立人工智慧安全研究人員 @cereblab 的一份報告。SpaceXAI 推出的 AI 程式設計助手 Grok Build 在其官方網站上聲稱其“優先本地執行,程式碼
Interesting to see Microsoft climbing the leaderboard, but I can't help feeling like these benchmark rankings are a bit like beauty contests—impressive stats don't always translate to real-world creativity. 🤔
Just read about Microsoft's MAI-Image-2 hitting top 3 on LMArena. As a hobbyist who dabbles with DALL-E and Midjourney, this direct benchmark climb is wild! 😲 Makes me wonder how this shakes up the 'Big Model' race... are we heading for a costly quality war, or will this push open-source models further behind? The compute costs alone must be staggering.





首頁






