Moar Thread 適配 MiniMax H3 多模態大模型,助力國產算力生態

MiniMax 於 8 月 3 日正式釋出了其首款多模態生成模型 MiniMax H3。依託 AI 訓練與推理一體化智慧計算卡 MTT S5000 以及 MUSA 軟體棧,沐曦在宣佈當天迅速適配並最佳化了該模型,實現了高效執行。
作為 MiniMax 的多模態旗艦產品,H3 突破了傳統單一任務的侷限。它能夠準確解讀不同語境下的創意意圖,並全面支援文字、影象、音訊和影片的綜合輸入。根據官方規格,該模型可生成原生 2K 解析度的音影片內容,最大時長為 15 秒,在多種場景下提供商業級效能與多功能性。
值得注意的是,H3 在 Artificial Analysis 影片模型排行榜中獲得了“影片編輯能力”全球排名第一。生成 2K 解析度影片的成本低至每秒 0.8 元,具有極高的商業價值。此外,其開源特性透過支援靈活的本地部署和企業自定義資料整合,降低了採用門檻,從而在確保安全性和合規性的同時,加速了多模態生產力工具的廣泛普及。
針對該模型的釋出,沐曦團隊展現了卓越的敏捷性。在開源公告發布後的短短三個小時內,研發團隊分析了模型架構,研究了核心技術,並梳理了典型運算元。這一快速努力完成了從 SGLang-MUSA 推理框架到 MATE 和 muDNN 高效能運算元庫的完整適配路徑,實現了 H3 在 MTT S5000 上的快速部署和穩定執行。
沐曦表示,將繼續深化與 MiniMax 的合作關係。雙方將聚焦於探索多模態領域的高階上下文理解能力及模型擴充套件,全面加速 AGI 技術的創新與產業化程序。
相關文章
Claude Opus 5.2 夜灰色版釋出,響應速度更快,解決懶惰問題
Opus 5.2 今晨悄然上線,促使許多開發者注意到,更新後的模型 Claude Opus 5.2 已在 Claude Code 內部開始有限範圍的推送。昨晚,X 平臺使用者觀察到,在 Claude Code 中呼叫 Opus 5 時,其效能遠超標準網頁版,宛如“降維打擊”。這種路由策略在頂級 AI 公司中十分常見。資料包分析顯示,儘管前端標籤未變,但底層模型識別符號已切換為 Opus 5.2,這表明 Anthropic 可能完全跳過了 5.1 版本。速度、精度與自動“高強度迴圈”下的持續執
Fireworks AI 釋出搭載 Opus 的 FireRouter:編碼成本降低 57%,精度損失極小
Fireworks AI 推出了搭載 Opus 的 FireRouter,這是業界首個專為 Claude Opus 系列定製的快取感知路由系統。目前,該獨立路由模型已透過無伺服器端點開放使用。經過超過一個月的內部 A/B 測試,FireRouter 在編碼任務中實現了 98.1% 的準確率,同時與單獨使用 Opus 相比,成本降低了 57%。FireRouter 的工作原理是在每次使用者互動時評估每個模型對當前任務的適用性。它計算處理成本(包括提示詞快取),並判斷切換模型所節省的成本是否足以抵消緩
NVIDIA 釋出 Nemotron-Labs-Audex-30B-A3B 統一音訊智慧模型
隨著多模態大模型的快速發展,音訊處理能力往往受到妥協——許多模型在提升音訊理解能力的同時,卻犧牲了文字邏輯。為解決這一問題,NVIDIA 研究人員推出了 Nemotron-Labs-Audex-30B-A3B(Audex),這是一款統一的音訊-文字大語言模型,旨在彌合這一差距。Audex 採用精簡高效的設計,基於強大的純文字混合專家(MoE)架構構建。透過利用單個 Transformer 解碼器,它同時處理文字和量化音訊令牌。該方法將音訊輸入投影到文字嵌入空間,確保與現有用於多模態任務的大語言
相關專題推薦
評論 (0)
0/500

MiniMax 於 8 月 3 日正式釋出了其首款多模態生成模型 MiniMax H3。依託 AI 訓練與推理一體化智慧計算卡 MTT S5000 以及 MUSA 軟體棧,沐曦在宣佈當天迅速適配並最佳化了該模型,實現了高效執行。
作為 MiniMax 的多模態旗艦產品,H3 突破了傳統單一任務的侷限。它能夠準確解讀不同語境下的創意意圖,並全面支援文字、影象、音訊和影片的綜合輸入。根據官方規格,該模型可生成原生 2K 解析度的音影片內容,最大時長為 15 秒,在多種場景下提供商業級效能與多功能性。
值得注意的是,H3 在 Artificial Analysis 影片模型排行榜中獲得了“影片編輯能力”全球排名第一。生成 2K 解析度影片的成本低至每秒 0.8 元,具有極高的商業價值。此外,其開源特性透過支援靈活的本地部署和企業自定義資料整合,降低了採用門檻,從而在確保安全性和合規性的同時,加速了多模態生產力工具的廣泛普及。
針對該模型的釋出,沐曦團隊展現了卓越的敏捷性。在開源公告發布後的短短三個小時內,研發團隊分析了模型架構,研究了核心技術,並梳理了典型運算元。這一快速努力完成了從 SGLang-MUSA 推理框架到 MATE 和 muDNN 高效能運算元庫的完整適配路徑,實現了 H3 在 MTT S5000 上的快速部署和穩定執行。
沐曦表示,將繼續深化與 MiniMax 的合作關係。雙方將聚焦於探索多模態領域的高階上下文理解能力及模型擴充套件,全面加速 AGI 技術的創新與產業化程序。
Claude Opus 5.2 夜灰色版釋出,響應速度更快,解決懶惰問題
Opus 5.2 今晨悄然上線,促使許多開發者注意到,更新後的模型 Claude Opus 5.2 已在 Claude Code 內部開始有限範圍的推送。昨晚,X 平臺使用者觀察到,在 Claude Code 中呼叫 Opus 5 時,其效能遠超標準網頁版,宛如“降維打擊”。這種路由策略在頂級 AI 公司中十分常見。資料包分析顯示,儘管前端標籤未變,但底層模型識別符號已切換為 Opus 5.2,這表明 Anthropic 可能完全跳過了 5.1 版本。速度、精度與自動“高強度迴圈”下的持續執
Fireworks AI 釋出搭載 Opus 的 FireRouter:編碼成本降低 57%,精度損失極小
Fireworks AI 推出了搭載 Opus 的 FireRouter,這是業界首個專為 Claude Opus 系列定製的快取感知路由系統。目前,該獨立路由模型已透過無伺服器端點開放使用。經過超過一個月的內部 A/B 測試,FireRouter 在編碼任務中實現了 98.1% 的準確率,同時與單獨使用 Opus 相比,成本降低了 57%。FireRouter 的工作原理是在每次使用者互動時評估每個模型對當前任務的適用性。它計算處理成本(包括提示詞快取),並判斷切換模型所節省的成本是否足以抵消緩
NVIDIA 釋出 Nemotron-Labs-Audex-30B-A3B 統一音訊智慧模型
隨著多模態大模型的快速發展,音訊處理能力往往受到妥協——許多模型在提升音訊理解能力的同時,卻犧牲了文字邏輯。為解決這一問題,NVIDIA 研究人員推出了 Nemotron-Labs-Audex-30B-A3B(Audex),這是一款統一的音訊-文字大語言模型,旨在彌合這一差距。Audex 採用精簡高效的設計,基於強大的純文字混合專家(MoE)架構構建。透過利用單個 Transformer 解碼器,它同時處理文字和量化音訊令牌。該方法將音訊輸入投影到文字嵌入空間,確保與現有用於多模態任務的大語言





首頁






