Moar Thread 适配 MiniMax H3 多模态大模型,助力国产算力生态

MiniMax 于 8 月 3 日正式发布了其首款多模态生成模型 MiniMax H3。依托 AI 训练与推理一体化智能计算卡 MTT S5000 以及 MUSA 软件栈,沐曦在宣布当天迅速适配并优化了该模型,实现了高效运行。
作为 MiniMax 的多模态旗舰产品,H3 突破了传统单一任务的局限。它能够准确解读不同语境下的创意意图,并全面支持文本、图像、音频和视频的综合输入。根据官方规格,该模型可生成原生 2K 分辨率的音视频内容,最大时长为 15 秒,在多种场景下提供商业级性能与多功能性。
值得注意的是,H3 在 Artificial Analysis 视频模型排行榜中获得了“视频编辑能力”全球排名第一。生成 2K 分辨率视频的成本低至每秒 0.8 元,具有极高的商业价值。此外,其开源特性通过支持灵活的本地部署和企业自定义数据集成,降低了采用门槛,从而在确保安全性和合规性的同时,加速了多模态生产力工具的广泛普及。
针对该模型的发布,沐曦团队展现了卓越的敏捷性。在开源公告发布后的短短三个小时内,研发团队分析了模型架构,研究了核心技术,并梳理了典型算子。这一快速努力完成了从 SGLang-MUSA 推理框架到 MATE 和 muDNN 高性能算子库的完整适配路径,实现了 H3 在 MTT S5000 上的快速部署和稳定运行。
沐曦表示,将继续深化与 MiniMax 的合作关系。双方将聚焦于探索多模态领域的高级上下文理解能力及模型扩展,全面加速 AGI 技术的创新与产业化进程。
相关文章
Claude Opus 5.2 夜灰色版发布,响应速度更快,解决懒惰问题
Opus 5.2 今晨悄然上线,促使许多开发者注意到,更新后的模型 Claude Opus 5.2 已在 Claude Code 内部开始有限范围的推送。昨晚,X 平台用户观察到,在 Claude Code 中调用 Opus 5 时,其性能远超标准网页版,宛如“降维打击”。这种路由策略在顶级 AI 公司中十分常见。数据包分析显示,尽管前端标签未变,但底层模型标识符已切换为 Opus 5.2,这表明 Anthropic 可能完全跳过了 5.1 版本。速度、精度与自动“高强度循环”下的持续执行
Fireworks AI 发布搭载 Opus 的 FireRouter:编码成本降低 57%,精度损失极小
Fireworks AI 推出了搭载 Opus 的 FireRouter,这是业界首个专为 Claude Opus 系列定制的缓存感知路由系统。目前,该独立路由模型已通过无服务器端点开放使用。经过超过一个月的内部 A/B 测试,FireRouter 在编码任务中实现了 98.1% 的准确率,同时与单独使用 Opus 相比,成本降低了 57%。FireRouter 的工作原理是在每次用户交互时评估每个模型对当前任务的适用性。它计算处理成本(包括提示词缓存),并判断切换模型所节省的成本是否足以抵消缓
NVIDIA 发布 Nemotron-Labs-Audex-30B-A3B 统一音频智能模型
随着多模态大模型的快速发展,音频处理能力往往受到妥协——许多模型在提升音频理解能力的同时,却牺牲了文本逻辑。为解决这一问题,NVIDIA 研究人员推出了 Nemotron-Labs-Audex-30B-A3B(Audex),这是一款统一的音频-文本大语言模型,旨在弥合这一差距。Audex 采用精简高效的设计,基于强大的纯文本混合专家(MoE)架构构建。通过利用单个 Transformer 解码器,它同时处理文本和量化音频令牌。该方法将音频输入投影到文本嵌入空间,确保与现有用于多模态任务的大语言
相关专题推荐
评论 (0)
0/500

MiniMax 于 8 月 3 日正式发布了其首款多模态生成模型 MiniMax H3。依托 AI 训练与推理一体化智能计算卡 MTT S5000 以及 MUSA 软件栈,沐曦在宣布当天迅速适配并优化了该模型,实现了高效运行。
作为 MiniMax 的多模态旗舰产品,H3 突破了传统单一任务的局限。它能够准确解读不同语境下的创意意图,并全面支持文本、图像、音频和视频的综合输入。根据官方规格,该模型可生成原生 2K 分辨率的音视频内容,最大时长为 15 秒,在多种场景下提供商业级性能与多功能性。
值得注意的是,H3 在 Artificial Analysis 视频模型排行榜中获得了“视频编辑能力”全球排名第一。生成 2K 分辨率视频的成本低至每秒 0.8 元,具有极高的商业价值。此外,其开源特性通过支持灵活的本地部署和企业自定义数据集成,降低了采用门槛,从而在确保安全性和合规性的同时,加速了多模态生产力工具的广泛普及。
针对该模型的发布,沐曦团队展现了卓越的敏捷性。在开源公告发布后的短短三个小时内,研发团队分析了模型架构,研究了核心技术,并梳理了典型算子。这一快速努力完成了从 SGLang-MUSA 推理框架到 MATE 和 muDNN 高性能算子库的完整适配路径,实现了 H3 在 MTT S5000 上的快速部署和稳定运行。
沐曦表示,将继续深化与 MiniMax 的合作关系。双方将聚焦于探索多模态领域的高级上下文理解能力及模型扩展,全面加速 AGI 技术的创新与产业化进程。
Claude Opus 5.2 夜灰色版发布,响应速度更快,解决懒惰问题
Opus 5.2 今晨悄然上线,促使许多开发者注意到,更新后的模型 Claude Opus 5.2 已在 Claude Code 内部开始有限范围的推送。昨晚,X 平台用户观察到,在 Claude Code 中调用 Opus 5 时,其性能远超标准网页版,宛如“降维打击”。这种路由策略在顶级 AI 公司中十分常见。数据包分析显示,尽管前端标签未变,但底层模型标识符已切换为 Opus 5.2,这表明 Anthropic 可能完全跳过了 5.1 版本。速度、精度与自动“高强度循环”下的持续执行
Fireworks AI 发布搭载 Opus 的 FireRouter:编码成本降低 57%,精度损失极小
Fireworks AI 推出了搭载 Opus 的 FireRouter,这是业界首个专为 Claude Opus 系列定制的缓存感知路由系统。目前,该独立路由模型已通过无服务器端点开放使用。经过超过一个月的内部 A/B 测试,FireRouter 在编码任务中实现了 98.1% 的准确率,同时与单独使用 Opus 相比,成本降低了 57%。FireRouter 的工作原理是在每次用户交互时评估每个模型对当前任务的适用性。它计算处理成本(包括提示词缓存),并判断切换模型所节省的成本是否足以抵消缓
NVIDIA 发布 Nemotron-Labs-Audex-30B-A3B 统一音频智能模型
随着多模态大模型的快速发展,音频处理能力往往受到妥协——许多模型在提升音频理解能力的同时,却牺牲了文本逻辑。为解决这一问题,NVIDIA 研究人员推出了 Nemotron-Labs-Audex-30B-A3B(Audex),这是一款统一的音频-文本大语言模型,旨在弥合这一差距。Audex 采用精简高效的设计,基于强大的纯文本混合专家(MoE)架构构建。通过利用单个 Transformer 解码器,它同时处理文本和量化音频令牌。该方法将音频输入投影到文本嵌入空间,确保与现有用于多模态任务的大语言





首页






