谷歌推出四种规格的Gemma4开源模型,310亿参数版本全球排名第三
北京时间4月3日凌晨4点03分,谷歌正式发布了开源大型语言模型Gemma4。该模型在“单位参数效率”方面实现了突破,为驱动智能代理工作流的开源模型树立了新的标杆。
该系列包含高效的E2B(23亿参数)和E4B(45亿参数)版本,以及高性能的260亿参数MoE模型和310亿参数全连接模型。作为基于Gemini3技术栈构建的最新迭代版本,Gemma4支持完整的多模态输入(图像和视频)。 E2B和E4B模型还原生支持语音输入,可在边缘端实现实时语音理解。

在技术架构方面,这些大参数模型通过优化实现了卓越的硬件效率。在 Arena AI 文本排行榜上,31B 密集版在开源模型中位列全球第三,而 26B MoE 版则位居第六。其逻辑推理和函数调用能力足够强大,足以驱动复杂的自主智能体。
对于本地部署,Gemma4 大幅降低了获取前沿 AI 技术的门槛。31B 非量化模型的权重可在单块 80GB H100 GPU 上运行,而量化版本则兼容消费级 GPU。 针对移动和物联网设备,得益于创新的 PLE 嵌入技术以及对 128K 上下文长度的支持,E2B 和 E4B 模型可在树莓派和智能手机等平台上实现低延迟的逻辑处理。
此次发布不仅彰显了谷歌对开源生态系统的坚定承诺,更通过 Apache 2.0 许可协议,为全球开发者构建本地化、高隐私的 AI 应用奠定了基础。
相关文章
美国股市触及历史里程碑,人工智能与航空航天巨头准备开启万亿美元时代
埃隆·马斯克、山姆·阿尔特曼和达里奥·阿莫迪,这三位科技领域的巨头,正推动其各自的企业迈向首次公开募股(IPO)。随着 SpaceX、OpenAI 和 Anthropic——这三家估值接近万亿美元的行业巨头——即将上市,2026 年被预测将成为美国历史上新股发行规模最大的一年。这一历史性的资本激增已引起全球金融界的关注,成为检验公共市场吸收如此大规模资金能力的关键压力测试。这些主要融资活动的同步启动预计将打破 2021 年创下的 1560 亿美元纪录。超级独角兽的资本博弈每家公司上市的路径
瑞典人工智能初创公司Lovable Eyes在完成主要融资轮后估值达132亿美元
随着人工智能驱动的编码工具日益普及,瑞典初创公司 Lovable 已获一轮重大融资。该公司计划筹集 30 亿美元,其估值有望升至 132 亿美元——这是去年 12 月记录的 66 亿美元的两倍。预计 Menlo Ventures 将主导此次投资。Lovable 的吸引力源于其核心的“氛围编码”(vibe coding)技术,该技术通过消除对复杂编码技能的需求来简化软件开发。用户只需以自然语言描述其需求,系统即可自动生成应用程序。这种直观的方法吸引了个人开发者、设计师和小企业,并扩展至 Work
Google 测试 Remy AI 代理,以 Gemini 为重点转向用户控制
根据《商业内幕》的报道,谷歌正在测试 Remy,这是 Gemini 的一款全新 AI 个人代理工具。该工具旨在代表用户执行任务,从而简化专业工作流程和日常事务。目前,Remy 正在 Gemini 应用的内部员工专属版本中进行测试。该报告引用了一份内部文件以及对两位熟悉该项目的个人的采访。内部资料将 Remy 描述为“全天候个人代理”,将 Gemini 定位为能够代表用户行事的主动助手。接近该项目的消息人士证实,谷歌员工正在积极测试 Remy。谷歌发言人拒绝提供进一步评论。该报告未提及公开发布
相关专题推荐
评论 (2)
0/500
Finally Google open-sources something decent! The 31B version ranking third globally is impressive, but I wonder how it compares to Llama 3 in real-world agent tasks? Honestly, parameter efficiency sounds like marketing fluff, but let's see the benchmarks. 🤔
北京时间4月3日凌晨4点03分,谷歌正式发布了开源大型语言模型Gemma4。该模型在“单位参数效率”方面实现了突破,为驱动智能代理工作流的开源模型树立了新的标杆。
该系列包含高效的E2B(23亿参数)和E4B(45亿参数)版本,以及高性能的260亿参数MoE模型和310亿参数全连接模型。作为基于Gemini3技术栈构建的最新迭代版本,Gemma4支持完整的多模态输入(图像和视频)。 E2B和E4B模型还原生支持语音输入,可在边缘端实现实时语音理解。

在技术架构方面,这些大参数模型通过优化实现了卓越的硬件效率。在 Arena AI 文本排行榜上,31B 密集版在开源模型中位列全球第三,而 26B MoE 版则位居第六。其逻辑推理和函数调用能力足够强大,足以驱动复杂的自主智能体。
对于本地部署,Gemma4 大幅降低了获取前沿 AI 技术的门槛。31B 非量化模型的权重可在单块 80GB H100 GPU 上运行,而量化版本则兼容消费级 GPU。 针对移动和物联网设备,得益于创新的 PLE 嵌入技术以及对 128K 上下文长度的支持,E2B 和 E4B 模型可在树莓派和智能手机等平台上实现低延迟的逻辑处理。
此次发布不仅彰显了谷歌对开源生态系统的坚定承诺,更通过 Apache 2.0 许可协议,为全球开发者构建本地化、高隐私的 AI 应用奠定了基础。
美国股市触及历史里程碑,人工智能与航空航天巨头准备开启万亿美元时代
埃隆·马斯克、山姆·阿尔特曼和达里奥·阿莫迪,这三位科技领域的巨头,正推动其各自的企业迈向首次公开募股(IPO)。随着 SpaceX、OpenAI 和 Anthropic——这三家估值接近万亿美元的行业巨头——即将上市,2026 年被预测将成为美国历史上新股发行规模最大的一年。这一历史性的资本激增已引起全球金融界的关注,成为检验公共市场吸收如此大规模资金能力的关键压力测试。这些主要融资活动的同步启动预计将打破 2021 年创下的 1560 亿美元纪录。超级独角兽的资本博弈每家公司上市的路径
瑞典人工智能初创公司Lovable Eyes在完成主要融资轮后估值达132亿美元
随着人工智能驱动的编码工具日益普及,瑞典初创公司 Lovable 已获一轮重大融资。该公司计划筹集 30 亿美元,其估值有望升至 132 亿美元——这是去年 12 月记录的 66 亿美元的两倍。预计 Menlo Ventures 将主导此次投资。Lovable 的吸引力源于其核心的“氛围编码”(vibe coding)技术,该技术通过消除对复杂编码技能的需求来简化软件开发。用户只需以自然语言描述其需求,系统即可自动生成应用程序。这种直观的方法吸引了个人开发者、设计师和小企业,并扩展至 Work
Finally Google open-sources something decent! The 31B version ranking third globally is impressive, but I wonder how it compares to Llama 3 in real-world agent tasks? Honestly, parameter efficiency sounds like marketing fluff, but let's see the benchmarks. 🤔





首页






