Ai2发布紧凑型AI模型,超越Google、Meta竞争对手

本周小型AI模型掀起热潮。
周四,非营利AI研究组织Ai2推出Olmo 2 1B,一个10亿参数模型,在多项基准测试中超越Google、Meta和阿里巴巴的同类模型。参数,通常称为权重,是塑造模型性能的内部元素。
Olmo 2 1B在Hugging Face平台上以Apache 2.0许可证免费提供,供AI开发者使用。与大多数模型不同,它可完全重现,Ai2共享了其开发使用的代码和数据集(Olmo-mix-1124、Dolmino-mix-1124)。
虽然小型模型可能不如大型模型强大,但它们无需高端硬件,适合在标准笔记本电脑或消费设备上使用的开发者和爱好者。
近期小型模型发布激增,从微软的Phi 4推理系列到Qwen的2.5 Omni 3B。大多数模型,包括Olmo 2 1B,可在现代笔记本电脑甚至移动设备上顺畅运行。
Ai2表示,Olmo 2 1B在来自公共、AI生成和精选来源的4万亿token上进行训练。一百万token大约等于75万个单词。
在GSM8K等算术推理测试中,Olmo 2 1B超越Google的Gemma 3 1B、Meta的Llama 3.2 1B和阿里巴巴的Qwen 2.5 1.5B。它还在TruthfulQA事实准确性基准测试中表现出色。
TechCrunch Sessions: AI展示
在TC Sessions: AI预订展示空间,向超过1200名决策者展示你的工作,费用亲民。截止至5月9日或名额满为止。
TechCrunch Sessions: AI展示
在TC Sessions: AI预订展示空间,向超过1200名决策者展示你的工作,费用亲民。截止至5月9日或名额满为止。
加州伯克利 | 6月5日
立即预订
此模型在4万亿高质量数据token上预训练,遵循我们7、13和32B模型的相同标准预训练至高质量退火。我们上传了训练中每1000步的中间检查点。
访问基础模型:https://t.co/xofyWJmo85 pic.twitter.com/7uSJ6sYMdL
— Ai2 (@allen_ai) 2025年5月1日
Ai2警告,Olmo 2 1B存在风险。如所有AI模型,它可能生成有问题输出,包括有害或敏感内容及不准确信息。Ai2建议不要在商业应用中使用。
相关文章
LLM中有什么? AI2 olmotrace将“追踪”来源
了解大型语言模型(LLM)的输出及其培训数据之间的连接一直是企业IT的难题。本周,艾伦AI研究所(AI2)发起了一项令人兴奋的新开源计划,名为Olmotrace,旨在使这个Relati神秘化
Google 测试 Remy AI 代理,以 Gemini 为重点转向用户控制
根据《商业内幕》的报道,谷歌正在测试 Remy,这是 Gemini 的一款全新 AI 个人代理工具。该工具旨在代表用户执行任务,从而简化专业工作流程和日常事务。目前,Remy 正在 Gemini 应用的内部员工专属版本中进行测试。该报告引用了一份内部文件以及对两位熟悉该项目的个人的采访。内部资料将 Remy 描述为“全天候个人代理”,将 Gemini 定位为能够代表用户行事的主动助手。接近该项目的消息人士证实,谷歌员工正在积极测试 Remy。谷歌发言人拒绝提供进一步评论。该报告未提及公开发布
如何修复核心网页指标以获得更好的 SEO 排名
利用 AI 工具简化成绩单评语撰写引言用于生成成绩单评语的 AI 工具Magic SchoolAlmanac AIChat GPT使用 Magic School 生成成绩单评语登录 Magic School选择成绩单评语工具为学生定制评语使用 Almanac AI 生成成绩单评语设置课程与评分方案配置评语长度与学生信息使用 Almanac AI 生成评语比较 Magic School 与 Almanac AI设置的便捷性可定制性与课程内容的整合速度与效率使用
相关专题推荐
评论 (4)
0/500
Interesting to see a nonprofit like Ai2 pushing the boundaries with Olmo 2 1B! It really makes you wonder if the future of AI innovation lies more with smaller, specialized teams rather than just the tech giants. The efficiency gains here could be huge for real-world applications. 🧠
Olmo 2 1B par Ai2 est vraiment impressionnant! Un modèle d'1 milliard de paramètres qui bat ceux de Google et Meta? Ça montre qu'en IA, la taille n'est pas tout. J'adore voir des recherches orientées sur l'efficacité plutôt que la course aux plus gros modèles. C'est plus accessible et peut-être plus durable à long terme! 👏
Honestly, 1B参数的小模型能超越谷歌和Meta的对手,这太令人惊喜了!🥳 感觉大公司们的优势在被慢慢蚕食,这种非营利性组织的创新对整个生态是件好事,更轻量级的AI或许能让更多开发者参与进来。期待看到更多实际应用!

本周小型AI模型掀起热潮。
周四,非营利AI研究组织Ai2推出Olmo 2 1B,一个10亿参数模型,在多项基准测试中超越Google、Meta和阿里巴巴的同类模型。参数,通常称为权重,是塑造模型性能的内部元素。
Olmo 2 1B在Hugging Face平台上以Apache 2.0许可证免费提供,供AI开发者使用。与大多数模型不同,它可完全重现,Ai2共享了其开发使用的代码和数据集(Olmo-mix-1124、Dolmino-mix-1124)。
虽然小型模型可能不如大型模型强大,但它们无需高端硬件,适合在标准笔记本电脑或消费设备上使用的开发者和爱好者。
近期小型模型发布激增,从微软的Phi 4推理系列到Qwen的2.5 Omni 3B。大多数模型,包括Olmo 2 1B,可在现代笔记本电脑甚至移动设备上顺畅运行。
Ai2表示,Olmo 2 1B在来自公共、AI生成和精选来源的4万亿token上进行训练。一百万token大约等于75万个单词。
在GSM8K等算术推理测试中,Olmo 2 1B超越Google的Gemma 3 1B、Meta的Llama 3.2 1B和阿里巴巴的Qwen 2.5 1.5B。它还在TruthfulQA事实准确性基准测试中表现出色。
TechCrunch Sessions: AI展示
在TC Sessions: AI预订展示空间,向超过1200名决策者展示你的工作,费用亲民。截止至5月9日或名额满为止。
TechCrunch Sessions: AI展示
在TC Sessions: AI预订展示空间,向超过1200名决策者展示你的工作,费用亲民。截止至5月9日或名额满为止。
加州伯克利 | 6月5日 立即预订此模型在4万亿高质量数据token上预训练,遵循我们7、13和32B模型的相同标准预训练至高质量退火。我们上传了训练中每1000步的中间检查点。
— Ai2 (@allen_ai) 2025年5月1日
访问基础模型:https://t.co/xofyWJmo85 pic.twitter.com/7uSJ6sYMdL
Ai2警告,Olmo 2 1B存在风险。如所有AI模型,它可能生成有问题输出,包括有害或敏感内容及不准确信息。Ai2建议不要在商业应用中使用。
LLM中有什么? AI2 olmotrace将“追踪”来源
了解大型语言模型(LLM)的输出及其培训数据之间的连接一直是企业IT的难题。本周,艾伦AI研究所(AI2)发起了一项令人兴奋的新开源计划,名为Olmotrace,旨在使这个Relati神秘化
如何修复核心网页指标以获得更好的 SEO 排名
利用 AI 工具简化成绩单评语撰写引言用于生成成绩单评语的 AI 工具Magic SchoolAlmanac AIChat GPT使用 Magic School 生成成绩单评语登录 Magic School选择成绩单评语工具为学生定制评语使用 Almanac AI 生成成绩单评语设置课程与评分方案配置评语长度与学生信息使用 Almanac AI 生成评语比较 Magic School 与 Almanac AI设置的便捷性可定制性与课程内容的整合速度与效率使用
Interesting to see a nonprofit like Ai2 pushing the boundaries with Olmo 2 1B! It really makes you wonder if the future of AI innovation lies more with smaller, specialized teams rather than just the tech giants. The efficiency gains here could be huge for real-world applications. 🧠
Olmo 2 1B par Ai2 est vraiment impressionnant! Un modèle d'1 milliard de paramètres qui bat ceux de Google et Meta? Ça montre qu'en IA, la taille n'est pas tout. J'adore voir des recherches orientées sur l'efficacité plutôt que la course aux plus gros modèles. C'est plus accessible et peut-être plus durable à long terme! 👏
Honestly, 1B参数的小模型能超越谷歌和Meta的对手,这太令人惊喜了!🥳 感觉大公司们的优势在被慢慢蚕食,这种非营利性组织的创新对整个生态是件好事,更轻量级的AI或许能让更多开发者参与进来。期待看到更多实际应用!





首页






