发现高质量的人工智能工具
将全球领先的人工智能工具聚集在一起,以帮助提高工作效率
由SamuelJackson发布的文章
谷歌和英伟达将DiffusionGemma开源,单显卡推理速度提升4倍
2026年6月10日,谷歌推出了DiffusionGemma——一款实验性的开源语言模型,它打破了传统自回归范式中“逐词生成文本”的模式。 该模型率先将图像AI中的扩散机制应用于文本生成,从随机噪声开始,通过迭代精炼,每步可并行输出256个令牌的文本块。在硬件性能方面,得益于英伟达的深度优化,该模型在单GPU单用户模式下的运行速度比同类传统模型快近四倍。 在 H100 GPU 上,单次请求的输出速
微软推出一款工具,帮助开发者根据文本描述创建人工智能行为测试
人工智能研究人员和实验室在评估人工智能模型的安全性、合规性、阿谀奉承倾向以及对齐性方面取得了重大进展。然而,企业和开发者现在面临着一个具体的挑战:确保其人工智能系统能够完全按照其特定产品或服务的预期进行运作。为了简化这一测试流程,微软于本周二发布了ASSERT——该名称是“自适应规范驱动评分评估与回归测试”(Adaptive Spec-driven Scoring for Evaluation a
美国陆军授予安杜里尔公司一份潜在价值达200亿美元的合同
美国陆军于上周五晚间宣布,已与国防科技初创公司安杜里尔(Anduril)签署了一份为期10年的合同,该协议的潜在价值最高可达200亿美元。公告称,该合同首先设定了为期五年的基础期,并包含一项可再延长五年的选择权,涵盖Anduril的硬件、软件、基础设施及服务。陆军将该协议描述为一份单一企业合同,整合了此前针对安杜里尔商业解决方案的“120多项独立采购行动”。“现代战场越来越由软件所定义,”国防部首
谷歌Meet推出实时语音翻译功能
在2025年谷歌I/O大会上,谷歌为Google Meet推出了实时语音翻译功能。该功能依托谷歌DeepMind研发的大型音频语言模型,使不同语言使用者能够进行流畅自然的对话。Meet的语音翻译功能可即时将说话内容转换为听者选择的语言,同时完整保留发言者的原声、语调及情感表达。 谷歌强调该技术的多种实用场景:例如英语孙辈可与西班牙语祖辈无缝交流;跨国企业也能借此实现全球团队的实时协作。谷歌声
AI工具通过去除数字化妆绕过过滤器
面部化妆品正使未成年用户(主要是女孩)得以绕过约会应用和电商网站等平台基于自拍的年龄验证系统。一款新型人工智能工具通过训练有素的鉴别模型解决了这一漏洞——该模型能在去除妆容的同时保留面部特征,使未成年人更难欺骗自动化检测。 随着全球在线年龄验证趋势的兴起,基于自拍的第三方年龄验证服务正日益普及。例如根据英国《网络安全法》,各类第三方服务可通过视觉年龄估算等方法进行年龄验证——即AI从移动设备实时摄
AI漫画工厂:轻松使用AI创建惊艳漫画
人工智能已转变了漫画创作,使其变得比以往任何时候都更简单和易于接触。借助AI漫画工厂等工具,任何人都无需高级艺术技能即可创作引人入胜的漫画。该平台利用AI生成生动的图像和叙事,开启了讲故事和创意表达的新可能性。了解AI漫画工厂的运作方式、其独特功能以及如何使用它将你的漫画创意变为现实。主要亮点AI漫画工厂通过先进的AI技术赋能用户创作漫画。它支持多样化的应用,从展示数学概念到辅助语言学习。该平台免
微软LAM:借助大型动作模型革新人工智能
探索微软的大规模动作模型(LAM)人工智能不断发展,微软凭借其创新性的大规模动作模型(LAM)正在突破界限。与仅生成文本的传统语言模型不同,LAM旨在直接在Windows环境中采取行动。这种独特的方法旨在连接理解语言的人工智能和能够执行任务的人工智能,为更加实用且无缝集成的人工智能解决方案铺平道路。什么是大规模动作模型(LAM)?微软的大规模动作模型(LAM





