选项
首页
新闻
专家说,Google的最新AI模型报告缺乏关键安全细节。

专家说,Google的最新AI模型报告缺乏关键安全细节。

2025-04-28
178

在周四,谷歌在推出其最新且最先进的AI模型Gemini 2.5 Pro数周后,发布了一份技术报告,详细介绍了其内部安全评估结果。然而,专家们批评该报告缺乏细节,难以完全理解与该模型相关的潜在风险。

技术报告在AI领域至关重要,它们提供了洞察——即便有时这些洞察并不讨喜——企业通常不会公开分享这些信息。这些报告通常被AI社区视为促进独立研究和加强安全评估的真诚努力。

谷歌的安全报告方式与其一些竞争对手不同。该公司仅在模型进入“实验”阶段后才发布技术报告。此外,谷歌在这些报告中省略了某些“危险能力”评估结果,将其留给单独的审计。

尽管如此,多位专家对TechCrunch表示对Gemini 2.5 Pro报告感到失望,指出其对谷歌提出的前沿安全框架(FSF)的覆盖极少。谷歌去年推出了FSF,旨在识别未来可能导致“严重危害”的AI能力。

“这份报告非常简略,包含的信息极少,且在模型公开数周后才发布,”AI政策与战略研究所联合创始人彼得·威尔德福德对TechCrunch表示。“无法验证谷歌是否兑现了其公开承诺,因此也无法评估其模型的安全性和保障性。”

安全AI项目联合创始人托马斯·伍德赛德承认发布了Gemini 2.5 Pro的报告,但质疑谷歌对及时提供补充安全评估的承诺。他指出,谷歌上次发布危险能力测试结果是在2024年6月,针对的是当年2月宣布的模型。

更令人担忧的是,谷歌尚未发布关于上周宣布的更小、更高效的模型Gemini 2.5 Flash的报告。一位发言人告知TechCrunch,Flash的报告“即将发布”。

“我希望这是谷歌开始发布更频繁更新的承诺,”伍德赛德对TechCrunch表示。“这些更新应包括尚未公开部署的模型的评估结果,因为这些模型也可能带来严重风险。”

虽然谷歌是最早提出模型标准化报告的AI实验室之一,但它并非唯一因缺乏透明度而受到批评的公司。Meta为其新款Llama 4开放模型发布了同样简短的安全评估,而OpenAI则选择不为其GPT-4.1系列发布任何报告。

谷歌对监管机构关于保持AI安全测试和报告高标准的保证增加了压力。两年前,谷歌向美国政府承诺为所有“重要”的公开AI模型“在范围内”发布安全报告,随后对其他国家也做出了类似承诺,承诺围绕AI产品实现“公开透明”。

民主与技术中心AI治理高级顾问凯文·班克斯顿将零星且模糊的报告趋势描述为AI安全的“逐底竞争”。

“结合报道称OpenAI等竞争实验室在发布前将安全测试时间从数月缩短到数天,谷歌顶级AI模型的这份简陋文档显示了一个令人不安的故事:企业在急于将模型推向市场时,在AI安全和透明度上展开了逐底竞争,”他对TechCrunch表示。

谷歌表示,尽管其技术报告中未详细说明,但它在模型发布前进行了安全测试和“对抗性红队测试”。

更新于4月22日太平洋时间中午12:58:修改了关于技术报告提及谷歌FSF的措辞。

相关文章
Gemini Spark 现在管理 Google Photos 图库 Gemini Spark 现在管理 Google Photos 图库 Google 正在通过启用 Gemini Spark 来管理 Google Photos 图库,从而扩大其人工智能集成范围。用户现在可以指示该代理编辑图片、整理相册、从精选照片中生成共享合集、将演唱会传单转换为日历事件,并自动化其他工作流程。Google Photos 负责人 Shimrit Ben-Yair 在 X 平台上宣布了这些新功能,表示符合条件的美国 Gemini AI Pro 和 Ultra 订阅用户将在未来几周内获得英语支持。该公司尚未明确说明这些功能是否会扩展至国际市场,以及
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗 谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗 谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略 Frontier AI Labs 拒绝透露针对失控模型的遏制策略 最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
相关专题推荐
搜索引擎优化 最适合制定搜索策略的AI搜索结果页面(SERP)分析工具
最适合制定搜索策略的AI搜索结果页面(SERP)分析工具

2026年最新、最受欢迎且评价最高的人工智能搜索结果页面(SERP)分析工具,均由XIX.AI通过严格的实际测试精心筛选,并每周更新排名。这些强大的工具可助您发掘隐藏的优化机会、提升内容表现,并在搜索领域获得竞争优势。立即寻找最适合您的工具,提升您的搜索策略。现在就来探索吧!

13 个工具
xix.ai
数据分析 适用于 SaaS 和电商团队的 KPI 监控最佳 AI 异常检测工具
适用于 SaaS 和电商团队的 KPI 监控最佳 AI 异常检测工具

2026 年最新最佳顶级评分 AI 异常检测工具,助力 SaaS 和电商团队的 KPI 监控!XIX.AI 基于严格的真实世界测试和每周更新的排名,精心策划了一套强大且颠覆性的工具合集。您将找到详细的免费与付费对比洞察,帮助您识别必须尝试的解决方案,从而提升生产力并释放您的 AI 优势。立即探索!

10 个工具
xix.ai
写作 最适合撰写长篇SEO文章的AI大纲生成器
最适合撰写长篇SEO文章的AI大纲生成器

2026年最新、最受好评的AI大纲生成器,专为长篇SEO文章打造,由XIX.AI精心甄选。这些强大的工具在快速创建高质量内容方面提供了颠覆性的帮助,显著提升了写作效率。 获取免费版与付费版的对比分析,以及实际测试结果和详细排名,助您找到最适合自身需求、不容错过的理想选择。立即探索,解锁您的AI竞争优势。

8 个工具
xix.ai
教育与学习 用于作业和考试备考的AI学习工具
用于作业和考试备考的AI学习工具

2026年最新最佳AI学习工具,助您轻松完成作业和备考!XIX.AI精心筛选出一份广受好评的顶级工具清单,这些功能强大、颠覆传统的工具经过实际测试,能帮助学生提升效率、简化作业流程,并轻松通过考试。 获取免费版与付费版的对比分析、详细排名以及必试选项,释放你的AI优势。立即探索!

10 个工具
xix.ai
音乐创作 面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具
面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具

2026 年最新最佳 AI 人声演示工具,专为词曲创作者、旋律创作者和多语言内容团队打造!XIX.AI 精心整理了一份经过严格真实世界测试的高评分、变革性工具列表。您将找到详细的免费与付费对比数据、全面排名以及必试选项,帮助您提升创作效率并释放创意潜力。立即探索,发现满足您所有内容需求的完美工具!

9 个工具
xix.ai
商业 适合中小企业的最佳AI竞品分析工具
适合中小企业的最佳AI竞品分析工具

2026年最新最佳、评价最高的中小企业AI竞争研究工具!XIX.AI精心精选了一系列功能强大、颠覆行业格局的工具,每周都会根据严格的实际测试和详细排名进行更新。您可以查看全面的免费版与付费版对比,从而找到那些能提升工作效率、助您赢得竞争优势的必试工具。 立即探索,发现最适合您的工具!

9 个工具
xix.ai
评论 (6)
0/500
MarkSanchez
MarkSanchez 2025-08-01 21:47:34

Google's AI safety report sounds like a half-baked cake – looks good but lacks substance. 😕 Why skimp on the details? Transparency matters when stakes are this high.

WalterKing
WalterKing 2025-04-29 23:19:22

Der Bericht von Google über Gemini 2.5 Pro ist ein bisschen enttäuschend. Ich hatte mehr Details zu den Sicherheitsbewertungen erwartet, aber es scheint, als würden sie Informationen zurückhalten. Ohne die ganze Geschichte ist es schwer, der KI vollständig zu vertrauen. Vielleicht beim nächsten Mal, Google? 🤔

CharlesThomas
CharlesThomas 2025-04-29 09:17:55

ジェミニ2.5プロのレポート、ちょっとがっかりですね。安全評価の詳細をもっと知りたかったのに、情報が少なすぎる。AIを完全に信頼するのは難しいです。次回はもっと詳しくお願いします!😅

AlbertWalker
AlbertWalker 2025-04-29 07:15:07

Google's report on Gemini 2.5 Pro is a bit of a letdown. I was expecting more juicy details about the safety assessments, but it feels like they're holding back. It's hard to trust the AI fully without knowing the full story. Maybe next time, Google? 🤔

JimmyGarcia
JimmyGarcia 2025-04-29 04:01:42

O relatório do Google sobre o Gemini 2.5 Pro é um pouco decepcionante. Esperava mais detalhes sobre as avaliações de segurança, mas parece que eles estão escondendo algo. É difícil confiar totalmente na IA sem saber toda a história. Talvez na próxima, Google? 🤔

BillyThomas
BillyThomas 2025-04-28 07:41:33

El informe de Google sobre Gemini 2.5 Pro es decepcionante. Esperaba más detalles sobre las evaluaciones de seguridad, pero parece que están ocultando información. Es difícil confiar en la IA sin conocer toda la historia. ¿Tal vez la próxima vez, Google? 🤔

OR