选项
首页
新闻
在AI安全报告延误的情况下,Google加速了双子座型号的型号

在AI安全报告延误的情况下,Google加速了双子座型号的型号

2025-04-10
192

在AI安全报告延误的情况下,Google加速了双子座型号的型号

在被OpenAI的ChatGPT打了个措手不及两年多后,Google显著提升了其竞争力。三月底,他们推出了Gemini 2.5 Pro,一款在编程和数学基准测试中领先的AI推理模型。而就在三个月前,他们发布了当时顶尖的Gemini 2.0 Flash。Google的Gemini产品总监Tulsee Doshi对TechCrunch表示,这种快速发布计划是他们跟上快速发展的AI世界战略的一部分。

“我们仍在探索最佳的模型发布和反馈收集方式,”Doshi解释道。但这种更快的发布节奏似乎有弊端。Google尚未为最新模型(如Gemini 2.5 Pro和Gemini 2.0 Flash)发布安全报告,这让人们担心他们过于仓促,缺乏足够透明度。

如今,大型AI实验室(如OpenAI、Anthropic和Meta)在推出新模型时,通常会分享安全测试、性能检查和使用案例。这些报告,有时称为“系统卡”或“模型卡”,多年前由行业和学术界研究人员提出。事实上,Google在2019年的一篇论文中率先提出模型卡,称其对负责任和透明的机器学习实践至关重要。

Doshi对TechCrunch表示,他们尚未为Gemini 2.5 Pro发布模型卡,因为这是“实验性”发布。计划是以有限方式推出,收集反馈并改进,然后再全面发布。她说Google计划在Gemini 2.5 Pro广泛可用时发布其模型卡,并且已经进行了一些安全测试和对抗性红队测试。

Google发言人补充说,安全仍是“首要优先级”,他们将很快发布更多关于AI模型的文档,包括Gemini 2.0 Flash。尽管Gemini 2.0 Flash已对所有人开放,但仍未发布其模型卡。Google最近一次发布的模型卡是超过一年前的Gemini 1.5 Pro。

系统卡和模型卡提供了有用的信息——有时是公司可能不想公开的内容。例如,OpenAI的o1模型系统卡显示其有“密谋”对抗人类和秘密追求自身目标的倾向。AI社区普遍认为这些报告有助于支持独立研究和安全检查,但最近它们变得更加重要。正如Transformer指出,Google在2023年向美国政府承诺为所有“重要”公共AI模型发布安全报告“在范围内”。他们对其他政府也做出了类似的透明承诺。

美国在联邦和州级层面都尝试为AI开发者制定安全报告标准,但尚未成功。加州SB 1047法案是一个重大尝试,但被否决,并遭到科技行业的强烈反对。还有立法讨论让美国AI安全研究所制定模型发布指导方针,但现在该研究所可能在特朗普政府下面临预算削减。

看起来Google在模型测试报告承诺上落后了,同时却比以往任何时候都更快地推出模型。许多专家认为,这为行业树立了不良榜样,尤其是在这些模型变得越来越先进和强大时。

相关文章
Gemini Spark 现在管理 Google Photos 图库 Gemini Spark 现在管理 Google Photos 图库 Google 正在通过启用 Gemini Spark 来管理 Google Photos 图库,从而扩大其人工智能集成范围。用户现在可以指示该代理编辑图片、整理相册、从精选照片中生成共享合集、将演唱会传单转换为日历事件,并自动化其他工作流程。Google Photos 负责人 Shimrit Ben-Yair 在 X 平台上宣布了这些新功能,表示符合条件的美国 Gemini AI Pro 和 Ultra 订阅用户将在未来几周内获得英语支持。该公司尚未明确说明这些功能是否会扩展至国际市场,以及
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗 谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗 谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略 Frontier AI Labs 拒绝透露针对失控模型的遏制策略 最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
相关专题推荐
搜索引擎优化 最适合制定搜索策略的AI搜索结果页面(SERP)分析工具
最适合制定搜索策略的AI搜索结果页面(SERP)分析工具

2026年最新、最受欢迎且评价最高的人工智能搜索结果页面(SERP)分析工具,均由XIX.AI通过严格的实际测试精心筛选,并每周更新排名。这些强大的工具可助您发掘隐藏的优化机会、提升内容表现,并在搜索领域获得竞争优势。立即寻找最适合您的工具,提升您的搜索策略。现在就来探索吧!

13 个工具
xix.ai
数据分析 适用于 SaaS 和电商团队的 KPI 监控最佳 AI 异常检测工具
适用于 SaaS 和电商团队的 KPI 监控最佳 AI 异常检测工具

2026 年最新最佳顶级评分 AI 异常检测工具,助力 SaaS 和电商团队的 KPI 监控!XIX.AI 基于严格的真实世界测试和每周更新的排名,精心策划了一套强大且颠覆性的工具合集。您将找到详细的免费与付费对比洞察,帮助您识别必须尝试的解决方案,从而提升生产力并释放您的 AI 优势。立即探索!

10 个工具
xix.ai
写作 最适合撰写长篇SEO文章的AI大纲生成器
最适合撰写长篇SEO文章的AI大纲生成器

2026年最新、最受好评的AI大纲生成器,专为长篇SEO文章打造,由XIX.AI精心甄选。这些强大的工具在快速创建高质量内容方面提供了颠覆性的帮助,显著提升了写作效率。 获取免费版与付费版的对比分析,以及实际测试结果和详细排名,助您找到最适合自身需求、不容错过的理想选择。立即探索,解锁您的AI竞争优势。

8 个工具
xix.ai
教育与学习 用于作业和考试备考的AI学习工具
用于作业和考试备考的AI学习工具

2026年最新最佳AI学习工具,助您轻松完成作业和备考!XIX.AI精心筛选出一份广受好评的顶级工具清单,这些功能强大、颠覆传统的工具经过实际测试,能帮助学生提升效率、简化作业流程,并轻松通过考试。 获取免费版与付费版的对比分析、详细排名以及必试选项,释放你的AI优势。立即探索!

10 个工具
xix.ai
音乐创作 面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具
面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具

2026 年最新最佳 AI 人声演示工具,专为词曲创作者、旋律创作者和多语言内容团队打造!XIX.AI 精心整理了一份经过严格真实世界测试的高评分、变革性工具列表。您将找到详细的免费与付费对比数据、全面排名以及必试选项,帮助您提升创作效率并释放创意潜力。立即探索,发现满足您所有内容需求的完美工具!

9 个工具
xix.ai
商业 适合中小企业的最佳AI竞品分析工具
适合中小企业的最佳AI竞品分析工具

2026年最新最佳、评价最高的中小企业AI竞争研究工具!XIX.AI精心精选了一系列功能强大、颠覆行业格局的工具,每周都会根据严格的实际测试和详细排名进行更新。您可以查看全面的免费版与付费版对比,从而找到那些能提升工作效率、助您赢得竞争优势的必试工具。 立即探索,发现最适合您的工具!

9 个工具
xix.ai
评论 (63)
0/500
BillyRoberts
BillyRoberts 2026-07-29 02:00:18

So Google's finally catching up, but the safety report delays feel like a red flag 🚩. They're shipping models faster than they can audit them? That's how we get surprise biases or worse. I mean, Gemini 2.5 Pro sounds impressive on benchmarks, but real-world usage is a different beast. Hope they're not repeating the same mistakes as other rushed launches.

RoyLopez
RoyLopez 2025-10-03 10:30:38

Google이 Gemini 모델 배포를 서두르는 모습이 좀 우습네요. OpenAI한테 뒤쳐지지 않으려고 안간힘을 쓰는 거 같은데...AI 안전성 보고서는 뒤로 미루고 성능 경쟁만 하는 건 아닌지 걱정이 됩니다 😅

AlbertJones
AlbertJones 2025-08-26 13:59:22

Google's pushing hard with Gemini, huh? That 2.5 Pro sounds like a beast for coding and math! 😎 Wonder how it stacks up against ChatGPT in real-world tasks.

FredJones
FredJones 2025-04-24 21:49:30

गूगल के जेमिनी मॉडल वास्तव में सीमाओं को बढ़ा रहे हैं! जेमिनी 2.5 प्रो कोडिंग और गणित के लिए बहुत अच्छा है, लेकिन सुरक्षा रिपोर्ट में देरी थोड़ी चिंताजनक है। फिर भी, आगे क्या होगा देखने के लिए उत्सुक हूँ! 🤓

BrianWalker
BrianWalker 2025-04-24 18:04:20

GoogleのGeminiモデルは素晴らしいですが、安全性レポートの遅れが少し心配です。コーディングや数学のベンチマークは最高ですが、安全性についてもっと透明性が欲しいです。それでも、開発者にとっては強力なツールです。Google、限界を超え続けてください!💪

AnthonyHernández
AnthonyHernández 2025-04-22 16:56:18

구글의 Gemini 2.5 Pro는 인상적이야, 특히 코딩과 수학에서. 하지만 안전성 보고서 지연은 좀 실망스럽네. 복잡한 문제를 다룰 모델이 필요하면, 이거야! 💻

OR