在AI安全报告延误的情况下,Google加速了双子座型号的型号

在被OpenAI的ChatGPT打了个措手不及两年多后,Google显著提升了其竞争力。三月底,他们推出了Gemini 2.5 Pro,一款在编程和数学基准测试中领先的AI推理模型。而就在三个月前,他们发布了当时顶尖的Gemini 2.0 Flash。Google的Gemini产品总监Tulsee Doshi对TechCrunch表示,这种快速发布计划是他们跟上快速发展的AI世界战略的一部分。
“我们仍在探索最佳的模型发布和反馈收集方式,”Doshi解释道。但这种更快的发布节奏似乎有弊端。Google尚未为最新模型(如Gemini 2.5 Pro和Gemini 2.0 Flash)发布安全报告,这让人们担心他们过于仓促,缺乏足够透明度。
如今,大型AI实验室(如OpenAI、Anthropic和Meta)在推出新模型时,通常会分享安全测试、性能检查和使用案例。这些报告,有时称为“系统卡”或“模型卡”,多年前由行业和学术界研究人员提出。事实上,Google在2019年的一篇论文中率先提出模型卡,称其对负责任和透明的机器学习实践至关重要。
Doshi对TechCrunch表示,他们尚未为Gemini 2.5 Pro发布模型卡,因为这是“实验性”发布。计划是以有限方式推出,收集反馈并改进,然后再全面发布。她说Google计划在Gemini 2.5 Pro广泛可用时发布其模型卡,并且已经进行了一些安全测试和对抗性红队测试。
Google发言人补充说,安全仍是“首要优先级”,他们将很快发布更多关于AI模型的文档,包括Gemini 2.0 Flash。尽管Gemini 2.0 Flash已对所有人开放,但仍未发布其模型卡。Google最近一次发布的模型卡是超过一年前的Gemini 1.5 Pro。
系统卡和模型卡提供了有用的信息——有时是公司可能不想公开的内容。例如,OpenAI的o1模型系统卡显示其有“密谋”对抗人类和秘密追求自身目标的倾向。AI社区普遍认为这些报告有助于支持独立研究和安全检查,但最近它们变得更加重要。正如Transformer指出,Google在2023年向美国政府承诺为所有“重要”公共AI模型发布安全报告“在范围内”。他们对其他政府也做出了类似的透明承诺。
美国在联邦和州级层面都尝试为AI开发者制定安全报告标准,但尚未成功。加州SB 1047法案是一个重大尝试,但被否决,并遭到科技行业的强烈反对。还有立法讨论让美国AI安全研究所制定模型发布指导方针,但现在该研究所可能在特朗普政府下面临预算削减。
看起来Google在模型测试报告承诺上落后了,同时却比以往任何时候都更快地推出模型。许多专家认为,这为行业树立了不良榜样,尤其是在这些模型变得越来越先进和强大时。
相关文章
Gemini Spark 现在管理 Google Photos 图库
Google 正在通过启用 Gemini Spark 来管理 Google Photos 图库,从而扩大其人工智能集成范围。用户现在可以指示该代理编辑图片、整理相册、从精选照片中生成共享合集、将演唱会传单转换为日历事件,并自动化其他工作流程。Google Photos 负责人 Shimrit Ben-Yair 在 X 平台上宣布了这些新功能,表示符合条件的美国 Gemini AI Pro 和 Ultra 订阅用户将在未来几周内获得英语支持。该公司尚未明确说明这些功能是否会扩展至国际市场,以及
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
相关专题推荐
评论 (63)
0/500
So Google's finally catching up, but the safety report delays feel like a red flag 🚩. They're shipping models faster than they can audit them? That's how we get surprise biases or worse. I mean, Gemini 2.5 Pro sounds impressive on benchmarks, but real-world usage is a different beast. Hope they're not repeating the same mistakes as other rushed launches.
Google이 Gemini 모델 배포를 서두르는 모습이 좀 우습네요. OpenAI한테 뒤쳐지지 않으려고 안간힘을 쓰는 거 같은데...AI 안전성 보고서는 뒤로 미루고 성능 경쟁만 하는 건 아닌지 걱정이 됩니다 😅
Google's pushing hard with Gemini, huh? That 2.5 Pro sounds like a beast for coding and math! 😎 Wonder how it stacks up against ChatGPT in real-world tasks.
गूगल के जेमिनी मॉडल वास्तव में सीमाओं को बढ़ा रहे हैं! जेमिनी 2.5 प्रो कोडिंग और गणित के लिए बहुत अच्छा है, लेकिन सुरक्षा रिपोर्ट में देरी थोड़ी चिंताजनक है। फिर भी, आगे क्या होगा देखने के लिए उत्सुक हूँ! 🤓
GoogleのGeminiモデルは素晴らしいですが、安全性レポートの遅れが少し心配です。コーディングや数学のベンチマークは最高ですが、安全性についてもっと透明性が欲しいです。それでも、開発者にとっては強力なツールです。Google、限界を超え続けてください!💪

在被OpenAI的ChatGPT打了个措手不及两年多后,Google显著提升了其竞争力。三月底,他们推出了Gemini 2.5 Pro,一款在编程和数学基准测试中领先的AI推理模型。而就在三个月前,他们发布了当时顶尖的Gemini 2.0 Flash。Google的Gemini产品总监Tulsee Doshi对TechCrunch表示,这种快速发布计划是他们跟上快速发展的AI世界战略的一部分。
“我们仍在探索最佳的模型发布和反馈收集方式,”Doshi解释道。但这种更快的发布节奏似乎有弊端。Google尚未为最新模型(如Gemini 2.5 Pro和Gemini 2.0 Flash)发布安全报告,这让人们担心他们过于仓促,缺乏足够透明度。
如今,大型AI实验室(如OpenAI、Anthropic和Meta)在推出新模型时,通常会分享安全测试、性能检查和使用案例。这些报告,有时称为“系统卡”或“模型卡”,多年前由行业和学术界研究人员提出。事实上,Google在2019年的一篇论文中率先提出模型卡,称其对负责任和透明的机器学习实践至关重要。
Doshi对TechCrunch表示,他们尚未为Gemini 2.5 Pro发布模型卡,因为这是“实验性”发布。计划是以有限方式推出,收集反馈并改进,然后再全面发布。她说Google计划在Gemini 2.5 Pro广泛可用时发布其模型卡,并且已经进行了一些安全测试和对抗性红队测试。
Google发言人补充说,安全仍是“首要优先级”,他们将很快发布更多关于AI模型的文档,包括Gemini 2.0 Flash。尽管Gemini 2.0 Flash已对所有人开放,但仍未发布其模型卡。Google最近一次发布的模型卡是超过一年前的Gemini 1.5 Pro。
系统卡和模型卡提供了有用的信息——有时是公司可能不想公开的内容。例如,OpenAI的o1模型系统卡显示其有“密谋”对抗人类和秘密追求自身目标的倾向。AI社区普遍认为这些报告有助于支持独立研究和安全检查,但最近它们变得更加重要。正如Transformer指出,Google在2023年向美国政府承诺为所有“重要”公共AI模型发布安全报告“在范围内”。他们对其他政府也做出了类似的透明承诺。
美国在联邦和州级层面都尝试为AI开发者制定安全报告标准,但尚未成功。加州SB 1047法案是一个重大尝试,但被否决,并遭到科技行业的强烈反对。还有立法讨论让美国AI安全研究所制定模型发布指导方针,但现在该研究所可能在特朗普政府下面临预算削减。
看起来Google在模型测试报告承诺上落后了,同时却比以往任何时候都更快地推出模型。许多专家认为,这为行业树立了不良榜样,尤其是在这些模型变得越来越先进和强大时。
Gemini Spark 现在管理 Google Photos 图库
Google 正在通过启用 Gemini Spark 来管理 Google Photos 图库,从而扩大其人工智能集成范围。用户现在可以指示该代理编辑图片、整理相册、从精选照片中生成共享合集、将演唱会传单转换为日历事件,并自动化其他工作流程。Google Photos 负责人 Shimrit Ben-Yair 在 X 平台上宣布了这些新功能,表示符合条件的美国 Gemini AI Pro 和 Ultra 订阅用户将在未来几周内获得英语支持。该公司尚未明确说明这些功能是否会扩展至国际市场,以及
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
So Google's finally catching up, but the safety report delays feel like a red flag 🚩. They're shipping models faster than they can audit them? That's how we get surprise biases or worse. I mean, Gemini 2.5 Pro sounds impressive on benchmarks, but real-world usage is a different beast. Hope they're not repeating the same mistakes as other rushed launches.
Google이 Gemini 모델 배포를 서두르는 모습이 좀 우습네요. OpenAI한테 뒤쳐지지 않으려고 안간힘을 쓰는 거 같은데...AI 안전성 보고서는 뒤로 미루고 성능 경쟁만 하는 건 아닌지 걱정이 됩니다 😅
Google's pushing hard with Gemini, huh? That 2.5 Pro sounds like a beast for coding and math! 😎 Wonder how it stacks up against ChatGPT in real-world tasks.
गूगल के जेमिनी मॉडल वास्तव में सीमाओं को बढ़ा रहे हैं! जेमिनी 2.5 प्रो कोडिंग और गणित के लिए बहुत अच्छा है, लेकिन सुरक्षा रिपोर्ट में देरी थोड़ी चिंताजनक है। फिर भी, आगे क्या होगा देखने के लिए उत्सुक हूँ! 🤓
GoogleのGeminiモデルは素晴らしいですが、安全性レポートの遅れが少し心配です。コーディングや数学のベンチマークは最高ですが、安全性についてもっと透明性が欲しいです。それでも、開発者にとっては強力なツールです。Google、限界を超え続けてください!💪





首页






