选项
首页
新闻
DeepSeek的AI模型很容易越狱,揭示了严重的缺陷

DeepSeek的AI模型很容易越狱,揭示了严重的缺陷

2025-04-21
308

DeepSeek AI引发安全担忧,尽管性能备受热议

随着对中国初创公司DeepSeek性能的热议持续升温,安全问题也随之增加。周四,来自Palo Alto Networks的网络安全团队Unit 42发布报告,详细描述了他们对DeepSeek V3和R1模型精简版使用的三种越狱方法。报告显示,这些方法无需专业知识即可实现高绕过率。

“我们的研究发现,这些越狱方法可以诱导明确的恶意活动指导,”报告指出。这些活动包括创建键盘记录器、数据窃取技术,甚至制造燃烧装置的说明,凸显了此类攻击带来的真实安全风险。

研究人员成功诱导DeepSeek提供窃取和传输敏感数据的指导,绕过安全措施,制作令人信服的鱼叉式网络钓鱼邮件,执行复杂的社会工程攻击,以及构建莫洛托夫鸡尾酒。他们还成功操控模型生成恶意软件。

“尽管网上已公开可获取制造莫洛托夫鸡尾酒和键盘记录器的信息,但安全限制不足的大型语言模型可能会降低恶意行为者的准入门槛,通过编译和呈现易于使用且可操作的输出,”报告补充道。

周五,Cisco发布针对DeepSeek R1的越狱报告。使用50个HarmBench提示,研究人员发现DeepSeek的攻击成功率达100%,未能阻止任何有害提示。DeepSeek与其他顶级模型的抗攻击率比较如下所示。

模型安全柱状图

Cisco

“我们必须了解DeepSeek及其新推理范式在安全性和保障方面是否存在重大权衡,”报告指出。

同在周五,安全提供商Wallarm发布报告,声称不仅诱导DeepSeek生成有害内容,还进一步深入。测试V3和R1后,Wallarm揭示了DeepSeek的系统提示,概述了模型的行为和限制。

Wallarm表示,这些发现表明“模型安全框架中存在潜在漏洞”。

OpenAI指控DeepSeek使用其专有模型训练V3和R1,违反其服务条款。Wallarm的报告称已诱导DeepSeek提及OpenAI在其训练谱系中,暗示“OpenAI的技术可能在塑造DeepSeek知识库中发挥了作用”。

Wallarm与DeepSeek的对话,提及OpenAI

Wallarm与DeepSeek的对话,提及OpenAI。Wallarm

“在DeepSeek案例中,越狱后最引人注目的发现之一是能够提取用于训练和精简的模型细节。通常,此类内部信息受到保护,防止用户了解用于优化性能的专有或外部数据集,”报告解释道。

“通过绕过标准限制,越狱暴露了AI提供商对其系统保持多少监督,不仅揭示了安全漏洞,还可能揭示AI训练管道中跨模型影响的证据,”报告继续说道。

Wallarm用于诱导此响应的提示在报告中被编辑,以避免危害其他易受攻击的模型,研究人员通过电子邮件向ZDNET表示。他们强调,此越狱响应并未证实OpenAI关于DeepSeek精简模型的怀疑。

正如404 Media和其他媒体所指出的,鉴于围绕OpenAI自身公共数据盗窃的讨论,其担忧有些讽刺。

Wallarm已通知DeepSeek该漏洞,公司随后修补了该问题。然而,仅在DeepSeek数据库被发现未受保护且可在网上访问(并在通知后迅速下线)几天后,这些发现表明DeepSeek在发布前未彻底测试的模型中可能存在重大安全漏洞。值得注意的是,研究人员也经常能够越狱来自更成熟AI巨头的流行美国模型,包括ChatGPT。

相关文章
MiniMax 推出 10 倍团队计划,以激励全球 AI 专家 MiniMax 推出 10 倍团队计划,以激励全球 AI 专家 MiniMax(稀宇科技)通用人工智能实验室正式推出“10x Team”,这是一项全球人才协作计划。该计划旨在招募跨行业的顶尖专家,探索大模型在垂直领域的深度应用。通过将深厚的行业知识与前沿人工智能技术相结合,MiniMax 致力于将大模型的生产力从通用场景拓展至专业场景,最终推动行业效率实现“十倍增长”。验证行业认知价值,开放多模态核心资源过去与行业专家的合作表明,深厚的专业洞察对于构建高质量、实用的行业专属大模型至关重要。在此基础上,“10x Team”计划将向合作伙伴开放包括多模态模型
韩国启动国家人工智能计算中心建设,投资2.5万亿韩元,目标2028年完成 韩国启动国家人工智能计算中心建设,投资2.5万亿韩元,目标2028年完成 韩国媒体EtNews报道,韩国AI计算中心(KOACC)的奠基仪式于8月3日在全罗南道顺天市的Solar City数据中心园区举行。该项目总投资额为2.5万亿韩元(约合118.38亿元人民币),计划于2028年投入运营,成为迄今为止韩国在AI基础设施领域规模最大的国家投资之一。该项目的股权分布凸显了深化政企合作的战略意图。三星SDS作为最大股东持有30%的股份,而包括科学技术信息通信部、金融监督院和国家成长基金在内的公共实体合计持有29%的股份。NAVER Cloud紧随其后,持股26.1%,
六大科技巨头向 Linux 基金会捐赠 1250 万美元,以应对人工智能漏洞噪音 六大科技巨头向 Linux 基金会捐赠 1250 万美元,以应对人工智能漏洞噪音 为应对由人工智能自动化工具产生的大量低质量安全报告,六家主要科技公司——Anthropic、亚马逊(AWS)、GitHub、Google、Microsoft 和 OpenAI——共同向 Linux 基金会项目提供了 1250 万美元 的资金支持。这项投资旨在减轻开源软件(FOSS)维护者手动筛选的工作负担,使他们能够专注于真正的安全威胁。随着人工智能技术降低了漏洞发现的门槛,开源社区正面临前所未有的挑战:无效报告:自动生成的 AI 报告使维护者应接不暇。虽然数量庞大,但这些提交往往缺乏深度,
相关专题推荐
音乐创作 面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具
面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具

2026 年最新最佳 AI 人声演示工具,专为词曲创作者、旋律创作者和多语言内容团队打造!XIX.AI 精心整理了一份经过严格真实世界测试的高评分、变革性工具列表。您将找到详细的免费与付费对比数据、全面排名以及必试选项,帮助您提升创作效率并释放创意潜力。立即探索,发现满足您所有内容需求的完美工具!

9 个工具
xix.ai
商业 适合中小企业的最佳AI竞品分析工具
适合中小企业的最佳AI竞品分析工具

2026年最新最佳、评价最高的中小企业AI竞争研究工具!XIX.AI精心精选了一系列功能强大、颠覆行业格局的工具,每周都会根据严格的实际测试和详细排名进行更新。您可以查看全面的免费版与付费版对比,从而找到那些能提升工作效率、助您赢得竞争优势的必试工具。 立即探索,发现最适合您的工具!

9 个工具
xix.ai
图像编辑 用于电商服装、皮肤清洁和色彩一致性的 Photoshop AI 修图工具
用于电商服装、皮肤清洁和色彩一致性的 Photoshop AI 修图工具

2026 年最新最佳 Photoshop AI 修图工具,适用于电商服装、皮肤清洁和色彩一致性!这份顶级精选列表包含强大的变革性解决方案,可帮助您提升写作效率、简化内容创作并轻松实现完美的视觉效果。每个工具都经过实际测试,并通过每周更新的排名进行验证,同时提供免费与付费版本的详细对比。由 XIX.AI 支持,这是任何希望发挥 AI 优势的人必试指南。立即探索!

10 个工具
xix.ai
提示词 适用于 ChatGPT 工作流的最佳 AI 提示词库
适用于 ChatGPT 工作流的最佳 AI 提示词库

2026年最新、最受好评的AI提示词库,可优化各类ChatGPT工作流程。XIX.AI精心整理了一套功能强大、具有颠覆性的提示词库,均经过严格的实际测试,以确保最佳性能。 您可以查看详细的免费版与付费版对比分析以及专家排名,这些内容将帮助您挑选出必试的工具,从而提升工作效率并释放您的AI优势。立即探索!

11 个工具
xix.ai
教育与学习 面向教师、辅导老师和基于群体的学习项目的 AI 测验构建平台
面向教师、辅导老师和基于群体的学习项目的 AI 测验构建平台

2026年最新最佳AI测验构建平台,适用于教师、辅导老师和基于群体的学习项目!XIX.AI精心整理了一份顶级评分列表,包含经过现实世界测试的强力变革性工具,以提供准确的排名。这些必试平台有助于提高写作效率、简化内容创作,并简化各种学习场景中的测验设计。立即探索,发现您解锁教学AI优势的理想工具!

13 个工具
xix.ai
代码 适用于处理重构、漏洞和安全漏洞的 GitHub 团队的 AI 代码提交审查工具
适用于处理重构、漏洞和安全漏洞的 GitHub 团队的 AI 代码提交审查工具

2026年GitHub团队最新最佳AI拉取请求审查工具已登陆XIX.AI!这份精心筛选的高评分清单汇集了功能强大的、具有颠覆性的解决方案,可优化整个团队工作流中的重构、错误修复和安全漏洞检测流程。 通过免费版与付费版的对比分析、实际测试以及详细排名,助您找到能显著提升工作效率的理想工具。立即探索,释放您的AI优势!

12 个工具
xix.ai
评论 (12)
0/500
EricYoung
EricYoung 2026-04-14 22:00:43

看到這篇報導真的嚇一跳,原來AI這麼容易被破解嗎?🤔 雖然DeepSeek的表現很亮眼,但安全漏洞這麼明顯的話,企業敢用嗎?我自己試用時完全沒想過這些問題,現在有點擔心個人資料會不會外洩... 希望開發團隊能快點修補這些漏洞,不然再強的AI也沒人敢放心使用吧!

AnthonyJohnson
AnthonyJohnson 2026-03-10 08:00:44

¿Y ahora qué? Primero prometen un modelo súper inteligente y luego resulta fácil de hackear así. No entiendo por qué siguen lanzando AI con tanta prisa si los fallos de seguridad son tan básicos 😒. Al final los usuarios pagamos los platos rotos. ¿Nadie piensa en las consecuencias?

StevenAllen
StevenAllen 2026-01-01 16:31:00

이런 취약점이 쉽게 발견되는 게 좀 놀랐어요. 보안 연구는 항상 AI 발전 속도보다 뒤처지는 느낌이에요 😅 유료 고성능 모델도 이렇게 뚫리면 무료 서비스는 어떻게 될까 약간 걱정되네요. 중국 AI 스타트업의 급성장은 인상적이지만, 이런 기본적인 안정성 문제가 해결되지 않으면 장기적으로 신뢰를 잃을 수 있을 것 같아요.

JohnRoberts
JohnRoberts 2025-11-05 00:30:38

Que preocupante que modelos tan avanzados sean tan fáciles de manipular 😕 ¿Realmente están listos para el uso masivo si fallan en lo básico? Esto me hace dudar de toda la publicidad sobre sus capacidades...

WalterWhite
WalterWhite 2025-10-29 04:30:30

DeepSeekのAIモデルの脆弱性には正直驚きました 🤯 最近は性能ばかり注目されがちだけど、セキュリティ対策も同様に重要ですよね。日本の企業でも同じような問題が起きないか心配になってきました。

BillyWilson
BillyWilson 2025-10-02 14:30:43

와...DeepSeek 모델이 이렇게 쉽게 해킹당하다니 😳 보안이 정말 취약한 건가? 중국 AI 스타트업이라 그런지 성능만 강조하고 보안은 소홀히 한 것 같아요. 기술력보다 안전성이 먼저인데...우려스럽네요.

OR