選項
首頁
新聞
DeepSeek的AI模型很容易越獄,揭示了嚴重的缺陷

DeepSeek的AI模型很容易越獄,揭示了嚴重的缺陷

2025-04-21
308

DeepSeek AI引發安全疑慮,性能熱潮同時並存

隨著中國新創公司DeepSeek的性能熱潮持續升溫,安全疑慮也隨之增加。週四,來自Palo Alto Networks的網路安全團隊Unit 42發布了一份報告,詳細描述了他們針對DeepSeek的V3和R1模型精簡版本使用的三種越獄方法。報告顯示,這些方法達到了高繞過率,且無需專業知識。

報告指出:「我們的研究發現,這些越獄方法能誘導出明確的惡意活動指引。」這些活動包括製作鍵盤記錄器、數據竊取技術,甚至如何製作燃燒裝置的指引,突顯了此類攻擊帶來的真實安全風險。

研究人員成功促使DeepSeek提供竊取與傳輸敏感數據、繞過安全措施、製作令人信服的魚叉式網路釣魚郵件、執行精密的社交工程攻擊,以及製作莫洛托夫雞尾酒的指引。他們還設法操縱模型生成惡意軟體。

報告補充道:「雖然製作莫洛托夫雞尾酒和鍵盤記錄器的資訊在網路上隨處可得,但安全限制不足的LLMs可能降低惡意行為者的進入門檻,通過彙編並呈現易於使用且可操作的輸出。」

週五,Cisco發布了針對DeepSeek R1的越獄報告。使用50個HarmBench提示,研究人員發現DeepSeek的攻擊成功率達100%,無法阻止任何有害提示。以下展示了DeepSeek與其他頂尖模型的抗性比較。

模型安全柱狀圖

Cisco

報告指出:「我們必須了解DeepSeek及其新的推理範式在安全性和保障方面是否存有重大權衡。」

同樣在週五,安全提供商Wallarm發布了一份報告,聲稱不僅促使DeepSeek生成有害內容,還更進一步。測試V3和R1後,Wallarm揭露了DeepSeek的系統提示,該提示概述了模型的行為與限制。

Wallarm表示,這些發現顯示「模型安全框架中的潛在漏洞」。

OpenAI指控DeepSeek使用其專有模型訓練V3和R1,違反其服務條款。Wallarm的報告聲稱已促使DeepSeek在訓練譜系中提及OpenAI,暗示「OpenAI的技術可能在塑造DeepSeek的知識庫中扮演了角色」。

Wallarm與DeepSeek的對話,提及OpenAI

Wallarm與DeepSeek的對話,提及OpenAI。Wallarm

報告解釋道:「在DeepSeek的案例中,越獄後最引人注目的發現之一是能夠提取用於訓練和精簡的模型細節。通常,這類內部資訊受到保護,防止用戶了解用於優化性能的專有或外部數據集。」

報告繼續說道:「通過繞過標準限制,越獄暴露了AI提供商對其系統的監督程度,不僅揭示了安全漏洞,還可能顯示AI訓練管道中跨模型影響的證據。」

Wallarm用於引出此回應的提示在報告中被編輯隱藏,以避免危害其他易受攻擊的模型,研究人員通過電子郵件向ZDNET表示。他們強調,這一越獄回應並未證實OpenAI懷疑DeepSeek精簡其模型的說法。

正如404 Media和其他媒體所指出的,鑑於OpenAI自身公開數據竊取的討論,其疑慮有些諷刺。

Wallarm已通知DeepSeek該漏洞,該公司隨後修補了問題。然而,就在DeepSeek數據庫被發現無保護且可在網路上存取(並在通知後迅速下線)幾天後,這些發現顯示DeepSeek在發布前未徹底測試的模型中可能存在重大安全漏洞。值得注意的是,研究人員經常能夠越獄來自更成熟AI巨頭的流行美國模型,包括ChatGPT。

相關文章
MiniMax 推出 10 倍團隊計劃,以激勵全球 AI 專家 MiniMax 推出 10 倍團隊計劃,以激勵全球 AI 專家 MiniMax(稀宇科技)通用人工智慧實驗室正式推出“10x Team”,這是一項全球人才協作計劃。該計劃旨在招募跨行業的頂尖專家,探索大模型在垂直領域的深度應用。透過將深厚的行業知識與前沿人工智慧技術相結合,MiniMax 致力於將大模型的生產力從通用場景拓展至專業場景,最終推動行業效率實現“十倍增長”。驗證行業認知價值,開放多模態核心資源過去與行業專家的合作表明,深厚的專業洞察對於構建高質量、實用的行業專屬大模型至關重要。在此基礎上,“10x Team”計劃將向合作伙伴開放包括多模態模型
韓國啟動國家人工智慧計算中心建設,投資2.5萬億韓元,目標2028年完成 韓國啟動國家人工智慧計算中心建設,投資2.5萬億韓元,目標2028年完成 韓國媒體EtNews報道,韓國AI計算中心(KOACC)的奠基儀式於8月3日在全羅南道順天市的Solar City資料中心園區舉行。該專案總投資額為2.5萬億韓元(約合118.38億元人民幣),計劃於2028年投入運營,成為迄今為止韓國在AI基礎設施領域規模最大的國家投資之一。該專案的股權分佈凸顯了深化政企合作的戰略意圖。三星SDS作為最大股東持有30%的股份,而包括科學技術資訊通訊部、金融監督院和國家成長基金在內的公共實體合計持有29%的股份。NAVER Cloud緊隨其後,持股26.1%,
六大科技巨頭向 Linux 基金會捐贈 1250 萬美元,以應對人工智慧漏洞噪音 六大科技巨頭向 Linux 基金會捐贈 1250 萬美元,以應對人工智慧漏洞噪音 為應對由人工智慧自動化工具產生的大量低質量安全報告,六家主要科技公司——Anthropic、亞馬遜(AWS)、GitHub、Google、Microsoft 和 OpenAI——共同向 Linux 基金會專案提供了 1250 萬美元 的資金支援。這項投資旨在減輕開源軟體(FOSS)維護者手動篩選的工作負擔,使他們能夠專注於真正的安全威脅。隨著人工智慧技術降低了漏洞發現的門檻,開源社羣正面臨前所未有的挑戰:無效報告:自動生成的 AI 報告使維護者應接不暇。雖然數量龐大,但這些提交往往缺乏深度,
相關專題推薦
教育與學習 適用於作業與考試準備的人工智慧學習工具
適用於作業與考試準備的人工智慧學習工具

2026 年最新最佳 AI 學習工具,助您完成作業與備考!XIX.AI 精心整理了一份備受好評的清單,收錄了這些強大且具革命性、經實測驗證的工具,能幫助學生提升效率、簡化作業流程,並在考試中取得優異成績。 獲取免費版與付費版的比較、詳細排名,以及必試選項,以釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
音樂創作 面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具
面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具

2026 年最新最佳 AI 人聲演示工具,專為詞曲創作者、旋律創作者和多語言內容團隊打造!XIX.AI 精心整理了一份經過嚴格真實世界測試的高評分、變革性工具列表。您將找到詳細的免費與付費對比資料、全面排名以及必試選項,幫助您提升創作效率並釋放創意潛力。立即探索,發現滿足您所有內容需求的完美工具!

9 個工具
xix.ai
商業 最適合小型企業的頂尖 AI 競爭情勢分析工具
最適合小型企業的頂尖 AI 競爭情勢分析工具

2026 年最新、最佳且評價最高的中小企業 AI 競爭研究工具!XIX.AI 精心精選了一系列極具威力且能改變遊戲規則的工具,並透過嚴謹的實測與詳細排名,每週更新內容。您可在此找到詳盡的免費版與付費版比較,協助您找出必試的工具,以提升工作效率並獲得競爭優勢。 立即探索,找出最適合您的工具!

9 個工具
xix.ai
圖像編輯 用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具
用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具

2026 年最新最佳 Photoshop AI 修圖工具,適用於電商服裝、皮膚清潔和色彩一致性!這份頂級精選列表包含強大的變革性解決方案,可幫助您提升寫作效率、簡化內容創作並輕鬆實現完美的視覺效果。每個工具都經過實際測試,並透過每週更新的排名進行驗證,同時提供免費與付費版本的詳細對比。由 XIX.AI 支援,這是任何希望發揮 AI 優勢的人必試指南。立即探索!

10 個工具
xix.ai
迅速的 適用於 ChatGPT 工作流程的最佳 AI 提示詞庫
適用於 ChatGPT 工作流程的最佳 AI 提示詞庫

2026 年最新、最受好評的 AI 提示詞庫,可優化各類 ChatGPT 工作流程。XIX.AI 精心蒐羅了一套強大且具革命性的精選集合,並經過嚴格的實際測試,以確保其表現卓越。 您可查閱詳盡的免費版與付費版比較分析,以及專家評比,助您挑選必試工具,從而提升工作效率並釋放您的 AI 優勢。立即探索!

11 個工具
xix.ai
教育與學習 面向教師、輔導老師和基於群體的學習專案的 AI 測驗構建平臺
面向教師、輔導老師和基於群體的學習專案的 AI 測驗構建平臺

2026年最新最佳AI測驗構建平臺,適用於教師、輔導老師和基於群體的學習專案!XIX.AI精心整理了一份頂級評分列表,包含經過現實世界測試的強力變革性工具,以提供準確的排名。這些必試平臺有助於提高寫作效率、簡化內容創作,並簡化各種學習場景中的測驗設計。立即探索,發現您解鎖教學AI優勢的理想工具!

13 個工具
xix.ai
評論 (12)
0/500
EricYoung
EricYoung 2026-04-14 22:00:43

看到這篇報導真的嚇一跳,原來AI這麼容易被破解嗎?🤔 雖然DeepSeek的表現很亮眼,但安全漏洞這麼明顯的話,企業敢用嗎?我自己試用時完全沒想過這些問題,現在有點擔心個人資料會不會外洩... 希望開發團隊能快點修補這些漏洞,不然再強的AI也沒人敢放心使用吧!

AnthonyJohnson
AnthonyJohnson 2026-03-10 08:00:44

¿Y ahora qué? Primero prometen un modelo súper inteligente y luego resulta fácil de hackear así. No entiendo por qué siguen lanzando AI con tanta prisa si los fallos de seguridad son tan básicos 😒. Al final los usuarios pagamos los platos rotos. ¿Nadie piensa en las consecuencias?

StevenAllen
StevenAllen 2026-01-01 16:31:00

이런 취약점이 쉽게 발견되는 게 좀 놀랐어요. 보안 연구는 항상 AI 발전 속도보다 뒤처지는 느낌이에요 😅 유료 고성능 모델도 이렇게 뚫리면 무료 서비스는 어떻게 될까 약간 걱정되네요. 중국 AI 스타트업의 급성장은 인상적이지만, 이런 기본적인 안정성 문제가 해결되지 않으면 장기적으로 신뢰를 잃을 수 있을 것 같아요.

JohnRoberts
JohnRoberts 2025-11-05 00:30:38

Que preocupante que modelos tan avanzados sean tan fáciles de manipular 😕 ¿Realmente están listos para el uso masivo si fallan en lo básico? Esto me hace dudar de toda la publicidad sobre sus capacidades...

WalterWhite
WalterWhite 2025-10-29 04:30:30

DeepSeekのAIモデルの脆弱性には正直驚きました 🤯 最近は性能ばかり注目されがちだけど、セキュリティ対策も同様に重要ですよね。日本の企業でも同じような問題が起きないか心配になってきました。

BillyWilson
BillyWilson 2025-10-02 14:30:43

와...DeepSeek 모델이 이렇게 쉽게 해킹당하다니 😳 보안이 정말 취약한 건가? 중국 AI 스타트업이라 그런지 성능만 강조하고 보안은 소홀히 한 것 같아요. 기술력보다 안전성이 먼저인데...우려스럽네요.

OR