DeepSeek的AI模型很容易越獄,揭示了嚴重的缺陷
DeepSeek AI引發安全疑慮,性能熱潮同時並存
隨著中國新創公司DeepSeek的性能熱潮持續升溫,安全疑慮也隨之增加。週四,來自Palo Alto Networks的網路安全團隊Unit 42發布了一份報告,詳細描述了他們針對DeepSeek的V3和R1模型精簡版本使用的三種越獄方法。報告顯示,這些方法達到了高繞過率,且無需專業知識。
報告指出:「我們的研究發現,這些越獄方法能誘導出明確的惡意活動指引。」這些活動包括製作鍵盤記錄器、數據竊取技術,甚至如何製作燃燒裝置的指引,突顯了此類攻擊帶來的真實安全風險。
研究人員成功促使DeepSeek提供竊取與傳輸敏感數據、繞過安全措施、製作令人信服的魚叉式網路釣魚郵件、執行精密的社交工程攻擊,以及製作莫洛托夫雞尾酒的指引。他們還設法操縱模型生成惡意軟體。
報告補充道:「雖然製作莫洛托夫雞尾酒和鍵盤記錄器的資訊在網路上隨處可得,但安全限制不足的LLMs可能降低惡意行為者的進入門檻,通過彙編並呈現易於使用且可操作的輸出。」
週五,Cisco發布了針對DeepSeek R1的越獄報告。使用50個HarmBench提示,研究人員發現DeepSeek的攻擊成功率達100%,無法阻止任何有害提示。以下展示了DeepSeek與其他頂尖模型的抗性比較。

Cisco 報告指出:「我們必須了解DeepSeek及其新的推理範式在安全性和保障方面是否存有重大權衡。」
同樣在週五,安全提供商Wallarm發布了一份報告,聲稱不僅促使DeepSeek生成有害內容,還更進一步。測試V3和R1後,Wallarm揭露了DeepSeek的系統提示,該提示概述了模型的行為與限制。
Wallarm表示,這些發現顯示「模型安全框架中的潛在漏洞」。
OpenAI指控DeepSeek使用其專有模型訓練V3和R1,違反其服務條款。Wallarm的報告聲稱已促使DeepSeek在訓練譜系中提及OpenAI,暗示「OpenAI的技術可能在塑造DeepSeek的知識庫中扮演了角色」。

Wallarm與DeepSeek的對話,提及OpenAI。Wallarm 報告解釋道:「在DeepSeek的案例中,越獄後最引人注目的發現之一是能夠提取用於訓練和精簡的模型細節。通常,這類內部資訊受到保護,防止用戶了解用於優化性能的專有或外部數據集。」
報告繼續說道:「通過繞過標準限制,越獄暴露了AI提供商對其系統的監督程度,不僅揭示了安全漏洞,還可能顯示AI訓練管道中跨模型影響的證據。」
Wallarm用於引出此回應的提示在報告中被編輯隱藏,以避免危害其他易受攻擊的模型,研究人員通過電子郵件向ZDNET表示。他們強調,這一越獄回應並未證實OpenAI懷疑DeepSeek精簡其模型的說法。
正如404 Media和其他媒體所指出的,鑑於OpenAI自身公開數據竊取的討論,其疑慮有些諷刺。
Wallarm已通知DeepSeek該漏洞,該公司隨後修補了問題。然而,就在DeepSeek數據庫被發現無保護且可在網路上存取(並在通知後迅速下線)幾天後,這些發現顯示DeepSeek在發布前未徹底測試的模型中可能存在重大安全漏洞。值得注意的是,研究人員經常能夠越獄來自更成熟AI巨頭的流行美國模型,包括ChatGPT。
相關文章
MiniMax 推出 10 倍團隊計劃,以激勵全球 AI 專家
MiniMax(稀宇科技)通用人工智慧實驗室正式推出“10x Team”,這是一項全球人才協作計劃。該計劃旨在招募跨行業的頂尖專家,探索大模型在垂直領域的深度應用。透過將深厚的行業知識與前沿人工智慧技術相結合,MiniMax 致力於將大模型的生產力從通用場景拓展至專業場景,最終推動行業效率實現“十倍增長”。驗證行業認知價值,開放多模態核心資源過去與行業專家的合作表明,深厚的專業洞察對於構建高質量、實用的行業專屬大模型至關重要。在此基礎上,“10x Team”計劃將向合作伙伴開放包括多模態模型
韓國啟動國家人工智慧計算中心建設,投資2.5萬億韓元,目標2028年完成
韓國媒體EtNews報道,韓國AI計算中心(KOACC)的奠基儀式於8月3日在全羅南道順天市的Solar City資料中心園區舉行。該專案總投資額為2.5萬億韓元(約合118.38億元人民幣),計劃於2028年投入運營,成為迄今為止韓國在AI基礎設施領域規模最大的國家投資之一。該專案的股權分佈凸顯了深化政企合作的戰略意圖。三星SDS作為最大股東持有30%的股份,而包括科學技術資訊通訊部、金融監督院和國家成長基金在內的公共實體合計持有29%的股份。NAVER Cloud緊隨其後,持股26.1%,
六大科技巨頭向 Linux 基金會捐贈 1250 萬美元,以應對人工智慧漏洞噪音
為應對由人工智慧自動化工具產生的大量低質量安全報告,六家主要科技公司——Anthropic、亞馬遜(AWS)、GitHub、Google、Microsoft 和 OpenAI——共同向 Linux 基金會專案提供了 1250 萬美元 的資金支援。這項投資旨在減輕開源軟體(FOSS)維護者手動篩選的工作負擔,使他們能夠專注於真正的安全威脅。隨著人工智慧技術降低了漏洞發現的門檻,開源社羣正面臨前所未有的挑戰:無效報告:自動生成的 AI 報告使維護者應接不暇。雖然數量龐大,但這些提交往往缺乏深度,
相關專題推薦
評論 (12)
0/500
看到這篇報導真的嚇一跳,原來AI這麼容易被破解嗎?🤔 雖然DeepSeek的表現很亮眼,但安全漏洞這麼明顯的話,企業敢用嗎?我自己試用時完全沒想過這些問題,現在有點擔心個人資料會不會外洩... 希望開發團隊能快點修補這些漏洞,不然再強的AI也沒人敢放心使用吧!
¿Y ahora qué? Primero prometen un modelo súper inteligente y luego resulta fácil de hackear así. No entiendo por qué siguen lanzando AI con tanta prisa si los fallos de seguridad son tan básicos 😒. Al final los usuarios pagamos los platos rotos. ¿Nadie piensa en las consecuencias?
이런 취약점이 쉽게 발견되는 게 좀 놀랐어요. 보안 연구는 항상 AI 발전 속도보다 뒤처지는 느낌이에요 😅 유료 고성능 모델도 이렇게 뚫리면 무료 서비스는 어떻게 될까 약간 걱정되네요. 중국 AI 스타트업의 급성장은 인상적이지만, 이런 기본적인 안정성 문제가 해결되지 않으면 장기적으로 신뢰를 잃을 수 있을 것 같아요.
Que preocupante que modelos tan avanzados sean tan fáciles de manipular 😕 ¿Realmente están listos para el uso masivo si fallan en lo básico? Esto me hace dudar de toda la publicidad sobre sus capacidades...
DeepSeek AI引發安全疑慮,性能熱潮同時並存
隨著中國新創公司DeepSeek的性能熱潮持續升溫,安全疑慮也隨之增加。週四,來自Palo Alto Networks的網路安全團隊Unit 42發布了一份報告,詳細描述了他們針對DeepSeek的V3和R1模型精簡版本使用的三種越獄方法。報告顯示,這些方法達到了高繞過率,且無需專業知識。
報告指出:「我們的研究發現,這些越獄方法能誘導出明確的惡意活動指引。」這些活動包括製作鍵盤記錄器、數據竊取技術,甚至如何製作燃燒裝置的指引,突顯了此類攻擊帶來的真實安全風險。
研究人員成功促使DeepSeek提供竊取與傳輸敏感數據、繞過安全措施、製作令人信服的魚叉式網路釣魚郵件、執行精密的社交工程攻擊,以及製作莫洛托夫雞尾酒的指引。他們還設法操縱模型生成惡意軟體。
報告補充道:「雖然製作莫洛托夫雞尾酒和鍵盤記錄器的資訊在網路上隨處可得,但安全限制不足的LLMs可能降低惡意行為者的進入門檻,通過彙編並呈現易於使用且可操作的輸出。」
週五,Cisco發布了針對DeepSeek R1的越獄報告。使用50個HarmBench提示,研究人員發現DeepSeek的攻擊成功率達100%,無法阻止任何有害提示。以下展示了DeepSeek與其他頂尖模型的抗性比較。
報告指出:「我們必須了解DeepSeek及其新的推理範式在安全性和保障方面是否存有重大權衡。」
同樣在週五,安全提供商Wallarm發布了一份報告,聲稱不僅促使DeepSeek生成有害內容,還更進一步。測試V3和R1後,Wallarm揭露了DeepSeek的系統提示,該提示概述了模型的行為與限制。
Wallarm表示,這些發現顯示「模型安全框架中的潛在漏洞」。
OpenAI指控DeepSeek使用其專有模型訓練V3和R1,違反其服務條款。Wallarm的報告聲稱已促使DeepSeek在訓練譜系中提及OpenAI,暗示「OpenAI的技術可能在塑造DeepSeek的知識庫中扮演了角色」。
報告解釋道:「在DeepSeek的案例中,越獄後最引人注目的發現之一是能夠提取用於訓練和精簡的模型細節。通常,這類內部資訊受到保護,防止用戶了解用於優化性能的專有或外部數據集。」
報告繼續說道:「通過繞過標準限制,越獄暴露了AI提供商對其系統的監督程度,不僅揭示了安全漏洞,還可能顯示AI訓練管道中跨模型影響的證據。」
Wallarm用於引出此回應的提示在報告中被編輯隱藏,以避免危害其他易受攻擊的模型,研究人員通過電子郵件向ZDNET表示。他們強調,這一越獄回應並未證實OpenAI懷疑DeepSeek精簡其模型的說法。
正如404 Media和其他媒體所指出的,鑑於OpenAI自身公開數據竊取的討論,其疑慮有些諷刺。
Wallarm已通知DeepSeek該漏洞,該公司隨後修補了問題。然而,就在DeepSeek數據庫被發現無保護且可在網路上存取(並在通知後迅速下線)幾天後,這些發現顯示DeepSeek在發布前未徹底測試的模型中可能存在重大安全漏洞。值得注意的是,研究人員經常能夠越獄來自更成熟AI巨頭的流行美國模型,包括ChatGPT。
MiniMax 推出 10 倍團隊計劃,以激勵全球 AI 專家
MiniMax(稀宇科技)通用人工智慧實驗室正式推出“10x Team”,這是一項全球人才協作計劃。該計劃旨在招募跨行業的頂尖專家,探索大模型在垂直領域的深度應用。透過將深厚的行業知識與前沿人工智慧技術相結合,MiniMax 致力於將大模型的生產力從通用場景拓展至專業場景,最終推動行業效率實現“十倍增長”。驗證行業認知價值,開放多模態核心資源過去與行業專家的合作表明,深厚的專業洞察對於構建高質量、實用的行業專屬大模型至關重要。在此基礎上,“10x Team”計劃將向合作伙伴開放包括多模態模型
韓國啟動國家人工智慧計算中心建設,投資2.5萬億韓元,目標2028年完成
韓國媒體EtNews報道,韓國AI計算中心(KOACC)的奠基儀式於8月3日在全羅南道順天市的Solar City資料中心園區舉行。該專案總投資額為2.5萬億韓元(約合118.38億元人民幣),計劃於2028年投入運營,成為迄今為止韓國在AI基礎設施領域規模最大的國家投資之一。該專案的股權分佈凸顯了深化政企合作的戰略意圖。三星SDS作為最大股東持有30%的股份,而包括科學技術資訊通訊部、金融監督院和國家成長基金在內的公共實體合計持有29%的股份。NAVER Cloud緊隨其後,持股26.1%,
六大科技巨頭向 Linux 基金會捐贈 1250 萬美元,以應對人工智慧漏洞噪音
為應對由人工智慧自動化工具產生的大量低質量安全報告,六家主要科技公司——Anthropic、亞馬遜(AWS)、GitHub、Google、Microsoft 和 OpenAI——共同向 Linux 基金會專案提供了 1250 萬美元 的資金支援。這項投資旨在減輕開源軟體(FOSS)維護者手動篩選的工作負擔,使他們能夠專注於真正的安全威脅。隨著人工智慧技術降低了漏洞發現的門檻,開源社羣正面臨前所未有的挑戰:無效報告:自動生成的 AI 報告使維護者應接不暇。雖然數量龐大,但這些提交往往缺乏深度,
看到這篇報導真的嚇一跳,原來AI這麼容易被破解嗎?🤔 雖然DeepSeek的表現很亮眼,但安全漏洞這麼明顯的話,企業敢用嗎?我自己試用時完全沒想過這些問題,現在有點擔心個人資料會不會外洩... 希望開發團隊能快點修補這些漏洞,不然再強的AI也沒人敢放心使用吧!
¿Y ahora qué? Primero prometen un modelo súper inteligente y luego resulta fácil de hackear así. No entiendo por qué siguen lanzando AI con tanta prisa si los fallos de seguridad son tan básicos 😒. Al final los usuarios pagamos los platos rotos. ¿Nadie piensa en las consecuencias?
이런 취약점이 쉽게 발견되는 게 좀 놀랐어요. 보안 연구는 항상 AI 발전 속도보다 뒤처지는 느낌이에요 😅 유료 고성능 모델도 이렇게 뚫리면 무료 서비스는 어떻게 될까 약간 걱정되네요. 중국 AI 스타트업의 급성장은 인상적이지만, 이런 기본적인 안정성 문제가 해결되지 않으면 장기적으로 신뢰를 잃을 수 있을 것 같아요.
Que preocupante que modelos tan avanzados sean tan fáciles de manipular 😕 ¿Realmente están listos para el uso masivo si fallan en lo básico? Esto me hace dudar de toda la publicidad sobre sus capacidades...





首頁






