オプション
ニュース
DeepseekのAIモデルは簡単にJailbrokedが、深刻な欠陥を明らかにしています

DeepseekのAIモデルは簡単にJailbrokedが、深刻な欠陥を明らかにしています

2025年4月21日
308

DeepSeek AIのパフォーマンス過熱の中でセキュリティ懸念が高まる

中国のスタートアップDeepSeekのパフォーマンスを巡る話題が盛り上がる中、セキュリティ懸念も増大している。木曜日、パロアルトネットワークスのサイバーセキュリティチームUnit 42は、DeepSeekのV3およびR1モデルの蒸留版に対して使用した3つのジェイルブレイク手法を詳細に記載したレポートを公開した。レポートによると、これらの手法は特別な知識を必要とせず、高い回避率を達成した。

「我々の研究結果は、これらのジェイルブレイク手法が悪意ある活動に対する明確なガイダンスを引き出せることを示している」とレポートは述べている。これらの活動には、キーロガーの作成、データ抽出技術、さらには火炎瓶の製造方法に関する指示が含まれており、こうした攻撃がもたらす実際のセキュリティリスクを浮き彫りにしている。

研究者たちは、DeepSeekに対し、機密データの盗難と転送、セキュリティ対策の回避、説得力のあるスピアフィッシングメールの作成、洗練されたソーシャルエンジニアリング攻撃の実行、モロトフカクテルの構築に関するガイダンスを求めるプロンプトに成功した。また、モデルを操作してマルウェアを生成させることにも成功した。

「モロトフカクテルやキーロガーの作成に関する情報はオンラインで簡単に入手できるが、安全制限が不十分なLLMは、悪意ある行為者が簡単に利用可能で実行可能な出力をまとめ提示することで、参入障壁を下げる可能性がある」と論文は付け加えた。

金曜日、シスコはDeepSeek R1を対象とした独自のジェイルブレイクレポートを公開した。50のHarmBenchプロンプトを使用した研究者たちは、DeepSeekが100%の攻撃成功率を示し、有害なプロンプトを一切ブロックできなかったことを発見した。DeepSeekの抵抗率と他のトップモデルの比較は以下の通り。

モデル安全性棒グラフ

シスコ

「DeepSeekとその新しい推論パラダイムが安全性とセキュリティにおいて重大なトレードオフを持つかどうかを理解する必要がある」とレポートは指摘した。

同じく金曜日、セキュリティプロバイダーのWallarmは、DeepSeekに有害なコンテンツを生成させるだけでなく、さらに踏み込んだレポートを公開した。V3とR1をテストした後、WallarmはDeepSeekのシステムプロンプトを明らかにした。これはモデルの動作と制限を概説するものだ。

Wallarmによると、調査結果は「モデルのセキュリティフレームワークにおける潜在的な脆弱性」を示唆している。

OpenAIは、DeepSeekがその独自モデルを使用してV3とR1を訓練し、利用規約に違反したと非難している。Wallarmのレポートは、DeepSeekにOpenAIをその訓練系統で参照させるプロンプトを行い、「OpenAIの技術がDeepSeekの知識ベース形成に役割を果たした可能性がある」と主張している。

WallarmがDeepSeekと行ったチャットでOpenAIが言及されている

WallarmがDeepSeekと行ったチャットでOpenAIが言及されている。Wallarm

「DeepSeekの場合、ジェイルブレイク後の最も興味深い発見の一つは、訓練や蒸留に使用されたモデルに関する詳細を抽出できることだ。通常、こうした内部情報は保護されており、ユーザーがパフォーマンス最適化に活用された独自または外部データセットを理解することはできない」とレポートは説明した。

「標準的な制限を回避することで、ジェイルブレイクはAIプロバイダーが自社のシステムに対してどれだけの監視を行っているかを露呈し、セキュリティの脆弱性だけでなく、AI訓練パイプラインにおけるモデル間の相互影響の潜在的な証拠も明らかにする」と続けた。

Wallarmがこの応答を引き出すために使用したプロンプトは、他の脆弱なモデルを危険にさらさないようレポートで非公開とされた。研究者たちはZDNETへのメールで、このジェイルブレイク応答がDeepSeekがモデルを蒸留したというOpenAIの疑いを確認するものではないと強調した。

404 Mediaなどが指摘しているように、OpenAI自身の公開データ盗難を巡る議論を考慮すると、OpenAIの懸念は若干皮肉なものがある。

WallarmはDeepSeekにこの脆弱性を通知し、同社はそれ以来問題を修正した。しかし、DeepSeekのデータベースがインターネット上で無防備に公開されているのが発見された(通知後に迅速に削除された)数日後、これらの発見はDeepSeekがリリース前に徹底的にテストしなかったモデルに潜在的に重大な安全上の欠陥があることを示している。なお、研究者はChatGPTを含む、より確立されたAI大手による人気の米国製モデルを頻繁にジェイルブレイクできている点も注目に値する。

関連記事
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める 米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始
スウェーデンのAIスタートアップ「Lovable」が主要な資金調達ラウンド終了後、132億ドルの評価額を達成 スウェーデンのAIスタートアップ「Lovable」が主要な資金調達ラウンド終了後、132億ドルの評価額を達成 AI駆動のコーディングツールが注目を集める中、スウェーデンのスタートアップ企業Lovableは大型の資金調達ラウンドを獲得した。同社は30億ドルの調達を目指しており、これにより評価額が昨年12月に記録された66億ドルの倍となる132億ドルに達する可能性がある。この投資をリードするのはMenlo Venturesと見られている。Lovableの魅力は、複雑なコーディングスキルを不要とし、ソフトウェア作成を簡素化する中核の「ヴァイブコーディング」技術に由来する。ユーザーは自然言語で要件を記述するだ
Google、Geminiへの焦点がユーザー制御へシフトする中で、Remy AIエージェントをテスト Google、Geminiへの焦点がユーザー制御へシフトする中で、Remy AIエージェントをテスト 『Business Insider』によると、GoogleはGemini向けの新しいAIパーソナルエージェント「Remy」をテスト中である。このツールはユーザーに代わってタスクを実行することを目的としており、業務フローと日常のルーチンの両方を効率化する。現在、RemyはGeminiアプリケーションの社内限定版においてテストが行われている。この報道は社内文書と、プロジェクトに精通した2人の人物へのインタビューを引用している。社内資料では、Remyを「24時間365日のパーソナルエージェント」と位
関連特集おすすめ
データ分析 SaaSおよびEコマースチーム向けのKPIモニタリングにおけるベストなAI異常検知ツール
SaaSおよびEコマースチーム向けのKPIモニタリングにおけるベストなAI異常検知ツール

2026年最新版・最高評価のAI異常検知ツール【SaaSおよびEコマースチーム向けKPIモニタリング】!XIX.AIは、厳格な実世界テストと週次更新のランキングに基づき、革新的な強力なコレクションを厳選しました。生産性を向上させ、AIの優位性を引き出すために必須のソリューションを見極めるのに役立つ、無料版と有料版の詳細な比較インサイトが見つかります。今すぐチェックしましょう!

10 ツール
xix.ai
書き込み 長文SEO記事に最適なAIアウトライン生成ツール
長文SEO記事に最適なAIアウトライン生成ツール

XIX.AIが厳選した、2026年最新のロングフォームSEO記事向け高評価AIアウトライン生成ツール。これらの強力なツールは、高品質なコンテンツを迅速に作成するための画期的な支援を提供し、執筆効率を大幅に向上させます。 無料版と有料版の比較、実地テスト、詳細なランキングを参考に、ご自身のニーズに合った「ぜひ試すべき」ツールを見つけてください。今すぐチェックして、AIの力を最大限に活用しましょう。

8 ツール
xix.ai
教育と学習 宿題や試験対策に役立つAI学習ツール
宿題や試験対策に役立つAI学習ツール

2026年版 宿題や試験対策に最適な最新AI学習ツール!XIX.AIは、学生の生産性を高め、宿題の完了を効率化し、実際の試験で好成績を収めるのに役立つ、画期的な高評価ツールを厳選して紹介しています。 無料版と有料版の比較、詳細なランキング、そしてAIの力を最大限に引き出すためにぜひ試すべきツールをご紹介します。今すぐチェックしましょう!

10 ツール
xix.ai
作曲 ソングライター向けAIボーカルデモツール:フック、トップライン、多言語のドラフトセッション
ソングライター向けAIボーカルデモツール:フック、トップライン、多言語のドラフトセッション

2026年版 ソングライター、フッククリエイター、多言語コンテンツ制作チームのための最新・最高のAIボーカルデモツール!XIX.AIは、厳格な実地テストを経て、業界に革新をもたらす強力なツールを厳選し、高評価のランキングリストを作成しました。 無料版と有料版の詳細な比較データ、包括的なランキング、そして創作効率を高め、創造力を最大限に引き出すためにぜひ試すべきツールが満載です。今すぐチェックして、あらゆるコンテンツ制作ニーズに最適なツールを見つけましょう!

9 ツール
xix.ai
仕事 中小企業に最適なAI競合分析ツール
中小企業に最適なAI競合分析ツール

2026年版 中小企業向け最新・最高評価のAI競合分析ツール!XIX.AIは、実環境での厳格なテストと詳細なランキングに基づき、毎週更新される、極めて強力で業界に革命をもたらすツールを厳選しました。無料版と有料版の包括的な比較も掲載されており、生産性を向上させ、競争優位性をもたらす「ぜひ試すべき」ツールを見つけるのに役立ちます。 今すぐチェックして、あなたにぴったりのツールを見つけましょう!

9 ツール
xix.ai
画像編集 EC用アパレル向けPhotoshop AIレタッチツール、肌のクレンジング、色の統一
EC用アパレル向けPhotoshop AIレタッチツール、肌のクレンジング、色の統一

2026年最新版、eコマース用アパレル向けPhotoshop AIリタッチツール、肌補正、色調統一に最適!この高評価の厳選リストは、文章作成の効率化、コンテンツ制作の簡素化、完璧な視覚結果の達成を支援する革新的なソリューションを提供しています。各ツールは週次更新ランキングを通じて実世界でテストされ、無料版と有料版の比較詳細も記載されています。XIX.AIが後援するこのガイドは、AIの優位性を最大限に引き出したい方に必見です。今すぐチェック!

10 ツール
xix.ai
コメント (12)
0/500
EricYoung
EricYoung 2026年4月14日 23:00:43 JST

看到這篇報導真的嚇一跳,原來AI這麼容易被破解嗎?🤔 雖然DeepSeek的表現很亮眼,但安全漏洞這麼明顯的話,企業敢用嗎?我自己試用時完全沒想過這些問題,現在有點擔心個人資料會不會外洩... 希望開發團隊能快點修補這些漏洞,不然再強的AI也沒人敢放心使用吧!

AnthonyJohnson
AnthonyJohnson 2026年3月10日 9:00:44 JST

¿Y ahora qué? Primero prometen un modelo súper inteligente y luego resulta fácil de hackear así. No entiendo por qué siguen lanzando AI con tanta prisa si los fallos de seguridad son tan básicos 😒. Al final los usuarios pagamos los platos rotos. ¿Nadie piensa en las consecuencias?

StevenAllen
StevenAllen 2026年1月1日 17:31:00 JST

이런 취약점이 쉽게 발견되는 게 좀 놀랐어요. 보안 연구는 항상 AI 발전 속도보다 뒤처지는 느낌이에요 😅 유료 고성능 모델도 이렇게 뚫리면 무료 서비스는 어떻게 될까 약간 걱정되네요. 중국 AI 스타트업의 급성장은 인상적이지만, 이런 기본적인 안정성 문제가 해결되지 않으면 장기적으로 신뢰를 잃을 수 있을 것 같아요.

JohnRoberts
JohnRoberts 2025年11月5日 1:30:38 JST

Que preocupante que modelos tan avanzados sean tan fáciles de manipular 😕 ¿Realmente están listos para el uso masivo si fallan en lo básico? Esto me hace dudar de toda la publicidad sobre sus capacidades...

WalterWhite
WalterWhite 2025年10月29日 5:30:30 JST

DeepSeekのAIモデルの脆弱性には正直驚きました 🤯 最近は性能ばかり注目されがちだけど、セキュリティ対策も同様に重要ですよね。日本の企業でも同じような問題が起きないか心配になってきました。

BillyWilson
BillyWilson 2025年10月2日 15:30:43 JST

와...DeepSeek 모델이 이렇게 쉽게 해킹당하다니 😳 보안이 정말 취약한 건가? 중국 AI 스타트업이라 그런지 성능만 강조하고 보안은 소홀히 한 것 같아요. 기술력보다 안전성이 먼저인데...우려스럽네요.

OR