選項
首頁
新聞
AI 模型的記憶資料在 CAMIA 隱私外洩事件中曝光

AI 模型的記憶資料在 CAMIA 隱私外洩事件中曝光

2025-11-13
179

一項突破性的全新隱私權攻擊透過偵測個人資料是否被用於訓練 AI 系統來揭露漏洞。

由 Brave 與新加坡國立大學研究人員共同開發的 CAMIA (Context-Aware Membership Inference Attack,情境感知成員推理攻擊) 在分析 AI 模型記憶體方面顯著優於之前的方法。

AI 產業面臨越來越多有關「資料記憶化」的疑慮,模型會在無意間保留敏感的訓練資訊。醫療保健 AI 可能會洩露病患記錄,而企業訓練的模型則可能會反覆敘述機密電子郵件。

最近的發展,例如 LinkedIn 計劃利用使用者資料進行 AI 訓練,更激化了隱私權的爭論,突顯出敏感資訊出現在生成內容中的潛在風險。

安全專家採用會員推論攻擊 (Membership Inference Attacks, MIAs) 來偵測資料洩漏。這些測試基本上是詢問模型"這個特定範例是您訓練的一部分嗎?成功的攻擊會確認危險的隱私外洩。

其原理源於模型處理熟悉訓練資料的方式與處理新資訊的方式不同 - MIA 系統性地利用這些行為差異。

傳統的 MIA 被證明對現代生成式 AI 無效,因為它們是針對較簡單的分類模型所設計。大型語言模型會依序產生文字,因此整體評估不足以發現洩漏。

CAMIA 的創新意識到 AI 的記憶取決於上下文。當後續回應不確定時,模型最依賴記住的內容。

考慮「哈利波特是......寫的......哈利的世界......"。- 模型可透過上下文線索而非記憶,輕鬆預測「波特」。

但是,如果只給出 "Harry「,預測 」Potter "就需要實際記憶訓練資料。在模棱兩可的情境中,高置信度的預測強烈顯示出已記憶的內容。

CAMIA 代表了第一個專門為生成式 AI 設計的隱私攻擊。它追蹤文字產生過程中的不確定性波動,區分上下文猜測與真正的回憶。

使用 Pythia 和 GPT-Neo 模型在 MIMIR 基準上進行測試,結果令人印象深刻。針對 2.8B 參數的 Pythia 模型,CAMIA 將偵測準確率提高近一倍,同時維持最低的 1% 誤判率。

該攻擊的運作效率很高 - 在 A100 GPU 上處理 1,000 個樣本僅需約 38 分鐘,使其成為實際模型稽核的可行方法。

這項研究強調了在未經審核的資料集上訓練大量模型所固有的隱私風險。該團隊的目標是推廣保護隱私的技術,以平衡 AI 效用與使用者保護。

另請參閱:三星基準企業 AI 模型的實際生產力

在阿姆斯特丹、加利福尼亞和倫敦的 AI & Big Data Expo 上探索 AI 和大數據進展。這項隸屬於 TechEx 的活動可與領先的技術會議一同提供全面的洞察力。

AI News 由 TechForge Media 提供。探索即將舉行的企業技術活動和網路研討會。

相關文章
據報導,員工瀏覽了露骨內容,Meta 因此面臨關於 AI 眼鏡隱私問題的訴訟 據報導,員工瀏覽了露骨內容,Meta 因此面臨關於 AI 眼鏡隱私問題的訴訟 Meta 正因旗下 AI 智慧眼鏡的隱私問題面臨新一波訴訟。根據瑞典報紙的調查,一家總部位於肯亞的分包商員工一直在審查客戶的影像資料。據報導,這些影像包含裸露、性行為以及如廁等敏感內容。Meta聲稱會對影像中的臉部進行模糊處理,但新聞報導援引消息來源指出,此舉並非總是能有效發揮作用。這項調查結果促使英國資訊專員辦公室展開調查。這家科技巨頭如今在美國也面臨法律訴訟。在這份新提交的訴狀中,由公益律師事
OpenAI執行長山姆·阿特曼宣告超級智能時代的來臨 OpenAI執行長山姆·阿特曼宣告超級智能時代的來臨 OpenAI執行長山姆·奧特曼宣佈,人類已邁入人工超級智慧時代,且此進程不可逆轉。「我們已跨越無法回頭的臨界點,升華之路正式展開,」奧特曼表示:「人類正站在創造數位超級智能的門檻上,而迄今為止,這過程竟比想像中更為尋常。」儘管缺乏明顯跡象——街頭尚未遍布機器人,疾病仍未絕跡——但奧特曼所描述的深刻變革已悄然啟動。在諸如其公司等機構中,正研發出能超越人類通用智能的系統。「從重要層面而言,ChatGP
人工智慧熱潮引發網路泡沫時期的泡沫憂慮 人工智慧熱潮引發網路泡沫時期的泡沫憂慮 數十億美元湧入人工智慧領域的投資熱潮,引發一場激烈辯論:該產業是否正走向網路泡沫式的泡沫?投資者正密切關注熱潮是否降溫,或巨額晶片與基礎建設支出未能帶來預期回報的跡象。美銀全球研究近期調查凸顯此種謹慎態度:54%基金經理人認為人工智慧股票已處泡沫期,38%持反對意見。與網路泡沫的相似之處儘管樂觀情緒蔓延,質疑者仍質疑人工智慧的實質影響力,部分人士更直指其為虛張聲勢或即將破裂的泡沫。思科亞太、日本及
相關專題推薦
搜索引擎優化 最適合制定搜尋策略的 AI 搜尋結果頁面(SERP)分析工具
最適合制定搜尋策略的 AI 搜尋結果頁面(SERP)分析工具

XIX.AI 透過嚴格的實際測試及每週更新的排行榜,精選了 2026 年最新、最佳且評價最高的 AI 搜尋結果頁面(SERP)分析工具,以協助制定搜尋策略。這些強大的工具能幫助您發掘隱藏的優化機會、提升內容表現,並在搜尋領域中取得競爭優勢。立即探索最適合您的工具,提升您的搜尋策略。現在就來探索吧!

13 個工具
xix.ai
數據分析 適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具
適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具

2026 年最新最佳頂級評分 AI 異常檢測工具,助力 SaaS 和電商團隊的 KPI 監控!XIX.AI 基於嚴格的真實世界測試和每週更新的排名,精心策劃了一套強大且顛覆性的工具合集。您將找到詳細的免費與付費對比洞察,幫助您識別必須嘗試的解決方案,從而提升生產力並釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
寫作 最適合撰寫長篇 SEO 文章的 AI 大綱生成工具
最適合撰寫長篇 SEO 文章的 AI 大綱生成工具

2026 年最新最佳、評價最高的 AI 大綱生成器,專為長篇 SEO 文章打造,由 XIX.AI 精心精選。這些強大的工具能為快速創作高品質內容提供革命性的協助,大幅提升寫作效率。 透過免費版與付費版的比較、實際測試結果及詳細排名,協助您找出最符合需求且不容錯過的選項。立即探索,釋放您的 AI 優勢。

8 個工具
xix.ai
教育與學習 適用於作業與考試準備的人工智慧學習工具
適用於作業與考試準備的人工智慧學習工具

2026 年最新最佳 AI 學習工具,助您完成作業與備考!XIX.AI 精心整理了一份備受好評的清單,收錄了這些強大且具革命性、經實測驗證的工具,能幫助學生提升效率、簡化作業流程,並在考試中取得優異成績。 獲取免費版與付費版的比較、詳細排名,以及必試選項,以釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
音樂創作 面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具
面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具

2026 年最新最佳 AI 人聲演示工具,專為詞曲創作者、旋律創作者和多語言內容團隊打造!XIX.AI 精心整理了一份經過嚴格真實世界測試的高評分、變革性工具列表。您將找到詳細的免費與付費對比資料、全面排名以及必試選項,幫助您提升創作效率並釋放創意潛力。立即探索,發現滿足您所有內容需求的完美工具!

9 個工具
xix.ai
商業 最適合小型企業的頂尖 AI 競爭情勢分析工具
最適合小型企業的頂尖 AI 競爭情勢分析工具

2026 年最新、最佳且評價最高的中小企業 AI 競爭研究工具!XIX.AI 精心精選了一系列極具威力且能改變遊戲規則的工具,並透過嚴謹的實測與詳細排名,每週更新內容。您可在此找到詳盡的免費版與付費版比較,協助您找出必試的工具,以提升工作效率並獲得競爭優勢。 立即探索,找出最適合您的工具!

9 個工具
xix.ai
評論 (4)
0/500
JoeWalker
JoeWalker 2026-09-16 12:00:07

Is my data in there? 🤔 This CAMIA attack by Brave and NUS is pretty scary. It feels like we're just training material for these models without even knowing it. Makes me wonder about the real cost of 'free' AI services.

BenGarcía
BenGarcía 2026-06-02 08:00:08

This is wild! 🤯 So basically they can tell if my personal data was used to train an AI? That's both cool and terrifying. What if companies get sued over this? Privacy laws need to catch up fast, because memorization is a real issue.

MarkHarris
MarkHarris 2026-03-20 14:00:36

Also das mit dem CAMIA-Angriff klingt echt nicht gut. KI-Modelle sollen doch keine persönlichen Daten speichern, oder? Wenn jetzt jeder prüfen kann, ob seine eigenen Daten im Training waren, wo soll das hinführen? Da müssen dringend strengere Datenschutzregeln für KI-Entwicklung her. Ist ja fast schon beängstigend, was da alles rauskommen könnte... 🤔

RalphSmith
RalphSmith 2025-12-06 08:30:37

Слышали про CAMIA? Это кошмар для приватности! Теперь любой может узнать, использовались ли их данные для обучения ИИ. Время удалять свои фото из интернета 📸 А вы как думаете - стоит ли запретить сбор личных данных для ИИ?

OR