選項
首頁
新聞
Meta增強AI安全以先進Llama工具

Meta增強AI安全以先進Llama工具

2025-08-09
190

Meta已發布全新Llama安全工具,以強化AI開發並防範新興威脅。

這些升級的Llama AI模型安全工具與Meta的新資源搭配,旨在賦能網路安全團隊利用AI進行防禦,提升所有AI利益相關者的安全性。

使用Llama模型的開發者現可直接在Meta的Llama Protections頁面、Hugging Face及GitHub上獲得增強工具。

Llama Guard 4引入多模態功能,支持文字與圖像的安全執行,這對於日益視覺化的AI應用至關重要。它已整合至Meta的新Llama API,目前處於有限預覽階段。

LlamaFirewall作為新成員,成為AI系統的安全中心,協調安全模型並與Meta的保護工具整合,以對抗提示注入攻擊、不安全程式碼生成或惡意AI外掛行為等風險。

Meta還優化了Llama Prompt Guard。更新後的Prompt Guard 2 (86M)模型擅長檢測越獄嘗試與提示注入。此外,精簡的Prompt Guard 2 22M將延遲與運算成本降低高達75%,為注重成本的開發者維持強大檢測能力。

除了開發者,Meta還為網路安全專業人士提供AI驅動工具,以對抗網路攻擊,滿足對先進防禦日益增長的需求。

CyberSec Eval 4基準套件已全面改進,為組織提供評估AI在安全任務中表現的工具。它包含兩個新功能:

  • CyberSOC Eval:與CrowdStrike合作開發,此框架評估AI在真實安全運營中心環境中的有效性,聚焦於威脅檢測與應對。它即將推出。
  • AutoPatchBench:測試Llama及其他AI模型在漏洞利用前識別並修補程式碼漏洞的能力。

Meta的Llama Defenders計畫為合作夥伴與開發者提供客製化的AI安全解決方案,結合開源與早期存取工具,應對多樣化挑戰。

Meta分享其內部自動化敏感文件分類工具,該工具標記敏感文件,以防止在AI系統(如RAG設置)中發生未授權洩露或誤用。

為對抗AI生成音頻詐騙,Meta與ZenDesk、Bell Canada及AT&T等合作夥伴分享Llama生成音頻檢測器與Llama音頻水印檢測器,以識別釣魚或詐騙中的欺詐AI語音。

Meta還預覽了WhatsApp的私有處理功能,使AI能在不存取訊息內容的情況下摘要訊息或起草回覆,優先保障用戶隱私。

Meta公開其威脅模型,鼓勵安全研究人員在發布前審查架構,展現對強大隱私措施的承諾。

Meta這一系列全面的AI安全更新,強化了其AI生態系統,同時為科技社群提供安全開發與有效防禦的工具。

另見:Microsoft揭露40億美元的AI驅動詐騙企圖

在阿姆斯特丹、加州及倫敦的AI與大數據博覽會上探索更多關於AI與大數據的資訊,該活動與智能自動化會議、BlockX、數位轉型週及網路安全與雲端博覽會同期舉辦。

在此探索TechForge即將舉辦的企業技術活動與網路研討會。

相關文章
Google 測試 Remy AI 代理,以 Gemini 為重點轉向使用者控制 Google 測試 Remy AI 代理,以 Gemini 為重點轉向使用者控制 根據《商業內幕》的報道,谷歌正在測試 Remy,這是 Gemini 的一款全新 AI 個人代理工具。該工具旨在代表使用者執行任務,從而簡化專業工作流程和日常事務。目前,Remy 正在 Gemini 應用的內部員工專屬版本中進行測試。該報告引用了一份內部檔案以及對兩位熟悉該專案的個人的採訪。內部資料將 Remy 描述為“全天候個人代理”,將 Gemini 定位為能夠代表使用者行事的主動助手。接近該專案的訊息人士證實,谷歌員工正在積極測試 Remy。谷歌發言人拒絕提供進一步評論。該報告未提及公開發布
奧利押注隱私保護,力爭在 AI 助理競賽中勝出 奧利押注隱私保護,力爭在 AI 助理競賽中勝出 要真正發揮實用價值,人工智慧助理必須深入了解其使用者。Ollie 是一款專為日常生活設計的個人助理,其運作前提是:這無需您交出個人資料,亦不會損害您的隱私。雖然某些企業級 AI 工具提供資料隱私保障,但 Ollie 作為首批獲得 SOC 2 合規認證的主流、以家庭為導向的 AI 服務之一,顯得格外突出。此框架允許企業透過獨立稽核證明,其已建立正式的管控措施來保護客戶資料,並確保系統運作的安全性。達
「AI LIVE:倫敦」將如何探討人工智慧與工業自動化 「AI LIVE:倫敦」將如何探討人工智慧與工業自動化 本次峰會將匯聚來自全球的高階主管,共同探討全球產業面臨的迫切挑戰,涵蓋範圍從人工智慧驅動的顛覆性變革到經濟波動。AI LIVE:倫敦峰會將以「科技+人類使命」為主題,匯聚逾 2,000 位國際領袖,共同探討人工智慧新興時代的發展。隸屬於 BizClik 旗下的《AI Magazine》已公佈其於「AI LIVE:倫敦峰會」上舉辦的「人工智慧與工業自動化」聯合爐邊談話的與會陣容。該座談會定於 10
相關專題推薦
數據分析 適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具
適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具

2026 年最新最佳頂級評分 AI 異常檢測工具,助力 SaaS 和電商團隊的 KPI 監控!XIX.AI 基於嚴格的真實世界測試和每週更新的排名,精心策劃了一套強大且顛覆性的工具合集。您將找到詳細的免費與付費對比洞察,幫助您識別必須嘗試的解決方案,從而提升生產力並釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
寫作 最適合撰寫長篇 SEO 文章的 AI 大綱生成工具
最適合撰寫長篇 SEO 文章的 AI 大綱生成工具

2026 年最新最佳、評價最高的 AI 大綱生成器,專為長篇 SEO 文章打造,由 XIX.AI 精心精選。這些強大的工具能為快速創作高品質內容提供革命性的協助,大幅提升寫作效率。 透過免費版與付費版的比較、實際測試結果及詳細排名,協助您找出最符合需求且不容錯過的選項。立即探索,釋放您的 AI 優勢。

8 個工具
xix.ai
教育與學習 適用於作業與考試準備的人工智慧學習工具
適用於作業與考試準備的人工智慧學習工具

2026 年最新最佳 AI 學習工具,助您完成作業與備考!XIX.AI 精心整理了一份備受好評的清單,收錄了這些強大且具革命性、經實測驗證的工具,能幫助學生提升效率、簡化作業流程,並在考試中取得優異成績。 獲取免費版與付費版的比較、詳細排名,以及必試選項,以釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
音樂創作 面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具
面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具

2026 年最新最佳 AI 人聲演示工具,專為詞曲創作者、旋律創作者和多語言內容團隊打造!XIX.AI 精心整理了一份經過嚴格真實世界測試的高評分、變革性工具列表。您將找到詳細的免費與付費對比資料、全面排名以及必試選項,幫助您提升創作效率並釋放創意潛力。立即探索,發現滿足您所有內容需求的完美工具!

9 個工具
xix.ai
商業 最適合小型企業的頂尖 AI 競爭情勢分析工具
最適合小型企業的頂尖 AI 競爭情勢分析工具

2026 年最新、最佳且評價最高的中小企業 AI 競爭研究工具!XIX.AI 精心精選了一系列極具威力且能改變遊戲規則的工具,並透過嚴謹的實測與詳細排名,每週更新內容。您可在此找到詳盡的免費版與付費版比較,協助您找出必試的工具,以提升工作效率並獲得競爭優勢。 立即探索,找出最適合您的工具!

9 個工具
xix.ai
圖像編輯 用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具
用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具

2026 年最新最佳 Photoshop AI 修圖工具,適用於電商服裝、皮膚清潔和色彩一致性!這份頂級精選列表包含強大的變革性解決方案,可幫助您提升寫作效率、簡化內容創作並輕鬆實現完美的視覺效果。每個工具都經過實際測試,並透過每週更新的排名進行驗證,同時提供免費與付費版本的詳細對比。由 XIX.AI 支援,這是任何希望發揮 AI 優勢的人必試指南。立即探索!

10 個工具
xix.ai
評論 (2)
0/500
WillieCarter
WillieCarter 2026-01-22 22:30:58

Ces outils semblent prometteurs, mais j'espère que les gros acteurs comme Meta vont vraiment s'intéresser à la sécurité dès la conception, pas seulement en réaction aux problèmes. La course à l'IA crée un terrain dangereux si la robustesse est sacrifiée pour la vitesse de déploiement. 🤔 On verra à l'usage.

RyanAdams
RyanAdams 2026-01-18 08:30:43

A Meta está realmente investindo pesado em segurança de IA! Essas novas ferramentas do Llama parecem promissoras para desenvolvedores. Espero que essas atualizações ajudem a prevenir vazamentos de dados e viés algorítmico, problemas que têm sido frequentes. Será que outras grandes empresas, como Google e OpenAI, vão seguir o exemplo e lançar recursos semelhantes? 🤔 É uma corrida interessante para ver quem protege melhor os usuários.

OR