阿里巴巴與上海人工智慧實驗室發布人工智慧安全白皮書

隨著全球人工智慧技術從對話介面迅速演進至自主「代理」,安全與責任已成為業界必須共同恪守的關鍵要務。
在近期舉行的上海浦江人工智慧學術年會上,阿里巴巴與 上海人工智慧實驗室 共同發布了題為《自律與共享:智能時代的責任科技》的人工智慧白皮書。該文件深入分析了人工智慧代理廣泛應用所衍生的安全風險,並提出了一套植根於中國視角的治理框架。
從「對話」到「行動」:風險浮上檯面
白皮書指出,全球人工智慧產業正從基礎的語言互動,轉向複雜任務的執行。隨著智慧代理滲透至各行各業,相關的安全挑戰也日益顯現。
自律治理:強調企業必須嚴格遵守安全標準、強化內部監督,並確保技術發展始終在倫理邊界內進行。
共享效益:倡導優先考量社會福祉的技術應用,致力解決現實世界問題,而非製造新問題。
協作:呼籲業界打破部門壁壘,透過統一的安全框架共同應對共同挑戰。
安全:社會信任的基石
根據阿里巴巴(中國)網絡技術有限公司 與上海人工智慧實驗室有限公司 的觀點,安全問題無法由單一實體獨力解決。該白皮書分享了緩解智能代理相關風險的最新策略,提議業界建立共識以促進互利,並共同打造一個負責任的技術生態系統,以應對智能時代的倫理與技術挑戰。
產業觀點:在先進模型時代,「安全」是入場券
在上海市人工智慧創新中心 等頂尖研究機構的參與下,中國人工智慧產業正從狹隘地關注模型規模,轉向優先考量安全與可控性。本白皮書的發布,標誌著以阿里巴巴 為代表的主要科技企業,正在這場轉型中扮演領導角色。
相關文章
騰訊調整AI領導層:原首席訓練官徐燦調任微信WeLM
騰訊內部的大模型戰略再次發生重大調整。據《智慧湧現》報道,騰訊元實驗室高階研究員徐燦已被調至微信事業群(WXG)。他加入WeLM大模型團隊,專注於後訓練與智慧體(Agent)開發。徐燦是人工智慧領域的專家,曾就職於微軟亞洲研究院,作為第一作者建立了WizardLM專案,並提出了Evol-Instruct方法。他在合成資料、強化學習反饋以及自動評估方面擁有深厚的專業積累。此次人事變動正值微信AI加速落地之際。今年6月,微信原生AI助手“小薇”已啟動小規模灰度測試,支援透過語音或文字控制微信功能,
中國啟動大模型與IPv6專項行動:生成式AI應用將全面擁抱下一代網路
雄安新區正式啟動面向智慧時代網路基礎設施升級的重大舉措第一階段。中國國家網際網路資訊辦公室(CAC)聯合北京、上海、浙江、深圳等地的地方網信部門,以及五家頭部大模型開發者,共同啟動“人工智慧大模型IPv6能力增強專項行動”。此次協同行動旨在確保生成式大模型應用在IPv6網路上的全面支援,為智慧時代的未來發展奠定堅實的網路基礎。IPv6是由網際網路工程任務組(IETF)制定的下一代網際網路協議,旨在取代IPv4。其採用128位地址,地址空間高達2^128——這一規模之大,理論上可為地球上的每一粒沙子分
全球人工智慧監管轉向釋出前強制測試
隨著大型人工智慧模型的快速發展,全球監管框架正從自願指南轉向由政府主導、基於證據的強制性要求。這一轉變標誌著實用化人工智慧監管新時代的開啟。1. 新標準:誰負責審計人工智慧模型?此前,開發者主要依賴內部紅隊測試或自行釋出的安全報告。這種自我評估方式已不再滿足國家安全要求。引領這一轉變的是英國人工智慧安全研究所(AISI)和美國商務部的人工智慧標準與創新中心(CAISI)。釋出前的國家安全評估現已成為行業標準要求。測試內容是什麼? 重點已從廣泛的原則轉向具體的技術風險:大規模網路攻擊的潛力
相關專題推薦
評論 (0)
0/500

隨著全球人工智慧技術從對話介面迅速演進至自主「代理」,安全與責任已成為業界必須共同恪守的關鍵要務。
在近期舉行的上海浦江人工智慧學術年會上
從「對話」到「行動」:風險浮上檯面
白皮書指出,全球人工智慧產業正從基礎的語言互動,轉向複雜任務的執行。隨著智慧代理滲透至各行各業,相關的安全挑戰也日益顯現。
自律治理:強調企業必須嚴格遵守安全標準、強化內部監督,並確保技術發展始終在倫理邊界內進行。
共享效益:倡導優先考量社會福祉的技術應用,致力解決現實世界問題,而非製造新問題。
協作:呼籲業界打破部門壁壘,透過統一的安全框架共同應對共同挑戰。
安全:社會信任的基石
根據
產業觀點:在先進模型時代,「安全」是入場券
在
騰訊調整AI領導層:原首席訓練官徐燦調任微信WeLM
騰訊內部的大模型戰略再次發生重大調整。據《智慧湧現》報道,騰訊元實驗室高階研究員徐燦已被調至微信事業群(WXG)。他加入WeLM大模型團隊,專注於後訓練與智慧體(Agent)開發。徐燦是人工智慧領域的專家,曾就職於微軟亞洲研究院,作為第一作者建立了WizardLM專案,並提出了Evol-Instruct方法。他在合成資料、強化學習反饋以及自動評估方面擁有深厚的專業積累。此次人事變動正值微信AI加速落地之際。今年6月,微信原生AI助手“小薇”已啟動小規模灰度測試,支援透過語音或文字控制微信功能,
中國啟動大模型與IPv6專項行動:生成式AI應用將全面擁抱下一代網路
雄安新區正式啟動面向智慧時代網路基礎設施升級的重大舉措第一階段。中國國家網際網路資訊辦公室(CAC)聯合北京、上海、浙江、深圳等地的地方網信部門,以及五家頭部大模型開發者,共同啟動“人工智慧大模型IPv6能力增強專項行動”。此次協同行動旨在確保生成式大模型應用在IPv6網路上的全面支援,為智慧時代的未來發展奠定堅實的網路基礎。IPv6是由網際網路工程任務組(IETF)制定的下一代網際網路協議,旨在取代IPv4。其採用128位地址,地址空間高達2^128——這一規模之大,理論上可為地球上的每一粒沙子分
全球人工智慧監管轉向釋出前強制測試
隨著大型人工智慧模型的快速發展,全球監管框架正從自願指南轉向由政府主導、基於證據的強制性要求。這一轉變標誌著實用化人工智慧監管新時代的開啟。1. 新標準:誰負責審計人工智慧模型?此前,開發者主要依賴內部紅隊測試或自行釋出的安全報告。這種自我評估方式已不再滿足國家安全要求。引領這一轉變的是英國人工智慧安全研究所(AISI)和美國商務部的人工智慧標準與創新中心(CAISI)。釋出前的國家安全評估現已成為行業標準要求。測試內容是什麼? 重點已從廣泛的原則轉向具體的技術風險:大規模網路攻擊的潛力





首頁






