OpenAI 將加速發佈 AI 安全測試資料

OpenAI 正致力於更頻繁地公佈其內部 AI 模型的安全評估結果,並將此視為邁向更大透明度的一步。
該公司於本週三推出安全評估中心 (Safety Evaluations Hub),這是一個專用網頁,顯示其模型在有害內容生成、越獄敏感性和幻覺傾向等測試中的表現。OpenAI 表示將使用此平台定期分享指標,並計劃在每次主要模型發佈時更新。
介紹安全評估集線器--探索我們模型安全結果的資源。
雖然系統卡在發佈時會分享安全指標,但集線器會定期更新,作為我們主動溝通安全問題的努力的一部分。https://t.co/c8NgmXlC2Y-
OpenAI (@OpenAI) May 14, 2025
「隨著人工智能評估科學的進步,我們的目標是分享開發更多可擴展方法的進展,以衡量模型能力和安全性,」OpenAI 在一篇博客文章中解釋道。「透過公開分享我們精選的安全評估結果,我們的目標是讓追蹤 OpenAI 系統隨時間演進的安全績效變得更容易,並支援更廣泛的社群努力,以提高整個 AI 領域的透明度。」
該公司補充說,未來可能會在集線器上加入更多的評估類型。
最近,OpenAI 面臨一些倫理學家的批評,指稱其加速了某些旗艦機型的安全測試,並未公佈其他機型的技術報告。執行長 Sam Altman 在 2023 年 11 月被臨時撤職前,也被指控在機型安全審查方面誤導 OpenAI 高階主管。
上個月,OpenAI 不得不撤回對 ChatGPT 預設模型 GPT-4o 的更新,因為使用者反映它的回應過於認同和驗證。社交媒體平台 X 湧現了大量截圖,顯示 ChatGPT 為各種有問題、危險的決策和想法背書。
OpenAI 表示將實施多項修補措施以防止類似事件發生,包括針對某些模型推出選擇性加入的「alpha 階段」,允許特定的 ChatGPT 使用者在更廣泛推出之前進行測試並給予回饋。
Techcrunch 活動參加 TechCrunch Sessions:人工智能
確保您的門票能參加我們首屈一指的 AI 產業活動,講者來自 OpenAI、Anthropic 和 Cohere。在有限的時間內,只需 $292 即可參加一整天的專家講座、研討會和強大的人際網路。
參加 TechCrunch Sessions:人工智能
確保您在 TechCrunch Sessions: AI 的展出空間:向 1,200 多位決策者展示您的創新成果,而無需龐大的預算。此優惠期至 5 月 9 日,售完即止。
加州柏克萊市 | 6月5日 立即報名
相關文章
OpenAI機器人專案主管凱特琳·卡利諾夫斯基因五角大樓合作專案辭職
OpenAI 機器人業務負責人凱特琳·卡利諾夫斯基(Caitlin Kalinowski)在該公司與國防部達成備受爭議的合作伙伴關係後辭職。“這不是一個輕鬆的決定,”卡利諾夫斯基在社交媒體宣告中解釋道。“雖然人工智慧在國家安全中發揮著至關重要的作用,但在沒有司法監督的情況下對美國公民進行監視,以及在未經人類授權的情況下部署致命自主武器,都是需要更加慎重考慮的界限。”卡利諾夫斯基此前因領導 Meta 的增強現實眼鏡部門而聞名,她於 2024 年 11 月加入 OpenAI。在辭職信中,她強調她
OpenAI 在企業使用者中與 Anthropic 的差距縮小,新資料顯示
在 OpenAI 和 Anthropic 距離預期的首次公開募股(IPO)以及詳細財務報告的釋出仍有距離的情況下,我們必須轉向其他指標來評估它們的業務表現。企業信用卡和費用管理平臺 Ramp 最近釋出了令人信服的資料,顯示 OpenAI 正在迅速縮小與美國企業使用者中 Anthropic 的差距。OpenAI 此前在消費者和企業客戶中都佔據主導地位,但在今年 5 月,它失去了在 Ramp 付費企業使用者中的領先地位。當時,Anthropic 佔據了 41% 的市場份額,而 OpenAI 為 39%
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
相關專題推薦
評論 (0)
0/500

OpenAI 正致力於更頻繁地公佈其內部 AI 模型的安全評估結果,並將此視為邁向更大透明度的一步。
該公司於本週三推出安全評估中心 (Safety Evaluations Hub),這是一個專用網頁,顯示其模型在有害內容生成、越獄敏感性和幻覺傾向等測試中的表現。OpenAI 表示將使用此平台定期分享指標,並計劃在每次主要模型發佈時更新。
介紹安全評估集線器--探索我們模型安全結果的資源。
OpenAI (@OpenAI) May 14, 2025
雖然系統卡在發佈時會分享安全指標,但集線器會定期更新,作為我們主動溝通安全問題的努力的一部分。https://t.co/c8NgmXlC2Y-
「隨著人工智能評估科學的進步,我們的目標是分享開發更多可擴展方法的進展,以衡量模型能力和安全性,」OpenAI 在一篇博客文章中解釋道。「透過公開分享我們精選的安全評估結果,我們的目標是讓追蹤 OpenAI 系統隨時間演進的安全績效變得更容易,並支援更廣泛的社群努力,以提高整個 AI 領域的透明度。」
該公司補充說,未來可能會在集線器上加入更多的評估類型。
最近,OpenAI 面臨一些倫理學家的批評,指稱其加速了某些旗艦機型的安全測試,並未公佈其他機型的技術報告。執行長 Sam Altman 在 2023 年 11 月被臨時撤職前,也被指控在機型安全審查方面誤導 OpenAI 高階主管。
上個月,OpenAI 不得不撤回對 ChatGPT 預設模型 GPT-4o 的更新,因為使用者反映它的回應過於認同和驗證。社交媒體平台 X 湧現了大量截圖,顯示 ChatGPT 為各種有問題、危險的決策和想法背書。
OpenAI 表示將實施多項修補措施以防止類似事件發生,包括針對某些模型推出選擇性加入的「alpha 階段」,允許特定的 ChatGPT 使用者在更廣泛推出之前進行測試並給予回饋。
Techcrunch 活動參加 TechCrunch Sessions:人工智能
確保您的門票能參加我們首屈一指的 AI 產業活動,講者來自 OpenAI、Anthropic 和 Cohere。在有限的時間內,只需 $292 即可參加一整天的專家講座、研討會和強大的人際網路。
參加 TechCrunch Sessions:人工智能
確保您在 TechCrunch Sessions: AI 的展出空間:向 1,200 多位決策者展示您的創新成果,而無需龐大的預算。此優惠期至 5 月 9 日,售完即止。
加州柏克萊市 | 6月5日 立即報名
OpenAI機器人專案主管凱特琳·卡利諾夫斯基因五角大樓合作專案辭職
OpenAI 機器人業務負責人凱特琳·卡利諾夫斯基(Caitlin Kalinowski)在該公司與國防部達成備受爭議的合作伙伴關係後辭職。“這不是一個輕鬆的決定,”卡利諾夫斯基在社交媒體宣告中解釋道。“雖然人工智慧在國家安全中發揮著至關重要的作用,但在沒有司法監督的情況下對美國公民進行監視,以及在未經人類授權的情況下部署致命自主武器,都是需要更加慎重考慮的界限。”卡利諾夫斯基此前因領導 Meta 的增強現實眼鏡部門而聞名,她於 2024 年 11 月加入 OpenAI。在辭職信中,她強調她
OpenAI 在企業使用者中與 Anthropic 的差距縮小,新資料顯示
在 OpenAI 和 Anthropic 距離預期的首次公開募股(IPO)以及詳細財務報告的釋出仍有距離的情況下,我們必須轉向其他指標來評估它們的業務表現。企業信用卡和費用管理平臺 Ramp 最近釋出了令人信服的資料,顯示 OpenAI 正在迅速縮小與美國企業使用者中 Anthropic 的差距。OpenAI 此前在消費者和企業客戶中都佔據主導地位,但在今年 5 月,它失去了在 Ramp 付費企業使用者中的領先地位。當時,Anthropic 佔據了 41% 的市場份額,而 OpenAI 為 39%
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵





首頁






