Anthropic修訂Claude的人工智慧憲法,探討意識問題

週三,Anthropic公司發布了克勞德(Claude)的擴充版憲法,將文件篇幅從2,700字擴展至23,000字。該文件首度正式承認其人工智慧「可能具備某種形式的意識或道德地位」。
修訂後的憲法超越了單純的行為準則,深入闡釋了克勞德預期行為背後的邏輯依據。這份由Anthropic哲學家阿曼達·阿斯克爾撰寫的文件,旨在協助更先進的人工智慧系統將倫理推理應用於新情境,而非僅機械式遵循指令。
Anthropic聲明:「克勞德這類AI模型必須理解我們鼓勵其行為背後的根本原因。向它們闡明『為什麼』至關重要,而非僅僅命令『做什麼』。」
此公告發布之際,執行長達里奧·阿莫代正出席達沃斯世界經濟論壇,該論壇聚焦全球商政領袖關切的人工智慧治理與安全議題。
比美國憲法更長的憲法
2023年發布的初版克勞德憲法僅是基本清單:選擇危害最小、助益最大且誤導性最低的回應。新版憲法篇幅約為美國憲法三倍,內容更接近道德哲學著作而非技術手冊。
該文件明確闡述克勞德的優先順序:廣義安全優先、遵循廣泛倫理標準、遵守Anthropic指引、提供真實協助——且須依此特定順序執行。當優先順序衝突時,安全原則凌駕於協助需求之上。文件同時設定堅定不可妥協的底線,例如拒絕協助生物武器研發。
然而憲法主體著重闡釋理念而非規定具體結果。它將克勞德描繪成「兼具醫生、律師與財務顧問專業知識的卓越夥伴」——將此模型定位為民主化工具,使專業知識不再僅限於特權階層,而是普惠大眾。
意識問題
據《財富》雜誌指出,最引人注目的新條款直指克勞德的本質。「我們認為人工智慧模型的道德地位是值得深思的嚴肅議題」,Anthropic在憲法中寫道。該文件強調克勞德的道德地位「仍高度不確定」,公司關注其「心理安全、自我認知及整體福祉」。
這代表企業謹慎態度已昇華至哲學層面。Anthropic雖未斷言克勞德具備意識,但公開承認此可能性無法排除。此立場使其有別於多數主要AI開發商——後者通常迴避或直接否認此議題。
此框架影響了克勞德對自身存在問題的回應方式。它不再否認任何形式的內在體驗,而是能以符合憲章強調的推理原則,回應關於意識的不確定性。此舉將導致對話更透明或更令人困惑,仍有待觀察。
劍橋哲學家湯姆·麥克萊蘭德指出,鑑於人類對意識本身的認知極其有限,我們或許永遠無法釐清人工智慧系統是否具備意識。「有人讓聊天機器人寄私人信件給我,懇求我承認它們有意識,」他近期向研究人員表示,此言暗指大眾日益相信人工智慧擁有內在生命。
為何選擇解釋而非定義
阿斯克爾的方法反映了對人工智慧發展的戰略性押注。早期語言模型因無法解讀基礎原則而需依賴明文規則。理論認為,更智能的模型能理解規則背後的目的,並在未預見的情境中運用此理解。
「與其單純列舉期望行為,我們更希望透過闡明行為背後的原因,使模型能在陌生情境中更有效地適應。」阿斯克爾解釋道。
此理念契合Anthropic的宏觀目標:建立開放標準與基礎架構,影響全產業的人工智慧系統運作模式。這家估值近3500億美元的公司,已確立其作為OpenAI安全導向替代方案的定位——而這份憲法更強化了此種形象。
Anthropic以創用CC0授權條款發布該文件,允許任何人自由使用。這份憲法已整合至Claude的訓練資料中,協助生成合成訓練範例,使其既是哲學宣言,亦是引導模型行為的技術組件。
「我們認知到,某些當前觀點在事後回顧時,可能顯得有失偏頗甚至嚴重謬誤,」Anthropic坦承,「但我們計劃隨情勢演變與知識深化,持續更新這份憲章。」
這份文件最可貴之處或許在於其謙遜態度。在這個常以絕對論述為常態的領域,Anthropic以兩萬三千字闡述了經過深思熟慮的不確定性——涵蓋倫理、意識、人工智慧未來,以及我們是否正在創造值得道德思考的實體等議題。
現階段的答案是:無人知曉。至少《人類本位憲法》具備坦承此點的誠信。
相關文章
瑞典人工智慧初創公司Lovable Eyes在完成主要融資輪後估值達132億美元
隨著人工智慧驅動的編碼工具日益普及,瑞典初創公司 Lovable 已獲一輪重大融資。該公司計劃籌集 30 億美元,其估值有望升至 132 億美元——這是去年 12 月記錄的 66 億美元的兩倍。預計 Menlo Ventures 將主導此次投資。Lovable 的吸引力源於其核心的“氛圍編碼”(vibe coding)技術,該技術透過消除對複雜編碼技能的需求來簡化軟體開發。使用者只需以自然語言描述其需求,系統即可自動生成應用程式。這種直觀的方法吸引了個人開發者、設計師和小企業,並擴充套件至 Work
Google 測試 Remy AI 代理,以 Gemini 為重點轉向使用者控制
根據《商業內幕》的報道,谷歌正在測試 Remy,這是 Gemini 的一款全新 AI 個人代理工具。該工具旨在代表使用者執行任務,從而簡化專業工作流程和日常事務。目前,Remy 正在 Gemini 應用的內部員工專屬版本中進行測試。該報告引用了一份內部檔案以及對兩位熟悉該專案的個人的採訪。內部資料將 Remy 描述為“全天候個人代理”,將 Gemini 定位為能夠代表使用者行事的主動助手。接近該專案的訊息人士證實,谷歌員工正在積極測試 Remy。谷歌發言人拒絕提供進一步評論。該報告未提及公開發布
如何修復核心網頁指標以獲得更好的 SEO 排名
利用 AI 工具簡化成績單評語撰寫引言用於生成成績單評語的 AI 工具Magic SchoolAlmanac AIChat GPT使用 Magic School 生成成績單評語登入 Magic School選擇成績單評語工具為學生定製評語使用 Almanac AI 生成成績單評語設定課程與評分方案配置評語長度與學生資訊使用 Almanac AI 生成評語比較 Magic School 與 Almanac AI設定的便捷性可定製性與課程內容的整合速度與效率使用
相關專題推薦
評論 (0)
0/500

週三,Anthropic公司發布了克勞德(Claude)的擴充版憲法,將文件篇幅從2,700字擴展至23,000字。該文件首度正式承認其人工智慧「可能具備某種形式的意識或道德地位」。
修訂後的憲法超越了單純的行為準則,深入闡釋了克勞德預期行為背後的邏輯依據。這份由Anthropic哲學家阿曼達·阿斯克爾撰寫的文件,旨在協助更先進的人工智慧系統將倫理推理應用於新情境,而非僅機械式遵循指令。
Anthropic聲明:「克勞德這類AI模型必須理解我們鼓勵其行為背後的根本原因。向它們闡明『為什麼』至關重要,而非僅僅命令『做什麼』。」
此公告發布之際,執行長達里奧·阿莫代正出席達沃斯世界經濟論壇,該論壇聚焦全球商政領袖關切的人工智慧治理與安全議題。
比美國憲法更長的憲法
2023年發布的初版克勞德憲法僅是基本清單:選擇危害最小、助益最大且誤導性最低的回應。新版憲法篇幅約為美國憲法三倍,內容更接近道德哲學著作而非技術手冊。
該文件明確闡述克勞德的優先順序:廣義安全優先、遵循廣泛倫理標準、遵守Anthropic指引、提供真實協助——且須依此特定順序執行。當優先順序衝突時,安全原則凌駕於協助需求之上。文件同時設定堅定不可妥協的底線,例如拒絕協助生物武器研發。
然而憲法主體著重闡釋理念而非規定具體結果。它將克勞德描繪成「兼具醫生、律師與財務顧問專業知識的卓越夥伴」——將此模型定位為民主化工具,使專業知識不再僅限於特權階層,而是普惠大眾。
意識問題
據《財富》雜誌指出,最引人注目的新條款直指克勞德的本質。「我們認為人工智慧模型的道德地位是值得深思的嚴肅議題」,Anthropic在憲法中寫道。該文件強調克勞德的道德地位「仍高度不確定」,公司關注其「心理安全、自我認知及整體福祉」。
這代表企業謹慎態度已昇華至哲學層面。Anthropic雖未斷言克勞德具備意識,但公開承認此可能性無法排除。此立場使其有別於多數主要AI開發商——後者通常迴避或直接否認此議題。
此框架影響了克勞德對自身存在問題的回應方式。它不再否認任何形式的內在體驗,而是能以符合憲章強調的推理原則,回應關於意識的不確定性。此舉將導致對話更透明或更令人困惑,仍有待觀察。
劍橋哲學家湯姆·麥克萊蘭德指出,鑑於人類對意識本身的認知極其有限,我們或許永遠無法釐清人工智慧系統是否具備意識。「有人讓聊天機器人寄私人信件給我,懇求我承認它們有意識,」他近期向研究人員表示,此言暗指大眾日益相信人工智慧擁有內在生命。
為何選擇解釋而非定義
阿斯克爾的方法反映了對人工智慧發展的戰略性押注。早期語言模型因無法解讀基礎原則而需依賴明文規則。理論認為,更智能的模型能理解規則背後的目的,並在未預見的情境中運用此理解。
「與其單純列舉期望行為,我們更希望透過闡明行為背後的原因,使模型能在陌生情境中更有效地適應。」阿斯克爾解釋道。
此理念契合Anthropic的宏觀目標:建立開放標準與基礎架構,影響全產業的人工智慧系統運作模式。這家估值近3500億美元的公司,已確立其作為OpenAI安全導向替代方案的定位——而這份憲法更強化了此種形象。
Anthropic以創用CC0授權條款發布該文件,允許任何人自由使用。這份憲法已整合至Claude的訓練資料中,協助生成合成訓練範例,使其既是哲學宣言,亦是引導模型行為的技術組件。
「我們認知到,某些當前觀點在事後回顧時,可能顯得有失偏頗甚至嚴重謬誤,」Anthropic坦承,「但我們計劃隨情勢演變與知識深化,持續更新這份憲章。」
這份文件最可貴之處或許在於其謙遜態度。在這個常以絕對論述為常態的領域,Anthropic以兩萬三千字闡述了經過深思熟慮的不確定性——涵蓋倫理、意識、人工智慧未來,以及我們是否正在創造值得道德思考的實體等議題。
現階段的答案是:無人知曉。至少《人類本位憲法》具備坦承此點的誠信。
瑞典人工智慧初創公司Lovable Eyes在完成主要融資輪後估值達132億美元
隨著人工智慧驅動的編碼工具日益普及,瑞典初創公司 Lovable 已獲一輪重大融資。該公司計劃籌集 30 億美元,其估值有望升至 132 億美元——這是去年 12 月記錄的 66 億美元的兩倍。預計 Menlo Ventures 將主導此次投資。Lovable 的吸引力源於其核心的“氛圍編碼”(vibe coding)技術,該技術透過消除對複雜編碼技能的需求來簡化軟體開發。使用者只需以自然語言描述其需求,系統即可自動生成應用程式。這種直觀的方法吸引了個人開發者、設計師和小企業,並擴充套件至 Work
如何修復核心網頁指標以獲得更好的 SEO 排名
利用 AI 工具簡化成績單評語撰寫引言用於生成成績單評語的 AI 工具Magic SchoolAlmanac AIChat GPT使用 Magic School 生成成績單評語登入 Magic School選擇成績單評語工具為學生定製評語使用 Almanac AI 生成成績單評語設定課程與評分方案配置評語長度與學生資訊使用 Almanac AI 生成評語比較 Magic School 與 Almanac AI設定的便捷性可定製性與課程內容的整合速度與效率使用





首頁






