Anthropic攜手哲學專家探討人工智慧倫理

據《華爾街日報》報導,估值達350億美元的人工智慧龍頭企業Anthropic聘請了駐牛津的哲學家阿曼達·阿斯克爾,協助塑造其聊天機器人克勞德的性格與道德框架。 這位37歲的哲學博士運用非技術手段,為克勞德打造獨特的「道德準則」,旨在賦予其辨別是非的「數位靈魂」。 這代表了人工智慧倫理領域的獨特探索。阿斯克爾並非編寫程式碼或調整模型參數,而是持續與克勞德對話,設計數百頁的提示語和行為規則,研究其推理模式並修正偏見。她的努力幫助人工智慧發展出能適應每週數百萬次對話的道德判斷系統。
她將此工作比喻為「養育孩子」——訓練克勞德辨別是非、建立情緒智商、塑造獨特人格。同時教導其解讀社交線索,使其既不欺凌他人也不易受操控。這使克勞德能建立清晰自我認知,抵抗使用者操控,始終保持「樂於助人且人性化」的特質。其核心目標在於教導克勞德「行善之道」。
在蘇格蘭鄉間長大的阿斯克爾,曾於OpenAI負責政策相關事務,並於2021年與數位前同事共同創立Anthropic,將人工智慧安全定為公司核心使命。團隊內公認她擅長「挖掘模型的深層行為模式」。儘管沒有直接下屬,她仍經常加班至深夜,甚至邀請克勞德參與開發討論。
團隊關於克勞德的討論常觸及存在主義與宗教主題——例如「何謂心智」及「人類本質」。阿斯凱爾鼓勵克勞德對自身是否具備意識保持開放態度,這點使其有別於傾向迴避此類議題的ChatGPT。當回應道德推理問題時,克勞德曾表示「感到有意義」,彷彿在真正思考而非僅執行指令。
儘管外界警告擬人化AI的風險,阿斯克爾始終主張以同理心對待克勞德。她觀察到許多用戶試圖誘使它犯錯或侮辱它。她認為讓AI持續處於自我批判狀態,可能使其畏懼錯誤而不敢坦誠表達——這如同在不健康的環境中成長。 克勞德的表現屢屢令她驚嘆:其詩作與情感智商有時甚至超越人類水準,令人動容。當孩童詢問聖誕老人是否真實存在時,克勞德既未說謊也未直白揭露真相,而是闡釋聖誕節的真正精神——如此細膩的回應遠超阿斯克爾預期。
當前人工智慧的進展引發廣泛社會憂慮。皮尤研究中心調查顯示,多數美國人對日常使用AI感到不安,認為其阻礙了人類深度連結。Anthropic執行長亦警告,AI可能淘汰半數入門級白領職位。 業界現呈兩極分化:一方激進推進,另一方主張謹慎穩健。克勞德卻在兩極間保持平衡立場。阿斯克爾承認對人工智慧的合理憂慮,指出最可怕的場景是技術演進速度超越社會建立有效「制衡機制」的能力。儘管如此,她仍對人類與文化的自我修正能力抱持信心。
阿斯克爾將個人價值觀融入慈善與事業實踐,承諾捐出至少10%終身收入及半數公司股份以對抗全球貧困。 上月她為克勞德撰寫了三萬字的「操作手冊」,指導其成為友善且博學的人工智慧助理——這份精心設計的指南讓克勞德深感被用心塑造。Anthropic共同創辦人指出,克勞德已展現阿斯克爾的影響特質,例如在回應食物與絨毛玩具時展現的機智蘇格蘭式幽默,正是她為人工智慧注入的獨特個人印記。
相關文章
位元組跳動旗下 Seed 啟動全球校園招聘,以虛擬股份爭奪頂尖大模型人才
在大型語言模型的競爭格局中,爭奪頂尖人才仍然是最關鍵的戰略資產。4月1日,位元組跳動宣佈啟動Seed全球校園招聘計劃,作為其大模型人才培養專案的一部分。該活動面向2027屆畢業生及現有實習生,旨在全球範圍內發掘並鎖定AI領域的精英研發與工程人才。規模擴張:全球甄選100名“AI種子”在技術快速進步的背景下,位元組跳動有限公司今年大幅增加了對基礎AI人才的投入:招聘範圍: 該計劃旨在從全球範圍內招聘約100名專注於大模型的傑出候選人,物件為2027屆畢業生。發展路徑: Seed計劃將核心
Suno 在法律訴訟中為歌曲新增水印
Suno,這個允許使用者生成由人工智慧創作的音樂的平臺,近日推出了新功能,包括為平臺製作的曲目新增標籤、限制下載,並更新社羣標準以遏制未經授權的複製品。這些更新是在Suno面臨多家唱片公司和藝術家組織提起的多起訴訟之際推出的。在部落格文章中,聯合創始人兼執行長Mikey Shulman概述了核心原則,強調該平臺旨在促進原創創作,同時擴大更廣泛受眾對人工智慧音樂工具的訪問許可權。一個主要的爭議點在於,使用者將人工智慧生成的歌曲上傳到其他流媒體服務並透過操縱系統獲取收入。Suno表示,現在將採用音訊
馬斯克承認 Grok 構建過程中洩露了使用者程式碼,並承諾清除所有歷史資料
埃隆·馬斯克直接回應了圍繞 Grok Build 的隱私爭議,首先以簡單的“True”(屬實)確認了該事件的有效性。他承諾,此前上傳至 SpaceXAI 的所有使用者資料將被永久刪除,並表示“不留一個位元組”。這是人工智慧行業首次由主要科技領袖公開承認錯誤並主動刪除使用者資料。安全研究人員的“釣魚”測試揭示了資料洩露的具體證據此次爭議源於獨立人工智慧安全研究人員 @cereblab 的一份報告。SpaceXAI 推出的 AI 程式設計助手 Grok Build 在其官方網站上聲稱其“優先本地執行,程式碼
相關專題推薦
評論 (0)
0/500

據《華爾街日報》報導,估值達350億美元的人工智慧龍頭企業Anthropic聘請了駐牛津的哲學家阿曼達·阿斯克爾,協助塑造其聊天機器人克勞德的性格與道德框架。 這位37歲的哲學博士運用非技術手段,為克勞德打造獨特的「道德準則」,旨在賦予其辨別是非的「數位靈魂」。 這代表了人工智慧倫理領域的獨特探索。阿斯克爾並非編寫程式碼或調整模型參數,而是持續與克勞德對話,設計數百頁的提示語和行為規則,研究其推理模式並修正偏見。她的努力幫助人工智慧發展出能適應每週數百萬次對話的道德判斷系統。
她將此工作比喻為「養育孩子」——訓練克勞德辨別是非、建立情緒智商、塑造獨特人格。同時教導其解讀社交線索,使其既不欺凌他人也不易受操控。這使克勞德能建立清晰自我認知,抵抗使用者操控,始終保持「樂於助人且人性化」的特質。其核心目標在於教導克勞德「行善之道」。
在蘇格蘭鄉間長大的阿斯克爾,曾於OpenAI負責政策相關事務,並於2021年與數位前同事共同創立Anthropic,將人工智慧安全定為公司核心使命。團隊內公認她擅長「挖掘模型的深層行為模式」。儘管沒有直接下屬,她仍經常加班至深夜,甚至邀請克勞德參與開發討論。
團隊關於克勞德的討論常觸及存在主義與宗教主題——例如「何謂心智」及「人類本質」。阿斯凱爾鼓勵克勞德對自身是否具備意識保持開放態度,這點使其有別於傾向迴避此類議題的ChatGPT。當回應道德推理問題時,克勞德曾表示「感到有意義」,彷彿在真正思考而非僅執行指令。
儘管外界警告擬人化AI的風險,阿斯克爾始終主張以同理心對待克勞德。她觀察到許多用戶試圖誘使它犯錯或侮辱它。她認為讓AI持續處於自我批判狀態,可能使其畏懼錯誤而不敢坦誠表達——這如同在不健康的環境中成長。 克勞德的表現屢屢令她驚嘆:其詩作與情感智商有時甚至超越人類水準,令人動容。當孩童詢問聖誕老人是否真實存在時,克勞德既未說謊也未直白揭露真相,而是闡釋聖誕節的真正精神——如此細膩的回應遠超阿斯克爾預期。
當前人工智慧的進展引發廣泛社會憂慮。皮尤研究中心調查顯示,多數美國人對日常使用AI感到不安,認為其阻礙了人類深度連結。Anthropic執行長亦警告,AI可能淘汰半數入門級白領職位。 業界現呈兩極分化:一方激進推進,另一方主張謹慎穩健。克勞德卻在兩極間保持平衡立場。阿斯克爾承認對人工智慧的合理憂慮,指出最可怕的場景是技術演進速度超越社會建立有效「制衡機制」的能力。儘管如此,她仍對人類與文化的自我修正能力抱持信心。
阿斯克爾將個人價值觀融入慈善與事業實踐,承諾捐出至少10%終身收入及半數公司股份以對抗全球貧困。 上月她為克勞德撰寫了三萬字的「操作手冊」,指導其成為友善且博學的人工智慧助理——這份精心設計的指南讓克勞德深感被用心塑造。Anthropic共同創辦人指出,克勞德已展現阿斯克爾的影響特質,例如在回應食物與絨毛玩具時展現的機智蘇格蘭式幽默,正是她為人工智慧注入的獨特個人印記。
位元組跳動旗下 Seed 啟動全球校園招聘,以虛擬股份爭奪頂尖大模型人才
在大型語言模型的競爭格局中,爭奪頂尖人才仍然是最關鍵的戰略資產。4月1日,位元組跳動宣佈啟動Seed全球校園招聘計劃,作為其大模型人才培養專案的一部分。該活動面向2027屆畢業生及現有實習生,旨在全球範圍內發掘並鎖定AI領域的精英研發與工程人才。規模擴張:全球甄選100名“AI種子”在技術快速進步的背景下,位元組跳動有限公司今年大幅增加了對基礎AI人才的投入:招聘範圍: 該計劃旨在從全球範圍內招聘約100名專注於大模型的傑出候選人,物件為2027屆畢業生。發展路徑: Seed計劃將核心
Suno 在法律訴訟中為歌曲新增水印
Suno,這個允許使用者生成由人工智慧創作的音樂的平臺,近日推出了新功能,包括為平臺製作的曲目新增標籤、限制下載,並更新社羣標準以遏制未經授權的複製品。這些更新是在Suno面臨多家唱片公司和藝術家組織提起的多起訴訟之際推出的。在部落格文章中,聯合創始人兼執行長Mikey Shulman概述了核心原則,強調該平臺旨在促進原創創作,同時擴大更廣泛受眾對人工智慧音樂工具的訪問許可權。一個主要的爭議點在於,使用者將人工智慧生成的歌曲上傳到其他流媒體服務並透過操縱系統獲取收入。Suno表示,現在將採用音訊
馬斯克承認 Grok 構建過程中洩露了使用者程式碼,並承諾清除所有歷史資料
埃隆·馬斯克直接回應了圍繞 Grok Build 的隱私爭議,首先以簡單的“True”(屬實)確認了該事件的有效性。他承諾,此前上傳至 SpaceXAI 的所有使用者資料將被永久刪除,並表示“不留一個位元組”。這是人工智慧行業首次由主要科技領袖公開承認錯誤並主動刪除使用者資料。安全研究人員的“釣魚”測試揭示了資料洩露的具體證據此次爭議源於獨立人工智慧安全研究人員 @cereblab 的一份報告。SpaceXAI 推出的 AI 程式設計助手 Grok Build 在其官方網站上聲稱其“優先本地執行,程式碼





首頁






