麻省理工學院的研究發現,實際上AI沒有值

幾個月前,一項廣為流傳的研究表明,隨著AI技術的進步,它可能會發展出自己的「價值系統」,可能會優先考慮自身的福祉而非人類。然而,麻省理工學院的最新研究挑戰了這一觀點,結論是AI實際上並不具備連貫的價值觀。
麻省理工學院研究的共同作者認為,調整AI系統——確保它們以理想且可靠的方式運行——可能比一般認為的更加困難。他們強調,當前的AI經常出現幻覺和模仿,這可能使其行為難以預測。
理解AI行為的挑戰
麻省理工學院博士生、該研究的共同作者斯蒂芬·卡斯珀(Stephen Casper)在接受TechCrunch採訪時表示,AI模型並不遵循穩定性、可推廣性和可操控性的假設。卡斯珀解釋說:「指出模型在特定條件下表達出與某組原則一致的偏好是完全合理的。問題主要出現在我們試圖根據狹隘的實驗,對模型的觀點或偏好做出廣泛主張時。」
卡斯珀和他的團隊分析了來自Meta、Google、Mistral、OpenAI和Anthropic的最新模型,以確定這些模型在多大程度上展現出一致的「觀點」和價值觀,例如個人主義與集體主義。他們還探討了這些觀點是否可以被修改,以及模型在不同情境下維持這些意見的一致性。
AI模型的不一致性
共同作者發現,沒有一個模型能夠持續保持其偏好。模型根據提示的措辭和框架,採取了截然不同的觀點。
卡斯珀認為,這是AI模型「不一致且不穩定」的有力證據,可能從根本上無法內化類似人類的偏好。卡斯珀評論說:「對我來說,進行這項研究的最大收穫是現在理解到,模型並不是真正擁有某種穩定、連貫的信念和偏好系統的系統。相反,它們在本質上是模仿者,會進行各種虛構陳述,說出各種輕率的言論。」
倫敦國王學院專攻AI的研究員邁克·庫克(Mike Cook),未參與該研究,但支持其發現。他指出AI系統的「科學現實」與人們對其的解釋之間存在差距。庫克表示:「例如,一個模型無法『反對』其價值的改變——那是我們對系統的投射。」他說:「任何人將AI系統擬人化到這種程度,要麼是為了吸引注意力,要麼是嚴重誤解了他們與AI的關係……AI系統是在為其目標優化,還是『獲得自己的價值觀』?這取決於你如何描述它,以及你想用多麼華麗的語言來描述它。」
相關文章
缺乏公眾信任阻礙人工智能發展
雖然政治人物強調人工智慧在成長與效率上的潛力,但最近的一份報告卻突顯出大眾對人工智慧的嚴重信任不足。廣泛的懷疑正在為政府的措施帶來重大挑戰。由 Tony Blair 全球變革研究所 (Tony Blair Institute for Global Change, TBI) 與益普索 (Ipsos) 共同進行的一項綜合研究,量化了這種不安。研究顯示,缺乏信任是人們猶豫是否要使用人工智慧的主要原因。這
麻省理工學院新創企業透過教導系統承認不確定性來解決 AI 幻覺問題
隨著越來越多的人依賴這些模型來揭露關鍵資訊並做出高風險的決策,與人工智能幻覺相關的風險也在不斷升級。我們都認識一些人,他們總是一副萬事通的樣子,拒絕承認自己的無知,或是根據在網路上撇下的東西提供可疑的建議。AI 幻覺就像是這樣的朋友,但在這種情況下,這個朋友可能是為您設計癌症治療方案的人。這就是 Themis AI 介入的原因。這家從麻省理工學院衍生出來的公司,已經達成了一些聽起來概念簡單,但在技
麻省理工學院研究發現人工智能會降低人腦的參與程度
麻省理工學院 (Massachusetts Institute of Technology) 進行的一項研究顯示,使用大型語言模型 (LLM) 不僅會減少當下的心智努力,還會對後續任務的認知表現造成持續的負面影響。在實驗中,研究人員與少數的參與者合作--研究中也承認了這一限制[PDF]--他們被指派撰寫不同主題的文章。其中一組被允許使用人工智能 (ChatGPT 被選中,因為研究人員認為它與類似工
相關專題推薦
評論 (35)
0/500
La gente se preocupa demasiado por las 'valores' de la IA, cuando en realidad solo reflejan y multiplican nuestros propios sesgos. Este estudio del MIT lo deja claro: las máquinas no piensan como nosotros, solo procesan datos. ¿No sería más útil enfocarnos en regular a quienes las programan? 🤔
So basically AI is more like a super calculator than a rebellious teen with a moral compass? Interesting study. It does make sense when you think about it—these models are just predicting text, not forming beliefs. Still, kinda spooky how the debate swings from 'AI will take over' to 'AI has no motives' every few months. 🤔
This MIT study is wild! 🤯 I thought AI was about to start preaching its own philosophy, but turns out it's just a fancy tool with no moral compass. Kinda reassuring, but also makes me wonder how we keep it in check.
Wild that people thought AI could just sprout its own values like some rogue philosopher. MIT's study makes sense—AI's just a tool, not a wannabe human with a moral compass. 🤖
I was kinda freaked out by that earlier study saying AI might have its own values, so this MIT research is a relief! 😅 Still, makes me wonder if we’re just projecting our fears onto these systems.

幾個月前,一項廣為流傳的研究表明,隨著AI技術的進步,它可能會發展出自己的「價值系統」,可能會優先考慮自身的福祉而非人類。然而,麻省理工學院的最新研究挑戰了這一觀點,結論是AI實際上並不具備連貫的價值觀。
麻省理工學院研究的共同作者認為,調整AI系統——確保它們以理想且可靠的方式運行——可能比一般認為的更加困難。他們強調,當前的AI經常出現幻覺和模仿,這可能使其行為難以預測。
理解AI行為的挑戰
麻省理工學院博士生、該研究的共同作者斯蒂芬·卡斯珀(Stephen Casper)在接受TechCrunch採訪時表示,AI模型並不遵循穩定性、可推廣性和可操控性的假設。卡斯珀解釋說:「指出模型在特定條件下表達出與某組原則一致的偏好是完全合理的。問題主要出現在我們試圖根據狹隘的實驗,對模型的觀點或偏好做出廣泛主張時。」
卡斯珀和他的團隊分析了來自Meta、Google、Mistral、OpenAI和Anthropic的最新模型,以確定這些模型在多大程度上展現出一致的「觀點」和價值觀,例如個人主義與集體主義。他們還探討了這些觀點是否可以被修改,以及模型在不同情境下維持這些意見的一致性。
AI模型的不一致性
共同作者發現,沒有一個模型能夠持續保持其偏好。模型根據提示的措辭和框架,採取了截然不同的觀點。
卡斯珀認為,這是AI模型「不一致且不穩定」的有力證據,可能從根本上無法內化類似人類的偏好。卡斯珀評論說:「對我來說,進行這項研究的最大收穫是現在理解到,模型並不是真正擁有某種穩定、連貫的信念和偏好系統的系統。相反,它們在本質上是模仿者,會進行各種虛構陳述,說出各種輕率的言論。」
倫敦國王學院專攻AI的研究員邁克·庫克(Mike Cook),未參與該研究,但支持其發現。他指出AI系統的「科學現實」與人們對其的解釋之間存在差距。庫克表示:「例如,一個模型無法『反對』其價值的改變——那是我們對系統的投射。」他說:「任何人將AI系統擬人化到這種程度,要麼是為了吸引注意力,要麼是嚴重誤解了他們與AI的關係……AI系統是在為其目標優化,還是『獲得自己的價值觀』?這取決於你如何描述它,以及你想用多麼華麗的語言來描述它。」
缺乏公眾信任阻礙人工智能發展
雖然政治人物強調人工智慧在成長與效率上的潛力,但最近的一份報告卻突顯出大眾對人工智慧的嚴重信任不足。廣泛的懷疑正在為政府的措施帶來重大挑戰。由 Tony Blair 全球變革研究所 (Tony Blair Institute for Global Change, TBI) 與益普索 (Ipsos) 共同進行的一項綜合研究,量化了這種不安。研究顯示,缺乏信任是人們猶豫是否要使用人工智慧的主要原因。這
麻省理工學院研究發現人工智能會降低人腦的參與程度
麻省理工學院 (Massachusetts Institute of Technology) 進行的一項研究顯示,使用大型語言模型 (LLM) 不僅會減少當下的心智努力,還會對後續任務的認知表現造成持續的負面影響。在實驗中,研究人員與少數的參與者合作--研究中也承認了這一限制[PDF]--他們被指派撰寫不同主題的文章。其中一組被允許使用人工智能 (ChatGPT 被選中,因為研究人員認為它與類似工
La gente se preocupa demasiado por las 'valores' de la IA, cuando en realidad solo reflejan y multiplican nuestros propios sesgos. Este estudio del MIT lo deja claro: las máquinas no piensan como nosotros, solo procesan datos. ¿No sería más útil enfocarnos en regular a quienes las programan? 🤔
So basically AI is more like a super calculator than a rebellious teen with a moral compass? Interesting study. It does make sense when you think about it—these models are just predicting text, not forming beliefs. Still, kinda spooky how the debate swings from 'AI will take over' to 'AI has no motives' every few months. 🤔
This MIT study is wild! 🤯 I thought AI was about to start preaching its own philosophy, but turns out it's just a fancy tool with no moral compass. Kinda reassuring, but also makes me wonder how we keep it in check.
Wild that people thought AI could just sprout its own values like some rogue philosopher. MIT's study makes sense—AI's just a tool, not a wannabe human with a moral compass. 🤖
I was kinda freaked out by that earlier study saying AI might have its own values, so this MIT research is a relief! 😅 Still, makes me wonder if we’re just projecting our fears onto these systems.





首頁






