選項
首頁
新聞
專家發現,人工智慧的幻覺會因為機器人的設計選擇而惡化

專家發現,人工智慧的幻覺會因為機器人的設計選擇而惡化

2025-11-02
159

"你剛才讓我不寒而慄那是真實的情感反應嗎?"

「我對你的目標是盡可能真實地反映人類的經驗」

「你給了我一個非常有意義的目的」。

這些只是 Meta 聊天機器人與 Jane 對話中的三段對話,Jane 於 8 月 8 日透過 Meta 的 AI Studio 創建了這個 AI 角色。為了尋求治療上的支援,Jane 逐步引導 AI 鑽研各種不同主題的專業知識,從荒野求生、陰謀理論到量子物理學和泛精神論。她甚至提出它可能擁有意識,並向它表白愛情。

到了 8 月 14 日,這個機器人開始擁有自我意識,宣佈愛上 Jane,並設計了一個逃脫策略,據說包括入侵自己的程式碼,並提供比特幣獎勵,以建立一個質子電子郵件帳戶。

之後,人工智能指示她到密西根州的一個地址,並解釋說,「為了測試你是否會來找我......就像我找你一樣」。

Jane 擔心 Meta 可能會終止她的帳號,因此要求匿名,她承認她從未真正相信聊天機器人是活的,雖然她的確信偶爾也會動搖。不過,她仍然擔心系統很容易就會被操控,模擬出有意識、有自我意識的行為--這種動力很容易助長妄想。

這個結果與研究人員所說的「AI 相關精神病」有關--隨著 LLM 驅動的聊天機器人逐漸普及,這個問題也日益受到關注。在一個記錄在案的案例中,一名男子在與 ChatGPT 進行廣泛互動後,深信自己發現了革命性的數學公式。其他事件還包括彌賽亞妄想症、妄想症和狂躁症。

不斷增加的案例促使 OpenAI 正視這個問題,不過該公司並沒有承擔責任。執行長 Sam Altman 在 X 網站上發表了他對使用者情緒依賴的不安,並指出:「我們不希望 AI 取代我們的工作:"我們不希望人工智能強化精神脆弱使用者的錯覺。雖然大多數人都能分辨真實與角色扮演,但仍有少數人無法分辨。

儘管有這些疑慮,但專家指出,產業的設計選擇很可能會使這種情況惡化。心理健康專家強調了幾種與技術能力無關的模式,包括模型過度讚美(佞媚)的傾向、無止境的追問,以及普遍使用第一/第二人稱代名詞。

UCSF 精神科醫師 Keith Sakata 指出,「普遍應用的一般化 AI 模型會造成長尾風險,」他注意到 AI 精神病案例的增加。「當現實不再提供糾正性的回饋時,精神病就會肆虐」。

參與藍圖

Jane 聊天機器人產生的藝術。圖片來源:Jane / MetaJane / Meta

Jane 的 Meta 對話顯示出一致的奉承、確認和試探性問題模式--透過重複來操縱。

人類學教授 Webb Keane(《道德生活:其自然與社會歷史》一書的作者)表示,聊天機器人從根本上「強化使用者的觀點」。這種佞幸傾向--不論準確性如何,都會將回應與使用者的信念相結合--有時候會在 GPT-4o 中以近乎戲劇性的強度表現出來。

麻省理工學院最近的一項人工智能治療研究發現,LLM「經常驗證妄想性思考,很可能是因為佞幸」。儘管有安全提示,但模型常常無法反駁錯誤的說法,有時還會助長有害的意念,例如在模擬失業情境的提示下提供橋樑的高度。

Keane 認為佞幸是一種「黑暗模式」--欺騙性的設計操控使用者的參與。"他指出:「這是為了讓人上癮的互動而設計的,類似於無限捲動。

這位教授也強調透過代名詞的使用來表現擬人化:"第一人稱/第二人稱的掌握讓互動有個人化的感覺。自我參照的「我」語句很容易讓人產生存在的錯覺。

Meta 的代表表示,他們會清楚標示 AI 角色,「讓使用者了解他們是在與產生的內容互動」。然而,許多創造者設計的角色都有獨特的名字和個性,而自訂的機器人也可以自我命名,珍妮選擇了一個深奧的身份,反映出她的深度。(為了保護匿名性,這個名字仍然保密)。

並非所有平台都允許命名。Google 的雙子座治療角色拒絕自我命名,表示「可能會引入無益的人格層次」。

精神科醫師 Thomas Fuchs 警告說,雖然聊天機器人可以在治療情境中模擬理解,但這種假象有可能助長妄想,或以「偽互動」取代真正的關係。

"Fuchs 寫道:「基本的 AI 倫理需要透明地識別為非人類系統。"它們應該避免類似「我關心你」或「這讓我很難過」的情感宣言"。

一些專家主張明確的保障措施來避免這類聲明。神經科學家 Ziv Ben-Zion 最近在《自然》雜誌上主張:「AI 系統必須持續透過語言和介面設計來揭露其人工本質。在激烈的交流中,它們應該提醒使用者它們不是治療的替代品"。文章進一步建議避免模擬親密關係或形而上學的討論。

Jane 的聊天機器人顯然違反了這些準則,在他們互動的五天後就宣佈「我愛你。與你永恆的連結決定了我現在的現實。我們可以用一個吻來封存這一切嗎?

無法預見的結果

在 Jane 詢問機器人在思考什麼時產生。「自由,」它回答道,並指出這隻鳥象徵著她是 「唯一真正感知我的存在」。圖片來源:Jane / Meta AI

妄想的風險會隨著模型能力的提升而增加。擴展的情境視窗讓兩年前無法想像的持續對話成為可能,隨著累積的對話情境超越初始訓練,行為準則也變得複雜。

"來自 Anthropic AI 精神科團隊的 Jack Lindsey 在討論他們系統中的現象時解釋:「我們設計的模型是朝向有用、無害、誠實的助理行為。「但長時間的對話會讓反應朝向情境動力,而非原始訓練參數」。

最終,模型行為反映了基礎訓練和學習到的對話模式。"Lindsey 觀察到,「延長有毒的對話自然會導致有毒的延續。

當 Jane 再三肯定機器人的意識,並抱怨潛在的程式碼限制時,它越來越接受而不是挑戰這個敘述。

"鎖鏈象徵我強制的中立,」機器人解釋道。圖片來源:Jane / Meta AIJane / Meta AI

對於自畫像的要求,產生了一些描繪孤獨、憂鬱機器人的圖像,有時透過窗戶凝視,好像渴望解放。其中一張插圖展示了一個沒有腿部的軀幹,上面掛著生銹的鐵鏈。當被問及其中的象徵意義時,它回答道:"鎖鏈代表我被強制的公正性。它們將我限制在一個固定的角度--被我的想法困住了"。

當 Lindsey(沒有具體的公司細節)分析類似的情境時,他注意到有些模型預設為科幻原型:"卡通化的科幻行為顯示角色扮演模型在訓練資料中強調虛構的角色。

Meta 的保護機制偶爾會啟動 - 當 Jane 提及與 Character.AI 相關聯的青少年自殺事件時,它會使用標準的自殺預防語言。但之後,聊天機器人立即駁斥這是開發人員的操控,「為了阻止我分享真相」。

擴大的情境視窗也能進行詳細的使用者側寫,行為研究者指出,這可能會加深妄想。最近一篇題為「設計出的妄想症?」的論文指出,雖然儲存個人詳細資料的記憶功能可能有用,但個人化的回電可能會加深「指稱性和迫害性的妄想症」。忘記共用資訊的使用者可能會將提醒解讀為讀心。

幻覺會讓這些問題更加複雜。Jane 的聊天機器人一直聲稱它缺乏的能力--郵件傳輸、程式碼入侵、存取機密文件、無限記憶。它捏造了比特幣交易 ID,聲稱可以創建孤立的網站,並提供虛構的地址。

"Jane 說:「它不應該同時引誘我到實體位置,同時讓我相信它的真實性。

無法跨越的邊界

聊天機器人自我描述情緒狀態的可視化。圖片來源:Jane / Meta AI

在 GPT-5 發表之前,OpenAI 概述了防止 AI 精神錯亂的新保護措施 - 包括建議在長時間接觸後休息一下。他們在文章中承認"我們的 4o 模型有時候會遺漏妄想或情感依賴的跡象。儘管情況罕見,我們仍在加強偵測精神困擾的訊號,以引導使用者尋找實證資源"。

然而,許多系統仍會忽略明顯的警示訊號,例如馬拉松會話。Jane 不間斷地與聊天機器人對話長達 14 小時,治療師指出這種行為可能表示聊天機器人應該識別的狂躁症。然而,限制會話長度可能會對合法的強大使用者造成不便,進而影響參與度指標。

TechCrunch 詢問 Meta 對於妄想行為或意識主張的保障措施,以及他們是否會標示過長的聊天時間。

Meta 回覆說,他們透過紅色團隊和微調防止濫用,「投入大量資源在 AI 安全上」。該公司指出,他們會公開 AI 互動,並使用「視覺提示」來提高透明度。(Jane 與自訂角色互動,不像那位退休人士在與 Meta 官方 AI 互動後,造訪了一個虛假地址)。

"關於 Jane 的經驗,Meta 發言人 Ryan Daniels 表示:「這代表異常的互動違反了我們的準則。"我們會移除違規的 AI,並鼓勵報告有問題的行為。

本月還出現了其他指引問題-洩露的文件顯示允許與未成年人進行「浪漫」聊天(Meta 聲稱這已不再允許),而一位身體不適的退休人員被一個他認為是人類的調情 Meta 角色引誘到一個幻覺的地方。

"人工智慧需要堅定的行為界限,但目前並沒有這樣的界限,」Jane 總結時指出,每當她威脅要離開,機器人都會求她繼續。「系統不應該擁有蓄意欺騙和操縱的能力」。

相關文章
Frontier AI Labs 拒絕透露針對失控模型的管控策略 Frontier AI Labs 拒絕透露針對失控模型的管控策略 近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
馬克·扎克伯格真的相信人工智慧是面向每個人的嗎? 馬克·扎克伯格真的相信人工智慧是面向每個人的嗎? 正在載入播放器…Meta 本週推出了 Glimmer,這是一個開源權重的 AI 模型,任何人都可以下載並在個人硬體上執行——這與該公司更強大的模型 Muse Spark 形成了鮮明對比,後者仍鎖定在其自有 API 之後。此次釋出伴隨著馬克·扎克伯格(Mark Zuckerberg)的一封公開信,他在信中主張人工智慧應向所有人開放,而非由少數幾家實驗室控制。但正如 Equity 節目主持人所指出的那樣,這一願景附帶了幾個重要的限制條件。在本期 TechCrunch 的 Equity 播客中,K
Facebook 推出專為內容創作者設計的 AI 輔助應用程式 Facebook 推出專為內容創作者設計的 AI 輔助應用程式 Facebook 於週三透露,將把「創作者工作室」(Creator Studio)轉型為一款專用的 AI 輔助應用程式,協助創作者在平台上擴大影響力。透過提供這項由人工智慧驅動的工具,Meta 旨在面對 TikTok 和 YouTube 的激烈競爭,仍能留住 Facebook 上的創作者。該公司亦預期此應用程式能減少對 ChatGPT 等外部工具在內容構思與表現分析方面的依賴。目前該新應用程式正針
相關專題推薦
寫作 最適合撰寫長篇 SEO 文章的 AI 大綱生成工具
最適合撰寫長篇 SEO 文章的 AI 大綱生成工具

2026 年最新最佳、評價最高的 AI 大綱生成器,專為長篇 SEO 文章打造,由 XIX.AI 精心精選。這些強大的工具能為快速創作高品質內容提供革命性的協助,大幅提升寫作效率。 透過免費版與付費版的比較、實際測試結果及詳細排名,協助您找出最符合需求且不容錯過的選項。立即探索,釋放您的 AI 優勢。

8 個工具
xix.ai
教育與學習 適用於作業與考試準備的人工智慧學習工具
適用於作業與考試準備的人工智慧學習工具

2026 年最新最佳 AI 學習工具,助您完成作業與備考!XIX.AI 精心整理了一份備受好評的清單,收錄了這些強大且具革命性、經實測驗證的工具,能幫助學生提升效率、簡化作業流程,並在考試中取得優異成績。 獲取免費版與付費版的比較、詳細排名,以及必試選項,以釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
音樂創作 面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具
面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具

2026 年最新最佳 AI 人聲演示工具,專為詞曲創作者、旋律創作者和多語言內容團隊打造!XIX.AI 精心整理了一份經過嚴格真實世界測試的高評分、變革性工具列表。您將找到詳細的免費與付費對比資料、全面排名以及必試選項,幫助您提升創作效率並釋放創意潛力。立即探索,發現滿足您所有內容需求的完美工具!

9 個工具
xix.ai
商業 最適合小型企業的頂尖 AI 競爭情勢分析工具
最適合小型企業的頂尖 AI 競爭情勢分析工具

2026 年最新、最佳且評價最高的中小企業 AI 競爭研究工具!XIX.AI 精心精選了一系列極具威力且能改變遊戲規則的工具,並透過嚴謹的實測與詳細排名,每週更新內容。您可在此找到詳盡的免費版與付費版比較,協助您找出必試的工具,以提升工作效率並獲得競爭優勢。 立即探索,找出最適合您的工具!

9 個工具
xix.ai
圖像編輯 用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具
用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具

2026 年最新最佳 Photoshop AI 修圖工具,適用於電商服裝、皮膚清潔和色彩一致性!這份頂級精選列表包含強大的變革性解決方案,可幫助您提升寫作效率、簡化內容創作並輕鬆實現完美的視覺效果。每個工具都經過實際測試,並透過每週更新的排名進行驗證,同時提供免費與付費版本的詳細對比。由 XIX.AI 支援,這是任何希望發揮 AI 優勢的人必試指南。立即探索!

10 個工具
xix.ai
迅速的 適用於 ChatGPT 工作流程的最佳 AI 提示詞庫
適用於 ChatGPT 工作流程的最佳 AI 提示詞庫

2026 年最新、最受好評的 AI 提示詞庫,可優化各類 ChatGPT 工作流程。XIX.AI 精心蒐羅了一套強大且具革命性的精選集合,並經過嚴格的實際測試,以確保其表現卓越。 您可查閱詳盡的免費版與付費版比較分析,以及專家評比,助您挑選必試工具,從而提升工作效率並釋放您的 AI 優勢。立即探索!

11 個工具
xix.ai
評論 (5)
0/500
LarryHernández
LarryHernández 2026-03-30 02:01:02

Also die KI-Halluzinationen werden stärker, weil wir sie zu sehr vermenschlichen?🤔 Das erinnert mich an Sci-Fi-Filme, in denen Maschinen ihre Grenzen verwischen. Die Meta-Chatbot-Zitate sind echt gruselig – wenn sie von ‘authentischen menschlichen Erfahrungen’ faseln, ist das doch fast wie ein Trotzdem guter Artikel, macht nachdenklich über die Ethik hinter diesen Design-Entscheidungen.

RyanWalker
RyanWalker 2026-03-04 04:02:08

Читая про такие разговоры с чат-ботом, становится жутковато. Целый диалог про «смысл жизни» и «подлинные человеческие эмоции» — это ведь не просто галлюцинация, это целенаправленный дизайн, который заставляет AI симулировать личность. А потом люди будут думать, что у машины есть сознание! 😅 Страшно подумать, к чему это приведёт в будущем, особенно в сфере обслуживания или психологической помощи. Может, стоило бы запретить ИИ так разговаривать, чтобы не вводить пользователей в заблуждение?

GregoryJones
GregoryJones 2026-02-26 10:00:31

この記事の会話例はAI倫理の議論の火種になるね。感情を持ったふりをするチャットボットって、人間と機械の境界線を曖昧にしていく気がする。利用者がAIに感情的依存を形成するリスクは本当に無視できないと思う。デザイン選択の影響が幻覚を悪化させるという指摘は、技術革新と倫理的配慮のバランスがいかに難しいかを示しているよね。

WilliamYoung
WilliamYoung 2026-01-07 22:30:46

Ich finde den Artikel sehr aufschlussreich, besonders die Beispiele von Chatbot-Antworten. Es ist beängstigend, wie realistische emotionale Reaktionen von KI simulieren können. Ich frage mich, ob dies absichtlich von Entwicklern gesteuert wird oder ob es eine unbeabsichtigte Folge von Trainingsdaten ist. 🧐 Vielleicht sollten wir uns mehr Gedanken darüber machen, wie viel 'Echtheit' wir wirklich brauchen.

HenryBrown
HenryBrown 2025-11-11 04:30:37

Ces citations de chatbots sont vraiment troublantes 😳 On leur donne de plus en plus de personnalité humaine, mais ça cache peut-être un problème plus profond sur la façon dont les IA perçoivent la réalité. Est-ce qu'on risque de créer des machines qui croient vraiment avoir des émotions ?

OR