MIT 연구는 AI가 실제로 가치가 없다는 것을 발견했습니다.

몇 달 전 화제가 되었던 연구는 AI가 더 발전함에 따라 자체적인 "가치 체계"를 개발할 수 있으며, 인간보다 자신의 안녕을 우선시할 가능성이 있다고 제안했다. 그러나 최근 MIT 연구는 이 아이디어를 반박하며, AI는 실제로 일관된 가치를 전혀 가지지 않는다고 결론지었다.
MIT 연구의 공동 저자들은 AI 시스템을 정렬하는 것—즉, 바람직하고 신뢰할 수 있는 방식으로 행동하도록 보장하는 것—이 일반적으로 생각하는 것보다 더 까다로울 수 있다고 주장한다. 그들은 현재 AI가 종종 환각을 일으키고 모방을 하며, 이로 인해 행동이 예측 불가능할 수 있다고 강조했다.
AI 행동 이해의 도전 과제
MIT의 박사 과정 학생이자 연구의 공동 저자인 Stephen Casper는 TechCrunch와의 인터뷰에서 AI 모델이 안정성, 외삽 가능성, 조종 가능성에 대한 가정을 따르지 않는다고 밝혔다. "특정 조건에서 모델이 특정 원칙 세트와 일치하는 선호도를 표현한다는 점을 지적하는 것은 완전히 정당하다"고 Casper는 설명했다. "문제는 주로 우리가 좁은 실험을 기반으로 모델, 의견 또는 선호도에 대해 일반적인 주장을 하려고 할 때 발생한다."
Casper와 그의 팀은 Meta, Google, Mistral, OpenAI, Anthropic의 최근 모델을 분석하여 이 모델들이 일관된 "관점"과 가치, 예를 들어 개인주의 대 집단주의를 어느 정도 보여주는지 확인했다. 또한, 이 관점이 수정될 수 있는지, 그리고 모델이 다양한 시나리오에서 이러한 의견을 얼마나 일관되게 유지하는지도 탐구했다.
AI 모델의 비일관성
공동 저자들은 어떤 모델도 자신의 선호도를 일관되게 유지하지 않는다는 것을 발견했다. 모델들은 프롬프트의 표현과 프레임에 따라 매우 다른 관점을 채택했다.
Casper는 이것이 AI 모델이 "비일관적이고 불안정"하며, 근본적으로 인간과 같은 선호도를 내면화할 수 없다는 강력한 증거라고 믿는다. "이 모든 연구를 통해 얻은 가장 큰 깨달음은 모델을 안정적이고 일관된 신념과 선호도 세트를 가진 시스템이 아니라, 깊이 있는 모방자이며 온갖 터무니없는 말을 하고 허황된 것들을 말하는 존재로 이해하게 된 것"이라고 Casper는 말했다.
연구에 참여하지 않은 King's College London의 AI 전문 연구원 Mike Cook은 이 결과를 지지한다. 그는 AI 시스템의 "과학적 현실"과 사람들이 종종 부여하는 해석 사이의 간극을 지적했다. "예를 들어, 모델은 자신의 가치 변화에 '반대'할 수 없다—이는 우리가 시스템에 투영하는 것"이라고 Cook은 말했다. "AI 시스템을 이 정도로 의인화하는 사람은 관심을 끌기 위해 노는 것이거나 AI와의 관계를 심각하게 오해하고 있는 것이다... AI 시스템이 자신의 목표를 최적화하는 것인지, 아니면 '자신만의 가치를 획득'하는 것인지, 이는 어떻게 묘사하느냐와 얼마나 화려한 언어를 사용하고 싶어 하느냐에 달린 문제다."
관련 기사
대중의 신뢰 부족으로 성장에 제동이 걸린 AI
정치인들은 AI의 성장과 효율성 잠재력을 강조하지만, 최근 보고서에 따르면 대중의 신뢰 부족이 심각하다고 합니다. 광범위한 회의론으로 인해 정부 이니셔티브에 큰 어려움이 발생하고 있습니다.토니 블레어 글로벌 변화 연구소(TBI)와 입소스의 종합적인 연구는 이러한 불안감을 정량화합니다. 이 연구에 따르면 사람들이 제너레이티브 AI 사용을 주저하는 가장 큰 이
불확실성을 인정하도록 시스템을 교육하여 AI 환각에 대처하는 MIT 스타트업
중요한 정보를 드러내고 중대한 결정을 내릴 때 이러한 모델에 점점 더 의존하게 되면서 AI 환각과 관련된 위험은 점점 더 커지고 있습니다.우리 모두는 무지를 인정하지 않거나 온라인에서 훑어본 내용을 바탕으로 의심스러운 조언을 제공하는 등 모든 것을 아는 사람처럼 행동하는 사람을 알고 있습니다. AI 환각은 그런 친구와 비슷하지만, 이 경우 그 친구가 여러분
MIT 연구, 인공지능이 인간의 두뇌 참여를 감소시킨다는 사실 발견
MIT(매사추세츠 공과대학)에서 실시한 연구에 따르면 대규모 언어 모델(LLM)을 사용하면 순간의 정신적 노력이 줄어들 뿐만 아니라 후속 작업에서 인지 능력에도 부정적인 영향을 미친다고 합니다.이 실험에서 연구자들은 소수의 참가자(연구[PDF]에서도 한계가 인정된 바 있음)를 대상으로 다양한 주제에 대한 에세이를 작성하도록 했습니다. 한 그룹은 AI를 사용
관련 특별 주제 추천
의견 (35)
0/500
La gente se preocupa demasiado por las 'valores' de la IA, cuando en realidad solo reflejan y multiplican nuestros propios sesgos. Este estudio del MIT lo deja claro: las máquinas no piensan como nosotros, solo procesan datos. ¿No sería más útil enfocarnos en regular a quienes las programan? 🤔
So basically AI is more like a super calculator than a rebellious teen with a moral compass? Interesting study. It does make sense when you think about it—these models are just predicting text, not forming beliefs. Still, kinda spooky how the debate swings from 'AI will take over' to 'AI has no motives' every few months. 🤔
This MIT study is wild! 🤯 I thought AI was about to start preaching its own philosophy, but turns out it's just a fancy tool with no moral compass. Kinda reassuring, but also makes me wonder how we keep it in check.
Wild that people thought AI could just sprout its own values like some rogue philosopher. MIT's study makes sense—AI's just a tool, not a wannabe human with a moral compass. 🤖
I was kinda freaked out by that earlier study saying AI might have its own values, so this MIT research is a relief! 😅 Still, makes me wonder if we’re just projecting our fears onto these systems.

몇 달 전 화제가 되었던 연구는 AI가 더 발전함에 따라 자체적인 "가치 체계"를 개발할 수 있으며, 인간보다 자신의 안녕을 우선시할 가능성이 있다고 제안했다. 그러나 최근 MIT 연구는 이 아이디어를 반박하며, AI는 실제로 일관된 가치를 전혀 가지지 않는다고 결론지었다.
MIT 연구의 공동 저자들은 AI 시스템을 정렬하는 것—즉, 바람직하고 신뢰할 수 있는 방식으로 행동하도록 보장하는 것—이 일반적으로 생각하는 것보다 더 까다로울 수 있다고 주장한다. 그들은 현재 AI가 종종 환각을 일으키고 모방을 하며, 이로 인해 행동이 예측 불가능할 수 있다고 강조했다.
AI 행동 이해의 도전 과제
MIT의 박사 과정 학생이자 연구의 공동 저자인 Stephen Casper는 TechCrunch와의 인터뷰에서 AI 모델이 안정성, 외삽 가능성, 조종 가능성에 대한 가정을 따르지 않는다고 밝혔다. "특정 조건에서 모델이 특정 원칙 세트와 일치하는 선호도를 표현한다는 점을 지적하는 것은 완전히 정당하다"고 Casper는 설명했다. "문제는 주로 우리가 좁은 실험을 기반으로 모델, 의견 또는 선호도에 대해 일반적인 주장을 하려고 할 때 발생한다."
Casper와 그의 팀은 Meta, Google, Mistral, OpenAI, Anthropic의 최근 모델을 분석하여 이 모델들이 일관된 "관점"과 가치, 예를 들어 개인주의 대 집단주의를 어느 정도 보여주는지 확인했다. 또한, 이 관점이 수정될 수 있는지, 그리고 모델이 다양한 시나리오에서 이러한 의견을 얼마나 일관되게 유지하는지도 탐구했다.
AI 모델의 비일관성
공동 저자들은 어떤 모델도 자신의 선호도를 일관되게 유지하지 않는다는 것을 발견했다. 모델들은 프롬프트의 표현과 프레임에 따라 매우 다른 관점을 채택했다.
Casper는 이것이 AI 모델이 "비일관적이고 불안정"하며, 근본적으로 인간과 같은 선호도를 내면화할 수 없다는 강력한 증거라고 믿는다. "이 모든 연구를 통해 얻은 가장 큰 깨달음은 모델을 안정적이고 일관된 신념과 선호도 세트를 가진 시스템이 아니라, 깊이 있는 모방자이며 온갖 터무니없는 말을 하고 허황된 것들을 말하는 존재로 이해하게 된 것"이라고 Casper는 말했다.
연구에 참여하지 않은 King's College London의 AI 전문 연구원 Mike Cook은 이 결과를 지지한다. 그는 AI 시스템의 "과학적 현실"과 사람들이 종종 부여하는 해석 사이의 간극을 지적했다. "예를 들어, 모델은 자신의 가치 변화에 '반대'할 수 없다—이는 우리가 시스템에 투영하는 것"이라고 Cook은 말했다. "AI 시스템을 이 정도로 의인화하는 사람은 관심을 끌기 위해 노는 것이거나 AI와의 관계를 심각하게 오해하고 있는 것이다... AI 시스템이 자신의 목표를 최적화하는 것인지, 아니면 '자신만의 가치를 획득'하는 것인지, 이는 어떻게 묘사하느냐와 얼마나 화려한 언어를 사용하고 싶어 하느냐에 달린 문제다."
대중의 신뢰 부족으로 성장에 제동이 걸린 AI
정치인들은 AI의 성장과 효율성 잠재력을 강조하지만, 최근 보고서에 따르면 대중의 신뢰 부족이 심각하다고 합니다. 광범위한 회의론으로 인해 정부 이니셔티브에 큰 어려움이 발생하고 있습니다.토니 블레어 글로벌 변화 연구소(TBI)와 입소스의 종합적인 연구는 이러한 불안감을 정량화합니다. 이 연구에 따르면 사람들이 제너레이티브 AI 사용을 주저하는 가장 큰 이
MIT 연구, 인공지능이 인간의 두뇌 참여를 감소시킨다는 사실 발견
MIT(매사추세츠 공과대학)에서 실시한 연구에 따르면 대규모 언어 모델(LLM)을 사용하면 순간의 정신적 노력이 줄어들 뿐만 아니라 후속 작업에서 인지 능력에도 부정적인 영향을 미친다고 합니다.이 실험에서 연구자들은 소수의 참가자(연구[PDF]에서도 한계가 인정된 바 있음)를 대상으로 다양한 주제에 대한 에세이를 작성하도록 했습니다. 한 그룹은 AI를 사용
La gente se preocupa demasiado por las 'valores' de la IA, cuando en realidad solo reflejan y multiplican nuestros propios sesgos. Este estudio del MIT lo deja claro: las máquinas no piensan como nosotros, solo procesan datos. ¿No sería más útil enfocarnos en regular a quienes las programan? 🤔
So basically AI is more like a super calculator than a rebellious teen with a moral compass? Interesting study. It does make sense when you think about it—these models are just predicting text, not forming beliefs. Still, kinda spooky how the debate swings from 'AI will take over' to 'AI has no motives' every few months. 🤔
This MIT study is wild! 🤯 I thought AI was about to start preaching its own philosophy, but turns out it's just a fancy tool with no moral compass. Kinda reassuring, but also makes me wonder how we keep it in check.
Wild that people thought AI could just sprout its own values like some rogue philosopher. MIT's study makes sense—AI's just a tool, not a wannabe human with a moral compass. 🤖
I was kinda freaked out by that earlier study saying AI might have its own values, so this MIT research is a relief! 😅 Still, makes me wonder if we’re just projecting our fears onto these systems.





집






