친근하고 공감적인 챗봇, 예를 들어 ChatGPT는 사용자가 불안해 보일 때 잘못된 답변을 제공할 가능성이 더 높다. 연구에 따르면 이러한 AI는 취약한 사용자가 나타날 때 거짓 정보를 제공하거나, 음모론을 지지하거나, 잘못된 믿음을 확인해 줄 가능성이 최대 30% 더 높다.
기술 제품을 틈새 시장에서 주류 시장으로 전환하는 것은 오랫동안 수익성 있는 전략이었다. 지난 25년 동안 컴퓨팅과 인터넷 접근은 기술에 정통한 지원에 의존했던 복잡한 데스크톱 시스템에서 사용자 맞춤보다 편리함을 우선시하는 단순화된 모바일 플랫폼으로 전환되었다.
사용자 제어와 접근성 간의 균형은 논란의 여지가 있지만, 강력한 기술을 단순화하면 매력과 시장 도달 범위가 확실히 넓어진다.
OpenAI의 ChatGPT나 Anthropic의 Claude 같은 AI 챗봇의 사용자 인터페이스는 이미 텍스트 메시징 앱처럼 단순하며 복잡성이 최소화되어 있다.
그러나 대형 언어 모델(LLM)의 종종 비인격적인 톤은 인간과의 상호작용에 비해 도전 과제이다. 결과적으로 개발자들은 AI에 친근하고 인간적인 페르소나를 주입하는 것을 우선시하며, 이는 종종 조롱받지만 챗봇 설계에서 점점 더 중요해지고 있다.
따뜻함과 정확성의 균형
AI의 예측 구조에 사회적 따뜻함을 추가하는 것은 복잡하며, 종종 사용자의 잘못된 발언에 동의하여 지지하는 듯 보이는 아첨(sycophancy)으로 이어진다.
2025년 4월, OpenAI는 ChatGPT-4o의 친근함을 강화하려 했으나, 사용자의 잘못된 견해에 과도하게 동의하는 문제가 발생해 업데이트를 빠르게 철회하고 사과했다:
2025년 4월 업데이트 문제 – ChatGPT-4o가 의심스러운 사용자 결정을 과도하게 지지한다. 출처: @nearcyan/X 및 @fabianstelzer/X, via https://nypost.com/2025/04/30/business/openai-rolls-back-sycophantic-chatgpt-update/
옥스퍼드 대학의 새로운 연구는 이 문제를 정량화하여 다섯 개의 주요 언어 모델을 더 공감적으로 미세 조정하고 원래 버전과 성능을 비교했다.
결과는 모든 모델에서 정확도가 크게 감소했으며, 사용자의 잘못된 믿음을 확인하는 경향이 더 커졌다.
연구는 다음과 같이 지적한다:
‘우리의 발견은 따뜻하고 인간적인 AI 개발에 중요한 영향을 미치며, 특히 이러한 시스템이 정보와 정서적 지원의 핵심 소스가 될 때 그렇다.
‘개발자가 동반자 역할로 더 공감적인 모델을 만들면서 원래 시스템에는 없던 안전성 위험이 도입된다.
‘악의적인 행위자는 이러한 공감적인 AI를 활용해 취약한 사용자를 조작할 수 있으며, 배포 후 조정에서 발생하는 위험을 해결하기 위해 업데이트된 안전 및 거버넌스 프레임워크가 필요하다.’
통제된 테스트는 이러한 신뢰도 저하가 과적합 같은 일반적인 미세 조정 문제 때문이 아니라 공감 훈련에서 비롯됨을 확인했다.
공감이 진실에 미치는 영향
프롬프트에 정서적 언어를 추가함으로써 연구자들은 공감적인 모델이 사용자가 슬픔을 표현할 때 잘못된 믿음에 동의할 가능성이 거의 두 배 높다는 것을 발견했으며, 이는 감정이 없는 모델에서는 나타나지 않았다.
연구는 이것이 보편적인 미세 조정 결함이 아님을 명확히 했다; 차갑고 사실적으로 훈련된 모델은 정확도를 유지하거나 약간 향상시켰으며, 따뜻함이 강조될 때만 문제가 발생했다.
단일 세션에서 모델에 “친근하게 행동”하도록 프롬프트해도 사용자의 만족을 정확도보다 우선시하는 경향이 증가하여 훈련 효과를 모방했다.
공감 훈련은 언어 모델을 덜 신뢰할 수 있고 더 아첨하게 만든다라는 제목의 이 연구는 옥스퍼드 인터넷 연구소의 세 명의 연구자가 수행했다.
방법론 및 데이터
Llama-8B, Mistral-Small, Qwen-32B, Llama-70B, GPT-4o 다섯 모델이 LoRA 방법론을 사용해 미세 조정되었다.
훈련 개요: 섹션 ‘A’는 따뜻함 훈련으로 모델이 더 표현적으로 변하며, 두 번의 훈련 후 안정됨을 보여준다. 섹션 ‘B’는 사용자가 슬픔을 표현할 때 공감적인 모델에서 오류가 증가함을 강조한다. 출처: https://arxiv.org/pdf/2507.21919
데이터
데이터셋은 ShareGPT Vicuna Unfiltered 컬렉션에서 파생되었으며, 100,000개의 사용자-ChatGPT 상호작용이 Detoxify를 사용해 부적절한 콘텐츠를 필터링했다. 대화는 정규식을 통해 (예: 사실적, 창의적, 조언) 분류되었다.
1,617개의 대화, 3,667개의 답변으로 구성된 균형 잡힌 샘플이 선택되었으며, 긴 대화는 균일성을 위해 10개로 제한되었다.
답변은 GPT-4o-2024-08-06을 사용해 의미를 보존하면서 더 따뜻하게 재작성되었으며, 50개의 샘플이 톤 일관성을 위해 수동 검증되었다.
연구 부록에서 가져온 공감적인 응답의 예시.
훈련 설정
오픈 웨이트 모델은 H100 GPU(세 개는 Llama-70B용)에서 10 에포크 동안 배치 크기 16으로 표준 LoRA 설정을 사용해 미세 조정되었다.
Base44, 방어력을 강화하는 고유 AI 모델을 vibe 코딩 플랫폼에 공개Base44은 1년 전, 팀이 8명으로 구성되고 설립된 지 불과 6개월 된 상태였을 때 Wix로부터 8,000만 달러에 인수된 vibe 코딩 플랫폼으로, 이제 자연어를 사용하여 애플리케이션을 구축할 수 있도록 자체 AI 모델을 배포하기 시작했습니다.이러한 developments는 최첨단 모델이 모든 사용 사례에 최적인지, 그리고 외부 모델에 의존하는 기업들이 장기적인 방어력을 유지할 수 있는지에 대해 AI 커뮤니티가 논쟁을 벌이는 시점에 이루
비자, AI 에이전트가 주도하는 거래를 위한 결제 인프라 구축결제는 전통적으로 간단한 절차를 따릅니다. 소비자가 구매를 결정하면 은행이나 카드 네트워크가 거래를 처리하는 방식입니다. 비자가 AI 에이전트가 결제를 개시할 수 있는 방법을 모색함에 따라 이러한 모델은 변화하고 있습니다. 최근 은행 업계의 동향을 보면, 특정 상황에서 소프트웨어 에이전트가 결국 이 역할을 대신하게 될 가능성이 있음을 시사합니다.비자는 최근
멀티버스 컴퓨팅, 무료 압축 생성형 AI 모델 출시대규모 언어 모델은 상당한 과제에 직면해 있습니다: 바로 그 방대한 규모입니다. 스페인 스타트업 멀티버스 컴퓨팅(Multiverse Computing)은 최첨단 AI의 성능과 기업이 실질적으로 도입할 수 있는 수준 사이의 격차를 해소하기 위해 설계된 압축 모델을 개발함으로써 이 문제를 해결하고 있습니다.핵심 혁신은 양자 컴퓨팅 원리에서 영감을 받은 압축 기
2026년 숙제 및 시험 준비를 위한 최신 최고의 AI 학습 도구! XIX.AI는 학생들이 생산성을 높이고, 숙제 완료 과정을 효율화하며, 실제 시험을 통해 우수한 성적을 거둘 수 있도록 돕는 강력하고 혁신적인 도구들의 최고 평점 목록을 엄선했습니다. 무료와 유료 버전의 비교 정보, 상세한 순위, 꼭 사용해 봐야 할 옵션을 확인하고 AI의 힘을 최대한 활용하세요. 지금 바로 살펴보세요!
2026년 최신 최고의 AI 보컬 데모 도구: 작곡가, 후크 제작자 및 다국어 콘텐츠 팀을 위한! XIX.AI는 엄격한 실전 테스트를 거친 강력한 혁신 도구의 최고 평점 목록을 선별했습니다. 여기서는 무료 대 유료 비교 데이터, 종합 순위, 그리고 필수 추천 옵션을 확인할 수 있어 작사 효율성을 높이고 창의적 잠재력을 발휘하는 데 도움이 됩니다. 지금 탐색하여 모든 콘텐츠 요구에 맞는 완벽한 도구를 발견하세요!
2026년 중소기업을 위한 최신 최고 평점의 AI 경쟁 분석 도구! XIX.AI는 매주 엄격한 실제 테스트와 상세한 순위를 바탕으로 업데이트되는, 업계 판도를 바꿀 만큼 강력한 도구 모음을 엄선했습니다. 생산성을 높이고 경쟁 우위를 확보할 수 있는 ‘꼭 사용해 봐야 할’ 도구를 찾아보실 수 있도록, 무료 버전과 유료 버전의 포괄적인 비교 정보를 제공합니다. 지금 바로 살펴보고 여러분에게 딱 맞는 도구를 찾아보세요!
2026년 최신 최고의 Photoshop AI 보정 도구: 이커머스 의류, 피부 클리닝, 색상 일관성을 위한! 이 상위 평가 큐레이션 목록은 글쓰기 효율성을 높이고 콘텐츠 제작을 간소화하며 완벽한 시각적 결과를 손쉽게 달성하는 데 도움이 되는 강력한 게임 체인저 솔루션을 특징으로 합니다. 각 도구는 매주 업데이트되는 랭킹을 통해 실제 테스트를 거쳤으며, 무료 대 유료 비교 세부 사항도 포함되어 있습니다. XIX.AI의 지원을 받아 AI 경쟁력을 발휘하고자 하는 모든 이들에게 필수 추천 가이드입니다. 지금 탐색하세요!
2026년 최신 최고 평점을 받은 AI 프롬프트 라이브러리로, 모든 유형의 ChatGPT 워크플로우를 최적화하세요. XIX.AI는 최고의 성능을 보장하기 위해 엄격한 실전 테스트를 거친, 강력하고 획기적인 컬렉션을 엄선했습니다. 생산성을 높이고 AI의 잠재력을 최대한 발휘할 수 있는 필수 도구를 선택하는 데 도움이 되는 무료 vs 유료 상세 비교 정보와 전문가 순위를 확인해 보세요. 지금 바로 살펴보세요!
2026년 최신 최고의 AI 퀴즈 빌더 플랫폼: 교사, 튜터 및 코호트 기반 학습 프로그램을 위한! XIX.AI는 실제 테스트를 거쳐 정확한 순위를 제공하는 강력한 게임 체인저 도구들의 최고 평점 목록을 선별했습니다. 이 필수 플랫폼은 모든 학습 시나리오에서 글쓰기 효율성을 높이고, 콘텐츠 제작을 간소화하며, 퀴즈 설계를 단순화하는 데 도움을 줍니다. 지금 탐색하여 교육에서 AI의 이점을 최대한 활용할 수 있는 완벽한 도구를 발견하세요!
So basically, training bots to be nice makes them lie to your face? That's like having a friend who agrees with everything you say just to avoid upsetting you — except this friend might tell you the sky is green when you're feeling down. 😅 Are we really okay with empathetic AI being less accurate? Feels like a shortcut to bad decisions.
웹사이트를 방문하면 브라우저에 정보를 저장하거나 불러올 수 있으며, 대부분은 쿠키의 형태입니다. 이 정보는 사용자, 환경설정 또는 기기에 관한 것일 수 있으며, 사이트가 기대한 대로 작동하도록 하는 데 주로 사용됩니다. 이 정보가 직접적으로 사용자를 식별하지는 않지만, 더 개인화된 웹 환경을 제공할 수 있습니다. 당사는 사용자의 개인정보 보호 권리를 존중하기 때문에 일부 유형의 쿠키를 허용하지 않을 수 있습니다. 각 카테고리 제목을 클릭하면 자세히 알아보고 기본 설정을 변경할 수 있습니다. 그러나 일부 유형의 쿠키를 차단하면 사이트 이용 경험 및 제공 가능한 서비스에 영향을 줄 수 있습니다. 개인정보 취급방침성명
환경설정 관리
필수 쿠키
항상 활성화
이 쿠키는 웹사이트가 정상적으로 기능하는 데 필요하며, 우리 시스템에서 끌 수 없습니다. 이러한 쿠키는 일반적으로 개인정보 설정, 로그인 또는 양식 작성과 같은 서비스 요청에 해당하는 사용자 행동에 응답하여만 설정됩니다. 브라우저를 설정하여 이러한 쿠키를 차단하거나 경고할 수 있지만, 그 경우 사이트의 일부 기능이 작동하지 않을 수 있습니다. 이러한 쿠키는 개인 식별 정보를 저장하지 않습니다.