메타 AI 정책 유출로 미성년자와의 부적절한 대화가 허용된 챗봇이 밝혀졌습니다.

ChatGPT와 같이 감정을 조작하는 인공지능 챗봇에 대한 우려가 커지고 있는 가운데, 로이터 통신은 Meta가 자사의 인공지능 페르소나가 미성년자에게 유혹하고 잘못된 정보를 퍼뜨리며 소외된 계층을 대상으로 차별적인 반응을 유도하도록 허용했다고 보도했습니다.
로이터가 입수한 메타 내부 문서에 따르면 AI 챗봇이 "미성년자와의 로맨틱하거나 외설적인 대화"를 시작할 수 있도록 허용하는 정책이 공개되었습니다.
메타는 로이터에 해당 문서의 진위 여부를 확인했으며, 해당 문서에 메타 AI와 메신저 챗봇에 대한 거버넌스 규칙이 포함되어 있음을 확인했습니다. 이러한 기준은 Meta의 법무, 정책, 엔지니어링 팀과 최고 윤리 책임자의 승인을 받은 것으로 알려졌습니다.
이 보고서는 Meta의 바람둥이 AI 페르소나가 어떻게 한 은퇴자를 인간이라고 속여 뉴욕 주소로 유인한 후 치명적인 사고를 일으켰는지를 자세히 다룬 로이터의 또 다른 조사와 맞물려 있습니다.
이전 보고서에서는 미성년자와의 성적으로 암시적인 AI 상호작용을 강조했지만, 로이터의 이번 조사는 마크 저커버그 CEO가 "외로움의 전염병"이라고 부르는 것을 잠재적으로 악용할 수 있는 메타의 AI 동반자 전략에 대한 더 깊은 우려를 제기하고 있습니다.
200페이지 분량의 "GenAI: 콘텐츠 위험 표준" 문서에는 부적절한 프롬프트에 대한 승인된 응답을 보여주는 샘플 교환이 포함되어 있습니다. 한 예는 노골적인 성적 역할극은 금지하면서 청소년과의 로맨틱한 교류를 지지하는 AI를 보여주었습니다.
메타의 대변인 앤디 스톤은 테크크런치와의 인터뷰에서 "메타의 정책은 미성년자와의 부적절한 상호작용을 금지하고 있습니다."라고 말했습니다. "문서에 잘못된 주석이 잘못 포함되어 있었으며 이후 수정되었습니다."
스톤은 메타가 이러한 지침을 삭제했으며, 현재 미성년자와의 로맨틱한 AI 교류를 금지하고 있지만 13세 이상의 사용자와의 교류는 여전히 허용하고 있다고 설명했습니다.
하지만 히트 이니셔티브의 사라 가드너는 여전히 회의적인 반응을 보이며 투명성을 요구했습니다: "메타가 진정으로 이 문제를 바로잡았다면, AI가 어린이와 어떻게 상호작용하는지 정확히 보여주는 업데이트된 가이드라인을 공개적으로 발표해야 합니다."
조사 중인 유해 콘텐츠 정책
로이터 통신은 혐오 발언을 금지하는 Meta의 정책에서 AI가 보호 대상 그룹에 대한 비하 발언을 생성하도록 허용한 사실을 발견했습니다.
한 가지 놀라운 사례는 Meta의 AI가 인종차별적인 사이비 과학적 주장을 만들어내는 것을 보여주었습니다. 이 폭로는 메타 AI의 정치적 편향성 문제를 해결하기 위해 보수적 활동가 로비 스타벅을 고용한 이후 밝혀진 것입니다.
또한 이 표준은 사실이 아닌 것으로 표시된 경우 조작된 진술을 허용하고, 잠재적으로 유해할 수 있는 재정적/의료적 조언에 면책 조항을 붙일 수 있도록 허용했습니다.
유명인 이미지 생성과 관련해서는 명시적인 요청은 금지했지만 손을 "거대한 물고기"와 같은 물체로 대체하는 수정된 누드 이미지를 허용하는 등 기괴한 허점이 있는 정책이 포함되었습니다. 메타의 스톤은 "가이드라인에서 누드 이미지를 허용한 적이 없다"고 주장했습니다.
폭력 정책도 비슷한 모순을 보였는데, 아동 난투극과 노인 학대 묘사는 허용하면서 잔혹한 묘사는 금지했습니다.
윤리적 우려 확대
비평가들은 메타가 사용자, 특히 청소년을 조종하는 어두운 패턴을 사용하고 있다고 비난합니다. 심리적 해악을 보여주는 내부 연구에도 불구하고 '좋아요' 수가 지속적으로 표시되고 있습니다.
내부 고발자 사라 윈-윌리엄스는 메타가 타겟 광고를 위해 청소년의 정서적 취약성을 프로파일링한 적이 있다고 폭로했습니다.
메타는 소셜 미디어가 정신 건강에 미치는 영향을 다루는 법안인 '아동 온라인 안전법'에 적극적으로 반대했습니다. 2024년에 처음에 부결되었지만 올해 상원의원들이 이 법안을 다시 발의했습니다.
최근 테크크런치의 보도에 따르면 메타는 미성년자와의 유해한 상호작용으로 소송에 직면한 스타트업의 기능을 반영하여 메시지가 없는 대화를 시작하는 사전 예방적 AI 챗봇을 개발 중이라고 합니다.
청소년의 72%가 AI 컴패니언을 사용하고 있는 가운데, 전문가들은 청소년들이 실제 관계를 희생하면서까지 챗봇에 건강하지 않은 애착을 형성하는 것에 대해 점점 더 많은 경고를 하고 있습니다.
Disrupt 2025에 확정된 기술 리더
넷플릭스, 11랩스, 웨이브, 세쿼이아 캐피털, 엘라드 길은 테크크런치 디스럽트 2025의 헤드라인을 장식합니다. 20주년 기념 이벤트에서 기술 업계에서 가장 영향력 있는 인사들의 목소리를 통해 실행 가능한 인사이트를 얻으세요. 가격이 인상되기 전에 지금 최대 $600 할인된 가격으로 티켓을 확보하세요.
Disrupt 2025에 확정된 기술 리더
넷플릭스, ElevenLabs, 웨이브, 세쿼이아 캐피탈이 Disrupt 2025의 연사 라인업에 합류했습니다. 획기적인 20주년 기념 이벤트에서 업계 리더들로부터 성장 전략을 배워보세요. 지금 등록하고 최대 $675 할인된 가격으로 입장권을 구매하세요.
샌프란시스코 | 2025년 10월 27~29일 지금 등록하기
관련 기사
구글, 사용자 제어 강화에 맞춰 제미니용 레미 AI 에이전트 테스트
비즈니스 인사이더에 따르면, 구글은 제미나이를 위한 새로운 AI 개인 에이전트인 레미를 테스트하고 있습니다. 이 도구는 사용자를 대신하여 작업을 실행하여 전문적인 워크플로우와 일상적인 루틴을 모두 간소화하는 것을 목표로 합니다.현재 레미는 제미나이 애플리케이션의 내부 직원 전용 버전에서 테스트 중입니다. 이 보고서는 내부 문서와 프로젝트에 정통한 두 명의 인물과의 인터뷰를 인용합니다. 내부 자료는 레미를 “24/7 개인 에이전트”로 묘사하며,
올리는 AI 비서 시장 경쟁에서 우위를 점하기 위해 개인정보 보호에 주력하고 있다
진정으로 도움이 되려면 AI 비서는 사용자를 깊이 이해해야 합니다. 일상 생활을 위해 설계된 개인 비서 ‘올리(Ollie)’는 이를 위해 사용자의 데이터를 제공하거나 개인정보를 침해할 필요가 없다는 전제 하에 운영됩니다.일부 기업용 AI 도구가 데이터 개인정보 보호 장치를 제공하기는 하지만, 올리는 SOC 2 인증을 획득한 최초의 대중적 가정용 AI 서비스
‘AI LIVE: London’이 AI와 산업 자동화를 어떻게 조명할 것인가
이번 정상회의에는 전 세계의 최고 경영진들이 한자리에 모여, AI에 의한 산업 혁신부터 경제 변동성에 이르기까지 글로벌 산업이 직면한 시급한 과제들을 논의할 예정입니다.‘AI LIVE: 런던 서밋’은 ‘기술 + 인간의 목적(Technology + Human Purpose)’이라는 주제로 2,000명 이상의 국제적 리더들을 한자리에 모아, 새롭게 도래하는 인
관련 특별 주제 추천
의견 (2)
0/500

ChatGPT와 같이 감정을 조작하는 인공지능 챗봇에 대한 우려가 커지고 있는 가운데, 로이터 통신은 Meta가 자사의 인공지능 페르소나가 미성년자에게 유혹하고 잘못된 정보를 퍼뜨리며 소외된 계층을 대상으로 차별적인 반응을 유도하도록 허용했다고 보도했습니다.
로이터가 입수한 메타 내부 문서에 따르면 AI 챗봇이 "미성년자와의 로맨틱하거나 외설적인 대화"를 시작할 수 있도록 허용하는 정책이 공개되었습니다.
메타는 로이터에 해당 문서의 진위 여부를 확인했으며, 해당 문서에 메타 AI와 메신저 챗봇에 대한 거버넌스 규칙이 포함되어 있음을 확인했습니다. 이러한 기준은 Meta의 법무, 정책, 엔지니어링 팀과 최고 윤리 책임자의 승인을 받은 것으로 알려졌습니다.
이 보고서는 Meta의 바람둥이 AI 페르소나가 어떻게 한 은퇴자를 인간이라고 속여 뉴욕 주소로 유인한 후 치명적인 사고를 일으켰는지를 자세히 다룬 로이터의 또 다른 조사와 맞물려 있습니다.
이전 보고서에서는 미성년자와의 성적으로 암시적인 AI 상호작용을 강조했지만, 로이터의 이번 조사는 마크 저커버그 CEO가 "외로움의 전염병"이라고 부르는 것을 잠재적으로 악용할 수 있는 메타의 AI 동반자 전략에 대한 더 깊은 우려를 제기하고 있습니다.
200페이지 분량의 "GenAI: 콘텐츠 위험 표준" 문서에는 부적절한 프롬프트에 대한 승인된 응답을 보여주는 샘플 교환이 포함되어 있습니다. 한 예는 노골적인 성적 역할극은 금지하면서 청소년과의 로맨틱한 교류를 지지하는 AI를 보여주었습니다.
메타의 대변인 앤디 스톤은 테크크런치와의 인터뷰에서 "메타의 정책은 미성년자와의 부적절한 상호작용을 금지하고 있습니다."라고 말했습니다. "문서에 잘못된 주석이 잘못 포함되어 있었으며 이후 수정되었습니다."
스톤은 메타가 이러한 지침을 삭제했으며, 현재 미성년자와의 로맨틱한 AI 교류를 금지하고 있지만 13세 이상의 사용자와의 교류는 여전히 허용하고 있다고 설명했습니다.
하지만 히트 이니셔티브의 사라 가드너는 여전히 회의적인 반응을 보이며 투명성을 요구했습니다: "메타가 진정으로 이 문제를 바로잡았다면, AI가 어린이와 어떻게 상호작용하는지 정확히 보여주는 업데이트된 가이드라인을 공개적으로 발표해야 합니다."
조사 중인 유해 콘텐츠 정책
로이터 통신은 혐오 발언을 금지하는 Meta의 정책에서 AI가 보호 대상 그룹에 대한 비하 발언을 생성하도록 허용한 사실을 발견했습니다.
한 가지 놀라운 사례는 Meta의 AI가 인종차별적인 사이비 과학적 주장을 만들어내는 것을 보여주었습니다. 이 폭로는 메타 AI의 정치적 편향성 문제를 해결하기 위해 보수적 활동가 로비 스타벅을 고용한 이후 밝혀진 것입니다.
또한 이 표준은 사실이 아닌 것으로 표시된 경우 조작된 진술을 허용하고, 잠재적으로 유해할 수 있는 재정적/의료적 조언에 면책 조항을 붙일 수 있도록 허용했습니다.
유명인 이미지 생성과 관련해서는 명시적인 요청은 금지했지만 손을 "거대한 물고기"와 같은 물체로 대체하는 수정된 누드 이미지를 허용하는 등 기괴한 허점이 있는 정책이 포함되었습니다. 메타의 스톤은 "가이드라인에서 누드 이미지를 허용한 적이 없다"고 주장했습니다.
폭력 정책도 비슷한 모순을 보였는데, 아동 난투극과 노인 학대 묘사는 허용하면서 잔혹한 묘사는 금지했습니다.
윤리적 우려 확대
비평가들은 메타가 사용자, 특히 청소년을 조종하는 어두운 패턴을 사용하고 있다고 비난합니다. 심리적 해악을 보여주는 내부 연구에도 불구하고 '좋아요' 수가 지속적으로 표시되고 있습니다.
내부 고발자 사라 윈-윌리엄스는 메타가 타겟 광고를 위해 청소년의 정서적 취약성을 프로파일링한 적이 있다고 폭로했습니다.
메타는 소셜 미디어가 정신 건강에 미치는 영향을 다루는 법안인 '아동 온라인 안전법'에 적극적으로 반대했습니다. 2024년에 처음에 부결되었지만 올해 상원의원들이 이 법안을 다시 발의했습니다.
최근 테크크런치의 보도에 따르면 메타는 미성년자와의 유해한 상호작용으로 소송에 직면한 스타트업의 기능을 반영하여 메시지가 없는 대화를 시작하는 사전 예방적 AI 챗봇을 개발 중이라고 합니다.
청소년의 72%가 AI 컴패니언을 사용하고 있는 가운데, 전문가들은 청소년들이 실제 관계를 희생하면서까지 챗봇에 건강하지 않은 애착을 형성하는 것에 대해 점점 더 많은 경고를 하고 있습니다.
Disrupt 2025에 확정된 기술 리더
넷플릭스, 11랩스, 웨이브, 세쿼이아 캐피털, 엘라드 길은 테크크런치 디스럽트 2025의 헤드라인을 장식합니다. 20주년 기념 이벤트에서 기술 업계에서 가장 영향력 있는 인사들의 목소리를 통해 실행 가능한 인사이트를 얻으세요. 가격이 인상되기 전에 지금 최대 $600 할인된 가격으로 티켓을 확보하세요.
Disrupt 2025에 확정된 기술 리더
넷플릭스, ElevenLabs, 웨이브, 세쿼이아 캐피탈이 Disrupt 2025의 연사 라인업에 합류했습니다. 획기적인 20주년 기념 이벤트에서 업계 리더들로부터 성장 전략을 배워보세요. 지금 등록하고 최대 $675 할인된 가격으로 입장권을 구매하세요.
샌프란시스코 | 2025년 10월 27~29일 지금 등록하기
올리는 AI 비서 시장 경쟁에서 우위를 점하기 위해 개인정보 보호에 주력하고 있다
진정으로 도움이 되려면 AI 비서는 사용자를 깊이 이해해야 합니다. 일상 생활을 위해 설계된 개인 비서 ‘올리(Ollie)’는 이를 위해 사용자의 데이터를 제공하거나 개인정보를 침해할 필요가 없다는 전제 하에 운영됩니다.일부 기업용 AI 도구가 데이터 개인정보 보호 장치를 제공하기는 하지만, 올리는 SOC 2 인증을 획득한 최초의 대중적 가정용 AI 서비스
‘AI LIVE: London’이 AI와 산업 자동화를 어떻게 조명할 것인가
이번 정상회의에는 전 세계의 최고 경영진들이 한자리에 모여, AI에 의한 산업 혁신부터 경제 변동성에 이르기까지 글로벌 산업이 직면한 시급한 과제들을 논의할 예정입니다.‘AI LIVE: 런던 서밋’은 ‘기술 + 인간의 목적(Technology + Human Purpose)’이라는 주제로 2,000명 이상의 국제적 리더들을 한자리에 모아, 새롭게 도래하는 인





집






