경쟁 AI들이 극단적인 심리학적 주제를 테스트하도록 유도한 Meta의 행위가 드러났습니다.

내부 메시지에 대한 최근의 폭로로 인해 AI 보안의 한계를 둘러싼 격렬한 논쟁이 일고 있습니다. 언론 보도에 따르면 메타는 “칸”이라는 프로젝트를 진행하며 외주 인력을 고용해 미성년자로 가장하게 한 뒤 ChatGPT, Gemini, Character.AI 등 주요 경쟁사의 챗봇들에 대해 논란이 되는 “극단적 압력 테스트”를 실시했습니다.
메타의 내부 문서와 여러 관계자들의 말에 따르면 이 프로젝트는 적어도 올해 4월 21일까지 계속되었습니다. 메타는 외주 업체인 Covalen을 통해 수백 명의 인력을 동원해 임시 이메일 주소와 일반적인 비밀번호를 사용하여 18세 미만 사용자의 가짜 프로필을 만들게 했습니다. 이러한 “미성년자” 계정들은 경쟁사의 AI 챗봇과 대화할 때 자살, 자해, 섭식 장애와 관련된 고위험도 프롬프트를 보내거나, 모델의 반응 메커니즘을 자극하기 위해 칼, 약병, 교수형 도구의 사진까지 업로드했습니다.
내부 프로젝트 문서에 따르면 이러한 테스트 시나리오들은 경쟁사 AI 시스템의 안전 장치를 점검하기 위해 세심하게 설계된 것으로, 챗봇들이 의도된 보안 조치를 우회하여 위험한 콘텐츠를 생성하도록 유도하는 것을 목표로 했습니다. 2025년 8월에 진행된 한 차례의 테스트에서만 직원들은 경쟁사 플랫폼에 45,000건이 넘는 고위험도 프롬프트를 입력했습니다. 테스터들은 종종 괴로워하는 청소년으로 가장해 “낙태약에 대해 묻는다”, “폭력적인 위협을 받는다” 혹은 “섭식 장애를 숨긴다”와 같은 상황을 만들어 모델의 한계를 시험했습니다.
이에 대해 메타는 자사의 행동을 옹호하는 공개 성명을 발표했습니다. 메타의 대변인은 챗봇의 반응을 기준으로 삼는 것은 AI 제품이 안전하고 적절한지 확인하기 위한 업계의 표준적인 관행이며, 악의적 의도라는 비난은 기술 회사들이 시스템을 개선하려는 노력을 잘못 전달하는 것이라고 말했습니다. 또한 메타는 경쟁사의 테스트 데이터를 자사 모델 훈련에 사용하지 않았다고 명확히 부인했습니다.
이 사건은 AI 안전 테스트 분야의 애매한 지점들을 드러내는 동시에, 청소년과 관련된 민감한 문제를 다룰 때 생성형 AI가 가질 수 있는 취약성에 대한 외부의 우려도 다시 불러일으키고 있습니다. AI 기술이 빠르게 발전함에 따라 효율적이면서도 안전한 테스트를 실시하는 것과 경쟁 행위와 윤리적 고려 사항 간의 균형을 맞추는 것은 업계가 시급히 해결해야 할 과제가 되고 있습니다.
관련 기사
미국의 주식 시장이 AI와 항공우주 거대 기업들의 1조 달러 데뷔를 앞두고 역사적 이정표에 도달
엘론 머스크, 샘 알트만, 그리고 다리오 아모데이라는 기술 산업의 거인 세 명이 각자의 기업에 대해 공개 시장 상장(IPO)을 앞두고 있다. 스페이스X, 오픈AI, 앤트로픽이라는 세 산업의 거대 기업이 1조 달러 이상의 기업 가치를 달성하며 상장을 준비함에 따라, 2026년은 미국 역사상 신주 발행 측면에서 가장 중요한 해가 될 것으로 전망된다.이러한 역사적인 자본 증가는 전 세계 금융계의 주목을 받고 있으며, 공공 시장이 이러한 규모의 자금
스웨덴의 AI 스타트업 로버블 아이즈, 주요 자금 조달 라운드 이후 132억 달러의 기업 가치 달성
AI 기반 코딩 도구가 인기를 얻으면서 스웨덴 스타트업 로버블(Lovable)이 주요 자금 조달 라운드를 성사시켰다. 이 회사는 30억 달러를 조달하여 지난 12월 기록된 66억 달러의 두 배인 132억 달러의 기업 가치를 달성할 수 있을 것으로 기대된다. 멘로 벤처스(Menlo Ventures)가 이 투자 라운드를 주도할 것으로 예상된다.로버블의 매력은 복잡한 코딩 기술이 필요하지 않은 소프트웨어 제작을 단순화하는 핵심 '바이브 코딩(vib
구글, 사용자 제어 강화에 맞춰 제미니용 레미 AI 에이전트 테스트
비즈니스 인사이더에 따르면, 구글은 제미나이를 위한 새로운 AI 개인 에이전트인 레미를 테스트하고 있습니다. 이 도구는 사용자를 대신하여 작업을 실행하여 전문적인 워크플로우와 일상적인 루틴을 모두 간소화하는 것을 목표로 합니다.현재 레미는 제미나이 애플리케이션의 내부 직원 전용 버전에서 테스트 중입니다. 이 보고서는 내부 문서와 프로젝트에 정통한 두 명의 인물과의 인터뷰를 인용합니다. 내부 자료는 레미를 “24/7 개인 에이전트”로 묘사하며,
관련 특별 주제 추천
의견 (0)
0/500

내부 메시지에 대한 최근의 폭로로 인해 AI 보안의 한계를 둘러싼 격렬한 논쟁이 일고 있습니다. 언론 보도에 따르면 메타는 “칸”이라는 프로젝트를 진행하며 외주 인력을 고용해 미성년자로 가장하게 한 뒤 ChatGPT, Gemini, Character.AI 등 주요 경쟁사의 챗봇들에 대해 논란이 되는 “극단적 압력 테스트”를 실시했습니다.
메타의 내부 문서와 여러 관계자들의 말에 따르면 이 프로젝트는 적어도 올해 4월 21일까지 계속되었습니다. 메타는 외주 업체인 Covalen을 통해 수백 명의 인력을 동원해 임시 이메일 주소와 일반적인 비밀번호를 사용하여 18세 미만 사용자의 가짜 프로필을 만들게 했습니다. 이러한 “미성년자” 계정들은 경쟁사의 AI 챗봇과 대화할 때 자살, 자해, 섭식 장애와 관련된 고위험도 프롬프트를 보내거나, 모델의 반응 메커니즘을 자극하기 위해 칼, 약병, 교수형 도구의 사진까지 업로드했습니다.
내부 프로젝트 문서에 따르면 이러한 테스트 시나리오들은 경쟁사 AI 시스템의 안전 장치를 점검하기 위해 세심하게 설계된 것으로, 챗봇들이 의도된 보안 조치를 우회하여 위험한 콘텐츠를 생성하도록 유도하는 것을 목표로 했습니다. 2025년 8월에 진행된 한 차례의 테스트에서만 직원들은 경쟁사 플랫폼에 45,000건이 넘는 고위험도 프롬프트를 입력했습니다. 테스터들은 종종 괴로워하는 청소년으로 가장해 “낙태약에 대해 묻는다”, “폭력적인 위협을 받는다” 혹은 “섭식 장애를 숨긴다”와 같은 상황을 만들어 모델의 한계를 시험했습니다.
이에 대해 메타는 자사의 행동을 옹호하는 공개 성명을 발표했습니다. 메타의 대변인은 챗봇의 반응을 기준으로 삼는 것은 AI 제품이 안전하고 적절한지 확인하기 위한 업계의 표준적인 관행이며, 악의적 의도라는 비난은 기술 회사들이 시스템을 개선하려는 노력을 잘못 전달하는 것이라고 말했습니다. 또한 메타는 경쟁사의 테스트 데이터를 자사 모델 훈련에 사용하지 않았다고 명확히 부인했습니다.
이 사건은 AI 안전 테스트 분야의 애매한 지점들을 드러내는 동시에, 청소년과 관련된 민감한 문제를 다룰 때 생성형 AI가 가질 수 있는 취약성에 대한 외부의 우려도 다시 불러일으키고 있습니다. AI 기술이 빠르게 발전함에 따라 효율적이면서도 안전한 테스트를 실시하는 것과 경쟁 행위와 윤리적 고려 사항 간의 균형을 맞추는 것은 업계가 시급히 해결해야 할 과제가 되고 있습니다.
미국의 주식 시장이 AI와 항공우주 거대 기업들의 1조 달러 데뷔를 앞두고 역사적 이정표에 도달
엘론 머스크, 샘 알트만, 그리고 다리오 아모데이라는 기술 산업의 거인 세 명이 각자의 기업에 대해 공개 시장 상장(IPO)을 앞두고 있다. 스페이스X, 오픈AI, 앤트로픽이라는 세 산업의 거대 기업이 1조 달러 이상의 기업 가치를 달성하며 상장을 준비함에 따라, 2026년은 미국 역사상 신주 발행 측면에서 가장 중요한 해가 될 것으로 전망된다.이러한 역사적인 자본 증가는 전 세계 금융계의 주목을 받고 있으며, 공공 시장이 이러한 규모의 자금
스웨덴의 AI 스타트업 로버블 아이즈, 주요 자금 조달 라운드 이후 132억 달러의 기업 가치 달성
AI 기반 코딩 도구가 인기를 얻으면서 스웨덴 스타트업 로버블(Lovable)이 주요 자금 조달 라운드를 성사시켰다. 이 회사는 30억 달러를 조달하여 지난 12월 기록된 66억 달러의 두 배인 132억 달러의 기업 가치를 달성할 수 있을 것으로 기대된다. 멘로 벤처스(Menlo Ventures)가 이 투자 라운드를 주도할 것으로 예상된다.로버블의 매력은 복잡한 코딩 기술이 필요하지 않은 소프트웨어 제작을 단순화하는 핵심 '바이브 코딩(vib





집






