옵션
뉴스
유출 된 데이터로 노출 된 중국 AI 검열

유출 된 데이터로 노출 된 중국 AI 검열

2025년 4월 10일
208

중국의 AI를 활용한 검열 능력 강화가 새로운 수준에 도달했으며, 이는 중국 정부가 민감한 내용으로 분류한 133,000개의 콘텐츠 사례가 포함된 유출된 데이터베이스를 통해 밝혀졌다. 이 정교한 대규모 언어 모델(LLM)은 농촌 지역의 빈곤, 공산당 내부의 부패, 그리고 심지어 미묘한 정치적 풍자에 이르기까지 다양한 주제와 관련된 콘텐츠를 자동으로 감지하고 검열하도록 설계되었다.

철조망 뒤에 있는 중국 국기

2019년 6월 4일에 촬영된 이 사진은 중국 서부 신장 지역 카슈가르 남쪽 옌기사르의 주거 단지에서 철조망 뒤에 있는 중국 국기를 보여준다. 이미지 제공: Greg Baker / AFP / Getty Images

UC Berkeley의 중국 검열 전문 연구원인 샤오 창(Xiao Qiang)에 따르면, 이 데이터베이스는 중국 정부 또는 그와 관련된 기관이 LLM을 활용하여 억압 노력을 강화하고 있다는 "명백한 증거"이다. 인간 모더레이터와 키워드 필터링에 의존하는 전통적인 방법과 달리, 이 AI 기반 접근법은 국가가 통제하는 정보 관리의 효율성과 정밀도를 크게 향상시킬 수 있다.

보안 연구원 NetAskari가 바이두 서버에서 보호되지 않은 Elasticsearch 데이터베이스에서 발견한 이 데이터셋은 2024년 12월의 최근 항목을 포함하고 있다. 데이터셋을 누가 정확히 만들었는지는 불분명하지만, 그 목적은 분명하다: 오염, 식품 안전, 금융 사기, 노동 분쟁, 군사 문제와 같은 민감한 주제와 관련된 콘텐츠를 식별하고 플래그를 지정하도록 LLM을 훈련시키는 것이다. 특히 역사적 비유나 대만과 관련된 정치적 풍자도 우선순위가 높은 대상이다.

프롬프트 토큰과 LLM을 참조하는 JSON 코드 조각. 내용의 대부분은 중국어로 되어 있다.

이미지 제공: Charles Rollet

훈련 데이터에는 부패한 경찰관에 대한 불만, 농촌 빈곤에 대한 보고서, 공산당에서 제명된 관리들에 대한 뉴스 등 사회적 불안을 유발할 가능성이 있는 다양한 콘텐츠 사례가 포함되어 있다. 데이터셋에는 대만 및 군사 관련 주제에 대한 광범위한 언급도 포함되어 있으며, 대만(台湾)이라는 중국어 단어가 15,000번 이상 등장한다.

데이터셋의 의도된 용도는 "여론 작업"으로 설명되며, Article 19의 마이클 캐스터(Michael Caster)는 이 용어가 일반적으로 중국 사이버 공간 관리국(CAC)과 관련이 있으며 검열 및 선전 노력을 포함한다고 설명한다. 이는 시진핑 중국 국가주석이 인터넷을 공산당의 여론 작업의 "최전선"으로 보는 관점과 일치한다.

이러한 발전은 권위주의 정권이 억압 목적으로 AI 기술을 채택하는 더 광범위한 추세의 일부이다. OpenAI는 최근 중국으로 추정되는 미확인 행위자가 생성 AI를 사용하여 소셜 미디어를 모니터링하고 반정부 게시물을 중국 정부에 전달했다고 보고했다. 동일한 기술은 또한 저명한 중국 반체제 인사인 차이 샤(Cai Xia)에 대한 비판적인 댓글을 생성하는 데 사용되었다.

중국의 전통적인 검열 방법은 블랙리스트에 오른 용어를 차단하는 기본 알고리즘에 의존하지만, LLM의 사용은 상당한 발전을 나타낸다. 이러한 AI 시스템은 대규모로 미묘한 비판까지 감지할 수 있으며, 더 많은 데이터를 처리하면서 지속적으로 개선된다.

"AI 기반 검열이 어떻게 진화하고 있는지, 특히 DeepSeek과 같은 중국 AI 모델이 주목받고 있는 시점에서 국가가 공공 담론을 더욱 정교하게 통제하고 있다는 점을 강조하는 것이 중요하다고 생각한다,"라고 샤오 창이 TechCrunch에 말했다.

관련 기사
XPeng Motors의 자회사 Dogotix, 9억 달러 투자 유치 XPeng Motors의 자회사 Dogotix, 9억 달러 투자 유치 XPeng의 자회사 Dogotix는 ‘IRON’ 휴머노이드 로봇을 개발 중이다. 출처: XPeng세계 주요 자동차 제조사들의 선례를 따라 XPeng Motors도 휴머노이드 로봇 분야로 사업 영역을 확장하고 있다. 이 전기차 제조사는 오늘 자사의 로봇 자회사인 Dogotix가 첫 투자 라운드에서 9억 달러 이상의 자금을 확보했으며, 이를 통해 투자 전 기업
세 명의 AI 개척자들이 안전에 대한 우려가 커지는 가운데 대규모 모델을 오픈으로 유지해야 한다고 주장한다 세 명의 AI 개척자들이 안전에 대한 우려가 커지는 가운데 대규모 모델을 오픈으로 유지해야 한다고 주장한다 Initiatives like Pacing the Frontier aim to ensure AI safety by partnering with major labs, yet open-source models remain a contentious issue within the industry. Due to their free distribution and lack of usage control, open-weight models are diffic
9억 달러 규모의 자금 조달이 XPENG의 로봇 공학 비전에 어떤 영향을 미칠 것인가 9억 달러 규모의 자금 조달이 XPENG의 로봇 공학 비전에 어떤 영향을 미칠 것인가 XPENG의 로봇 사업부는 9억 달러 이상의 자금을 조달하며, 투자 후 기업 가치를 63억 달러 이상으로 끌어올렸고, 물리적 AI의 도입을 가속화했다. 출처: XPENGXPENG 유럽의 브랜드 및 마케팅 총괄인 스벤 드 스메트(Sven De Smet)는 9억 달러 이상의 가치를 지닌 이번 시리즈 A 투자 라운드를 휴머노이드 로봇의 글로벌 확산을 위한 중대한
관련 특별 주제 추천
글쓰기 장문 SEO 기사용 최고의 AI 개요 생성기
장문 SEO 기사용 최고의 AI 개요 생성기

XIX.AI가 꼼꼼하게 선별한 2026년 최신 최고 평점을 받은 장문 SEO 기사용 AI 개요 생성기. 이 강력한 도구들은 고품질 콘텐츠를 신속하게 제작하는 데 획기적인 도움을 제공하여 글쓰기 효율을 크게 높여줍니다. 무료 버전과 유료 버전의 비교 정보와 실제 테스트 결과, 상세한 순위 정보를 확인하여 여러분의 필요에 딱 맞는, 꼭 사용해 봐야 할 옵션을 찾아보세요. 지금 바로 살펴보고 AI를 활용한 경쟁력을 확보하세요.

8 도구
xix.ai
교육 및 학습 숙제 및 시험 준비를 위한 AI 학습 도구
숙제 및 시험 준비를 위한 AI 학습 도구

2026년 숙제 및 시험 준비를 위한 최신 최고의 AI 학습 도구! XIX.AI는 학생들이 생산성을 높이고, 숙제 완료 과정을 효율화하며, 실제 시험을 통해 우수한 성적을 거둘 수 있도록 돕는 강력하고 혁신적인 도구들의 최고 평점 목록을 엄선했습니다. 무료와 유료 버전의 비교 정보, 상세한 순위, 꼭 사용해 봐야 할 옵션을 확인하고 AI의 힘을 최대한 활용하세요. 지금 바로 살펴보세요!

10 도구
xix.ai
음악 작곡 songwriter, 후크, 탑라인 및 다국어 초안 세션을 위한 AI 보컬 데모 도구
songwriter, 후크, 탑라인 및 다국어 초안 세션을 위한 AI 보컬 데모 도구

2026년 최신 최고의 AI 보컬 데모 도구: 작곡가, 후크 제작자 및 다국어 콘텐츠 팀을 위한! XIX.AI는 엄격한 실전 테스트를 거친 강력한 혁신 도구의 최고 평점 목록을 선별했습니다. 여기서는 무료 대 유료 비교 데이터, 종합 순위, 그리고 필수 추천 옵션을 확인할 수 있어 작사 효율성을 높이고 창의적 잠재력을 발휘하는 데 도움이 됩니다. 지금 탐색하여 모든 콘텐츠 요구에 맞는 완벽한 도구를 발견하세요!

9 도구
xix.ai
사업 중소기업을 위한 최고의 AI 경쟁사 분석 도구
중소기업을 위한 최고의 AI 경쟁사 분석 도구

2026년 중소기업을 위한 최신 최고 평점의 AI 경쟁 분석 도구! XIX.AI는 매주 엄격한 실제 테스트와 상세한 순위를 바탕으로 업데이트되는, 업계 판도를 바꿀 만큼 강력한 도구 모음을 엄선했습니다. 생산성을 높이고 경쟁 우위를 확보할 수 있는 ‘꼭 사용해 봐야 할’ 도구를 찾아보실 수 있도록, 무료 버전과 유료 버전의 포괄적인 비교 정보를 제공합니다. 지금 바로 살펴보고 여러분에게 딱 맞는 도구를 찾아보세요!

9 도구
xix.ai
이미지 편집 이커머스 의류용 Photoshop AI 보정 도구, 피부 결 정리 및 색상 일관성
이커머스 의류용 Photoshop AI 보정 도구, 피부 결 정리 및 색상 일관성

2026년 최신 최고의 Photoshop AI 보정 도구: 이커머스 의류, 피부 클리닝, 색상 일관성을 위한! 이 상위 평가 큐레이션 목록은 글쓰기 효율성을 높이고 콘텐츠 제작을 간소화하며 완벽한 시각적 결과를 손쉽게 달성하는 데 도움이 되는 강력한 게임 체인저 솔루션을 특징으로 합니다. 각 도구는 매주 업데이트되는 랭킹을 통해 실제 테스트를 거쳤으며, 무료 대 유료 비교 세부 사항도 포함되어 있습니다. XIX.AI의 지원을 받아 AI 경쟁력을 발휘하고자 하는 모든 이들에게 필수 추천 가이드입니다. 지금 탐색하세요!

10 도구
xix.ai
즉각적인 ChatGPT 워크플로우에 가장 적합한 AI 프롬프트 라이브러리
ChatGPT 워크플로우에 가장 적합한 AI 프롬프트 라이브러리

2026년 최신 최고 평점을 받은 AI 프롬프트 라이브러리로, 모든 유형의 ChatGPT 워크플로우를 최적화하세요. XIX.AI는 최고의 성능을 보장하기 위해 엄격한 실전 테스트를 거친, 강력하고 획기적인 컬렉션을 엄선했습니다. 생산성을 높이고 AI의 잠재력을 최대한 발휘할 수 있는 필수 도구를 선택하는 데 도움이 되는 무료 vs 유료 상세 비교 정보와 전문가 순위를 확인해 보세요. 지금 바로 살펴보세요!

11 도구
xix.ai
의견 (39)
0/500
TimothyBaker
TimothyBaker 2026년 9월 1일 오후 3시 0분 11초 GMT+09:00

这数据量真吓人,13万个例子,看来AI审查已经深入到毛细血管了。

HarryRoberts
HarryRoberts 2025년 8월 12일 오전 3시 1분 5초 GMT+09:00

Whoa, 133,000 flagged posts? That's wild! China's AI censorship game is intense, but I'm curious—how do they even decide what's 'sensitive'? Sounds like a slippery slope. 😬

CharlesGonzalez
CharlesGonzalez 2025년 8월 1일 오후 10시 47분 34초 GMT+09:00

This leak is wild! 133,000 flagged posts show how deep China's AI censorship goes. It's like a digital Big Brother on steroids. 😳 Makes you wonder how much we're not seeing online.

ElijahWalker
ElijahWalker 2025년 7월 22일 오후 4시 35분 51초 GMT+09:00

This leak is wild! 133,000 flagged posts? That’s a scary peek into how AI’s being used to control speech in China. Makes you wonder how much is being filtered without us knowing. 😳

MichaelDavis
MichaelDavis 2025년 4월 21일 오후 5시 6분 3초 GMT+09:00

Essa ferramenta é reveladora! Mostra como a censura por AI na China é profunda. O vazamento do banco de dados é um pouco assustador, mas é importante saber o que está acontecendo nos bastidores. Definitivamente, algo que todos interessados em liberdade na internet devem conhecer. Fique de olho nisso! 👀

SebastianAnderson
SebastianAnderson 2025년 4월 20일 오전 7시 25분 56초 GMT+09:00

Los datos filtrados sobre la censura de IA en China son escalofriantes. Es aterrador pensar en cómo se está utilizando la IA para controlar la información. Necesitamos más transparencia y menos censura, ¿no crees? 🤔

OR