옵션
뉴스
유출 된 데이터로 노출 된 중국 AI 검열

유출 된 데이터로 노출 된 중국 AI 검열

2025년 4월 10일
205

중국의 AI를 활용한 검열 능력 강화가 새로운 수준에 도달했으며, 이는 중국 정부가 민감한 내용으로 분류한 133,000개의 콘텐츠 사례가 포함된 유출된 데이터베이스를 통해 밝혀졌다. 이 정교한 대규모 언어 모델(LLM)은 농촌 지역의 빈곤, 공산당 내부의 부패, 그리고 심지어 미묘한 정치적 풍자에 이르기까지 다양한 주제와 관련된 콘텐츠를 자동으로 감지하고 검열하도록 설계되었다.

철조망 뒤에 있는 중국 국기

2019년 6월 4일에 촬영된 이 사진은 중국 서부 신장 지역 카슈가르 남쪽 옌기사르의 주거 단지에서 철조망 뒤에 있는 중국 국기를 보여준다. 이미지 제공: Greg Baker / AFP / Getty Images

UC Berkeley의 중국 검열 전문 연구원인 샤오 창(Xiao Qiang)에 따르면, 이 데이터베이스는 중국 정부 또는 그와 관련된 기관이 LLM을 활용하여 억압 노력을 강화하고 있다는 "명백한 증거"이다. 인간 모더레이터와 키워드 필터링에 의존하는 전통적인 방법과 달리, 이 AI 기반 접근법은 국가가 통제하는 정보 관리의 효율성과 정밀도를 크게 향상시킬 수 있다.

보안 연구원 NetAskari가 바이두 서버에서 보호되지 않은 Elasticsearch 데이터베이스에서 발견한 이 데이터셋은 2024년 12월의 최근 항목을 포함하고 있다. 데이터셋을 누가 정확히 만들었는지는 불분명하지만, 그 목적은 분명하다: 오염, 식품 안전, 금융 사기, 노동 분쟁, 군사 문제와 같은 민감한 주제와 관련된 콘텐츠를 식별하고 플래그를 지정하도록 LLM을 훈련시키는 것이다. 특히 역사적 비유나 대만과 관련된 정치적 풍자도 우선순위가 높은 대상이다.

프롬프트 토큰과 LLM을 참조하는 JSON 코드 조각. 내용의 대부분은 중국어로 되어 있다.

이미지 제공: Charles Rollet

훈련 데이터에는 부패한 경찰관에 대한 불만, 농촌 빈곤에 대한 보고서, 공산당에서 제명된 관리들에 대한 뉴스 등 사회적 불안을 유발할 가능성이 있는 다양한 콘텐츠 사례가 포함되어 있다. 데이터셋에는 대만 및 군사 관련 주제에 대한 광범위한 언급도 포함되어 있으며, 대만(台湾)이라는 중국어 단어가 15,000번 이상 등장한다.

데이터셋의 의도된 용도는 "여론 작업"으로 설명되며, Article 19의 마이클 캐스터(Michael Caster)는 이 용어가 일반적으로 중국 사이버 공간 관리국(CAC)과 관련이 있으며 검열 및 선전 노력을 포함한다고 설명한다. 이는 시진핑 중국 국가주석이 인터넷을 공산당의 여론 작업의 "최전선"으로 보는 관점과 일치한다.

이러한 발전은 권위주의 정권이 억압 목적으로 AI 기술을 채택하는 더 광범위한 추세의 일부이다. OpenAI는 최근 중국으로 추정되는 미확인 행위자가 생성 AI를 사용하여 소셜 미디어를 모니터링하고 반정부 게시물을 중국 정부에 전달했다고 보고했다. 동일한 기술은 또한 저명한 중국 반체제 인사인 차이 샤(Cai Xia)에 대한 비판적인 댓글을 생성하는 데 사용되었다.

중국의 전통적인 검열 방법은 블랙리스트에 오른 용어를 차단하는 기본 알고리즘에 의존하지만, LLM의 사용은 상당한 발전을 나타낸다. 이러한 AI 시스템은 대규모로 미묘한 비판까지 감지할 수 있으며, 더 많은 데이터를 처리하면서 지속적으로 개선된다.

"AI 기반 검열이 어떻게 진화하고 있는지, 특히 DeepSeek과 같은 중국 AI 모델이 주목받고 있는 시점에서 국가가 공공 담론을 더욱 정교하게 통제하고 있다는 점을 강조하는 것이 중요하다고 생각한다,"라고 샤오 창이 TechCrunch에 말했다.

관련 기사
XPeng Motors의 자회사 Dogotix, 9억 달러 투자 유치 XPeng Motors의 자회사 Dogotix, 9억 달러 투자 유치 XPeng의 자회사 Dogotix는 ‘IRON’ 휴머노이드 로봇을 개발 중이다. 출처: XPeng세계 주요 자동차 제조사들의 선례를 따라 XPeng Motors도 휴머노이드 로봇 분야로 사업 영역을 확장하고 있다. 이 전기차 제조사는 오늘 자사의 로봇 자회사인 Dogotix가 첫 투자 라운드에서 9억 달러 이상의 자금을 확보했으며, 이를 통해 투자 전 기업
세 명의 AI 개척자들이 안전에 대한 우려가 커지는 가운데 대규모 모델을 오픈으로 유지해야 한다고 주장한다 세 명의 AI 개척자들이 안전에 대한 우려가 커지는 가운데 대규모 모델을 오픈으로 유지해야 한다고 주장한다 Initiatives like Pacing the Frontier aim to ensure AI safety by partnering with major labs, yet open-source models remain a contentious issue within the industry. Due to their free distribution and lack of usage control, open-weight models are diffic
9억 달러 규모의 자금 조달이 XPENG의 로봇 공학 비전에 어떤 영향을 미칠 것인가 9억 달러 규모의 자금 조달이 XPENG의 로봇 공학 비전에 어떤 영향을 미칠 것인가 XPENG의 로봇 사업부는 9억 달러 이상의 자금을 조달하며, 투자 후 기업 가치를 63억 달러 이상으로 끌어올렸고, 물리적 AI의 도입을 가속화했다. 출처: XPENGXPENG 유럽의 브랜드 및 마케팅 총괄인 스벤 드 스메트(Sven De Smet)는 9억 달러 이상의 가치를 지닌 이번 시리즈 A 투자 라운드를 휴머노이드 로봇의 글로벌 확산을 위한 중대한
관련 특별 주제 추천
챗봇 언어 연습, 면접 준비 및 일상 유창성을 위한 최고의 AI 역할극 채팅 앱
언어 연습, 면접 준비 및 일상 유창성을 위한 최고의 AI 역할극 채팅 앱

2026년 최신 최고 인기 AI 역할극 채팅 앱: 언어 연습, 면접 준비 및 일상 유창성을 위한 최고의 선택! XIX.AI는 무료와 유료 비교, 실제 테스트, 매주 업데이트되는 순위 등을 제공하는 강력한 혁신적인 컬렉션을 엄선합니다. 이 필수 도구들은 글쓰기 실력을 향상시키고, 유창성 관련 어려움을 극복하며, 모든 일상 상황에서 의사소통 효율성을 높이는 데 도움을 줍니다. 지금 바로 탐색하여 언어 성장을 위한 완벽한 도구를 발견하세요!

10 도구
xix.ai
음악 작곡 리믹스 제작, 샘플링 준비, 카라오케 마스터 파일 제작을 위한 AI 스템 분리 도구
리믹스 제작, 샘플링 준비, 카라오케 마스터 파일 제작을 위한 AI 스템 분리 도구

2026년 최신형으로 선정된 최고 평점의 AI 스템 분리 도구들은 리믹스 제작, 샘플링 준비, 카라오케 녹음에 특화되어 있습니다. 이 강력하고 혁신적인 도구들은 실제 환경에서의 테스트를 거쳐 정밀한 오디오 분리 기능을 제공함으로써 작업 효율성을 크게 향상시켜 줍니다. XIX.AI는 매주 업데이트되는 무료 버전과 유료 버전의 비교 가이드를 제공하여 사용자의 니즈에 가장 적합한 도구를 찾는 데 도움을 줍니다. 지금 바로 확인하여 AI 기술의 잠재력을 최대한 활용해 보세요.

8 도구
xix.ai
데이터 분석 수익 대시보드, 퍼널 분석, 그리고 제품 지표를 위한 AI SQL 코파일럿
수익 대시보드, 퍼널 분석, 그리고 제품 지표를 위한 AI SQL 코파일럿

2026년 최신 최고의 AI SQL 코파일럿들이 최상위 순위에 올랐습니다! XIX.AI는 매주 업데이트되는 실제 환경 테스트를 위해 강력하고 혁신적인 도구들을 선별하여 제공합니다. 반드시 사용해 보아야 할 이 도구들은 정확한 수익 대시보드를 생성하고, 판매 과정을 분석하며, 제품 관련 지표를 신속하게 추적할 수 있도록 도와 생산성을 크게 향상시켜 줍니다. 데이터 기반 의사결정을 위한 완벽한 도구를 찾아보세요! 238자

9 도구
xix.ai
음악 작곡 노래 초안을 위한 최고의 AI 멜로디 작곡 도구
노래 초안을 위한 최고의 AI 멜로디 작곡 도구

2026년 최신 최고 인기 AI 멜로디 작곡 도구! XIX.AI는 엄격한 실전 테스트를 거쳐 최고의 작곡 경험을 제공하는 강력한 게임 체인저 컬렉션을 엄선했습니다. 무료와 유료 버전의 상세 비교, 정확한 순위, 그리고 놀라운 노래 초안을 손쉽게 만들고 창의적 생산성을 크게 높일 수 있는 필수 추천 옵션들을 확인할 수 있습니다. 지금 바로 탐색하여 완벽한 도구를 발견하세요!

8 도구
xix.ai
챗봇 면접 연습을 위한 최고의 AI 대화 트레이너 도구
면접 연습을 위한 최고의 AI 대화 트레이너 도구

2026년 최신 최고의 평점 높은 AI 대화 트레이너 도구들이 XIX.AI에서 만나보세요! 면접 연습을 위한 이 엄선된 컬렉션은 강력한, 게임 체인저 도구들을 포함하고 있으며, 엄격한 실제 세계 테스트를 거쳐 정확한 피드백을 제공합니다. 무료 대 유료 비교와 상세한 순위표를 찾을 수 있어 자신감과 기술을 향상시킬 수 있는 꼭 시도해봐야 할 옵션을 선택하는 데 도움이 됩니다. 지금 탐색하여 면접 성공을 위한 완벽한 도구를 발견하세요!

12 도구
xix.ai
디자인과 예술 창의적인 실험을 위한 최고의 AI 스타일 변환 도구
창의적인 실험을 위한 최고의 AI 스타일 변환 도구

2026년 최신, 최고 평점을 받은 창의적 실험을 위한 AI 스타일 변환 도구! XIX.AI는 실제 테스트와 엄격한 평가를 통해 탁월한 결과를 보여주는, 강력하고 판도를 바꿀 만한 ‘꼭 사용해 봐야 할’ 도구들을 엄선했습니다. 이 최고의 솔루션들은 콘텐츠 제작 속도를 높이고 무한한 창의적 가능성을 열어줌으로써 크리에이터들의 생산성을 크게 높여줍니다. 지금 바로 탐색하여 나에게 딱 맞는 도구를 찾아보고, 오늘 바로 창작을 시작해 보세요!

9 도구
xix.ai
의견 (39)
0/500
TimothyBaker
TimothyBaker 2026년 9월 1일 오후 3시 0분 11초 GMT+09:00

这数据量真吓人,13万个例子,看来AI审查已经深入到毛细血管了。

HarryRoberts
HarryRoberts 2025년 8월 12일 오전 3시 1분 5초 GMT+09:00

Whoa, 133,000 flagged posts? That's wild! China's AI censorship game is intense, but I'm curious—how do they even decide what's 'sensitive'? Sounds like a slippery slope. 😬

CharlesGonzalez
CharlesGonzalez 2025년 8월 1일 오후 10시 47분 34초 GMT+09:00

This leak is wild! 133,000 flagged posts show how deep China's AI censorship goes. It's like a digital Big Brother on steroids. 😳 Makes you wonder how much we're not seeing online.

ElijahWalker
ElijahWalker 2025년 7월 22일 오후 4시 35분 51초 GMT+09:00

This leak is wild! 133,000 flagged posts? That’s a scary peek into how AI’s being used to control speech in China. Makes you wonder how much is being filtered without us knowing. 😳

MichaelDavis
MichaelDavis 2025년 4월 21일 오후 5시 6분 3초 GMT+09:00

Essa ferramenta é reveladora! Mostra como a censura por AI na China é profunda. O vazamento do banco de dados é um pouco assustador, mas é importante saber o que está acontecendo nos bastidores. Definitivamente, algo que todos interessados em liberdade na internet devem conhecer. Fique de olho nisso! 👀

SebastianAnderson
SebastianAnderson 2025년 4월 20일 오전 7시 25분 56초 GMT+09:00

Los datos filtrados sobre la censura de IA en China son escalofriantes. Es aterrador pensar en cómo se está utilizando la IA para controlar la información. Necesitamos más transparencia y menos censura, ¿no crees? 🤔

OR