유출 된 데이터로 노출 된 중국 AI 검열
중국의 AI를 활용한 검열 능력 강화가 새로운 수준에 도달했으며, 이는 중국 정부가 민감한 내용으로 분류한 133,000개의 콘텐츠 사례가 포함된 유출된 데이터베이스를 통해 밝혀졌다. 이 정교한 대규모 언어 모델(LLM)은 농촌 지역의 빈곤, 공산당 내부의 부패, 그리고 심지어 미묘한 정치적 풍자에 이르기까지 다양한 주제와 관련된 콘텐츠를 자동으로 감지하고 검열하도록 설계되었다.

2019년 6월 4일에 촬영된 이 사진은 중국 서부 신장 지역 카슈가르 남쪽 옌기사르의 주거 단지에서 철조망 뒤에 있는 중국 국기를 보여준다. 이미지 제공: Greg Baker / AFP / Getty Images UC Berkeley의 중국 검열 전문 연구원인 샤오 창(Xiao Qiang)에 따르면, 이 데이터베이스는 중국 정부 또는 그와 관련된 기관이 LLM을 활용하여 억압 노력을 강화하고 있다는 "명백한 증거"이다. 인간 모더레이터와 키워드 필터링에 의존하는 전통적인 방법과 달리, 이 AI 기반 접근법은 국가가 통제하는 정보 관리의 효율성과 정밀도를 크게 향상시킬 수 있다.
보안 연구원 NetAskari가 바이두 서버에서 보호되지 않은 Elasticsearch 데이터베이스에서 발견한 이 데이터셋은 2024년 12월의 최근 항목을 포함하고 있다. 데이터셋을 누가 정확히 만들었는지는 불분명하지만, 그 목적은 분명하다: 오염, 식품 안전, 금융 사기, 노동 분쟁, 군사 문제와 같은 민감한 주제와 관련된 콘텐츠를 식별하고 플래그를 지정하도록 LLM을 훈련시키는 것이다. 특히 역사적 비유나 대만과 관련된 정치적 풍자도 우선순위가 높은 대상이다.

이미지 제공: Charles Rollet 훈련 데이터에는 부패한 경찰관에 대한 불만, 농촌 빈곤에 대한 보고서, 공산당에서 제명된 관리들에 대한 뉴스 등 사회적 불안을 유발할 가능성이 있는 다양한 콘텐츠 사례가 포함되어 있다. 데이터셋에는 대만 및 군사 관련 주제에 대한 광범위한 언급도 포함되어 있으며, 대만(台湾)이라는 중국어 단어가 15,000번 이상 등장한다.
데이터셋의 의도된 용도는 "여론 작업"으로 설명되며, Article 19의 마이클 캐스터(Michael Caster)는 이 용어가 일반적으로 중국 사이버 공간 관리국(CAC)과 관련이 있으며 검열 및 선전 노력을 포함한다고 설명한다. 이는 시진핑 중국 국가주석이 인터넷을 공산당의 여론 작업의 "최전선"으로 보는 관점과 일치한다.
이러한 발전은 권위주의 정권이 억압 목적으로 AI 기술을 채택하는 더 광범위한 추세의 일부이다. OpenAI는 최근 중국으로 추정되는 미확인 행위자가 생성 AI를 사용하여 소셜 미디어를 모니터링하고 반정부 게시물을 중국 정부에 전달했다고 보고했다. 동일한 기술은 또한 저명한 중국 반체제 인사인 차이 샤(Cai Xia)에 대한 비판적인 댓글을 생성하는 데 사용되었다.
중국의 전통적인 검열 방법은 블랙리스트에 오른 용어를 차단하는 기본 알고리즘에 의존하지만, LLM의 사용은 상당한 발전을 나타낸다. 이러한 AI 시스템은 대규모로 미묘한 비판까지 감지할 수 있으며, 더 많은 데이터를 처리하면서 지속적으로 개선된다.
"AI 기반 검열이 어떻게 진화하고 있는지, 특히 DeepSeek과 같은 중국 AI 모델이 주목받고 있는 시점에서 국가가 공공 담론을 더욱 정교하게 통제하고 있다는 점을 강조하는 것이 중요하다고 생각한다,"라고 샤오 창이 TechCrunch에 말했다.
관련 기사
XPeng Motors의 자회사 Dogotix, 9억 달러 투자 유치
XPeng의 자회사 Dogotix는 ‘IRON’ 휴머노이드 로봇을 개발 중이다. 출처: XPeng세계 주요 자동차 제조사들의 선례를 따라 XPeng Motors도 휴머노이드 로봇 분야로 사업 영역을 확장하고 있다. 이 전기차 제조사는 오늘 자사의 로봇 자회사인 Dogotix가 첫 투자 라운드에서 9억 달러 이상의 자금을 확보했으며, 이를 통해 투자 전 기업
세 명의 AI 개척자들이 안전에 대한 우려가 커지는 가운데 대규모 모델을 오픈으로 유지해야 한다고 주장한다
Initiatives like Pacing the Frontier aim to ensure AI safety by partnering with major labs, yet open-source models remain a contentious issue within the industry. Due to their free distribution and lack of usage control, open-weight models are diffic
9억 달러 규모의 자금 조달이 XPENG의 로봇 공학 비전에 어떤 영향을 미칠 것인가
XPENG의 로봇 사업부는 9억 달러 이상의 자금을 조달하며, 투자 후 기업 가치를 63억 달러 이상으로 끌어올렸고, 물리적 AI의 도입을 가속화했다. 출처: XPENGXPENG 유럽의 브랜드 및 마케팅 총괄인 스벤 드 스메트(Sven De Smet)는 9억 달러 이상의 가치를 지닌 이번 시리즈 A 투자 라운드를 휴머노이드 로봇의 글로벌 확산을 위한 중대한
관련 특별 주제 추천
의견 (39)
0/500
Whoa, 133,000 flagged posts? That's wild! China's AI censorship game is intense, but I'm curious—how do they even decide what's 'sensitive'? Sounds like a slippery slope. 😬
This leak is wild! 133,000 flagged posts show how deep China's AI censorship goes. It's like a digital Big Brother on steroids. 😳 Makes you wonder how much we're not seeing online.
This leak is wild! 133,000 flagged posts? That’s a scary peek into how AI’s being used to control speech in China. Makes you wonder how much is being filtered without us knowing. 😳
Essa ferramenta é reveladora! Mostra como a censura por AI na China é profunda. O vazamento do banco de dados é um pouco assustador, mas é importante saber o que está acontecendo nos bastidores. Definitivamente, algo que todos interessados em liberdade na internet devem conhecer. Fique de olho nisso! 👀
중국의 AI를 활용한 검열 능력 강화가 새로운 수준에 도달했으며, 이는 중국 정부가 민감한 내용으로 분류한 133,000개의 콘텐츠 사례가 포함된 유출된 데이터베이스를 통해 밝혀졌다. 이 정교한 대규모 언어 모델(LLM)은 농촌 지역의 빈곤, 공산당 내부의 부패, 그리고 심지어 미묘한 정치적 풍자에 이르기까지 다양한 주제와 관련된 콘텐츠를 자동으로 감지하고 검열하도록 설계되었다.

UC Berkeley의 중국 검열 전문 연구원인 샤오 창(Xiao Qiang)에 따르면, 이 데이터베이스는 중국 정부 또는 그와 관련된 기관이 LLM을 활용하여 억압 노력을 강화하고 있다는 "명백한 증거"이다. 인간 모더레이터와 키워드 필터링에 의존하는 전통적인 방법과 달리, 이 AI 기반 접근법은 국가가 통제하는 정보 관리의 효율성과 정밀도를 크게 향상시킬 수 있다.
보안 연구원 NetAskari가 바이두 서버에서 보호되지 않은 Elasticsearch 데이터베이스에서 발견한 이 데이터셋은 2024년 12월의 최근 항목을 포함하고 있다. 데이터셋을 누가 정확히 만들었는지는 불분명하지만, 그 목적은 분명하다: 오염, 식품 안전, 금융 사기, 노동 분쟁, 군사 문제와 같은 민감한 주제와 관련된 콘텐츠를 식별하고 플래그를 지정하도록 LLM을 훈련시키는 것이다. 특히 역사적 비유나 대만과 관련된 정치적 풍자도 우선순위가 높은 대상이다.

훈련 데이터에는 부패한 경찰관에 대한 불만, 농촌 빈곤에 대한 보고서, 공산당에서 제명된 관리들에 대한 뉴스 등 사회적 불안을 유발할 가능성이 있는 다양한 콘텐츠 사례가 포함되어 있다. 데이터셋에는 대만 및 군사 관련 주제에 대한 광범위한 언급도 포함되어 있으며, 대만(台湾)이라는 중국어 단어가 15,000번 이상 등장한다.
데이터셋의 의도된 용도는 "여론 작업"으로 설명되며, Article 19의 마이클 캐스터(Michael Caster)는 이 용어가 일반적으로 중국 사이버 공간 관리국(CAC)과 관련이 있으며 검열 및 선전 노력을 포함한다고 설명한다. 이는 시진핑 중국 국가주석이 인터넷을 공산당의 여론 작업의 "최전선"으로 보는 관점과 일치한다.
이러한 발전은 권위주의 정권이 억압 목적으로 AI 기술을 채택하는 더 광범위한 추세의 일부이다. OpenAI는 최근 중국으로 추정되는 미확인 행위자가 생성 AI를 사용하여 소셜 미디어를 모니터링하고 반정부 게시물을 중국 정부에 전달했다고 보고했다. 동일한 기술은 또한 저명한 중국 반체제 인사인 차이 샤(Cai Xia)에 대한 비판적인 댓글을 생성하는 데 사용되었다.
중국의 전통적인 검열 방법은 블랙리스트에 오른 용어를 차단하는 기본 알고리즘에 의존하지만, LLM의 사용은 상당한 발전을 나타낸다. 이러한 AI 시스템은 대규모로 미묘한 비판까지 감지할 수 있으며, 더 많은 데이터를 처리하면서 지속적으로 개선된다.
"AI 기반 검열이 어떻게 진화하고 있는지, 특히 DeepSeek과 같은 중국 AI 모델이 주목받고 있는 시점에서 국가가 공공 담론을 더욱 정교하게 통제하고 있다는 점을 강조하는 것이 중요하다고 생각한다,"라고 샤오 창이 TechCrunch에 말했다.
XPeng Motors의 자회사 Dogotix, 9억 달러 투자 유치
XPeng의 자회사 Dogotix는 ‘IRON’ 휴머노이드 로봇을 개발 중이다. 출처: XPeng세계 주요 자동차 제조사들의 선례를 따라 XPeng Motors도 휴머노이드 로봇 분야로 사업 영역을 확장하고 있다. 이 전기차 제조사는 오늘 자사의 로봇 자회사인 Dogotix가 첫 투자 라운드에서 9억 달러 이상의 자금을 확보했으며, 이를 통해 투자 전 기업
세 명의 AI 개척자들이 안전에 대한 우려가 커지는 가운데 대규모 모델을 오픈으로 유지해야 한다고 주장한다
Initiatives like Pacing the Frontier aim to ensure AI safety by partnering with major labs, yet open-source models remain a contentious issue within the industry. Due to their free distribution and lack of usage control, open-weight models are diffic
9억 달러 규모의 자금 조달이 XPENG의 로봇 공학 비전에 어떤 영향을 미칠 것인가
XPENG의 로봇 사업부는 9억 달러 이상의 자금을 조달하며, 투자 후 기업 가치를 63억 달러 이상으로 끌어올렸고, 물리적 AI의 도입을 가속화했다. 출처: XPENGXPENG 유럽의 브랜드 및 마케팅 총괄인 스벤 드 스메트(Sven De Smet)는 9억 달러 이상의 가치를 지닌 이번 시리즈 A 투자 라운드를 휴머노이드 로봇의 글로벌 확산을 위한 중대한
Whoa, 133,000 flagged posts? That's wild! China's AI censorship game is intense, but I'm curious—how do they even decide what's 'sensitive'? Sounds like a slippery slope. 😬
This leak is wild! 133,000 flagged posts show how deep China's AI censorship goes. It's like a digital Big Brother on steroids. 😳 Makes you wonder how much we're not seeing online.
This leak is wild! 133,000 flagged posts? That’s a scary peek into how AI’s being used to control speech in China. Makes you wonder how much is being filtered without us knowing. 😳
Essa ferramenta é reveladora! Mostra como a censura por AI na China é profunda. O vazamento do banco de dados é um pouco assustador, mas é importante saber o que está acontecendo nos bastidores. Definitivamente, algo que todos interessados em liberdade na internet devem conhecer. Fique de olho nisso! 👀





집






