중국, ‘토큰’의 공식 명칭을 ‘단어 단위’로 확정
중국 정부 웹사이트는 최근 인민일보 기사를 재게재하며, 국가데이터관리국이 대규모 모델의 기본 단위인 ‘토큰(Token)’을 공식적인 맥락에서 ‘단어 요소(Word Element)’로 명명했다고 전했다. 이 보고서에 따르면 중국 AI 산업 내 '단어 요소'의 일일 사용량은 현재 140조 건을 넘어선 것으로 나타났다. 이번 권위 있는 명칭 지정은 '토큰(Token)'의 중국어 번역에 대한 학계와 업계의 오랜 논쟁을 종결지었을 뿐만 아니라, 국가 차원에서 대규모 모델 기술 용어를 표준화하는 데 한 걸음 더 나아간 것을 의미한다.

이전에는 업계 내에서 '토큰(Token)'을 지칭하는 다양한 용어가 경쟁적으로 사용되었다. 텐센트 연구소의 양빈(Yang Bin) 학자는 '모델 요소(Model Element)'를 제안하여 광범위한 논의를 불러일으켰다. 이후 바이촨 인텔리전스(Baichuan Intelligence)의 왕샤오촨(Wang Xiaochuan) 대표, 룬천 테크놀로지(Lunchen Technology)의 유양(You Yang) 대표, 그리고 칭화대학교 전 부교수 후이린(Hu Yilin)이 제안한 "지능 요소(Intelligence Element)"라는 용어가 소셜 미디어에서 큰 반향을 일으켰다. 이 용어는 토큰이 단순한 "일반 계산"이 아닌 "일반 지능"의 단위로서의 역할을 강조한 것이었다.
그러나 정부가 채택한 용어인 '워드 엘리먼트(Word Element)'는 근본적인 기술적 논리에 더 초점을 맞추고 있다. 공식적으로 AI가 인간 언어를 이해하기 위한 최소 단위로 설명되는 워드 엘리먼트의 분할 단위는 문자(character)와 단어(word) 사이에 위치한다. 이를 통해 대규모 모델의 텍스트 처리 과정에서 의미적 단위를 보다 정밀하게 포괄할 수 있다. 사용량이 역사적인 140조 건이라는 이정표에 근접함에 따라, 통일된 용어 표준은 업계 전반의 의사소통 비용을 절감하고, 향후 AI 인프라와 관련된 통계적 정량화 및 정책 수립을 위한 견고한 기반을 마련하는 데 도움이 될 것이다.
관련 기사
내부 세부 사항 공개: 차세대 Gemini에 대한Computing Power의 긴장, 내부 팀들은 개발 우선순위와 자원 배분에 대해 의견이 갈렸다
보고에 따르면 구글의 높은 기대를 모았던次世代 제미니 모델의 출시가 연기되었다. 개발 우선순위와 자원 배분에 대한 내부 의견 불일치, 제한된 컴퓨팅 용량, 복잡한 승인 절차가 결합되어 2개월의 지연이 불가피해졌다. 자체 맞춤형 TPU 칩을 보유하고 있음에도 불구하고, 모델 학습, 구글 클라우드 서비스, 수많은 소비자 및 기업용 AI 애플리케이션 간의 경쟁적 수요로 인해 구글은 컴퓨팅 자원 부족에 직면해 있다. 최고 경영진은 이제 조직 개편을 통
OpenAI, 성장 둔화 우려 불식…여러 사업부門 가속화
외부로부터의 판매 성장 둔화 및 내부 목표 미달성에 대한 scrutiny에 대응하여, AI 선도 기업 오픈AI는 4월 28일 화요일에 자신감 있는 성명을 발표했다. 이 회사는 소비자 제품과 기업 서비스의 빠른 진전을 명확히 하며, 최근 제기된 사업 둔화에 대한 추측을 직접적으로 반박했다.동사가 "여러 내부 목표를 놓쳤다"는 주장에 대해, 오픈AI는 이러한 보도를 "전형적인 클릭베이트"로 일축했다. 이 회사는 AI 통합에 대한 강력한 기업 수요
알리바바 슈퍼컵: Qwen3.8-Max, 강화된 코딩 및 오피스 도구로 데뷔
Alibaba는 2.4조 개의 파라미터를 갖춘 차세대 기반 대형 모델인 Qwen3.8-Max를 공식적으로 공개했습니다. 이 중요한 AI 기술 발전은 코딩 및 전문 사무 작업 등 핵심 영역에서 상당한 성능 향상을 제공하며, 강력한 기술 역량을 보여줍니다.권위 있는 Arena 대형 모델 랭킹에서 Qwen3.8-Max는 Anthropic의 Claude 시리즈에 이어 우수한 성적을 거두며 업계 선두 그룹에 자리했습니다. 이 성과는 국내 대형 모델이
관련 특별 주제 추천
의견 (1)
0/500
중국 정부 웹사이트는 최근 인민일보 기사를 재게재하며, 국가데이터관리국이 대규모 모델의 기본 단위인 ‘토큰(Token)’을 공식적인 맥락에서 ‘단어 요소(Word Element)’로 명명했다고 전했다. 이 보고서에 따르면 중국 AI 산업 내 '단어 요소'의 일일 사용량은 현재 140조 건을 넘어선 것으로 나타났다. 이번 권위 있는 명칭 지정은 '토큰(Token)'의 중국어 번역에 대한 학계와 업계의 오랜 논쟁을 종결지었을 뿐만 아니라, 국가 차원에서 대규모 모델 기술 용어를 표준화하는 데 한 걸음 더 나아간 것을 의미한다.

이전에는 업계 내에서 '토큰(Token)'을 지칭하는 다양한 용어가 경쟁적으로 사용되었다. 텐센트 연구소의 양빈(Yang Bin) 학자는 '모델 요소(Model Element)'를 제안하여 광범위한 논의를 불러일으켰다. 이후 바이촨 인텔리전스(Baichuan Intelligence)의 왕샤오촨(Wang Xiaochuan) 대표, 룬천 테크놀로지(Lunchen Technology)의 유양(You Yang) 대표, 그리고 칭화대학교 전 부교수 후이린(Hu Yilin)이 제안한 "지능 요소(Intelligence Element)"라는 용어가 소셜 미디어에서 큰 반향을 일으켰다. 이 용어는 토큰이 단순한 "일반 계산"이 아닌 "일반 지능"의 단위로서의 역할을 강조한 것이었다.
그러나 정부가 채택한 용어인 '워드 엘리먼트(Word Element)'는 근본적인 기술적 논리에 더 초점을 맞추고 있다. 공식적으로 AI가 인간 언어를 이해하기 위한 최소 단위로 설명되는 워드 엘리먼트의 분할 단위는 문자(character)와 단어(word) 사이에 위치한다. 이를 통해 대규모 모델의 텍스트 처리 과정에서 의미적 단위를 보다 정밀하게 포괄할 수 있다. 사용량이 역사적인 140조 건이라는 이정표에 근접함에 따라, 통일된 용어 표준은 업계 전반의 의사소통 비용을 절감하고, 향후 AI 인프라와 관련된 통계적 정량화 및 정책 수립을 위한 견고한 기반을 마련하는 데 도움이 될 것이다.
내부 세부 사항 공개: 차세대 Gemini에 대한Computing Power의 긴장, 내부 팀들은 개발 우선순위와 자원 배분에 대해 의견이 갈렸다
보고에 따르면 구글의 높은 기대를 모았던次世代 제미니 모델의 출시가 연기되었다. 개발 우선순위와 자원 배분에 대한 내부 의견 불일치, 제한된 컴퓨팅 용량, 복잡한 승인 절차가 결합되어 2개월의 지연이 불가피해졌다. 자체 맞춤형 TPU 칩을 보유하고 있음에도 불구하고, 모델 학습, 구글 클라우드 서비스, 수많은 소비자 및 기업용 AI 애플리케이션 간의 경쟁적 수요로 인해 구글은 컴퓨팅 자원 부족에 직면해 있다. 최고 경영진은 이제 조직 개편을 통
OpenAI, 성장 둔화 우려 불식…여러 사업부門 가속화
외부로부터의 판매 성장 둔화 및 내부 목표 미달성에 대한 scrutiny에 대응하여, AI 선도 기업 오픈AI는 4월 28일 화요일에 자신감 있는 성명을 발표했다. 이 회사는 소비자 제품과 기업 서비스의 빠른 진전을 명확히 하며, 최근 제기된 사업 둔화에 대한 추측을 직접적으로 반박했다.동사가 "여러 내부 목표를 놓쳤다"는 주장에 대해, 오픈AI는 이러한 보도를 "전형적인 클릭베이트"로 일축했다. 이 회사는 AI 통합에 대한 강력한 기업 수요
알리바바 슈퍼컵: Qwen3.8-Max, 강화된 코딩 및 오피스 도구로 데뷔
Alibaba는 2.4조 개의 파라미터를 갖춘 차세대 기반 대형 모델인 Qwen3.8-Max를 공식적으로 공개했습니다. 이 중요한 AI 기술 발전은 코딩 및 전문 사무 작업 등 핵심 영역에서 상당한 성능 향상을 제공하며, 강력한 기술 역량을 보여줍니다.권위 있는 Arena 대형 모델 랭킹에서 Qwen3.8-Max는 Anthropic의 Claude 시리즈에 이어 우수한 성적을 거두며 업계 선두 그룹에 자리했습니다. 이 성과는 국내 대형 모델이





집






