SuperCLUE 2025 중국 대형 모델 보고서에 따르면 Claude-Opus-4.5-Reasoning이 68.25점으로 선두를 차지했으며, Gemini-3-Pro-Preview와 GPT-5.2가 그 뒤를 이었습니다. 국내 모델인 Kimi-K2.5-Thinking과 Qwen3-Max-Thinking은 각각 4위와 6위를 기록했으며, 코드 생성 및 수학적 추론 분야에서 우수한 성능을 보였습니다. 해외 모델들이 여전히 앞서고 있지만, 중국 오픈소스 모델들은 강력한 경쟁력을 보여주고 있다.