Senspeech X2.5 트윈 스타: 엣지에서의 첫 백만 토큰 컨텍스트, 국내 컴퓨팅 파워로 완전히 학습
9월 1일, iFLYTEK의 완전 자회사인 Ciyuan Xinghuo는 두 가지 에지 측 범용 대형 모델인 Xinghuo X2.5-4B와 Xinghuo X2.5-1.7B를 공식적으로 출시하고 오픈소스로 공개했습니다. 이 모델들은 최대 100만 토큰의 컨텍스트 길이를 네이티브로 지원하는 최초의 모델로, 모델 가중치, 코드 저장소, 배포 문서에 대한 전체 접근 권한을 제공합니다.
100만 레벨 컨텍스트 지원, 소형 모델도 "전체 책 읽기" 가능
두 모델 모두 하이브리드 어텐션 아키텍처를 활용하며, 에이전트, 코드, 수학, 지시어 따르기 등의 핵심 기능에 최적화되어 유사한 크기의 산업급 오픈소스 모델 중 가장 우수한 종합 성능을 제공합니다.
컨텍스트 기능과 관련하여 Xinghuo X2.5-4B와 Xinghuo X2.5-1.7B는 수조 토큰 수준의 고품질 데이터로 학습되었으며, 긴 문서와 기술 자료 등의 시나리오를 포함합니다. 이들은 100만 토큰의 컨텍스트 창을 네이티브로 지원하여 대규모 정보를 한 번에 수신하고 이해할 수 있습니다.

예를 들어, 제품 애프터서비스에서: 사용자는 전체 애프터서비스 매뉴얼을 Xinghuo X2.5-4B에 가져올 수 있습니다. 모델은 먼저 다양한 시나리오 하의 애프터서비스 규칙을 정리하고 해당 장을 표시합니다. "구매 후 10일 이내의 기기 고장 및 제3자 소모품 사용이 교체 대상인지"라는 질문에 대해, 모델은 반품, 고장 처리, 예외 사항에 대한 규정을 장을 연결하여 포괄적인 판단을 제공할 수 있습니다. 나중에 원격 지역이나 가족 지도가 있는 기기 같은 새로운 조건이 추가되더라도, 모델은 이전 컨텍스트를 유지하며 물류, 데이터 삭제, 비용 부담 규칙을 결합하여 조언을 계속 제공할 수 있습니다.
긴 컨텍스트는 "정보를 완전히 볼 수 있는지"라는 문제를 해결하는 반면, 에이전트 및 도구 호출 기능은 "시각화 후 행동을 취할 수 있는지"를 해결합니다. Xinghuo X2.5 에지 측 모델은 개인 사무, 코드 개발, 스마트 하드웨어, 로봇 공학 등의 시나리오에 로컬화된 지능형 기능을 제공합니다. 코드 개발 시나리오에서 Xinghuo X2.5-4B는 알고리즘 구현, 코드 완성 및 생성과 같은 작업에서 2~3배 더 큰 매개변수를 가진 클라우드 모델과 비교할 수 있습니다. Domux 스마트 홈 테스트 세트에서 Xinghuo X2.5-1.7B의 제어 명령에 대한 엔드투엔드 실행 정확도는 90.3%에 달하며, 평균 응답 시간은 단 0.85초입니다. 로봇 공학 시나리오에서 두 모델 모두 로봇 본체 또는 에지 장치에 배포될 수 있으며, 작동 제어, 대상 추적, 내비게이션 의사결정 등의 작업을 지원하여 클라우드 연결 및 고정 사전 설정 프로그램에 대한 의존성을 줄입니다.
전적으로 국내 컴퓨팅 파워로 훈련, 즉시 다운로드 및 경험
Xinghuo X2.5-4B와 Xinghuo X2.5-1.7B는 전적으로 국내 컴퓨팅 플랫폼에서 훈련되었으며, 약 20조 개의 다양한 토큰 데이터로 사전 훈련을 수행하고 고품질 감독 미세 조정 및 강화 학습을 통해 지속적으로 성능을 개선했습니다.
배포 측면에서 두 모델 모두 NVIDIA, Huawei, Hai Guang, Hemo를 포함한 하드웨어 플랫폼을 지원하며, vLLM, SGLang, llama.cpp와 같은 주요 추론 프레임워크와 호환됩니다. Ollama 및 LM Studio와 같은 도구를 통해 빠르게 배포할 수 있으며, LLaMA-Factory를 사용하여 증분 훈련을 지원합니다. 오늘부터 모델 가중치는 Hugging Face 및 GitHub와 같은 플랫폼에서 제공되며, iFLYTEK의 Starry MaaS 플랫폼에서 해당 모델 API가 출시되었으며, 제한된 기간 동안 무료로 제공됩니다. 9월 7일, iFLYTEK은 차세대 플래그십 범용 대형 모델인 Xinghuo X2.5를 공식적으로 출시하여 코드 및 에이전트와 같은 핵심 기능을 더욱 업그레이드할 예정입니다.
관련 기사
OpenAI, 수학 및 AI 자문단 출범; 미스터리한 모델이 24일 만에 100개의 세계적 문제 해결
9월 22일, 오픈에이아이(OpenAI)는 '수학 및 인공지능 자문위원회'의 구성을 발표했습니다. 프린스턴 고등연구소에 본부를 둔 이 독립 기구는 오픈에이아이와 별도로 운영되는 아홉 명의 수학자로 구성되어 있습니다.더욱 주목할 만한 점은, 8월 28일부터 학습을 시작한 미지의 모델이 나비-스토크스 밀레니엄 문제와 같은 논쟁적인 문제를 포함하여 다양한 수학 분야의 100개 이상의 오랜 미해결 문제를 성공적으로 해결했다는 오픈에이아이의 발표입니다
Meitun LongCat, LoHoSearch 출시…BrowseComp 점수 30% 미만으로 하락
지난 1년 동안 검색 에이전트의 능력은 주로 BrowseComp에 의해 정의되어 왔습니다. 그러나 이 벤치마크는 그 관련성을 잃어가고 있습니다. 이 벤치마크는 단 10개월 만에 모델 성능을 30%에서 90%로 끌어올렸지만, 그 가치는 빠르게 감소하고 있습니다. 7월 17일, 미투안의 LongCat은 검색 에이전트 개발에서 의미 있는 진전을 다시 불러일으키기 위해 설계된 더 엄격한 평가인 LoHoSearch를 출시했습니다.LoHoSearch의 과
MiniMax, GPT-5.5을 능가하는 국내 AI 대형 모델 M3 공개
중국의 AI 산업은 시위 기술(Xiyu Technology)의 최신 대규모 언어 모델인 MiniMax M3의 공식 출시를 통해 주요 기술적 도약을 목격했습니다. 이 고급 시스템은 최첨단의 코딩 숙련도와 최대 100만 토큰의 초장문 컨텍스트 창을 지원합니다. 특히, 이미지 및 비디오 처리를 포함한 멀티모달 입력과 컴퓨터 데스크톱 상호작용을 네이티브로 지원하여, 이 세 가지 핵심 기능을 통합한 중국 최초의 오픈소스 모델이 되었습니다.표준 벤치마크에
관련 특별 주제 추천
의견 (0)
0/500
9월 1일, iFLYTEK의 완전 자회사인 Ciyuan Xinghuo는 두 가지 에지 측 범용 대형 모델인 Xinghuo X2.5-4B와 Xinghuo X2.5-1.7B를 공식적으로 출시하고 오픈소스로 공개했습니다. 이 모델들은 최대 100만 토큰의 컨텍스트 길이를 네이티브로 지원하는 최초의 모델로, 모델 가중치, 코드 저장소, 배포 문서에 대한 전체 접근 권한을 제공합니다.
100만 레벨 컨텍스트 지원, 소형 모델도 "전체 책 읽기" 가능
두 모델 모두 하이브리드 어텐션 아키텍처를 활용하며, 에이전트, 코드, 수학, 지시어 따르기 등의 핵심 기능에 최적화되어 유사한 크기의 산업급 오픈소스 모델 중 가장 우수한 종합 성능을 제공합니다.
컨텍스트 기능과 관련하여 Xinghuo X2.5-4B와 Xinghuo X2.5-1.7B는 수조 토큰 수준의 고품질 데이터로 학습되었으며, 긴 문서와 기술 자료 등의 시나리오를 포함합니다. 이들은 100만 토큰의 컨텍스트 창을 네이티브로 지원하여 대규모 정보를 한 번에 수신하고 이해할 수 있습니다.

예를 들어, 제품 애프터서비스에서: 사용자는 전체 애프터서비스 매뉴얼을 Xinghuo X2.5-4B에 가져올 수 있습니다. 모델은 먼저 다양한 시나리오 하의 애프터서비스 규칙을 정리하고 해당 장을 표시합니다. "구매 후 10일 이내의 기기 고장 및 제3자 소모품 사용이 교체 대상인지"라는 질문에 대해, 모델은 반품, 고장 처리, 예외 사항에 대한 규정을 장을 연결하여 포괄적인 판단을 제공할 수 있습니다. 나중에 원격 지역이나 가족 지도가 있는 기기 같은 새로운 조건이 추가되더라도, 모델은 이전 컨텍스트를 유지하며 물류, 데이터 삭제, 비용 부담 규칙을 결합하여 조언을 계속 제공할 수 있습니다.
긴 컨텍스트는 "정보를 완전히 볼 수 있는지"라는 문제를 해결하는 반면, 에이전트 및 도구 호출 기능은 "시각화 후 행동을 취할 수 있는지"를 해결합니다. Xinghuo X2.5 에지 측 모델은 개인 사무, 코드 개발, 스마트 하드웨어, 로봇 공학 등의 시나리오에 로컬화된 지능형 기능을 제공합니다. 코드 개발 시나리오에서 Xinghuo X2.5-4B는 알고리즘 구현, 코드 완성 및 생성과 같은 작업에서 2~3배 더 큰 매개변수를 가진 클라우드 모델과 비교할 수 있습니다. Domux 스마트 홈 테스트 세트에서 Xinghuo X2.5-1.7B의 제어 명령에 대한 엔드투엔드 실행 정확도는 90.3%에 달하며, 평균 응답 시간은 단 0.85초입니다. 로봇 공학 시나리오에서 두 모델 모두 로봇 본체 또는 에지 장치에 배포될 수 있으며, 작동 제어, 대상 추적, 내비게이션 의사결정 등의 작업을 지원하여 클라우드 연결 및 고정 사전 설정 프로그램에 대한 의존성을 줄입니다.
전적으로 국내 컴퓨팅 파워로 훈련, 즉시 다운로드 및 경험
Xinghuo X2.5-4B와 Xinghuo X2.5-1.7B는 전적으로 국내 컴퓨팅 플랫폼에서 훈련되었으며, 약 20조 개의 다양한 토큰 데이터로 사전 훈련을 수행하고 고품질 감독 미세 조정 및 강화 학습을 통해 지속적으로 성능을 개선했습니다.
배포 측면에서 두 모델 모두 NVIDIA, Huawei, Hai Guang, Hemo를 포함한 하드웨어 플랫폼을 지원하며, vLLM, SGLang, llama.cpp와 같은 주요 추론 프레임워크와 호환됩니다. Ollama 및 LM Studio와 같은 도구를 통해 빠르게 배포할 수 있으며, LLaMA-Factory를 사용하여 증분 훈련을 지원합니다. 오늘부터 모델 가중치는 Hugging Face 및 GitHub와 같은 플랫폼에서 제공되며, iFLYTEK의 Starry MaaS 플랫폼에서 해당 모델 API가 출시되었으며, 제한된 기간 동안 무료로 제공됩니다. 9월 7일, iFLYTEK은 차세대 플래그십 범용 대형 모델인 Xinghuo X2.5를 공식적으로 출시하여 코드 및 에이전트와 같은 핵심 기능을 더욱 업그레이드할 예정입니다.
OpenAI, 수학 및 AI 자문단 출범; 미스터리한 모델이 24일 만에 100개의 세계적 문제 해결
9월 22일, 오픈에이아이(OpenAI)는 '수학 및 인공지능 자문위원회'의 구성을 발표했습니다. 프린스턴 고등연구소에 본부를 둔 이 독립 기구는 오픈에이아이와 별도로 운영되는 아홉 명의 수학자로 구성되어 있습니다.더욱 주목할 만한 점은, 8월 28일부터 학습을 시작한 미지의 모델이 나비-스토크스 밀레니엄 문제와 같은 논쟁적인 문제를 포함하여 다양한 수학 분야의 100개 이상의 오랜 미해결 문제를 성공적으로 해결했다는 오픈에이아이의 발표입니다
Meitun LongCat, LoHoSearch 출시…BrowseComp 점수 30% 미만으로 하락
지난 1년 동안 검색 에이전트의 능력은 주로 BrowseComp에 의해 정의되어 왔습니다. 그러나 이 벤치마크는 그 관련성을 잃어가고 있습니다. 이 벤치마크는 단 10개월 만에 모델 성능을 30%에서 90%로 끌어올렸지만, 그 가치는 빠르게 감소하고 있습니다. 7월 17일, 미투안의 LongCat은 검색 에이전트 개발에서 의미 있는 진전을 다시 불러일으키기 위해 설계된 더 엄격한 평가인 LoHoSearch를 출시했습니다.LoHoSearch의 과
MiniMax, GPT-5.5을 능가하는 국내 AI 대형 모델 M3 공개
중국의 AI 산업은 시위 기술(Xiyu Technology)의 최신 대규모 언어 모델인 MiniMax M3의 공식 출시를 통해 주요 기술적 도약을 목격했습니다. 이 고급 시스템은 최첨단의 코딩 숙련도와 최대 100만 토큰의 초장문 컨텍스트 창을 지원합니다. 특히, 이미지 및 비디오 처리를 포함한 멀티모달 입력과 컴퓨터 데스크톱 상호작용을 네이티브로 지원하여, 이 세 가지 핵심 기능을 통합한 중국 최초의 오픈소스 모델이 되었습니다.표준 벤치마크에





집






