Дом
Senspeech X2.5 Twin Stars: первый миллион токенов контекста на периферии, полностью обученный с использованием отечественных вычислительных мощностей
1 сентября wholly-owned дочерняя компания iFLYTEK, Ciyuan Xinghuo, официально запустила и открыла исходный код двух краевых общих больших моделей: Xinghuo X2.5-4B и Xinghuo X2.5-1.7B. Эти модели первыми в своем роде нативно поддерживают длину контекста до 1 миллиона токенов, предоставляя полный доступ к весам моделей, репозиториям кода и документации по развертыванию.
Поддержка контекста на уровне миллионов токенов, маленькие модели могут «читать целую книгу»
Обе модели используют гибридную архитектуру внимания, оптимизированную для таких ключевых возможностей, как агенты, код, математика и следование инструкциям, обеспечивая комплексную производительность, которая лидирует среди открытых моделей индустриального класса аналогичного размера.
Что касается возможности контекста, Xinghuo X2.5-4B и Xinghuo X2.5-1.7B обучены на качественных данных на уровне триллионов токенов, охватывающих такие сценарии, как длинные документы и технические материалы. Они нативно поддерживают окно контекста в 1 миллион токенов, позволяя им получать и понимать информацию крупномасштабного объема за один раз.

Например, в сфере послепродажного обслуживания продуктов: пользователи могут импортировать полное руководство по послепродажному обслуживанию в Xinghuo X2.5-4B. Модель сначала упорядочивает правила послепродажного обслуживания в различных сценариях и отмечает соответствующие главы. При вопросе «Подлежит ли замена устройства в течение 10 дней после покупки и использовании сторонних расходных материалов?» она может предоставить комплексную оценку, связывая положения о возврате, обработке неисправностей и исключениях из различных глав. Даже если позже будут добавлены новые условия, такие как удаленные районы или устройства с картами семьи, модель сможет сохранить предыдущий контекст и продолжать предоставлять рекомендации, объединяя правила логистики, стирания данных и несения затрат.
Длинный контекст решает проблему «можно ли полностью просмотреть информацию», в то время как возможности агентов и вызова инструментов решают «можно ли предпринять действия после просмотра». Краевые модели Xinghuo X2.5 предоставляют локализированные интеллектуальные возможности для сценариев, таких как личный офис, разработка кода, умное оборудование и робототехника. В сценариях разработки кода Xinghuo X2.5-4B может соответствовать облачным моделям с параметрами в 2–3 раза больше в задачах, таких как реализация алгоритмов, завершение кода и генерация; на наборе тестов умного дома Domux точность выполнения инструкций управления Xinghuo X2.5-1.7B достигает 90,3%, со средним временем ответа всего 0,85 секунды; в сценариях робототехники обе модели могут быть развернуты на корпусах роботов или краевых устройствах, поддерживая такие задачи, как управление операциями, отслеживание целей и принятие навигационных решений, снижая зависимость от облачных соединений и заранее установленных программ.
Обучение на полностью отечественных вычислительных мощностях, мгновенная загрузка и опыт
Xinghuo X2.5-4B и Xinghuo X2.5-1.7B были обучены полностью на отечественных вычислительных платформах, используя около 20 триллионов разнообразных токенов данных для предварительного обучения и постоянно улучшая производительность через высококачественное контролируемое тонкое обучение и обучение с подкреплением.
В плане развертывания обе модели поддерживают аппаратные платформы, включая NVIDIA, Huawei, Hai Guang и Hemo, и совместимы с основными фреймворками вывода, такими как vLLM, SGLang и llama.cpp. Их можно быстро развернуть с помощью таких инструментов, как Ollama и LM Studio, и поддерживать инкрементальное обучение с использованием LLaMA-Factory. Начиная с сегодняшнего дня, веса моделей стали доступны на платформах, таких как Hugging Face и GitHub, и соответствующие API моделей были запущены на платформе Starry MaaS iFLYTEK, бесплатно в течение ограниченного времени. 7 сентября iFLYTEK официально выпустит флагманскую общую большую модель следующего поколения Xinghuo X2.5, дополнительно улучшая такие ключевые возможности, как код и агенты.
Связанная статья
OpenAI запускает консультативную группу по математике и искусственному интеллекту; загадочная модель решает 100 мировых задач за 24 дня
22 сентября компания OpenAI объявила о создании «Консультативной группы по математике и искусственному интеллекту». Штаб-квартира этой независимой структуры, состоящей из девяти математиков, работающих отдельно от OpenAI, расположена в Институте пере
Meitun LongCat запускает LoHoSearch, пока оценки BrowseComp падают ниже 30%
Возможности поисковых агентов в значительной степени определялись benchmarkом BrowseComp на протяжении последнего года. Однако этот тест теряет свою актуальность: он обеспечил рост производительности моделей с 30% до 90% всего за десять месяцев, и ег
MiniMax представляет M3, отечественную большую языковую модель, превосходящую GPT-5.5
В секторе искусственного интеллекта Китая произошел значительный технологический скачок с официальным запуском новейшей большой языковой модели MiniMax M3 от компании Xiyu Technology. Эта передовая система сочетает в себе современные возможности прог
Рекомендации по связанным специальным темам
Комментарии (0)
1 сентября wholly-owned дочерняя компания iFLYTEK, Ciyuan Xinghuo, официально запустила и открыла исходный код двух краевых общих больших моделей: Xinghuo X2.5-4B и Xinghuo X2.5-1.7B. Эти модели первыми в своем роде нативно поддерживают длину контекста до 1 миллиона токенов, предоставляя полный доступ к весам моделей, репозиториям кода и документации по развертыванию.
Поддержка контекста на уровне миллионов токенов, маленькие модели могут «читать целую книгу»
Обе модели используют гибридную архитектуру внимания, оптимизированную для таких ключевых возможностей, как агенты, код, математика и следование инструкциям, обеспечивая комплексную производительность, которая лидирует среди открытых моделей индустриального класса аналогичного размера.
Что касается возможности контекста, Xinghuo X2.5-4B и Xinghuo X2.5-1.7B обучены на качественных данных на уровне триллионов токенов, охватывающих такие сценарии, как длинные документы и технические материалы. Они нативно поддерживают окно контекста в 1 миллион токенов, позволяя им получать и понимать информацию крупномасштабного объема за один раз.

Например, в сфере послепродажного обслуживания продуктов: пользователи могут импортировать полное руководство по послепродажному обслуживанию в Xinghuo X2.5-4B. Модель сначала упорядочивает правила послепродажного обслуживания в различных сценариях и отмечает соответствующие главы. При вопросе «Подлежит ли замена устройства в течение 10 дней после покупки и использовании сторонних расходных материалов?» она может предоставить комплексную оценку, связывая положения о возврате, обработке неисправностей и исключениях из различных глав. Даже если позже будут добавлены новые условия, такие как удаленные районы или устройства с картами семьи, модель сможет сохранить предыдущий контекст и продолжать предоставлять рекомендации, объединяя правила логистики, стирания данных и несения затрат.
Длинный контекст решает проблему «можно ли полностью просмотреть информацию», в то время как возможности агентов и вызова инструментов решают «можно ли предпринять действия после просмотра». Краевые модели Xinghuo X2.5 предоставляют локализированные интеллектуальные возможности для сценариев, таких как личный офис, разработка кода, умное оборудование и робототехника. В сценариях разработки кода Xinghuo X2.5-4B может соответствовать облачным моделям с параметрами в 2–3 раза больше в задачах, таких как реализация алгоритмов, завершение кода и генерация; на наборе тестов умного дома Domux точность выполнения инструкций управления Xinghuo X2.5-1.7B достигает 90,3%, со средним временем ответа всего 0,85 секунды; в сценариях робототехники обе модели могут быть развернуты на корпусах роботов или краевых устройствах, поддерживая такие задачи, как управление операциями, отслеживание целей и принятие навигационных решений, снижая зависимость от облачных соединений и заранее установленных программ.
Обучение на полностью отечественных вычислительных мощностях, мгновенная загрузка и опыт
Xinghuo X2.5-4B и Xinghuo X2.5-1.7B были обучены полностью на отечественных вычислительных платформах, используя около 20 триллионов разнообразных токенов данных для предварительного обучения и постоянно улучшая производительность через высококачественное контролируемое тонкое обучение и обучение с подкреплением.
В плане развертывания обе модели поддерживают аппаратные платформы, включая NVIDIA, Huawei, Hai Guang и Hemo, и совместимы с основными фреймворками вывода, такими как vLLM, SGLang и llama.cpp. Их можно быстро развернуть с помощью таких инструментов, как Ollama и LM Studio, и поддерживать инкрементальное обучение с использованием LLaMA-Factory. Начиная с сегодняшнего дня, веса моделей стали доступны на платформах, таких как Hugging Face и GitHub, и соответствующие API моделей были запущены на платформе Starry MaaS iFLYTEK, бесплатно в течение ограниченного времени. 7 сентября iFLYTEK официально выпустит флагманскую общую большую модель следующего поколения Xinghuo X2.5, дополнительно улучшая такие ключевые возможности, как код и агенты.
OpenAI запускает консультативную группу по математике и искусственному интеллекту; загадочная модель решает 100 мировых задач за 24 дня
22 сентября компания OpenAI объявила о создании «Консультативной группы по математике и искусственному интеллекту». Штаб-квартира этой независимой структуры, состоящей из девяти математиков, работающих отдельно от OpenAI, расположена в Институте пере
Meitun LongCat запускает LoHoSearch, пока оценки BrowseComp падают ниже 30%
Возможности поисковых агентов в значительной степени определялись benchmarkом BrowseComp на протяжении последнего года. Однако этот тест теряет свою актуальность: он обеспечил рост производительности моделей с 30% до 90% всего за десять месяцев, и ег
MiniMax представляет M3, отечественную большую языковую модель, превосходящую GPT-5.5
В секторе искусственного интеллекта Китая произошел значительный технологический скачок с официальным запуском новейшей большой языковой модели MiniMax M3 от компании Xiyu Technology. Эта передовая система сочетает в себе современные возможности прог











