Дом
Город Цзигун и Университет Цинхуа представили сетевую архитектуру ZCube, которая позволяет повысить пропускную способность инференса крупных моделей на 15 % и сократить затраты на сеть на треть
Вычисления по крупным моделям меняют инфраструктуру ИИ, и инновации в области архитектуры сетей в настоящее время играют ключевую роль в раскрытии потенциала аппаратного обеспечения. В сентябре 2025 года компании Zhipu, Yuchen Network и Университет Цинхуа представили результаты своих исследований по архитектуре сети ZCube на ACM SIGCOMM 2025 — ведущей конференции в области сетевых технологий.
21 мая 2026 года компания Zhipu объявила об успешном внедрении архитектуры ZCube в производственную среду кодирования GLM-5.1, что привело к значительному повышению производительности. Тесты производительности, проведенные с использованием неизменного аппаратного обеспечения графических процессоров, программного стека и приложений, показали, что ZCube сократила капитальные затраты на коммутаторы и оптические модули на 33 %, увеличила среднюю пропускную способность графических процессоров при инференции на 15 % и сократила задержку первого токена (TTFT P99) на 40,6 %. Этот прорыв на системном уровне обеспечивает баланс между высокой экономической эффективностью и высокой производительностью.

В настоящее время, когда инференция с длинным контекстом и развертывание с разделением Prefill-Decode (PD) становятся отраслевыми стандартами, передача данных между узлами кэша KV демонстрирует значительную асимметрию. Традиционные архитектуры ROFT (Rail-Optimized Fat-Tree), основанные на многоуровневом стекировании коммутаторов, ограничены статической топологией, что делает их подверженными локальным «горячим точкам» и обратному давлению PFC. Это создает структурное «узкое место», при котором общей пропускной способности достаточно, но часто возникают локальные перегрузки.

Чтобы устранить эту проблему, архитектура ZCube отходит от иерархического стекирования, характерного для традиционных конструкций Clos. Она исключает коммутаторы уровня Spine и вместо этого использует две группы полностью плоских коммутаторов, соединенных в виде двудольного графа, в сочетании с гибридным механизмом доступа (одно- и многодорожечным) с помощью двухпортовых сетевых карт. Благодаря уникальной стратегии маршрутизации ZCube гарантирует выделенный оптимальный путь для любой пары графических процессоров, обеспечивая идеальную балансировку нагрузки трафика на структурном уровне и поддерживая сверхмасштабное расширение до десятков тысяч или даже сотен тысяч графических процессоров.
В ходе трансформации производственной среды команда Yuchen Network успешно справилась с задачами прокладки кабельной разводки и реконструкции стратегии маршрутизации с помощью инструментов автоматизированного управления и верификации, обеспечив быстрое и стабильное обновление кластера. Нынешний кластер из тысячи карт стабильно работает уже более двух недель. Успешное развертывание ZCube знаменует переход инфраструктуры интеллектуальных вычислений от общего межсоединения к системному взаимодействию, управляемому трафиком моделей. В будущем глубокая интеграция сетевой топологии, библиотек связи и стратегий планирования станет основной движущей силой для дальнейшего повышения эффективности производства токенов и снижения общих затрат на MaaS.
Связанная статья
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями
Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Как исправить Core Web Vitals для улучшения позиций в поисковой выдаче
Оптимизация написания комментариев в отчетных карточках с помощью ИИ-инструментовВведениеИИ-инструменты для генерации комментариев в отчетных карточкахMagic SchoolAlmanac AIChat GPTИспользование Magic School для генерации комментариев в отчетны
Рекомендации по связанным специальным темам
Комментарии (0)
Вычисления по крупным моделям меняют инфраструктуру ИИ, и инновации в области архитектуры сетей в настоящее время играют ключевую роль в раскрытии потенциала аппаратного обеспечения. В сентябре 2025 года компании Zhipu, Yuchen Network и Университет Цинхуа представили результаты своих исследований по архитектуре сети ZCube на ACM SIGCOMM 2025 — ведущей конференции в области сетевых технологий.
21 мая 2026 года компания Zhipu объявила об успешном внедрении архитектуры ZCube в производственную среду кодирования GLM-5.1, что привело к значительному повышению производительности. Тесты производительности, проведенные с использованием неизменного аппаратного обеспечения графических процессоров, программного стека и приложений, показали, что ZCube сократила капитальные затраты на коммутаторы и оптические модули на 33 %, увеличила среднюю пропускную способность графических процессоров при инференции на 15 % и сократила задержку первого токена (TTFT P99) на 40,6 %. Этот прорыв на системном уровне обеспечивает баланс между высокой экономической эффективностью и высокой производительностью.

В настоящее время, когда инференция с длинным контекстом и развертывание с разделением Prefill-Decode (PD) становятся отраслевыми стандартами, передача данных между узлами кэша KV демонстрирует значительную асимметрию. Традиционные архитектуры ROFT (Rail-Optimized Fat-Tree), основанные на многоуровневом стекировании коммутаторов, ограничены статической топологией, что делает их подверженными локальным «горячим точкам» и обратному давлению PFC. Это создает структурное «узкое место», при котором общей пропускной способности достаточно, но часто возникают локальные перегрузки.

Чтобы устранить эту проблему, архитектура ZCube отходит от иерархического стекирования, характерного для традиционных конструкций Clos. Она исключает коммутаторы уровня Spine и вместо этого использует две группы полностью плоских коммутаторов, соединенных в виде двудольного графа, в сочетании с гибридным механизмом доступа (одно- и многодорожечным) с помощью двухпортовых сетевых карт. Благодаря уникальной стратегии маршрутизации ZCube гарантирует выделенный оптимальный путь для любой пары графических процессоров, обеспечивая идеальную балансировку нагрузки трафика на структурном уровне и поддерживая сверхмасштабное расширение до десятков тысяч или даже сотен тысяч графических процессоров.
В ходе трансформации производственной среды команда Yuchen Network успешно справилась с задачами прокладки кабельной разводки и реконструкции стратегии маршрутизации с помощью инструментов автоматизированного управления и верификации, обеспечив быстрое и стабильное обновление кластера. Нынешний кластер из тысячи карт стабильно работает уже более двух недель. Успешное развертывание ZCube знаменует переход инфраструктуры интеллектуальных вычислений от общего межсоединения к системному взаимодействию, управляемому трафиком моделей. В будущем глубокая интеграция сетевой топологии, библиотек связи и стратегий планирования станет основной движущей силой для дальнейшего повышения эффективности производства токенов и снижения общих затрат на MaaS.
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её
Как исправить Core Web Vitals для улучшения позиций в поисковой выдаче
Оптимизация написания комментариев в отчетных карточках с помощью ИИ-инструментовВведениеИИ-инструменты для генерации комментариев в отчетных карточкахMagic SchoolAlmanac AIChat GPTИспользование Magic School для генерации комментариев в отчетны











