вариант
Дом
Срочные новости
Содержание
MatthewLewis
MatthewLewis
21 июля 2026 г.

Google DeepMind представила GenCeption — модель, построенную на основе фреймворка Wan2.1 от Alibaba, которая превращает генерацию видео в механизм визуального анализа. Она одновременно выполняет пять основных задач, включая оценку глубины, сегментацию и оценку 3D-позы, за один проход. Обученная всего на 7500 синтетических видеороликах с одним человеком, она способна обобщать результаты на сцены с несколькими людьми, животными и роботами. Небольшая модель обрабатывает 81 кадр за 6 секунд; большая модель объемом 14 млрд параметров — за 10 секунд, сохраняя мелкие детали, такие как усы кошки и шерсть.

Google DeepMind представила GenCeption — модель, построенную на основе фреймворка Wan2.1 от Alibaba, которая превращает генерацию видео в механизм визуального анализа. Она одновременно выполняет пять основных задач, включая оценку глубины, сегментацию и оценку 3D-позы, за один проход. Обученная всего на 7500 синтетических видеороликах с одним человеком, она способна обобщать результаты на сцены с несколькими людьми, животными и роботами. Небольшая модель обрабатывает 81 кадр за 6 секунд; большая модель объемом 14 млрд параметров — за 10 секунд, сохраняя мелкие детали, такие как усы кошки и шерсть.
OR