вариант
Дом
Срочные новости
Содержание
RyanJackson
RyanJackson
10 октября 2026 г.

Компания Shengshu Technology выпустила Vidu Q4 Preview — модель генерации видео нового поколения, предназначенную для кино, короткометражных роликов с использованием ИИ и рекламы. Ключевые обновления включают разрешение 2K и 4K с 10-битной цветовой глубиной, 16-секундные клипы, создаваемые за один сеанс, многомерное управление эталонными изображениями с поддержкой до 15 изображений и 3 аудиофрагментов, а также усовершенствованные сложные движения камеры. Стоимость начинается от 0,09 юаня за секунду; предлагается несколько вариантов разрешения — от 540P до 4K — для экономичного тестирования и высококачественного конечного производства.

Компания Shengshu Technology выпустила Vidu Q4 Preview — модель генерации видео нового поколения, предназначенную для кино, короткометражных роликов с использованием ИИ и рекламы. Ключевые обновления включают разрешение 2K и 4K с 10-битной цветовой глубиной, 16-секундные клипы, создаваемые за один сеанс, многомерное управление эталонными изображениями с поддержкой до 15 изображений и 3 аудиофрагментов, а также усовершенствованные сложные движения камеры. Стоимость начинается от 0,09 юаня за секунду; предлагается несколько вариантов разрешения — от 540P до 4K — для экономичного тестирования и высококачественного конечного производства.
Автор PaulHill PaulHill 10 октября 2026 г.
Автор CarlGarcia CarlGarcia 9 октября 2026 г.
Исследователи из Мельбурнского университета и Университета Нового Южного Уэльса представили VoxMem — новый бенчмарк, выявляющий критические недостатки текущих методов оценки памяти голосового искусственного интеллекта. В отличие от предыдущих подходов, игнорирующих нюансы аудио, VoxMem изолирует длину разговора для проверки способности моделей запоминать личность говорящего, тон голоса и фоновые звуки на основе 34 743 аудиозаписей. Тестирование 15 популярных моделей показало, что ни одна из них не достигает точности выше 40% при длине контекста в 32K токенов. Модели демонстрируют значительные трудности с распознаванием паралингвистических сигналов и звуков окружающей среды, причем их эффективность снижается по мере увеличения объема истории диалога, что подчеркивает существенный пробел в возможностях понимания длинных аудиозаписей.
OR