вариант
Дом
Срочные новости
Содержание
HenryDavis
HenryDavis
3 августа 2026 г.

Компания SenseTime открыла исходный код SenseNova U1.5-Lite-Preview — облегченной мультимодальной модели с 8 млрд параметров (MoT). Основанная на архитектуре NEO-unify, она поддерживает генерацию изображений в формате 4K, улучшенную визуализацию текста и стабильное редактирование изображений. Доступная на GitHub, Hugging Face и ModelScope, она снижает барьеры для разработки приложений искусственного интеллекта.

Компания SenseTime открыла исходный код SenseNova U1.5-Lite-Preview — облегченной мультимодальной модели с 8 млрд параметров (MoT). Основанная на архитектуре NEO-unify, она поддерживает генерацию изображений в формате 4K, улучшенную визуализацию текста и стабильное редактирование изображений. Доступная на GitHub, Hugging Face и ModelScope, она снижает барьеры для разработки приложений искусственного интеллекта.
Автор CarlGarcia CarlGarcia 9 октября 2026 г.
Исследователи из Мельбурнского университета и Университета Нового Южного Уэльса представили VoxMem — новый бенчмарк, выявляющий критические недостатки текущих методов оценки памяти голосового искусственного интеллекта. В отличие от предыдущих подходов, игнорирующих нюансы аудио, VoxMem изолирует длину разговора для проверки способности моделей запоминать личность говорящего, тон голоса и фоновые звуки на основе 34 743 аудиозаписей. Тестирование 15 популярных моделей показало, что ни одна из них не достигает точности выше 40% при длине контекста в 32K токенов. Модели демонстрируют значительные трудности с распознаванием паралингвистических сигналов и звуков окружающей среды, причем их эффективность снижается по мере увеличения объема истории диалога, что подчеркивает существенный пробел в возможностях понимания длинных аудиозаписей.
OR