вариант
Дом
Срочные новости
Содержание
FrankWilliams
FrankWilliams
11 марта 2026 г.

WeChat разрабатывает ИИ-агент для интеграции миллионов мини-программ, планируя начать поэтапное тестирование к середине 2026 года Fish Audio запускает полностью открытую модель преобразования текста в речь S2 с управлением эмоциями на уровне слов Honor Magic V6 интегрирует передовые ИИ-технологии в совместную работу нескольких устройств через Lobster Universe Zhihu выпускает первый индекс конкурентоспособности брендов в области ИИ, ориентированный на видимость и достоверность контента Baidu Intelligent Cloud представляет ИИ-сервис DuClaw с нулевым развертыванием для упрощения использования интеллектуальных агентов Google запускает Gemini Embedding 2 — первую полную мультимодальную модель встраивания, поддерживающую более 100 языков. OpenAI обновляет браузер Atlas, добавив возможность входа с нескольких учетных записей для разделения рабочих и личных данных. Серия Xiaomi 18 будет оснащена физической кнопкой искусственного интеллекта и чипом Snapdragon 8 Gen6, а ее запуск возможен в сентябре.

WeChat разрабатывает ИИ-агент для интеграции миллионов мини-программ, планируя начать поэтапное тестирование к середине 2026 года Fish Audio запускает полностью открытую модель преобразования текста в речь S2 с управлением эмоциями на уровне слов Honor Magic V6 интегрирует передовые ИИ-технологии в совместную работу нескольких устройств через Lobster Universe Zhihu выпускает первый индекс конкурентоспособности брендов в области ИИ, ориентированный на видимость и достоверность контента Baidu Intelligent Cloud представляет ИИ-сервис DuClaw с нулевым развертыванием для упрощения использования интеллектуальных агентов Google запускает Gemini Embedding 2 — первую полную мультимодальную модель встраивания, поддерживающую более 100 языков. OpenAI обновляет браузер Atlas, добавив возможность входа с нескольких учетных записей для разделения рабочих и личных данных. Серия Xiaomi 18 будет оснащена физической кнопкой искусственного интеллекта и чипом Snapdragon 8 Gen6, а ее запуск возможен в сентябре. WeChat разрабатывает ИИ-агент для интеграции миллионов мини-программ, планируя начать поэтапное тестирование к середине 2026 года Fish Audio запускает полностью открытую модель преобразования текста в речь S2 с управлением эмоциями на уровне слов Honor Magic V6 интегрирует передовые ИИ-технологии в совместную работу нескольких устройств через Lobster Universe Zhihu выпускает первый индекс конкурентоспособности брендов в области ИИ, ориентированный на видимость и достоверность контента Baidu Intelligent Cloud представляет ИИ-сервис DuClaw с нулевым развертыванием для упрощения использования интеллектуальных агентов Google запускает Gemini Embedding 2 — первую полную мультимодальную модель встраивания, поддерживающую более 100 языков. OpenAI обновляет браузер Atlas, добавив возможность входа с нескольких учетных записей для разделения рабочих и личных данных. Серия Xiaomi 18 будет оснащена физической кнопкой искусственного интеллекта и чипом Snapdragon 8 Gen6, а ее запуск возможен в сентябре. WeChat разрабатывает ИИ-агент для интеграции миллионов мини-программ, планируя начать поэтапное тестирование к середине 2026 года Fish Audio запускает полностью открытую модель преобразования текста в речь S2 с управлением эмоциями на уровне слов Honor Magic V6 интегрирует передовые ИИ-технологии в совместную работу нескольких устройств через Lobster Universe Zhihu выпускает первый индекс конкурентоспособности брендов в области ИИ, ориентированный на видимость и достоверность контента Baidu Intelligent Cloud представляет ИИ-сервис DuClaw с нулевым развертыванием для упрощения использования интеллектуальных агентов Google запускает Gemini Embedding 2 — первую полную мультимодальную модель встраивания, поддерживающую более 100 языков. OpenAI обновляет браузер Atlas, добавив возможность входа с нескольких учетных записей для разделения рабочих и личных данных. Серия Xiaomi 18 будет оснащена физической кнопкой искусственного интеллекта и чипом Snapdragon 8 Gen6, а ее запуск возможен в сентябре.
Автор CarlPerez CarlPerez 23 сентября 2026 г.
Alibaba Qwen представила Qwen-Audio-3.1, включившую пять моделей, охватывающих распознавание речи, синтез речи, взаимодействие в реальном времени и генерацию контента. Обновление позволяет снизить цены на 70–95 %, делая голосовые технологии широко доступными. Ключевые функции включают контекстно-зависимое распознавание речи (ASR) с встроенной корректировкой транскрипции, поддержку 30 языков и 16 китайских диалектов, а также сверхнизкую задержку. Модель TTS-Next позволяет генерировать аудио общего назначения, комбинируя голоса, звуковые эффекты и фоновые шумы. Взаимодействие в реальном времени поддерживает полнодуплексный диалог с распознаванием эмоций и интеграцией инструментов. Этот комплексный набор решений значительно снижает затраты, одновременно повышая точность, расширяя многоязычную поддержку и расширяя возможности для творческого создания аудиоконтента.
/ru/live/7579
OR