вариант
Дом
Срочные новости
Содержание
SamuelRoberts
SamuelRoberts
24 июля 2026 г.

Компания Black Forest Lab выпустила Flux3 — первую нативную мультимодальную модель генерации аудио, способную создавать синхронизированный аудиовидеоконтент продолжительностью 20 секунд. Режим голоса Claude Opus был улучшен за счёт добавления инструментальной поддержки и мультиязычных функций. Kuaishou запустила сервис для создания интерактивного контента с использованием ИИ и начала набор творцов. Человекоподобный робот Xiaopeng начал пробную серийную производственную площадку с целью массового выпуска к 2026 году. Tencent объединил отделы мультимодальных технологий и LLM под руководством Яо Шуньюя. Microsoft представила модели MAI-Image-2.5-Pro и MAI-Voice-2-Flash, которые будут применяться в Bing и PowerPoint. Tencent также представила WorkBuddy Bench для тестирования агентов в областях программирования, веба, офисных задач и кибербезопасности. Alibaba сделала open-source модель OvisOCR2 — модель парсинга документов объёмом 0.8 миллиарда параметров, превосходящую по результатам тестов OmniDocBench.

Компания Black Forest Lab выпустила Flux3 — первую нативную мультимодальную модель генерации аудио, способную создавать синхронизированный аудиовидеоконтент продолжительностью 20 секунд. Режим голоса Claude Opus был улучшен за счёт добавления инструментальной поддержки и мультиязычных функций. Kuaishou запустила сервис для создания интерактивного контента с использованием ИИ и начала набор творцов. Человекоподобный робот Xiaopeng начал пробную серийную производственную площадку с целью массового выпуска к 2026 году. Tencent объединил отделы мультимодальных технологий и LLM под руководством Яо Шуньюя. Microsoft представила модели MAI-Image-2.5-Pro и MAI-Voice-2-Flash, которые будут применяться в Bing и PowerPoint. Tencent также представила WorkBuddy Bench для тестирования агентов в областях программирования, веба, офисных задач и кибербезопасности. Alibaba сделала open-source модель OvisOCR2 — модель парсинга документов объёмом 0.8 миллиарда параметров, превосходящую по результатам тестов OmniDocBench. Компания Black Forest Lab выпустила Flux3 — первую нативную мультимодальную модель генерации аудио, способную создавать синхронизированный аудиовидеоконтент продолжительностью 20 секунд. Режим голоса Claude Opus был улучшен за счёт добавления инструментальной поддержки и мультиязычных функций. Kuaishou запустила сервис для создания интерактивного контента с использованием ИИ и начала набор творцов. Человекоподобный робот Xiaopeng начал пробную серийную производственную площадку с целью массового выпуска к 2026 году. Tencent объединил отделы мультимодальных технологий и LLM под руководством Яо Шуньюя. Microsoft представила модели MAI-Image-2.5-Pro и MAI-Voice-2-Flash, которые будут применяться в Bing и PowerPoint. Tencent также представила WorkBuddy Bench для тестирования агентов в областях программирования, веба, офисных задач и кибербезопасности. Alibaba сделала open-source модель OvisOCR2 — модель парсинга документов объёмом 0.8 миллиарда параметров, превосходящую по результатам тестов OmniDocBench. Компания Black Forest Lab выпустила Flux3 — первую нативную мультимодальную модель генерации аудио, способную создавать синхронизированный аудиовидеоконтент продолжительностью 20 секунд. Режим голоса Claude Opus был улучшен за счёт добавления инструментальной поддержки и мультиязычных функций. Kuaishou запустила сервис для создания интерактивного контента с использованием ИИ и начала набор творцов. Человекоподобный робот Xiaopeng начал пробную серийную производственную площадку с целью массового выпуска к 2026 году. Tencent объединил отделы мультимодальных технологий и LLM под руководством Яо Шуньюя. Microsoft представила модели MAI-Image-2.5-Pro и MAI-Voice-2-Flash, которые будут применяться в Bing и PowerPoint. Tencent также представила WorkBuddy Bench для тестирования агентов в областях программирования, веба, офисных задач и кибербезопасности. Alibaba сделала open-source модель OvisOCR2 — модель парсинга документов объёмом 0.8 миллиарда параметров, превосходящую по результатам тестов OmniDocBench. Компания Black Forest Lab выпустила Flux3 — первую нативную мультимодальную модель генерации аудио, способную создавать синхронизированный аудиовидеоконтент продолжительностью 20 секунд. Режим голоса Claude Opus был улучшен за счёт добавления инструментальной поддержки и мультиязычных функций. Kuaishou запустила сервис для создания интерактивного контента с использованием ИИ и начала набор творцов. Человекоподобный робот Xiaopeng начал пробную серийную производственную площадку с целью массового выпуска к 2026 году. Tencent объединил отделы мультимодальных технологий и LLM под руководством Яо Шуньюя. Microsoft представила модели MAI-Image-2.5-Pro и MAI-Voice-2-Flash, которые будут применяться в Bing и PowerPoint. Tencent также представила WorkBuddy Bench для тестирования агентов в областях программирования, веба, офисных задач и кибербезопасности. Alibaba сделала open-source модель OvisOCR2 — модель парсинга документов объёмом 0.8 миллиарда параметров, превосходящую по результатам тестов OmniDocBench.
Автор JamesBaker JamesBaker 30 сентября 2026 г.
Компания LG Electronics в сотрудничестве с Microsoft представила на отраслевом саммите в Сеуле голосового помощника на базе искусственного интеллекта для своего хаба «умного дома» ThinQ ON. Благодаря использованию технологии «Speech to Speech» и сервиса Microsoft Voice Live система поддерживает естественные перерывы в разговоре, позволяя пользователям менять тему в середине беседы, не дожидаясь ответа. Это решает типичные проблемы, связанные с негибкими голосовыми помощниками. Эта функция будет запущена в этом году и станет доступна существующим пользователям посредством обновлений; она ориентирована как на жилой, так и на коммерческий сектор, включая отели и офисы. Компания LG стремится обеспечить себе конкурентное преимущество на рынке «умного дома», предлагая пользователям возможность вести диалог, по своему характеру не уступающий общению с человеком.
Автор NoahGreen NoahGreen 30 сентября 2026 г.
OR