⚡ СРОЧНО
МоделиГенерация медиа 🇨🇳 28.07.2026 00:03

Qwen2.5 Omni: видит, слышит, говорит, пишет — всё в одном

Alibaba/QwenAlibaba/Qwen
Компания Alibaba Qwen выпустила Qwen2.5-Omni, флагманскую мультимодальную модель, способную обрабатывать текст, изображения, аудио и видео, а также генерировать речь в реальном времени. Модель использует архитектуру Thinker-Talker и превосходит аналогичные модели по всем модальностям.
Alibaba Qwen представила Qwen2.5-Omni — новую флагманскую модель в серии Qwen, предназначенную для всестороннего мультимодального восприятия. Модель обрабатывает текст, изображения, аудио и видео, генерируя потоковые ответы в виде текста или естественной речи. Архитектура Thinker-Talker включает Thinker, который понимает входные данные, и Talker, который генерирует речь. Модель доступна на
Показать ещё ↓
Источник: Alibaba Qwen — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости