МоделиOpen Source 🇨🇳 28.07.2026 19:03

Alibaba выпускает Qwen2-Audio: новая аудио-языковая модель с голосовым чатом и анализом

Alibaba/QwenAlibaba/Qwen
Alibaba представила Qwen2-Audio — новую версию аудио-языковой модели, поддерживающую голосовой чат без автоматического распознавания речи (ASR), анализ звуков, музыки и речи, а также более 8 языков. Модели Qwen2-Audio-7B и Qwen2-Audio-7B-Instruct открыты в Hugging Face и ModelScope. Производительность превосходит предыдущие SOTA на нескольких бенчмарках.
Alibaba выпустила Qwen2-Audio, следующую версию Qwen-Audio, способную принимать аудио- и текстовые входы и генерировать текст. Впервые пользователи могут отдавать голосовые команды без модулей ASR (автоматического распознавания речи). Модель умеет анализировать аудиоинформацию (речь, звуки, музыку) по текстовым инструкциям и поддерживает более 8 языков, включая китайский, английский, кантонский,
Показать ещё ↓
Источник: Alibaba Qwen — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости