AI Digest · 24시간
Главное в рубрике «Генерация медиа» за сутки.
- Qwen2.5 Omni: 보고, 듣고, 말하고, 쓰는 올인원 모델
알리바바 Qwen이 플래그십 멀티모달 모델인 Qwen2.5-Omni를 공개했습니다. 이 모델은 텍스트, 이미지, 오디오, 비디오를 처리할 수 있을 뿐만 아니라 실시간 음성 생성도 가능합니다. Thinker-Talker 아키텍처를 사용하며, 모든 양식에서 유사 모델들을 능가합니다.
출처: ДНБ66 · Итоги рубрики —
원문
