모델 RSS

모델 🇨🇳

Qwen2.5 Omni: 보고, 듣고, 말하고, 쓰는 올인원 모델

알리바바 Qwen이 Qwen2.5-Omni를 출시했습니다. 이 새로운 플래그십 멀티모달 모델은 텍스트, 이미지, 오디오, 비디오를 처리하고 실시간으로 텍스트와 자연어 음성 응답을 생성할 수 있습니다. Thinker-Talker 아키텍처로 구축된 이 모델은 오픈소스이며 모든 모달리티에서 높은 성능을 보여줍니다.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen28.07 · 00:03
모델 🇨🇳

알리바바 Qwen, 시각적 추론 모델 QVQ-Max 출시

알리바바 Qwen이 시각적 추론 모델의 첫 번째 버전인 QVQ-Max를 공식 출시했습니다. 이 모델은 이미지와 비디오를 인식할 뿐만 아니라 분석하여 수학부터 창의적인 작업까지 해결할 수 있습니다. 개발자들은 사고 과정의 길이가 길어질수록 MathVision 벤치마크에서 모델의 정확도가 향상된다고 밝혔습니다.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen28.07 · 00:03
새로운 뉴스