Alibaba расширяет длину контекста Qwen2.5-Turbo до 1 миллиона токенов
Alibaba/Qwen
OpenAI
Alibaba выпускает Qwen2.5-Turbo с длиной контекста, увеличенной с 128K до 1M токенов. Модель достигает 100% точности в задаче Passkey Retrieval на 1M токенов и набирает 93,1 балла в тесте RULER, превосходя GPT-4. Скорость вывода улучшена до 4,3 раз за счёт разреженного внимания, при этом стоимость остаётся на уровне 0,3 юаня за 1M токенов.
Компания Alibaba представила модель Qwen2.5-Turbo, расширив её контекстную длину со 128 тыс. до 1 млн токенов, что эквивалентно примерно 1 миллиону английских слов или 1,5 миллионам китайских иероглифов. Модель достигает 100% точности в задаче «Поиск пароля» (Passkey Retrieval) при длине контекста в 1 млн токенов и набирает 93,1 балла в бенчмарке для длинных текстов RULER, превосходя показатели
Показать ещё ↓
Источник: Alibaba Qwen —
оригинал
