Alibaba расширяет длину контекста Qwen2.5-Turbo до 1 миллиона токенов
Alibaba выпускает Qwen2.5-Turbo с длиной контекста, увеличенной с 128K до 1M токенов. Модель достигает 100% точности в задаче Passkey Retrieval на 1M токенов и набирает 93,1 балла в тесте RULER, превосходя GPT-4. Скорость вывода улучшена до 4,3 раз за счёт разреженного внимания, при этом стоимость остаётся на уровне 0,3 юаня за 1M токенов.
Alibaba/Qwen
OpenAI
Alibaba Qwen28.07 · 17:04
