Alibaba открывает исходный код Qwen2.5-1M с поддержкой контекста до 1 млн токенов
Alibaba/Qwen
Alibaba выпустила открытые модели Qwen2.5-7B-Instruct-1M и Qwen2.5-14B-Instruct-1M с контекстом до 1 млн токенов, а также оптимизированный фреймворк инференса на базе vLLM. Модели превосходят предыдущие версии и GPT-4o-mini в задачах с длинным контекстом, сохраняя производительность на коротких текстах.
Alibaba Qwen представила открытые модели Qwen2.5-7B-Instruct-1M и Qwen2.5-14B-Instruct-1M, способные обрабатывать контекст до 1 миллиона токенов. Для их развертывания компания полностью открыла фреймворк инференса на основе vLLM (Very Large Language Model), который использует разреженное внимание (sparse attention) и ускоряет обработку 1M токенов в 3–7 раз. Модели обучались прогрессивно: сначала
Показать ещё ↓
Источник: Alibaba Qwen —
оригинал
