Официальные бенчмарки DeepSeek-V4-Flash: около 98% попаданий в кэш для максимальной экономической эффективности
Компания DeepSeek опубликовала официальные бенчмарки для своей модели V4-Flash, подчеркивая приблизительно 98% попаданий в кэш. Утверждается, что это обеспечивает экстремальную экономическую эффективность, так как кэшированные токены значительно дешевле. Модель представлена как конкурентоспособный вариант на рынке AI-инференса.
DeepSeek официально представил результаты бенчмарков для своей модели V4-Flash, демонстрируя впечатляющий показатель попадания в кэш около 98%. Высокий показатель попадания в кэш означает, что большая часть запросов может обслуживаться из кэша, что снижает вычислительные затраты и задержку. Такая эффективность приводит к заметно более низкой цене за токен, что делает V4-Flash высокоэкономичным
Показать ещё ↓
Источник: DeepSeek (GNews) —
оригинал
