Puntos de referencia oficiales de DeepSeek-V4-Flash: aproximadamente un 98 % de acierto de caché para una rentabilidad máxima
DeepSeek
DeepSeek ha publicado los puntos de referencia oficiales de su modelo V4-Flash, destacando una tasa de acierto de caché de aproximadamente el 98 %. Se dice que esto ofrece una relación coste-rendimiento extrema, ya que los tokens en caché son significativamente más baratos. El modelo se ha presentado como una opción competitiva en el mercado de inferencia de IA.
DeepSeek ha presentado oficialmente los resultados de referencia para su modelo V4-Flash, mostrando una impresionante tasa de aciertos de caché de aproximadamente el 98%. Una alta tasa de aciertos de caché significa que una gran parte de las solicitudes puede servirse desde la caché, reduciendo los costos computacionales y la latencia. Esta eficiencia se traduce en un precio por token notablemente más bajo, posicionando a V4-Flash como una solución altamente rentable para desarrolladores y empresas. El modelo compite en el mismo espacio que otros modelos de inferencia rápida, pero su optimización de caché lo distingue en términos de economía. El anuncio se realizó a través de Tencent News.
Fuente: DeepSeek (GNews) —
original
