Groq duplica el rendimiento de inferencia de Llama-2 70B en 3 semanas
La empresa Groq ha anunciado un aumento del doble en el rendimiento de inferencia para el modelo Llama-2 70B en solo tres semanas. La mejora se logró mediante la optimización del hardware y el software. Ahora el sistema procesa más de 1250 tokens por segundo por hilo.
Meta
Groq
Meta AI (GNews)28.07 · 10:04


