La compresión de modelos de IA de Multiverse Computing acelera la inferencia en hardware estándar
Multiverse Computing ha desarrollado un método para comprimir modelos de inteligencia artificial, lo que permite que se ejecuten más rápido en hardware estándar sin necesidad de aceleradores especializados. La técnica, que utiliza la descomposición en valores singulares, logra una aceleración de hasta 10 veces en unidades centrales de procesamiento.
Multiverse Computing
Meta AI (GNews)24.07 · 00:03



