Recherche RSS

Modèles 🇺🇸

Auto-Distillation du Raisonnement pour le Fine-Tuning d'Amazon Nova

Amazon a introduit la méthode d'Auto-Distillation du Raisonnement (SDR) pour le fine-tuning supervisé (SFT) des modèles Amazon Nova 2. SDR génère des chemins de raisonnement de chaîne de pensée (CoT) pour les ensembles de données qui en sont dépourvus, en utilisant le modèle lui-même. Cela résout le problème de la suppression du raisonnement et réduit l'oubli catastrophique, améliorant ainsi les performances cibles tout en conservant les capacités générales.

Amazon Web ServicesAmazon Web Services
AWS ML blog24.07 · 05:06
Recherche 🇺🇸

Simulation pour l'IA physique : une revue

La collecte de données pour l'IA physique dans le monde réel est un processus lent, coûteux et risqué. La simulation permet de générer de grands volumes de données physiques photoréalistes grâce au parallélisme des GPU. Cet article passe en revue les moteurs de simulation populaires : MuJoCo, MuJoCo Warp, NVIDIA Isaac Sim et Isaac Lab, ainsi que le nouveau moteur physique Newton, développé par NVIDIA, Google DeepMind et Disney Research.

NVIDIANVIDIA Google DeepMindGoogle DeepMind MuJoCoMuJoCo
Hugging Face blog24.07 · 05:05
Infos fraîches