Исследования RSS

Модели 🇺🇸

Само-дистиллированное рассуждение для тонкой настройки Amazon Nova

Amazon представила метод Self-Distilled Reasoning (SDR) для супервизированной тонкой настройки (SFT) моделей семейства Amazon Nova 2. SDR позволяет генерировать цепочки рассуждений (CoT) для наборов данных без таковых, используя собственную модель. Это решает проблему подавления рассуждений и уменьшает катастрофическое забывание, улучшая целевую производительность и сохраняя общие способности.

Amazon Web ServicesAmazon Web Services
AWS ML blog24.07 · 05:06

Состояние симуляции для физического ИИ: обзор

Сбор данных для физического ИИ в реальном мире — медленный, дорогой и рискованный процесс. Симуляция позволяет генерировать большие объёмы фотореалистичных физических данных с помощью GPU-параллелизма. В статье рассмотрены популярные движки симуляции: MuJoCo, MuJoCo Warp, NVIDIA Isaac Sim и Isaac Lab, а также новый физический движок Newton, разработанный NVIDIA, Google DeepMind и Disney Research.

NVIDIANVIDIA Google DeepMindGoogle DeepMind MuJoCoMuJoCo
Hugging Face blog24.07 · 05:05
Свежие новости