Ускорение тонкой настройки трансформеров с NVIDIA NeMo AutoModel

NVIDIA представила NeMo AutoModel — открытую библиотеку для масштабного создания кастомных генеративных ИИ-моделей на основе Transformers v5. Она добавляет экспертный параллелизм (Expert Parallelism), DeepEP и ядра TransformerEngine, что даёт ускорение обучения в 3.4–3.7 раза и снижение потребления GPU-памяти на 29–32% при тонкой настройке MoE-моделей без изменения API.

NVIDIANVIDIA Hugging FaceHugging Face Moonshot AIMoonshot AI DeepSeekDeepSeek
Hugging Face blog27.07 · 10:04
Агенты 🇺🇸

В Gemini 3.5 Flash появилась встроенная возможность управления компьютером

Google DeepMind объявила, что функция «управление компьютером» (computer use) теперь является встроенным инструментом в модели Gemini 3.5 Flash. Это позволяет разработчикам создавать агентов, которые могут видеть, рассуждать и действовать в браузере, на мобильных устройствах и десктопах. Компания также внедрила меры безопасности, включая состязательное обучение и опциональные корпоративные защитные системы.

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
Google DeepMind27.07 · 10:04
Свежие новости