ModellerDonanım ve Çıkarım 🇺🇸 05.08.2026 12:01

NVIDIA, Robotaksiler ve Otonom Sürüş İçin OpenMDW-1.1 Kapsamında Alpamayo 2 Super Modelini Yayınladı: 34B Görsel-Dil-Eylem Modeli

NVIDIANVIDIA
NVIDIA, otonom sürüş için 34B parametreli görsel-dil-eylem (VLA) modeli olan Alpamayo 2 Super'ı açık ticari lisansla yayınladı. Uzun kuyruk olaylarında üstün performans gösterir; tek bir kamera videosu geçişinden yörünge, nedensel açıklamalar ve meta-eylemler çıkarır. Ağırlıklar OpenMDW-1.1 altında, kaynak kod ise Apache 2.0 lisansıyla yayınlandı ve ticari dağıtıma olanak tanıyor.
NVIDIA, otonom sürüş için 34B parametreli bir görüntü-dil-eylem (VLA) modeli olan Alpamayo 2 Super'ı tanıttı ve modeli izin verici OpenMDW-1.1 lisansı altında yayınladı. Model, NVIDIA Cosmos 3 Super Reasoner üzerine inşa edilmiş 32B VLM omurgasını, uzun kuyruk ve çok etmenli sürüş senaryolarını ele almak üzere tasarlanmış 2.3B difüzyon tabanlı bir eylem kod çözücüyle birleştiriyor. Tam çevre kamera videosu üzerinde tek bir geçişte, planlanmış bir yörünge, nedensel bir açıklama (Neden-Sonuç Zinciri izi) ve bir meta-eylem üretiyor. Ağırlıklar OpenMDW-1.1 altında, kaynak kod ise Apache 2.0 altında yayınlanıyor; bu da ticari kullanım, ince ayar ve yeniden dağıtıma izin veriyor. Eğitim verileri yaklaşık 115.000 saatlik çok kameralı sürüş videosu, 3.7 milyon Neden-Sonuç Zinciri izi ve bir milyardan fazla görüntü içeriyor. LingoQA'da Lingo-Judge'da 79.2 puan alarak Qwen2.5-VL 72B'yi 17.0, Gemini 2.5 Pro'yu 15.1 ve GPT-4o'yu 23.2 puanla geride bırakıyor. AlpaSim ile 910 senaryo üzerinde yapılan kapalı döngü değerlendirmesi, 1.50 ± 0.13 AlpaSim puanı veriyor; 937 örnek üzerinde yapılan açık döngü değerlendirmesi ise 6.4 saniyede minADE₆ değerini 0.911 metre olarak gösteriyor. Model ayrıca otomatik etiketlemeyi destekliyor, açıklama döngülerini aylardan günlere sıkıştırıyor ve güvenlik doğrulaması için NVIDIA Halos ile entegre oluyor.
Kaynak: MarkTechPost — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler