Dyna Robotics apresenta Dyna-2, modelo mundo-ação pré-treinado com 1 milhão de horas de vídeo humano
A Dyna Robotics lançou o Dyna-2, um modelo mundo-ação para manipulação robótica pré-treinado com mais de um milhão de horas de vídeo humano egocêntrico. O modelo demonstra leis de escala em dados humanos, transfere sem ajuste zero para dados de robôs não vistos e mostra que a predição de vídeo impulsiona a generalização entre diferentes corpos. O Dyna-2 está disponível apenas como parte de uma célula robótica Dyna operada pelo fornecedor, sem checkpoint público, API ou licença.
A Dyna Robotics apresentou o Dyna-2, um modelo de ação mundial projetado para manipulação robótica, pré-treinado em mais de um milhão de horas de vídeo humano egocêntrico, o equivalente a aproximadamente 170 anos de experiência contínua acordada. O modelo utiliza uma mistura de transformers com tokenização e processamento separados de vídeo e ação, usando uma espinha dorsal de difusão de vídeo com correspondência de fluxo. A empresa relata três resultados-chave de escalonamento: uma lei de escalonamento é válida em dados humanos até um milhão de horas, essa lei transfere zero-shot para dados robóticos não vistos em 39 tarefas, e a previsão de vídeo, em vez de dados de ação, impulsiona a generalização entre diferentes corporificações. O pós-treinamento no robô em 14 tarefas em três corporificações mostrou pontuações normalizadas médias aumentando de 20% para 53% ao longo da escada de dados, com melhorias específicas, como a virada de chave da caixa de bloqueio, atingindo 90% de sucesso. O Dyna-2 não está disponível como pesos para download; a implantação requer a compra de uma célula robótica Dyna. O modelo superou o Dyna-1, o VLA de produção da empresa, em testes no robô e em locais de clientes não vistos, onde passou nos critérios de produção 87% das vezes, em comparação com 46% do Dyna-1. O relatório técnico está disponível para leitura adicional.
Fonte: MarkTechPost —
original
