Gemini Robotics 2: Googlen uusi tekoälymalli ohjaa robotteja kaikenkokoisia ja -muotoisia
Google/DeepMind
Google DeepMind
Google DeepMind on esitellyt Gemini Robotics 2:n, vision-language-action-mallin, joka pystyy ohjaamaan kaikenlaisia robotteja. Malli tukee älykästä koko kehon ohjausta, hienomotorisia taitoja ja useiden robottien yhteistyötä. Lisäksi on julkistettu Gemini Robotics ER 2 "embodied reasoning" -tarkoituksiin, joka on jo saatavilla Google AI Studiossa.
Google DeepMind on esitellyt Gemini Robotics 2 -mallin, joka on sen tähän mennessä kehittynein vision-language-action-malli (VLA), joka yhdistää kuvien tunnistuksen, kielen ymmärtämisen ja toiminnan ohjauksen, jotta robotit pystyisivät liikkumaan fyysisessä maailmassa. Mallin on tarkoitus toimia älykkyyskerroksena mukautuville roboteille, ja se mahdollistaa älykkään koko kehon ohjauksen, edistyneen hienomotorisen tarkkuuden sekä useiden robottien yhteistyön. Kiinnostuneet voivat ilmoittautua jonotuslistalle saadakseen varhaisen pääsyn malliin. Lisäksi esiteltiin Gemini Robotics ER 2, joka on malli "keholliseen päättelyyn" ja toimii robottien ylempänä aivona, korvaten huhtikuussa julkaistun aiemman mallin 1.6. Gemini Robotics ER 2 on jo saatavilla Google AI Studiossa.
Lähde: The Decoder (DE) —
Alkuperäinen
