RobotiikkaMallit 🇨🇳 12.08.2026 06:01

Robottiaivojen kilpailu syvenee: fyysinen maailma vaatii mallien suunnittelua alusta alkaen

Vuoden 2025 WAIC-messuilla kehollinen tekoäly oli keskiössä, kun yli 200 yritystä esitteli tuotteitaan, ja huomio siirtyi suorituskykyroboteista käytännön sovelluksiin, kuten käsittelyyn ja tarkastukseen. Ant Lingbon johtava tutkija Shen Yujun väittää, että digitaalisen maailman videomallien sovittaminen robotteihin hienosäädön avulla on polkuriippuvainen oikotie, ei lopullinen ratkaisu. Hän kannattaa "kehollisesti alkuperäistä" lähestymistapaa, jossa mallit suunnitellaan alusta alkaen fyysistä todellisuutta varten. Yritys esitteli täyden pinon Brain 2.0 -järjestelmän, johon kuuluu kuusi mallia, mukaan lukien alan ensimmäinen kehollisesti alkuperäinen maailma-toiminta-malli, ja ilmoitti rahoituskierroksesta, jonka tavoitteena on kerätä 1,5 miljardia juania.
WAIC-haastattelussa Ant Lingbon pääjohtaja Shen Yujun käsitteli kehollisen älykkyyden haasteita ja korosti, että datastandardit eivät ole yhtenäistyneet, koska tekniset reitit ovat yhä avoimia eikä yksimielisyyttä ole muodoista, tarkkuudesta tai laadusta. Hän huomautti, että oikea data, erityisesti robottien etäohjausdata ja ihmisten ensimmäisen persoonan data, on tärkeämpää yleiskäyttöisille roboteille kuin simulaatiodata, koska simulaatioiden on vaikea jäljitellä ihmisen alitajuisia toimintoja. Lingbon strategiaan kuuluu useiden mallien (kuten LingBot-Vision, LingBot-Depth, LingBot-Video, LingBot-VLA ja LingBot-VA) kehittäminen tiettyjen teknisten ongelmien ratkaisemiseksi, kuten modaliteettien yhdenmukaistaminen, dynamiikan ennustaminen ja kuorman tasapainottaminen MoE-arkkitehtuureissa, sen sijaan että yritettäisiin liian aikaisin yhtä päästä päähän -mallia. Shen esitteli käsitteen 'kehosta syntyvä' (embodied-native) -malli, joka edellyttää dataa, joka on luonnostaan fyysisten maailman tehtävien mukaista, mallin kykyjä reaaliaikaiseen vuorovaikutukseen ja mahdollisuutta kouluttaa alusta alkaen. Hän mainitsi vaikeudet toistaa itsestään ohjautuvia näkömalleja kuten DINO ja toteuttaa kausaalista mallinnusta yksisuuntaiselle huomiolle. Turvallisuudesta hän korosti, että 'aitapohjainen' turvallisuus (toimintojen rajoittaminen) ei riitä, vaan hän kannattaa 'luontaista turvallisuutta', joka sisällytetään esikoulutukseen, kuten ihmisen vaistot. Hän ennusti myös, että kehollisen tekoälyn 'ChatGPT-hetki' tapahtuu, kun tavalliset ihmiset voivat helposti osallistua datan keräämiseen, mikä tekee roboteista todella hyödyllisiä ja integroituja jokapäiväiseen elämään.
Lähde: InfoQ 中国 — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset