RisetAplikasi 🇺🇸 29.07.2026 00:02

Car-GPT: Akankah LLM Akhirnya Mewujudkan Mobil Swakemudi?

OpenAIOpenAI MetaMeta WayveWayve xAIxAI
Artikel ini mengeksplorasi potensi Large Language Models (LLM) untuk merevolusi kendaraan otonom, dengan menyamakannya dengan penemuan penisilin secara tidak sengaja oleh Alexander Fleming. Dijelaskan bagaimana LLM, melalui tokenisasi, transformer, dan prediksi kata berikutnya, dapat diadaptasi untuk tugas-tugas swakemudi seperti persepsi, perencanaan, dan generasi. Namun, masalah kepercayaan dan kotak hitam masih belum terselesaikan, dan masih terlalu dini untuk mengetahui apakah LLM akan menjadi kunci kendaraan otonom sepenuhnya.
Artikel ini membandingkan kondisi saat ini dalam penelitian mobil mengemudi sendiri dengan penemuan penisilin secara tidak sengaja, yang menunjukkan bahwa Large Language Models (LLM) mungkin menjadi terobosan tak terduga. Dijelaskan bahwa mengemudi otonom tradisional menggunakan pendekatan modular (persepsi, lokalisasi, perencanaan, kontrol), sementara pembelajaran ujung ke ujung menggantikan semua modul dengan satu jaringan saraf, menciptakan masalah kotak hitam. LLM bekerja melalui tokenisasi (mengubah teks menjadi angka), transformer (arsitektur berbasis atensi), dan prediksi kata berikutnya. Untuk mengemudi sendiri, input dapat berupa gambar atau data sensor yang ditokenisasi serupa, dan tugasnya meliputi persepsi (deteksi, prediksi, pelacakan), perencanaan (pengambilan keputusan, navigasi), dan generasi (membuat data pelatihan atau skenario). Contoh seperti Talk2BEV dan DriveGPT menggunakan LLM untuk meningkatkan persepsi BEV dan merencanakan lintasan, sementara GAIA-1 dan MagicDrive menghasilkan video atau adegan. Namun, kekhawatiran tentang halusinasi dan kurangnya determinisme membuat kepercayaan pada LLM untuk mengemudi waktu nyata tidak pasti, dan masih terlalu dini untuk menyimpulkan.
Sumber: The Gradient — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru