Model Besar Kembali ke Perlombaan Parameter: 2 Triliun Menjadi Standar, 3 Triliun Berikutnya?
Model AI besar kembali fokus pada jumlah parameter sebagai metrik kompetitif utama, dengan 200 miliar parameter menjadi standar untuk model teratas dan spekulasi bahwa 300 miliar bisa menjadi tonggak berikutnya. Perusahaan AI besar Tiongkok dilaporkan meningkatkan parameter pelatihan mereka untuk tetap kompetitif.
Artikel dari Sina Finance ini membahas kembali memanasnya persaingan antar model bahasa besar (Large Language Model/LLM) yang berpusat pada jumlah parameter. Artikel tersebut mencatat bahwa model dengan sekitar 200 miliar parameter kini telah menjadi standar industri bagi para pemain terkemuka, dan muncul spekulasi bahwa langkah berikutnya bisa jadi adalah model yang mencapai 300 miliar parameter. Tulisan ini menunjukkan bahwa tren tersebut menandakan kembalinya strategi scaling (peningkatan skala) sebagai pendekatan utama untuk meningkatkan kemampuan model, dengan implikasi terhadap kebutuhan sumber daya komputasi dan biaya pelatihan.
Sumber: Moonshot Kimi (GNews) —
asli
