ModelSumber Terbuka 🇨🇳 28.07.2026 13:02

Kimi K3 dan Unlimited OCR Puncaki Grafik Global, Model Sumber Terbuka Tiongkok Sapu Bersih di Luar Negeri

Moonshot AIMoonshot AI BaiduBaidu
Model sumber terbuka kecerdasan buatan (AI) asal Tiongkok mulai mendapatkan daya tarik global. Pada tanggal 27 Juli, Moonshot AI merilis bobot penuh Kimi K3, yang dengan cepat menduduki puncak daftar tren keseluruhan Hugging Face, diikuti oleh Unlimited OCR dari Baidu. Unlimited OCR juga meraih peringkat pertama di GitHub dan Hugging Face, dan kemudian kembali ke puncak daftar tren model global Hugging Face setelah satu bulan, didorong oleh adopsi pengembang yang berkelanjutan.
Pada 27 Juli, Moonshot AI merilis bobot model lengkap Kimi K3 secara open-source, yang langsung melesat ke puncak daftar tren keseluruhan Hugging Face dalam hitungan menit. Tak lama setelahnya, model OCR Tanpa Batas milik Baidu, yang telah memimpin daftar selama beberapa hari, mengamankan posisi kedua. Kedua model open-source Tiongkok ini mendominasi peringkat Hugging Face, menjadi sebuah fenomena. OCR Tanpa Batas mencapai prestasi luar biasa: dalam lima hari setelah dirilis, model ini mengumpulkan lebih dari 10.000 bintang GitHub dan menduduki puncak daftar GitHub Trending harian untuk kategori keseluruhan dan Python, serta daftar tren model global dan model multimodal Hugging Face, meraih posisi pertama di empat kategori. Sebulan kemudian, OCR Tanpa Batas kembali merebut posisi teratas daftar tren model global Hugging Face setelah di-retweet oleh peraih penghargaan Turing Yann LeCun. Bintang GitHub-nya telah melampaui 19.700 dan unduhan Hugging Face mencapai 2,65 juta. Popularitas OCR Tanpa Batas berasal dari terobosannya dalam penguraian dokumen panjang. Model OCR tradisional menangani dokumen panjang dengan mengurai halaman per halaman dan menggabungkan hasil, menyebabkan KV Cache bertambah selama decoding, meningkatkan kecepatan inferensi dan biaya memori. Baidu mengusulkan mekanisme Reference Sliding Window Attention (R-SWA), yang mempertahankan perhatian pada dokumen asli sambil hanya menyimpan konten yang baru dihasilkan sebagai memori kerja, memungkinkan penguraian puluhan halaman secara berkelanjutan dalam satu forward pass. Ini menjaga KV Cache tetap konstan, mengurangi biaya komputasi dan penggunaan memori. Para ahli industri mencatat bahwa inovasi ini tidak hanya mempercepat OCR tetapi juga menawarkan pendekatan baru untuk penalaran konteks panjang dan manajemen memori. Minat pengembang yang berkelanjutan terhadap OCR Tanpa Batas mencerminkan bahwa model open-source AI Tiongkok bergerak dari kegembiraan awal menuju adopsi berkelanjutan.
Sumber: QbitAI 量子位 — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru