Model Flash Baru DeepSeek Menyamai OpenAI GPT-5.6 Luna dengan Biaya Sekitar 60% Lebih Rendah
DeepSeek
OpenAI
DeepSeek merilis model hemat biaya V4 Flash "0731" yang mencetak 50 poin dalam indeks Artificial Analysis Intelligence, sepuluh poin lebih tinggi dari versi V4 Flash sebelumnya. Model ini hanya satu poin di bawah model hemat biaya OpenAI GPT-5.6 Luna, tetapi biayanya sekitar 60% lebih murah per tugas, berkat diskon 98% untuk cache. Peningkatannya terutama terlihat pada tugas agen: pada benchmark GDPval, skor naik dari 1189 menjadi 1559 poin Elo, dan halusinasi menjadi lebih jarang.
DeepSeek telah merilis model murah baru, V4 Flash "0731", yang mencetak 50 poin pada indeks Kecerdasan Analisis Buatan, sepuluh poin lebih banyak daripada versi sebelumnya yang dirilis pada April 2026. Ini hanya satu poin lebih rendah daripada model murah OpenAI, GPT-5.6 Luna, sementara biaya per tugas sekitar 60 persen lebih rendah, bahkan setelah memperhitungkan penurunan harga sebesar 80 persen oleh OpenAI. Faktor kuncinya adalah diskon cache sebesar 98 persen dari DeepSeek, yang secara signifikan lebih tinggi daripada rata-rata industri sebesar 90 persen. Model ini juga mengonsumsi token dua belas persen lebih sedikit daripada pendahulunya. Peningkatan mencakup semua kategori pengujian, terutama tugas-tugas agen: dalam tolok ukur GDPval, yang mengukur pekerjaan kantor dunia nyata yang kompleks, skor naik dari 1189 menjadi 1559 poin Elo, dan tingkat halusinasi menurun. Arsitekturnya tetap tidak berubah: 284 miliar parameter, di mana 13 miliar aktif, dengan jendela konteks satu juta token. Bobot model didistribusikan di bawah lisensi MIT di Hugging Face.
Sumber: The Decoder (DE) —
asli
