Benchmark Resmi DeepSeek-V4-Flash: Sekitar 98% Cache Hit untuk Efektivitas Biaya Maksimal
DeepSeek
DeepSeek telah merilis benchmark resmi untuk model V4-Flash-nya, menyoroti tingkat cache hit sekitar 98%. Hal ini diklaim memberikan performa biaya yang ekstrem, karena token yang di-cache jauh lebih murah. Model ini diposisikan sebagai opsi kompetitif di pasar inferensi AI.
DeepSeek secara resmi telah mengumumkan hasil benchmark untuk model V4-Flash-nya, yang menunjukkan tingkat cache hit sekitar 98% yang mengesankan. Tingkat cache hit yang tinggi berarti sebagian besar permintaan dapat dilayani dari cache, mengurangi biaya komputasi dan latensi. Efisiensi ini diterjemahkan menjadi harga per token yang lebih rendah, menjadikan V4-Flash sebagai solusi yang sangat hemat biaya bagi pengembang dan bisnis. Model ini bersaing di ruang yang sama dengan model inferensi cepat lainnya, tetapi optimasi cache-nya membedakannya dalam hal ekonomi. Pengumuman ini dibuat melalui Tencent News.
Sumber: DeepSeek (GNews) —
asli
