DeepSeek V4-Flash-0731 Güncellemesi: Ajan Kodlamada ve API Beta'da Büyük Kazanımlar
DeepSeek
Anthropic
DeepSeek, önizleme sürümünün resmi bir yükseltmesi olan DeepSeek-V4-Flash-0731'i yayınladı; ajan ve kodlama kriterlerinde önemli iyileştirmeler sağlandı. Model aynı mimariyi koruyor ancak yeniden eğitim sonrası işlemlerden faydalanıyor ve API artık Responses API formatı ile Codex uyarlamasını destekleyen genel beta sürümünde. Ağırlıklar MIT lisanslı ve erişime açık, bu da geniş dağıtım seçeneklerine olanak tanıyor.
DeepSeek, DeepSeek-V4-Flash-0731'i Hugging Face üzerinde yayınladı ve resmi V4-Flash API'sini 31 Temmuz 2026'da genel beta sürümüne taşıdı. Model kartı, bunun önizlemenin yerini alan resmi sürüm olduğunu ve mimari ile boyutun değişmediğini; kazanımların yeniden eğitim sonrasından geldiğini belirtiyor. Kontrol noktası (checkpoint), DSpark spekülatif kod çözme modülünü içeriyor ve Hugging Face, 284B tabanının üzerinde taslak modül dahil 304B parametre bildiriyor. API artık yerel olarak Responses API formatını destekliyor ve Codex'e uyarlanmış durumda, ancak V4-Pro API'si ve uygulama/web modelleri güncellenmedi. Dağıtım, düşük maliyetle API üzerinden (pro çıktı fiyatının yaklaşık üçte biri) veya önemli kaynaklar gerektiren kendi kendine barındırma yoluyla mümkün: MIT lisanslı ağırlıklar, ancak her uzman bellek içinde kalıcı olarak kalır. Bir vLLM örneği, 4×GB300 düğümünde sunar; Unsloth dinamik GGUFları agresif nicelemede yaklaşık 110GB belleğe sığar. Mimari, token başına 13B aktif parametre, 1M token bağlamı, CSA ve HCA ile hibrit dikkat ve manifold kısıtlı hiper bağlantılar içeren 284B parametre içerir. Kıyaslamalar, V4-Flash-0731'in tüm aracı kıyaslamalarında V4-Pro (Önizleme)'den daha iyi performans gösterdiğini gösteriyor, ancak tüm rakamlar DeepSeek tarafından yayınlanmamış bir test düzeneği üzerinde bildirilmiştir. DSpark, bir vLLM bayrağıyla etkinleştirilir ve model, bir Jinja sohbet şablonu yerine bir kodlama klasörü kullanır.
Kaynak: MarkTechPost —
orijinal
