DeepSeek、V4-Flash-0731をアップグレード:エージェント型コーディングとAPIベータで大幅な進歩
DeepSeek
Anthropic
DeepSeekはDeepSeek-V4-Flash-0731をリリースしました。これはプレビューの公式アップグレードで、エージェント型およびコーディングのベンチマークで大幅な改善が見られます。モデルは同じアーキテクチャを維持しつつ、再ポストトレーニングによる利点を享受しており、APIは現在パブリックベータで、Responses API形式とCodex適応をサポートしています。重みはMITライセンスでゲートなしに公開されており、幅広いデプロイオプションが可能です。
DeepSeekは、2026年7月31日にHugging Face上でDeepSeek-V4-Flash-0731を公開し、公式のV4-Flash APIをパブリックベータに移行しました。モデルカードには、プレビュー版を引き継ぐ公式リリースであり、アーキテクチャと規模は変更されておらず、改善点は再ポストトレーニングによるものと記載されています。チェックポイントにはDSpark投機的デコードモジュールが含まれており、Hugging Faceによると、284Bのベースモデルにドラフトモジュールを加えた304Bのパラメータが報告されています。APIは現在、Responses APIフォーマットをネイティブにサポートし、Codexに適合していますが、V4-Pro APIおよびアプリ/Webモデルは更新されていません。デプロイは、低コスト(プロの出力価格の約3分の1)のAPI経由、または自己ホスティングにより可能ですが、後者には多大なリソースが必要です。MITライセンスの重みを使用しますが、すべてのエキスパートがメモリ内に常駐します。vLLMの例では、4×GB300ノードで提供されています。Unslothの動的GGUFは、積極的な量子化で約110GBのメモリに収まります。アーキテクチャは、284Bのパラメータ、トークンあたり13Bのアクティブパラメータ、1Mトークンのコンテキスト、CSAとHCAを備えたハイブリッドアテンション、多様体制約付きハイパーコネクションを特徴としています。ベンチマークでは、V4-Flash-0731がすべてのエージェントベンチマークでV4-Pro(プレビュー版)を上回っていますが、すべての数値は未公開のハーネスでのDeepSeek報告によるものです。DSparkはvLLMフラグで有効になり、モデルはJinjaチャットテンプレートの代わりにエンコーディングフォルダを使用します。
出典: MarkTechPost —
原文
