

DeepSeek-V4-Flash-0731 是 V4-Flash 的官方版本,在智能体能力上实现了巨大飞跃。它在关键基准测试中优于 V4-Pro(预览版),原生支持 Responses API,并已全面适配 Codex CLI。
Loading comments…
制作者
indie_inkwell
访问网站
huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731
项目信息
产品关键词
DeepSeek-V4-Flash-0731是V4-Flash模型系列的官方版本,相比其预览版前身有显著提升。它与DeepSeek-V4-Flash-DSpark共享相同的模型架构,包括一个用于加速推理的附加推测解码模块。该模型在智能体能力上实现了巨大飞跃,尽管激活参数数量明显更少,但在关键基准测试中仍优于DeepSeek-V4-Pro(预览版)。它原生支持Responses API,并完全适配Codex CLI,使其成为自主智能体工作流和直接编码辅助的多功能选择。
DeepSeek-V4-Flash-0731在智能体评估中的得分大幅高于V4-Flash预览版和V4-Pro(预览版)。在Terminal Bench 2.1上达到82.7,Cybergym上为76.7,DeepSWE上为54.4——这些数据使其与当前最强的专有模型基本持平。
该模型附带一个推测解码组件,继承自DSpark变体。这一设计选择旨在降低生成期间的延迟,在快速周转至关重要的交互式智能体循环中尤其有价值。
DeepSeek-V4-Flash-0731原生支持Responses API,简化了希望使用结构化、现代接口构建智能体应用的开发者的集成流程。这消除了对自定义适配器或变通方案的需求。
该模型完全适配Codex CLI,开发者可以无缝将其接入现有的基于Codex的工作流。结合其在NL2Repo(54.2)和DSBench-Hard(59.6)等编码基准上的强劲表现,它是仓库级编码任务的可靠选择。
DeepSeek-V4-Flash-0731以极少的激活参数数量实现了接近前沿的智能体性能。
效率是这里的核心卖点。该模型在几乎所有基准测试上都超越了其Pro级同类产品,同时体积更小、运行更快。对于以前不得不在能力和成本之间做选择的团队,这次发布弥合了这一差距——你既能获得有竞争力的智能体行为、强劲的编码得分,又能得到一个适合自托管或通过标准推理栈服务的实用模型。
你正在为智能体编码助手、工具调用管道或自主任务自动化评估模型,并且希望获得超越更大替代方案性能的同时避免基础设施开销。如果你已经在使用Codex CLI或Responses API,原生支持将消除集成摩擦。如果你更倾向于在自己的硬件上运行模型,Transformers、vLLM、SGLang和Docker Model Runner的文档化路径使部署变得简单直接。对于在智能体任务上大量进行基准测试的团队,这些数据不言自明——这是一个远超其体量表现的模型。
其他您可能感兴趣的工具