2
这个用户还没有留下简介。
当前还没有回复,欢迎成为第一个参与讨论的人。
科技前沿 2026年7月31日讯 —— AI 领域迎来重要更新!DeepSeek(深度求索)今日宣布 DeepSeek-V4-Flash 正式版 API(模型标识:DeepSeek-V4-Flash-0731)正式上线并开启公测。
本次更新虽然在模型结构和尺寸上保持了与此前 Preview 版本的一致性,但通过全新的后训练(Post-Training)优化,使模型在 Agent 工具调用、终端指令执行、复杂代码构建与长推理调度等核心场景中的性能实现了质的飞跃。令人瞩目的是,在多项公开基准测试中,DeepSeek-V4-Flash 正式版的 Agent 能力全面超越了此前的 V4-Pro-Preview。
根据官方公布的对比数据,DeepSeek-V4-Flash-0731 在终端操作、代码生成及复杂工具链协同上表现出极强的能力提升:
| 评估基准 (Benchmark) | V4-Flash-0731 (正式版) | V4-Flash-Preview | V4-Pro-Preview | Claude 3.5 Sonnet | Opus 4.0 |
|---|---|---|---|---|---|
| Terminal Bench 2.1 | 82.7 | 61.8 | 72.1 | 61.0 | 85.0 |
| NL2Repo | 54.2 | 39.4 | 38.5 | 48.9 | 69.7 |
| Cybergym | 76.7 | 38.7 | 52.7 | - | 83.1 |
| DeepSWE | 54.4 | 7.3 | 12.8 | 46.2 | 58.0 |
| Toolathlon (Verified) | 70.3 | 49.7 | 55.9 | 59.9 | 76.2 |
| DSBench-FullStack (内部) | 68.7 | 37.0 | 41.8 | 61.8 | 71.6 |
| DSBench-Hard (内部) | 59.6 | 25.8 | 31.1 | 54.5 | 71.7 |
在专注于软件工程与终端命令行调度的 DeepSWE 和 Terminal Bench 2.1 测试中,V4-Flash-0731 均展现出了大幅提升,不仅轻松碾压此前版本,更是在部分指标上逼近行业顶尖模型。
在发布测试成绩的同时,DeepSeek 官方首次披露了内部用于评估与运行 Code Agent 的底层框架——DeepSeek Harness:
max effort、top_p=0.95、temperature=1.0 的标准采样配置。为了更好地融入现有的 AI 开发者工具生态,本次 API 更新在接口兼容性上做出了重大升级:
deepseek-v4-flash 原生适配 OpenAI 的 Responses API 规范(client.responses.create(...)),开发者无需编写复杂的兼容适配代码。V4-Flash 正式版继承并优化了 Reasoning Thought(思考模式)调度。API 支持通过 reasoning_effort 参数灵活调节模型的思考深度:
none(关闭思考)、low、high、xhigh 到 max 多档调节。官方特别提示,本次 API 升级仅针对 deepseek-v4-flash 接口:
deepseek-v4-pro API 暂未进行变更。DeepSeek-V4-Pro 正式版 API 及 deepseek-v4-pro 的 Responses API 支持已在紧密筹备中,预计将于近期推出。总结:DeepSeek-V4-Flash 正式版的上线,标志着轻量级/高性价比 API 在 Agent 智能体与代码自动化领域取得了重大突破。极致的响应速度、顶尖的工具调用表现以及高度兼容的 API 生态,将进一步降低开发者构建高性能 AI Agent 的门槛。