DeepSeek-V4 系列正式版发布:哪些能力升级了,现阶段可以如何使用?

AI前沿1小时前发布 yizz
1,632 0 0

DeepSeek-V4 系列正式版发布:哪些能力升级了,现阶段可以如何使用?

DeepSeek-V4 系列正式版已经发布。根据来源内容,在本内容发出时,用户已经可以通过 API 访问到 DeepSeek-V4-Flash 正式版;与此同时,DeepSeek-V4-Pro 正式版也将尽快发布。

这次发布的核心信息是什么?

这次更新里,已经明确可用的是 DeepSeek-V4-Flash 正式版。如果你关心的是“现在能不能接入、能不能直接用”,答案很直接:可以通过 API 访问。而 DeepSeek-V4-Pro 正式版目前还没有同步落地到“已经开放使用”的状态,来源只说明了它会尽快发布

DeepSeek-V4-Flash 正式版强在哪里?重点为什么是 Agent 能力?

来源内容给出的重点非常明确:正式版 V4-Flash 的 Agent 能力大幅增强,而且在基准测试中的表现远超 V4-Pro-Preview。这意味着,这一版的核心提升,不只是常规回答能力上的微调,而是更偏向于工具调用、任务执行、代码与自动化场景中的综合表现提升。

简单说,这里的“Agent 能力增强”不是一句空话,而是直接体现在一组公开列出的测试成绩里。

基准测试成绩具体有哪些?

正式版 V4-Flash 的相关基准测试成绩如下:

Terminal Bench 2.1:82.7

NL2Repo:54.2

Cybergym:76.7

DeepSWE:54.4

Toolathlon verified:70.3

Agent Last Exam:25.2

Automation Bench (Public):25.1

DSBench-FullStack:68.7

DSBench-Hard:59.6

这些测试数据传递出什么信号?

从来源原文的表述看,重点不是单项偶然领先,而是 V4-Flash 正式版在多项和 Agent自动化代码任务有关的测试中,都给出了完整成绩,并且原文明确强调其表现远超 V4-Pro-Preview。因此,这次正式版更像是在告诉开发者:Flash 版本已经不只是“轻量可用”,而是在执行型任务上变得更强了。

接口兼容性有什么变化?为什么要关注 Responses API?

除了能力提升,来源还提到一个非常关键的兼容信息:正式版 V4-Flash 原生支持 Responses API 格式,并针对性适配 Codex

这句话的价值在于两点:

第一,Responses API 格式是原生支持的

这说明在接口接入层面,V4-Flash 正式版已经支持 Responses API 格式,而不是依赖额外转接或非标准兼容方式。

第二,已经针对 Codex 做了适配

来源明确写到:针对性适配 Codex。这意味着,如果你的使用方式本身就依赖相关编程代理或代码任务工作流,那么这次正式版更新的意义会更直接。

至于具体怎么配置,来源内容也给出了边界:具体配置方法请参考文档。因此,能确认的是“支持”和“适配”已经到位;但具体参数、调用示例、字段写法,原文并没有展开。

模型本身有没有换架构?这次到底改了什么?

来源对这一点说得很清楚:DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练

这句话非常重要,因为它直接限定了这次更新的性质:

不是换了模型结构

模型结构、尺寸保持一致,说明这次正式版不是底层架构大改,也不是参数规模变化带来的“另一套模型”。

主要变化来自后训练

来源明确说的是仅重新进行了后训练。也就是说,这次正式版能力变化的重点,来自后训练阶段的优化,而不是预训练主体的重新设计。

原文里有哪些明显错误需要顺手纠正?

来源中有一个明显的拼写问题:DeepSeek-V4-Falsh 应为 DeepSeek-V4-Flash。从后文统一写法和整体语义来看,这里应当是单词拼写错误,而不是新型号名称。

这次 DeepSeek-V4 正式版发布,最值得记住的结论是什么?

把整段来源内容整理后,关键信息可以归纳为下面几点:

第一,DeepSeek-V4-Flash 正式版已经可以通过 API 使用。

第二,DeepSeek-V4-Pro 正式版还未同步开放,但会尽快发布。

第三,V4-Flash 正式版最突出的升级是 Agent 能力大幅增强,且多项基准测试成绩明确给出。

第四,正式版原生支持 Responses API 格式,并针对 Codex 做了适配。

第五,DeepSeek-V4-Flash-0731 与 preview 版在模型结构和尺寸上保持一致,本次变化主要来自后训练。

我认为:这次信息虽然不长,但说得很集中,也很“实”。它没有把重点放在空泛的描述上,而是直接告诉人们:现在能用什么、增强了什么、接口支持什么、模型本身改没改。尤其是“结构不变,只重做后训练”这一点,很能说明问题:很多时候,真正拉开差距的,不一定是把模型做得更大,而是把它调得更像一个能干活的系统。对于关注 API 接入Agent 工作流Codex 适配的人来说,这次正式版发布的信号,已经足够明确。

#正式版发布

© 版权声明

相关文章