DeepSeek最新版本藏了啥大招?是Agent能力跃升还是另有惊喜?

2026-08-13 18:35:00  阅读 9360 次 评论 0 条
摘要:

DeepSeekV4Pro正式版发布,Agent能力大幅提升,与运行框架Harness有关。在性能、功能等方面有诸多改进,不同版本各有特点,在市场竞争中展现出差异化优势。

DeepSeekV4Pro正式版亮点

性能对标顶级闭源模型

DeepSeekV4Pro正式版在多项关键基准测试中表现出色,跑分接近AnthropicFable5。在Agent能力评测DeepSWE上,得分从预览版的12.8%升至62.7%;在Terminal-Bench2.1上达87.9分,与Fable5持平。这显示出其在性能上的显著提升,能更好地满足用户需求。

思考/非思考双模式灵活切换

用户可依据任务复杂程度自由切换模式。简单问答或摘要可关闭思考模式追求低延迟;复杂代码调试、逻辑推演开启思考模式提升推理准确率。这种设计让用户能根据实际需求选择最优方式,提高使用效率。

Agent与工具链全面升级

它原生支持ToolCalls、ResponsesAPI,还可直接导入Codex使用,同时兼容OpenAI与Anthropic两种接口格式,大大降低了开发者迁移成本,方便开发者在不同场景中应用。

DeepSeek最新版本藏了啥大招?是Agent能力跃升还是另有惊喜?

关键规格与版本差异

超长上下文与输出能力

DeepSeekV4Pro上下文窗口高达100万Token,最大输出长度可达38.4万Token,可一次性处理整本小说或大型代码仓库,无需切片。这为处理长文本和复杂任务提供了有力支持。

价格定位与并发限制

正式版定价为V4Flash的3倍。缓存未命中输入3元/百万Token,输出6元/百万Token;缓存命中输入仅0.025元/百万Token。Pro版并发请求上限为500,低于Flash版的2500,体现了不同版本在资源分配上的差异,以适应不同需求。

市场影响与未来展望

完善产品线与差异化竞争

V4Pro正式版上线,标志着DeepSeekV4系列正式版全部就位。V4Pro主打“一次调用就够”的确定性,面向Agent、长文档、复杂编程等高价值场景;V4Flash以高并发、低成本策略覆盖高频轻量需求,形成产品分层,增强了市场竞争力。

Harness运行框架的潜在影响

随着V4Pro正式版问世,未来DeepSeekAIAgent系统的模型部分已完备。而Harness运行框架可能是决定未来AIAgent能力的关键。此前官网关于V4Flash正式版的更新公告中已暗示其即将到来,值得期待。

DeepSeek最新版本藏了啥大招?是Agent能力跃升还是另有惊喜?

相关问答

DeepSeekV4Pro正式版在性能上有哪些提升?

在多项关键基准测试中表现抢眼,跑分接近1成绩与Fable5持平。

DeepSeekV4Pro的思考/非思考双模式有什么作用?

用户能根据任务复杂程度自由切换。简单任务关闭思考模式可追求低延迟,复杂任务开启思考模式能提升推理准确率。

V4Pro的Agent与工具链有哪些升级?

原生支持ToolCalls、ResponsesAPI,可直接导入Codex使用,兼容OpenAI与Anthropic两种接口格式,降低开发者迁移成本。

V4Pro的价格定位和并发限制情况如何?

缓存未命中输入025元/百万Token。Pro版并发请求上限为500,低于Flash版的2500。

DeepSeekV4系列产品分层有什么意义?

V4Pro面向高价值场景,V4Flash覆盖高频轻量需求。这样能满足不同用户需求,增强市场竞争力,提高资源利用效率。

Harness运行框架对DeepSeek未来发展有何重要性?

近一两年,AI工程研究者认为未来决定AIAgent能力的关键在于Harness。随着V4Pro模型部分就位,Harness若完善,将提升DeepSeek整体性能。

本文地址:https://www.caiair.com/post/deepseek-531091-152660.html
简短标题:DeepSeek最新版本藏了啥大招?是Agent能力跃升还是另有惊喜?
转载声明:欢迎分享本文,转载请保留出处!发布者 财云量化