DeepSeek-V4-Pro-0813已发布,体验下来怎么样?
DeepSeek-V4-Pro-0813于2026年8月12日深夜悄然上线,没有发布会和预热,直接通过API更新推送从目前社区反馈和评测数据来看,这款模型的核心提升集中在Agent能力(智能体任务执行)上,整体评价可以概括为“能打但不封神,性价比依然炸裂”。 核心能力提升:Agent任务执行质变 这次升级最显著的变化在于“连续干活不掉链子”。此前很多模型在长流程任务中容易“迷路”——忘记上下文、突然另起炉灶或修好A又搞坏B V4-Pro-0813通过后训练将已有的代码与推理能力组织成了更稳定的执行过程。在多个Agent基准测试上实现了跨越式提升: 评测集V4-Pro-PreviewV4-Pro-0813变化幅度Terminal Bench 2.172.187.9+15.8DeepSWE12.862.7+49.9Cybergym68.583.3+14.8AutomationBench42.168.5+26.4DSBench-FullStack35.661.4+25.8 其中DeepSWE从12.8分暴涨至62.7分,甚至超越了Claude Opus 4.8 在AutomationBench、Cybergym等测试中,它也接近或部分超越了目前公认最强的Claude Fable 5 有用户评价说,它“以前更像一个代码写得不错的人,现在开始像一个能接任务的人。 这些都是官方发的测评数据,想听听实际用下来体验怎么样。
HOT TREND
近 7 次采集,数值由热榜热度字段解析而来
热度走势
CONFIRMED
已确认的信息
- 来源平台:知乎
- 首次收录:2026-08-15 15:38:24 UTC
- 最近更新:2026-08-15 17:08:31 UTC
- 历史最佳排名:第 3 位
- 最近热度:370 万热度