DeepSeek-V4-Pro 模型能力与性价比分析

机构研报 数据与宏观 / 数据跟踪点评 申万: 传媒
🔒
登录解锁完整投研深度报告与行情联动: 免费查阅完整机构研报原件、音频转写、五维画像模型与异动监控
立即登录 / 免费注册

📰 研报摘要

查看全文

8月13日DeepSeek-V4-Pro正式版上线,其软件工程能力在SWE-bench Verified评测中以96.4%的解决率位列全球第二,仅次于Claude Opus5,显示出极强的任务执行和复杂任务处理能力。该模型支持百万Token上下文及最高384K输出,并可通过结构化输出和外部工具接口接入主流Agent及编程工具,有助于在企业生产场景中落地。此外,DeepSeek预告将发布自研Harness框架,旨在通过模型与Agent框架协同进一步释放应用能力。在成本方面,V4-Pro采用峰谷定价模式,输出价格远低于Claude Fable5。未来通过Pro(处理复杂任务)与Flash(处理高频任务)的分工协作以及自研Harness的推出,有望在保持高效果的同时显著降低整体使用成本,构建一体化性价比优势。