推广 热搜: 京东  联通  iPhone  iphone11  摄像头  网络安全  自动驾驶  企业存储  XSKY  京东智能采购 

DeepSeek V4 Pro上线:Agent能力跃升,低价策略或为短期引流手段

   日期:2026-08-13     作者:itcg    浏览:2019    我要评论    
导读:DeepSeek V4 Pro上线:Agent能力跃升,低价策略或为短期引流手段

人工智能领域迎来新动态,DeepSeek旗下旗舰模型DeepSeek V4 Pro 0813正式版低调上线,补齐了DeepSeek V4系列产品的最后一块拼图。此前,该系列中的V4 Flash 0731已于7月31日完成转正。此次更新标志着DeepSeek在Agent能力领域迈出重要一步,引发行业广泛关注。

根据第三方机构SemiAnalysis的测试数据,DeepSeek V4 Pro在终端操作、代码工程等Agent相关场景中表现突出,甚至超越了参数规模更大的英伟达Nemotron3 Ultra模型。基准测试显示,V4 Pro在多个维度紧追海外前沿模型,部分指标实现反超。该模型支持100万tokens上下文窗口,可处理大型代码库或长文档,同时提供思考模式与非思考模式切换功能,满足开发者对响应速度与推理深度的不同需求。

在技术规格方面,V4 Pro与Flash版本保持接口兼容性,提供OpenAI与Anthropic双格式API,支持Json Output、Tool Calls等主流开发工具。模型输出能力达38.4万tokens,适用于复杂推理任务。价格策略延续低价路线,输入缓存未命中时每百万tokens收费3元,输出收费6元,缓存命中输入价格低至0.025元。这一定价仅为同类海外模型Opus 5的三十分之一、Fable 5的六十分之一,形成显著价格优势。

性能提升方面,V4 Pro正式版较4月发布的预览版实现跨越式进步。在DeepSWE软件工程测试中,得分从12.8跃升至62.7;Cybergym安全攻防测试得分从52.7提升至83.3;AutomationBench自动化流程测试得分翻倍至31.8。终端操作测试Terminal Bench 2.1成绩从72.1提高到87.9,部分指标甚至超过Anthropic最新旗舰模型Fable 5。值得注意的是,V4 Pro在工具调用能力上表现突出,HLE测试中带工具成绩反超Opus 4.8,显示出强大的任务串联能力。

行业分析指出,DeepSeek的成功不依赖于参数规模扩张。V4 Flash 0731在参数少于Nemotron3 Ultra的情况下,仍取得显著性能优势,证明算法效率的重要性。SemiAnalysis特别强调,DeepSeek在Agent任务的广度与进化幅度上形成双重领先,其能力覆盖终端操作、数据科学、安全攻防等九个核心维度,这种全链条支持正是Agent模型的核心竞争力所在。

市场策略层面,DeepSeek通过差异化定价构建产品矩阵。V4 Pro与Flash版本形成清晰定位:前者处理复杂推理任务,后者专注高频轻量场景,两者价差恰好三倍。并发限制设置进一步强化这种分层,Pro版本为500,Flash版本达2500。这种设计既满足不同开发需求,又避免内部竞争,同时为未来涨价预留空间。

价格调整信号已现。DeepSeek官方明确表示将上调API服务定价,预计涨幅较大。当前低价策略被视为新模型推广期的市场渗透手段,开发者需权衡技术红利与成本窗口期。即便涨价后,DeepSeek仍保持显著性价比优势,其输出价格仅为海外旗舰模型的数十分之一,这种定价策略可能重塑行业价格体系。

团队建设方面,DeepSeek于今年5月组建专门Agent团队,由具有华尔街量化背景的崔添翼领衔。该团队持续招募研究员与工程师,并于8月初启动Harness产品内测。相关微信公众号已完成注册,预示新产品即将面世。这种组织架构调整与技术突破形成协同效应,为模型迭代提供持续动力。

 
反对 0举报 0 收藏 0 打赏 0评论 0
 
更多>同类资讯
0相关评论

头条阅读
推荐图文
相关资讯
网站首页  |  物流配送  |  关于我们  |  联系方式  |  使用协议  |  版权隐私  |  网站地图  |  排名推广  |  广告服务  |  积分换礼  |  RSS订阅  |  违规举报  |  京ICP备14047533号-2