7月31日,DeepSeek官宣DeepSeek-V4-Flash正式版API开启公测。该版本大幅升级Agent智能体能力,基准测试得分达25.2分,接近Opus-4.8的25.7分,远高于V4-pro预览版的15.8分。
AI开发者张泽实测显示,V4-Flash正式版接入Hermes后完成相同任务耗时约40秒,而GPT-5.6 Sol+Codex耗时1分47秒;其交付结果达到可用水平,在及格线之上。孙涛反馈称,该模型在国内模型中优于GLM 5.2,但弱于GPT-5.6;在Pi Agent中表现良好,适用场景集中于推理、代码及长文档处理。
V4-Flash正式版在任务执行中工具调用准确度总体良好,能依据工具返回结果动态调整后续步骤,已可较顺畅满足个人开发需求。
价格方面,V4-Flash正式版实行峰谷定价机制。百万tokens输入(缓存未命中)高峰时段定价为2元人民币,输出为4元,较4月预览版翻倍;但对比国际模型仍具显著优势。按当前官方定价,GPT-5.6 Sol百万tokens输入、缓存输入、输出价格分别为5美元、0.5美元、30美元,折合人民币约为36元、3.6元、216元;V4-Flash对应价格为1元、0.02元、2元,成本差距达数十至百倍。
张泽实测一次本地文件阅读加全网信息检索汇总任务消耗51万tokens,费用为0.53元人民币。
7月28日OpenRouter数据显示,中国AI大模型周调用量全球领先,DeepSeek V4-Flash位列第二,V4-Pro位列第五;截至7月26日近28天统计,中国模型全球市场份额为63.5%,美国为35.5%。
DeepSeek Harness作为支撑Agent任务交付的基础设施,负责上下文准备、工具调度、状态管理与边界控制。DeepSeek于6月起加大Harness人才招聘力度,并于8月前披露Harness新进展:DeepSeek Harness即将公布。
中信证券指出,Harness核心价值在于解决长程任务交付痛点,实现稳定、低成本端到端交付;同时连接模型与泛办公场景,拓展市场并沉淀数据反哺模型迭代。AI竞争正由模型能力转向任务交付能力。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。



