DeepSeek正式涨价 涨幅最高达1100%

深度探索:DeepSeek调价背后的行业信号与开发者新选择
8月17日零点刚过,DeepSeek这套国内大模型圈头一份落地的峰谷计价规则,就正式跑通了第一笔计费请求。没有提前铺天盖地的预热官宣,这次调价和一周前V4 Pro正式版的上线风格如出一辙——深夜悄悄更新后台规则,等开发者第二天查账单的时候,才反应过来整个API服务的成本逻辑已经彻底换了玩法。
往前倒推5天,8月12日深夜的那次版本更新,还让不少做跨境内容生成、AI建站的开发者直呼“捡到宝”:刚上线的V4 Pro正式版,每百万tokens缓存未命中输入才3元,输出6元,缓存命中的复用成本更是压到了0.025元,比当时市面上同参数级别的旗舰模型便宜了近一半,不少团队连夜调整了业务管线,打算把核心生成任务全迁过去。谁也没料到,短短一周之后,这套性价比标杆的定价体系就完成了一次幅度不小的重构。
新规则里的时段划分完全贴合国内开发者的日常工作节奏:9点到12点、14点到18点这7个小时,是绝大多数企业集中跑批量任务、处理实时请求的高峰窗口,这个时段的V4 Pro价格直接跳涨:缓存未命中输入来到9元,输出27元,最让人意外的是缓存命中的复用价格,直接从0.025元涨到了0.3元,算下来涨幅超过11倍。剩下的17个小时全划入闲时段,所有服务单价直接打五折,V4 Pro闲时每百万tokens缓存未命中输入4.5元、输出13.5元,缓存命中复用成本压回0.15元,给错峰调度留下了足够的操作空间。
主打轻量快速的V4 Flash也同步完成了计价切换,之前它的定价是每百万tokens缓存命中0.02元、未命中输入1元、输出2元,调价后高峰时段三项分别涨到0.1元、3元、9元,闲时段同样维持高峰价的50%,哪怕是做低延迟实时问答的场景,也能通过时段调度把成本控制在可接受的范围里。
和调价消息几乎同步放出来的,还有DeepSeek憋了很久的首款Agent原生产品Harness v0.1,直接面向全球开发者开放测试,还拿最宽松的MIT协议把全量源码放了出来。和市面上那些把功能焊死在框架里的智能体工具完全不一样,这款产品从第一行代码开始就走“全插件化”的路子:没有任何绑定死的核心模块,模型选型、工具调用、自定义技能、会话管理、沙箱环境、数据存储、任务调度甚至前端交互界面,全都是可以自由插拔的独立插件。开发者想换底层模型就换,想加专属业务技能就自己写插件接进去,完全不用被厂商的技术栈绑死,相当于直接给所有想做智能体落地的团队,递了一套完全开放的“积木式”开发底座。
从靠低价抢占开发者迁移,到用峰谷定价调节算力供需,再到直接开源Agent全栈框架,DeepSeek这两步走,其实已经把国内大模型服务的竞争逻辑,从“比谁Token卖得便宜”直接拽到了“比谁能帮开发者把算力用得更高效”的新阶段。





























