8月13日晚上,DeepSeek接连扔了两颗炸弹。
先是 V4 Pro 正式版发布,同步甩出一份 API 调价公告,新价格8月17日零点生效,今天已经是8月14日,留给开发者的窗口期只剩3天。
几个小时之后,第二记重拳落地,DeepSeek Harness(社区简称 DSH)开发者预览版 v0.1 开启全球公测,全部源码按 MIT 协议开源。GitHub 仓库半小时涨星破万,Hacker News 的讨论帖直接冲上当天 TOP 1。
一边把价格往上抬,一边把框架往外送。这两件事放在一起看,比单看任何一件都有意思。
先看涨价这一拳,打得有多重
这次调价采用峰谷定价,高峰时段定在9点到12点、14点到18点,正好把打工人的核心工作时间全包了。
|
模型 |
高峰时段输出价(每百万tokens) |
空闲时段输出价(每百万tokens) |
|
V4-Pro |
27元,较现价上涨350% |
13.5元,约为现价的2.25倍 |
|
V4-Flash |
9元,较现价上涨350% |
4.5元 |
真正扎心的细节在缓存价格上。高峰时段的缓存命中输入定价涨了约11倍,也就是说,那些靠缓存命中率压成本的团队,这次被重点照顾了。综合算下来,高峰时段的整体调用成本大约是原来的4倍。
而且这不是 DeepSeek 一家的动作。把时间线拉长看,这是一轮全行业的转向。
智谱年内已经三次上调 API 价格,2026年一季度调用定价较2025年底提升约83%,调用量反倒增长了400%。月之暗面7月发布 Kimi K3 时定价大幅上调,官方给的说法很直白,更聪明的模型执行更复杂的任务,消耗的资源是巨大的。阿里云、百度智能云、腾讯云今年也都上调了 AI 算力产品价格,涨幅在5%到34%之间。大洋那边同样在涨,杰富瑞统计,今年二季度美国大模型 API 价格上涨了89%。
价格战打了两年,按下暂停键的是当年打得最凶的那个。
对普通开发者来说,这里面的信号很朴素,token 需求爆发了,算力供给跟不上,便宜的窗口正在关上。据《中国企业家》报道,梁文锋之前跟投资者交流时提过一个判断,在极低价格区间里,开发者对价格几乎不敏感,价格翻倍,消耗量也不会明显下降。现在 DeepSeek 真的动手涨了,某种程度上就是在验证这个判断。
再看开源这一拳,野心写在架构里
很多人第一反应是,DeepSeek 做了个「国产 Claude Code」。这个理解只对了一半。
DSH 官方给的定义是一个公式,Model + Harness = Agent。模型负责思考推理,Harness 承担模型之外的所有工程化工作,工具调用、任务规划、执行调度、沙箱、会话管理,全在这一层。它对标的是 Anthropic 的 Claude Code 和 OpenAI 的 Codex,但设计思路完全不一样。
最让我在意的一点,是它把「一切皆插件」做到了底。
一般的 Agent 产品,插件是往外扩的东西,你可以加 MCP、加技能包,但核心循环是焊死的。DSH 反过来,模型适配器是插件,工具注册表是插件,会话日志是插件,连 Agent Loop 本身也是插件,全部可以配置替换。官方架构文档里写得很直接,没有特权核心。
这个设计等于公开宣布了一件事,模型是可替换组件。
社区的反应很分裂。看好的说这是今年最有野心的一次 Agent 开源,MIT 协议加上全插件化,降低了对闭源工具的依赖。泼冷水的也不少,v0.1 还是毛坯,产品外壳很早期,有人直言它更像一个开发框架,不是能直接上手的 Coding Agent,短期替代 Claude Code 不现实。
两种说法都对。但我觉得大家争论「成品还是毛坯」的时候,容易忽略一个更要紧的信号,当模型变成插件,锁定就在松动。今天你的应用跑在 V4 Pro 上,明天换个模型,理论上只需要换一个适配器插件。
还有一组数字值得盯着看。有博主实测 DSH 写一部10万字的小说,系统直接拉起40个子 Agent 并发干活,每个子 Agent 各自挂着 token 消耗,单个就烧掉18万到34万 tokens。Agent 时代的消耗是按机器速度跑的,人只做了一件事,后台已经发生了几十次调用。
两记重拳,指向同一件事
把两件事并排放在一起,棋路就清楚了。
涨价这一手,是把商业化拉回正轨。算力紧缺是硬约束,低价补贴换增长的游戏玩不下去了,模型厂商要靠 API 收入修复现金流,才能继续扩算力。
开源这一手,是抢开发者生态的入口。模型层越来越难卷出差异化,往上走一层,去定义 Agent 怎么跑、工具怎么接、开发者在谁的框架里写代码。
一手收钱,一手圈地。对 DeepSeek 是自洽的,对开发者就是一道必答题了。
模型会越来越贵,同时模型会越来越可替换。那真正要经营的,反而是夹在中间的那一层,你自己的接入入口、路由策略、密钥和预算。这一层做扎实了,模型随便换,价格随便涨,业务不跟着抖。
落到具体动作上,我觉得有三件事值得现在就做。
动作一,3天窗口期,把迁移验证跑完
8月17日之前,把你最核心的几个业务场景在备选模型上跑一遍,看看效果差多少、成本差多少。不是让你马上搬家,是让你手里有账。涨价之后才知道自己能不能走,就晚了。
顺手做两件事。一是盘点哪些请求能命中缓存、哪些能降级到轻量模型,峰谷价差摆在那里,批处理任务往后半夜挪一挪,成本差距很直观。二是在我们的实际观察里,大量日常请求其实用不到旗舰模型,把简单任务和复杂推理分开路由,是涨价面前最直接的缓冲垫。
动作二,把多模型接入收拢到一个统一入口
DSH 都把模型适配器做成插件了,应用层反而更该有自己的抽象层。所有模型调用走同一个兼容主流大模型接口格式的入口,切模型只改路由配置,不动业务代码。
这层东西自己搭也行,用现成的也行。比如我我经常用的平台,就是这个思路,一个 API 统一接入多个模型,顺手把 token 用量统计和成本核算做进去,谁用了多少、花在哪个项目上,账是清楚的。入口统一了,涨价来的时候你才有资格谈「换一家」。
动作三,像管钱一样管 Key 和预算
Agent 时代的消耗速度和聊天时代完全是两个量级。一个任务拉起几十个子 Agent,Key 要是泄露了,或者哪个 agent 跑飞了陷入循环,账单会以肉眼可见的速度失控。这不是假设,有真实案例,一个小团队因为 API Key 泄露被批量调用,48小时烧掉8万多美元。
几件基础的事,现在就该做。不同项目用不同的 Key,每个 Key 设日度和月度额度上限,超阈值自动告警、超额度自动熔断,调用日志全量留痕,出了问题能查到是谁、在什么时间、烧了多少。
回过头看这盘棋
DeepSeek 这波操作,往小了看是一次调价加一次发布,往大了看,是整个行业从「拼价格抢用户」转向「把账算清楚」的标志性事件。价格屠夫自己放下了屠刀,这件事本身就是信号。
对开发者来说,要求其实很直白。模型选型已经从一次性决定,变成一件要持续运营的事。模型会一直换,价格会一直动,能稳住的只有你自己搭的那层入口和治理。
17号新价格生效之后,你的账单会有什么变化?你的项目做好多模型切换的准备了吗?评论区聊聊
网硕互联帮助中心





评论前必须登录!
注册