DeepSeek这一次把价格线抬高了。峰时输出价格翻到4.55倍,缓存命中价格更是跳升12倍——"可以不强但不能贵"的默契,正在被它自己亲手打破。
"我能接受DeepSeek V4 Pro的性能稍差,但不能接受它涨价。"一名开源社区程序员这样评价。DeepSeek留给市场的最大印象,从来都是用远低于主流的价格,提供逼近第一梯队的能力。用户容忍它偶尔答错、工具调用偶尔失灵,因为极强的性价比足以盖过这些小毛病。而这次涨价,动摇了这份默契。
8月17日起,V4 Pro和V4 Flash的新价格正式生效。V4 Pro峰时缓存命中价格从每百万Token 0.003625美元跳到0.044美元,是原来的12.14倍;输出价格从0.87美元涨到3.96美元,为4.55倍;V4 Flash峰时输出也从0.28美元抬到1.32美元,变为4.71倍。官方同时引入峰谷定价,谷时价格为峰时一半。峰时换算成北京时间,正好覆盖上午9时至12时和下午2时至6时——国内企业和开发者最集中的工作时间。
一条评论在社区里流传:"DeepSeek可以不强,但是不能贵,贵就是原罪。"这话带着情绪,却也精准点出了DeepSeek的商业难题:一旦甩掉深入骨髓的"性价比"标签,开发者真的买账吗?Token涨价之后,完成一项任务的综合成本要抬升多少?
涨价传导的第一层:订阅平台
上游价格一动,最先反应的是模型订阅平台。OpenCode披露,一次典型V4 Flash请求包含410个新增输入Token、7.13万个缓存Token和310个输出Token。按此计算,调价前每次请求约需0.000344美元;新价格机制下,谷时约0.000794美元、峰时约0.001588美元,分别是原来的2.31倍和4.62倍。
OpenCode Go五小时额度仍是12美元。假设请求结构不变,调价前理论上可完成约3.49万次请求,峰时新价格下只剩约7600次,减少约78%。社区里"从6.33万次减少到3800次、缩水94%"的说法虽然混合了促销额度与平台早期显示值、会夸大常态变化,但按3.165万次和最新7600次计算,约减少四分之三,冲击依然明显。
市场并未同步涨价,套利空间出现
要理解涨价影响,先要厘清DeepSeek的销售渠道。最直接的是官方API,按缓存命中、输入输出Token付费并分峰谷;其次是OpenRouter等聚合平台,把同一模型接入多家推理服务商任用户选择;再往下是云平台,可能存在原厂转售、云厂商自部署、区域节点、企业折扣、包量套餐;还有OpenCode Go一类的订阅服务,平台后台承担采购、路由和成本波动;最后一类是自部署开放权重,成本转为GPU租金、量化精度、吞吐率和运维投入。
这些渠道共同造成一个看似矛盾的现象:官方涨价,不代表市场上所有DeepSeek服务会在同一天、按同一幅度上涨。截至8月18日,V4 Pro 0813已接入11家服务商,多数线路的普通输入输出价格集中在每百万Token 1.32美元和3.96美元,GMICloud折后最低至1.218和2.436美元,阿里云国际最高至1.452和4.356美元;缓存价格差异更大,从0.044美元到0.44美元,相差10倍。新版模型上线数日内,服务商从三家增至12家,说明第三方推理供给正在快速跟进,但大部分线路价格已向官方峰时价格靠拢,明显的价差集中在限时折扣、缓存价格和生成速度上。
这也是第三方托管短期套利空间出现的原因:自建算力的服务商可以暂时维持旧价,也能靠量化、提高GPU利用率压低报价。但低价线路要过四道检验:生成速度稳不稳、峰值流量可不可用、量化后能力是否下降、给的是不是最新模型版本。
对手在反向行动
DeepSeek涨价前后,竞争对手正往相反方向使劲。单看Token价格,V4 Flash峰时已失去部分优势:普通输入每百万Token 0.44美元,是Luna的2.2倍;输出1.32美元,比Luna高10%;只有缓存读取0.014美元,仍比Luna低30%。到了谷时,V4 Flash输入0.22美元,只比Luna高10%;输出0.66美元,比Luna低45%;缓存读取0.007美元,低65%。
也就是说,缓存少、输入常变的应用,峰时用Luna可能更便宜;大量复用上下文的代码Agent,V4 Flash仍有机会守住优势。临界条件也能算出来:V4 Flash要在峰时保持成本低于Luna,缓存Token数需大于"新增输入的40倍加上输出的20倍"。
但固定Token结构只能回答一次调用的账单,无法判断完成同一项工作需要消耗多少Token、调用多少次工具、经历多少次重试。开源软件工程评测项目DRadar提供了另一层观察:把Sol、Terra、Luna、V4 Flash和V4 Pro放进真实软件工程任务,按任务表现和实际消耗计算"综合成本—能力"位置。涨价前,V4 Flash低推理档和V4 Pro High还占据部分性价比前沿;涨价后模型得分没变,综合成本坐标却明显右移——即便按谷时价格,V4 Flash多个档位也开始被Luna以更低成本、更高能力覆盖,V4 Pro High则滑进Sol、Terra的成本区间却无能力领先。结论是:涨价后DeepSeek基本退出了原有的综合成本—能力前沿。
谁在替涨价买单
Token Plan运营商成为最直接的传导层。这类平台向用户收固定月费,再靠批量采购、包销GPU、缓存优化和使用率差异,把10美元订阅封装成价值数十美元的用量。OpenCode Go月费10美元,本希望通过批量折扣和预留GPU为用户提供最高约60美元、相当于六倍的用量,但这一倍率不适用于所有模型。涨价后,OpenCode为V4 Flash配置的套餐使用价值为30美元,V4 Pro只有15美元,均低于成熟模型可达的60美元。按典型请求结构,在每五小时12美元上限内,V4 Flash预计可完成约7600次请求,V4 Pro约1050次。固定月费没变,上游压力被转化为更低的使用倍率和更少的估算调用次数。
第二批承压的是薄毛利AI应用。写作、翻译、客服、知识库产品通常固定订阅,很难在上游涨价当天同步提价,模型路由、上下文压缩、峰谷调度、限制重度用户成了维持毛利率的工具。第三批是Agent平台——Agent要反复读取上下文、调用工具、检查结果、处理失败,一次简单任务可能产生数十轮调用,只要一环不稳,Token价格优势就会被重试成本抵消。
画风转向背后,Harness的两面
DeepSeek的价格画风转得有点急。今年5月,它把V4 Pro的75%促销折扣转成长期价格,普通输入输出约为每百万Token 0.435和0.87美元。当时能力接近的模型贵出数倍甚至一个数量级,社区由此形容:一个模型若没有显著超过DeepSeek,就很难解释自己为什么贵那么多——这就是那条隐形的线。8月17日之后,线被DeepSeek自己抬高了。
DeepSeek给出的另一个答案是Harness,其核心设计可概括为"一切皆插件":模型、工具、技能、会话、沙箱、存储、Agent循环、任务调度和UI都能加载、卸载或替换,模型在这套架构里只是一个组件。截至8月18日,Harness在GitHub已获约15.3万Star和1.6万Fork,社区自发建立插件目录、插件市场,提供桌面客户端、文件工作台、任务看板、模型切换、MCP管理等功能。对DeepSeek而言,这有机会形成模型、插件和真实任务相互推动的反馈循环。
但也有批判声。项目首页用大写字母提醒后续"会出现破坏兼容性的变化",说明尚未形成稳定的生产标准。有开发者发现,极简模式执行pwd、ls等毫秒级命令时启动要约3.5秒,首条命令有时等7秒——底层终端等待dsh>提示符,上层持久化Shell插件却用了另一个字符串,两层程序互相确认不了Shell是否就绪,只能等超时。改两处代码后,命令延迟从约3600毫秒降到158毫秒。这暴露了一个普遍问题:Agent的成本还包括工具等待、失败重试和额外上下文,一个很小的运行时错误,就可能吃掉模型在Token价格上省下的成本。
更值得玩味的是,甚至有人提议在Harness里接入更便宜的Luna订阅。这恰恰暴露了插件架构的另一面:Harness帮DeepSeek建立Agent入口,也让用户更容易替换掉DeepSeek模型。在一个"一切皆插件"的世界里,每个入口也都是出口——运行时赢得了开发者,并不保证调用量留在DeepSeek。
DeepSeek为什么大幅涨价?官方理由是"更合理地配置资源、提升服务稳定性",但这只能解释峰谷差价。有人猜是算力趋紧,有人认为在结束推广期定价,也有人把它看作DeepSeek开始测试自己的品牌溢价和商业化能力。涨价之后的DeepSeek,还是原来的那个DeepSeek吗?
免责声明:本文基于公开报道的事实信息整理,仅供参考,不构成任何投资或技术选型建议。
发表评论 取消回复