网易首页 > 网易号 > 正文 申请入驻

涨价是DeepSeek的原罪?

0
分享至

“我能接受DeepSeek V4 Pro的性能稍差,但不能接受DeepSeek涨价。”一名开源社区程序员这样评价DeepSeek的涨价。

DeepSeek留给市场最鲜明的印象,是用远低于主流模型的价格,提供接近第一梯队的能力。用户可以容忍它偶尔答错、工具调用不稳定,因为极强的性价比足以覆盖这些小缺点。

这次涨价动摇了这份默契。

8月17日,DeepSeek V4 Pro和V4 Flash的新价格正式生效。V4 Pro峰时缓存命中价格从每百万Token 0.003625美元提高到0.044美元,价格变为原来的12.14倍;输出价格从0.87美元提高到3.96美元,变为4.55倍。V4 Flash峰时输出也从0.28美元提高到1.32美元,变为4.71倍。


DeepSeek同时引入峰谷定价,谷时价格为峰时的一半。官方划定的峰时为UTC时间1时至4时、6时至10时,换算成北京时间,正好覆盖上午9时至12时和下午2时至6时,也就是国内企业和开发者最集中的工作时间。

一条评论在社区流传:“DeepSeek可以不强,但是不能贵,贵就是原罪。”

“原罪”是一种情绪化说法,却准确点出了DeepSeek面对的商业难题。如果甩掉深入骨髓的“性价比”标签,开发者是否真的能接受?Token价格上涨之后,它完成一项任务的综合成本要提升多少?

上游价格调整之后,最先做出反应的已经是模型订阅平台。

OpenCode披露,一次典型V4 Flash请求包含410个新增输入Token、7.13万个缓存Token和310个输出Token。按此计算,调价前每次请求约需0.000344美元;新价格机制下,谷时约0.000794美元,峰时约0.001588美元,分别变为原来的2.31倍和4.62倍。

OpenCode Go的五小时额度仍为12美元。假设请求结构不变,调价前理论上可完成约3.49万次请求,峰时新价格下约为7600次,减少约78%。

社区里还出现过“从6.33万次减少到3800次、缩水94%”的说法。这个口径同时采用了临时双倍促销额度和平台早期显示值,会夸大常态额度的变化。但按照3.165万次和最新7600次计算,约减少四分之三,冲击依然足够明显。

从价格传导的角度来看,上游价格表的改动,会逐渐影响下游重新分配模型、额度和毛利。


图:惊涛骇浪中半潜的鲸 由AI生成

1

同一个DeepSeek,五种价格

要理解这次涨价的影响,首先要厘清DeepSeek的销售渠道。

最直接的渠道是官方API,用户按照缓存命中、普通输入和输出Token付费,并接受峰、谷价格。DeepSeek网页和App承担消费者入口,但开发者、Agent平台和企业应用的边际成本,主要由API价格决定。

第二类渠道是OpenRouter等模型聚合平台。OpenRouter将同一个模型接入多家推理服务商,用户可以在价格、生成速度和可用性之间选择,平台也可以自动路由。

第三类是云平台。这里可能同时存在原厂API转售、云厂商自行部署、区域节点、企业折扣、包量套餐和积分计划。

第四类是OpenCode Go一类的订阅服务。用户支付固定月费,平台在后台承担模型采购、路由和成本波动。

第五类是自行部署开放权重。此时用户不再按Token向DeepSeek付费,成本转化为GPU租金、量化精度、推理框架、吞吐率和运维投入。

这些渠道共同造成了一个看似矛盾的现象:DeepSeek官方涨价,不代表市场上所有DeepSeek服务会在同一天、按照同一幅度上涨。

截至8月18日,Deepseek V4 Pro 0813已经接入11家服务商。多数线路的普通输入和输出价格集中在每百万Token 1.32美元和3.96美元,GMICloud折后最低为1.218美元和2.436美元,阿里云国际最高为1.452美元和4.356美元。相比普通输入和输出,缓存价格差异更大,从0.044美元到0.44美元,相差10倍。各线路的典型生成速度差异明显,中位数从每秒约28个Token到97个Token不等。

新版模型上线数日内,服务商数量从早期的三家迅速增加至12家,说明第三方推理供给正在快速跟进。不过,目前大多数线路的普通输入和输出价格已经向DeepSeek官方峰时价格靠拢,明显的价差主要集中在限时折扣、缓存价格、生成速度和服务可用性上。


这也是第三方托管可能出现短期套利空间的原因。官方价格调整后,自建算力的服务商可以暂时维持旧价格,也可以通过量化和提高GPU利用率压低报价。

问题在于,低价线路仍要接受四项检验:生成速度是否稳定、峰值流量下是否可用、量化后能力是否下降,以及它提供的究竟是不是最新模型版本。


1

DeepSeek还有性价比吗?

DeepSeek的新价格生效前后,竞争对手正在向相反方向行动。

单看Token价格,DeepSeek Flash在峰时已经失去部分优势:普通输入为每百万Token 0.44美元,是Luna的2.2倍;输出为1.32美元,比Luna高10%;缓存读取为0.014美元,仍比Luna低30%。

到了谷时,V4 Flash普通输入为0.22美元,只比Luna高10%;输出为0.66美元,比Luna低45%;缓存读取为0.007美元,比Luna低65%。

这意味着,缓存较少、输入内容经常变化的应用,在峰时使用Luna可能更便宜;大量复用上下文的代码Agent,V4 Flash仍有机会保留优势。

按照OpenCode披露的典型Flash请求计算,每次请求包含410个新增输入Token、7.13万个缓存Token和310个输出Token。调价前,这次请求约需0.000344美元;调价后谷时约需0.000794美元,变为原来的2.31倍;峰时约需0.001588美元,变为4.62倍。

如果让Luna处理完全相同数量的Token,成本约为0.00188美元。在这个缓存量远高于新增输入的例子中,V4 Flash峰时仍比Luna便宜约15.5%。

临界条件也可以计算出来:V4 Flash要在峰时保持成本低于Luna,缓存Token数量需要大于“新增输入的40倍,加上输出的20倍”。一旦达不到这个比例,Luna的Token成本更低。

不过,固定Token结构只能回答一次调用的账单,无法判断完成同一项工作需要消耗多少Token、调用多少次工具或者经历多少次重试。

开源软件工程任务评测项目DRadar提供了另一层观察。它将Sol、Terra、Luna、DeepSeek V4 Flash和V4 Pro放入真实软件工程任务,通过不同推理强度下的任务表现和实际消耗,计算“综合成本—能力”位置。

涨价前,V4 Flash的低推理档和V4 Pro High仍占据部分性价比前沿,其中V4 Pro High能够以明显低于Sol和Terra的成本,取得接近高能力档位的结果。

DeepSeek涨价后,模型得分没有变化,综合成本坐标却明显右移。即使按照谷时价格计算,V4 Flash的多个档位也开始被Luna以更低成本和更高能力覆盖;V4 Pro High则移动到Sol、Terra的成本区间,能力没有形成相应领先。到了峰时,这种挤压更加明显:中等能力任务更容易落入Luna的优势区间,接近高能力档位的任务则需要重新比较Sol和Terra。

按照DRadar这组真实软件工程任务的结果,DeepSeek涨价后基本退出了原有的综合成本—能力前沿。

V4 Pro面临的压力更直接。无论峰时还是谷时,其普通输入、缓存输入和输出价格都高于Luna。它需要依靠更高的任务成功率、更少的重试和更稳定的工具执行,证明自己在每次成功任务上的投入仍然合理。


图:DRadar开源项目测算的涨价前后综合成本对比

1

谁最先为DeepSeek涨价买单?

涨价最先会影响到谁?Token Plan运营商已经成为这次涨价最直接的传导层。

这类平台通常向用户收取固定月费,再通过批量采购、包销GPU、缓存优化和用户使用率差异,把10美元订阅封装成价值数十美元的模型用量。

OpenCode Go每月订阅价格为10美元,平台希望通过批量折扣和预留GPU容量,为用户提供最高约60美元、相当于订阅费六倍的模型用量。但这一倍率并不适用于所有模型。对于暂时无法获得采购折扣、也难以通过自行托管降低成本的模型,OpenCode只能压低相应的使用价值。

DeepSeek涨价后,这种差异已经反映在额度表中。OpenCode为V4 Flash配置的套餐使用价值为30美元,V4 Pro只有15美元,均未达到部分成熟模型可获得的60美元。按照平台观察到的典型请求结构,在每五小时12美元的使用上限内,V4 Flash预计可以完成约7600次请求,V4 Pro约为1050次。固定月费没有变化,上游价格压力被转化成了更低的使用倍率和更少的估算调用次数。

作为参照,同一计划中,GPT-5.6 Luna每五小时约可完成2050次请求,MiniMax M3约3200次,Hy3约4300次,MiMo-V2.5则达到3.01万次。不同模型的输入长度、缓存量和输出量并不相同,这些数字不能用于比较单次任务的真实成本。

它们能够说明的是,在固定订阅模式下,平台会根据采购价格和托管成本重新分配模型额度,DeepSeek涨价最终由订阅用户以可用量减少的方式承担。


图:在OpenCode社区,一名用户以“Bye bye OpenCode Go”为题讨论Flash价格变化,评论中有人提醒取消订阅,也有人表示“已经不值得”。

面向多模型重度用户、规模相对较小的Cola Token Plan也表示,按照自身流量结构测算,DeepSeek的综合成本增加约3至6倍,随后将Flash和Lite的套餐消耗标准整体调整到此前约三倍,并准备重新设计模型组合。

第二批承受压力的是薄毛利AI应用。写作、翻译、客服和知识库产品通常采用固定订阅,很难在上游涨价当天同步向用户提价。模型路由、上下文压缩、峰谷调度和限制重度用户,都会成为维持毛利率的工具。

第三批是Agent平台。Agent需要重复读取上下文、调用工具、检查结果和处理失败。一次看似简单的任务可能产生数十轮模型调用。只要其中一个环节不稳定,Token价格优势就可能被重试成本抵消。

DeepSeek的价格画风转向有点急。

今年5月,DeepSeek将V4 Pro的75%促销折扣转为长期价格。调整后的普通输入和输出分别约为每百万Token 0.435美元和0.87美元。当时,能力接近的模型贵出数倍甚至一个数量级,价格接近的模型又存在明显能力差距。

社区由此如此形容DeepSeek的价格,如果一个模型如果没有显著超过DeepSeek,就很难解释自己为什么贵那么多,这也形成了一条隐形的线。

但是8月17日之后,这条线被DeepSeek自己抬高了。Flash仍有机会依靠缓存和谷时价格守住大量调用,Pro开始进入一个更加严苛的竞争区间。开发者会把它与Luna、GLM、Kimi和其他开放模型逐项比较,模型在推理、工具调用和代码能力上的小幅差距,也会被重新放大。

在价格优势之外,DeepSeek还拥有开放权重、百万Token上下文、中文能力和较高的开发者认知。新版V4 Pro也在多项Agent评测中明显超过Flash。问题在于,这些优势能否支持数倍于旧价格的账单。

DeepSeek给出的另一个答案,是Harness。

1

“运行时”竞争

DeepSeek Harness的核心设计可以概括为“一切皆插件”。

模型、工具、技能、会话、沙箱、存储、Agent循环、任务调度和用户界面,都能被加载、卸载或替换。开发者可以增加工具、更换模型供应商、重写记忆方式,也可以改造整个Agent循环。模型在这套架构中只是一个组件。

推出Harness之后,DeepSeek开始进入模型与真实工作之间的执行层。

截至8月18日,DeepSeek Harness在GitHub已获得约15.3万Star和1.6万Fork,显示出极强的社区号召力。

DeepSeek在官方README中鼓励开发者使用dsh-plugin标签发布插件,社区随后建立了插件目录和插件市场,开始提供桌面客户端、文件工作台、任务看板、模型切换、MCP管理、会话恢复、缓存统计和费用监控等功能。还有开发者讨论插件注册规范、兼容性检查和dsh doctor诊断工具。

这些项目的质量仍然参差不齐,至少说明“一切皆插件”降低了参与门槛。对DeepSeek而言,这有机会形成模型、插件和真实任务相互推动的反馈循环,也为未来的托管运行时、企业SLA、安全审计和插件认证留下商业空间。

与此同时,也出现了不少批判性评价。

DeepSeek在项目首页用大写字母提醒,后续“会出现破坏兼容性的变化”。这意味着现有部署在升级后可能需要重新适配。对于开发者预览版,这是正常的风险说明;但如果企业希望进行私有化部署,它表明dsh尚未形成稳定的生产标准。

一名开发者评价:“一个没有在市场上打磨的Harness,很难效果好,不是针对DeepSeek,任何一家都一样。”Agent运行时需要面对复杂环境,许多问题只有在大量真实任务中才会暴露。

社区已经发现了一些具体问题。

一名开发者发现,Harness极简模式执行pwd、ls等毫秒级命令时,启动需要约3.5秒,第一条命令有时要等待7秒。检查代码后,最终发现底层终端等待的是dsh>提示符,上层持久化Shell插件却使用了另一个字符串。两层程序无法确认Shell已经准备完成,只能等到超时。

修改两处代码后,该开发者称命令延迟从约3600毫秒降至158毫秒,并向官方提交了修复分支。这个案例说明了一个普遍问题:Agent的成本还包括工具等待、失败重试和额外上下文。一个很小的运行时错误,就可能消耗掉模型在Token价格上节省的成本。


还有开发者认为,如果DeepSeek先依靠低价Flash扩大Harness的使用规模,就能更快获得Bug报告、失败轨迹和插件适配经验。API涨价提高了使用deepseek模型试用harnesss的成本,可能拖慢这一过程。

甚至有人提出,能否在DeepSeek Harness中接入Luna的订阅,因为Luna更便宜。这暴露了插件架构的另一面:Harness可以帮助DeepSeek建立Agent入口,也让用户更容易替换DeepSeek模型。运行时获得开发者,并不保证调用量最终留在DeepSeek。

在一个“一切皆插件”的世界里,每个入口,也都是出口。Harness可以把更多任务带给DeepSeek,也可以成为开发者切换到其他模型的舷梯。

因此,deepseek harness的生态意义已经出现,商业价值还要打个问号。

DeepSeek为什么要大幅涨价?DeepSeek给出的官方理由是“更合理地配置资源、提升服务稳定性”,但这只能解释峰谷差价,无法完整解释此次涨价。

有人猜测是算力趋紧,有人认为它在结束推广期定价,也有人把这看作DeepSeek开始测试自己的品牌溢价和商业化能力。

涨价之后的DeepSeek,还是原来的那个DeepSeek吗?

文章转载于腾讯科技,作者晓静。

点个爱心,再走 吧

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
“没有手艺都是科技”,青岛一烤羊店招牌被六旬师傅装反,店主:主打纯手艺无科技,视频太火了,正在犹豫要不要改过来

“没有手艺都是科技”,青岛一烤羊店招牌被六旬师傅装反,店主:主打纯手艺无科技,视频太火了,正在犹豫要不要改过来

扬子晚报
2026-09-01 12:22:59
不查不知道一查吓一跳!执掌恒大27年的许家印,私下到底有多壕?

不查不知道一查吓一跳!执掌恒大27年的许家印,私下到底有多壕?

花颜蕴韵
2026-09-02 17:32:24
紧急预警!新型入室盗窃席卷全国,无数家庭已经中招

紧急预警!新型入室盗窃席卷全国,无数家庭已经中招

小虎新车推荐员
2026-09-01 09:17:01
体坛大乱!国羽高层被一锅端,刘国梁被带走?唯独蔡振华全身而退

体坛大乱!国羽高层被一锅端,刘国梁被带走?唯独蔡振华全身而退

林子说事
2026-09-02 12:21:47
外卖下半场,为何最先恢复的是美团?

外卖下半场,为何最先恢复的是美团?

道总有理
2026-09-01 20:53:59
日媒得出大胆结论:特朗普仅用6个月,就把美国霸权逼至终结拐点

日媒得出大胆结论:特朗普仅用6个月,就把美国霸权逼至终结拐点

福建睿平
2026-09-02 07:21:31
423万拆迁款女儿一分没有,父亲大寿她不去,一月后哥哥送来文件

423万拆迁款女儿一分没有,父亲大寿她不去,一月后哥哥送来文件

林林故事揭秘
2025-05-06 15:43:19
赛力斯8月销量骤降44%:问界品牌近乎腰斩

赛力斯8月销量骤降44%:问界品牌近乎腰斩

阿芒娱乐说
2026-09-02 05:09:21
品牌打印机为什么不愿适配鸿蒙系统?

品牌打印机为什么不愿适配鸿蒙系统?

小柱解说游戏
2026-08-31 13:21:35
麦克托米奈:若皇马来电,我会考虑

麦克托米奈:若皇马来电,我会考虑

懂球帝
2026-09-02 16:00:41
韩国光州双年展恢复“台湾馆”名称,大陆艺术家集体撤展,国台办:台湾参与国际活动,必须按照一个中国原则来处理

韩国光州双年展恢复“台湾馆”名称,大陆艺术家集体撤展,国台办:台湾参与国际活动,必须按照一个中国原则来处理

政知新媒体
2026-09-02 13:03:33
吴柳芳谈退役安置不公:我没刘翔那命,只有16万买断

吴柳芳谈退役安置不公:我没刘翔那命,只有16万买断

东方不败然多多
2026-09-01 11:00:29
卡塔尔半岛电视台确认了:美国偷袭伊朗拉腊克岛,美军轰炸了岛上两处伊朗革命卫队火箭发射装置,这是美军一个月来首次对伊朗采取军事行动

卡塔尔半岛电视台确认了:美国偷袭伊朗拉腊克岛,美军轰炸了岛上两处伊朗革命卫队火箭发射装置,这是美军一个月来首次对伊朗采取军事行动

吉刻新闻
2026-08-31 07:20:45
“一个月陪睡一两次”:网红魏莹的榜一大哥照片曝光,他身价过亿,是个大企业家

“一个月陪睡一两次”:网红魏莹的榜一大哥照片曝光,他身价过亿,是个大企业家

江山挥笔
2026-08-25 16:40:36
孙宇晨前女友曾颖回应景甜“三千万彩礼”:他给的大概率是千万要开心,千万要幸福,千万要平安

孙宇晨前女友曾颖回应景甜“三千万彩礼”:他给的大概率是千万要开心,千万要幸福,千万要平安

背包旅行
2026-08-31 17:43:35
金正恩女儿持枪开坦克,韩情报院称已进入接班人内定阶段

金正恩女儿持枪开坦克,韩情报院称已进入接班人内定阶段

桂系007
2026-09-02 10:15:38
常州400多人HR群事件发酵!成都网友爆料,当地同样存在这类HR同盟群,直言“钱可以让人不要脸,更不要心”

常州400多人HR群事件发酵!成都网友爆料,当地同样存在这类HR同盟群,直言“钱可以让人不要脸,更不要心”

火山詩话
2026-08-31 08:17:34
消化科主任忠告:立即停止食用这5类素食,吃的越多,息肉越大

消化科主任忠告:立即停止食用这5类素食,吃的越多,息肉越大

医学科普汇
2026-09-02 15:50:59
高铁女孩熟睡男生盯死手机不敢转头,两百万外网围观无声的人机对峙,藏着成年人不敢破冰的社交尴尬防线

高铁女孩熟睡男生盯死手机不敢转头,两百万外网围观无声的人机对峙,藏着成年人不敢破冰的社交尴尬防线

明话直说
2026-08-25 18:07:55
离婚的妇人都是咋和前夫相处的?网友:我就好奇,有没有睡在一起

离婚的妇人都是咋和前夫相处的?网友:我就好奇,有没有睡在一起

带你感受人间冷暖
2026-08-31 00:05:16
2026-09-02 18:15:00
硅星人 incentive-icons
硅星人
硅(Si)是创造未来的基础,欢迎来到这个星球。
3372文章数 10529关注度
往期回顾 全部

科技要闻

凌晨最强模型上新,Claude Fable 5.1发布

头条要闻

尼泊尔用无人机找幸存者 隧道被泥浆"像牙膏一样"塞满

头条要闻

尼泊尔用无人机找幸存者 隧道被泥浆"像牙膏一样"塞满

体育要闻

一次有奖问答,让他成为欧冠主帅

娱乐要闻

香港武打影星陈观泰离世,终年80岁

财经要闻

需要重视的全球“资金失衡”

汽车要闻

23万级给到激光雷达和900km续航 比亚迪海狮08售22.99万起

态度原创

数码
房产
游戏
亲子
军事航空

数码要闻

万元显卡售后翻车!用户收到变形RTX 5080不敢修:装不进机箱没法用

房产要闻

新四代住宅 新样板间开放丨以艺术之名 赴一场迭代之约

《巫师3》杀穿科隆!新DLC愿望单碾压科隆所有展出游戏

亲子要闻

拒学、拖延、叛逆?新学期别再怪孩子“不听话”

军事要闻

特朗普威胁伊朗终极打击蓄势待发

无障碍浏览 进入关怀版