DeepSeek 官宣 V4.1 Flash 版本开启内测,同步公布全新 API 定价方案,9 月 10 日正式生效。本次调价采用分时定价创新模式,区分高峰时段与空闲时段:空闲时段输入缓存命中单价仅 0.02 元,缓存未命中单价 1 元,输出单价 4 元;工作日高峰时段价格翻倍。对比原有价格体系,缓存命中最高降幅达到 60%,缓存未命中降幅 33.33%,输出价格小幅下调 11.11%。这标志国内大模型行业正式进入性能迭代 + 价格战并行的激烈竞争阶段。
分时定价策略,本质是复用算力闲置资源,优化算力利用率。大模型推理算力波动巨大,白天企业业务请求密集,夜间算力大量闲置。通过低价引导客户错峰调用 API,摊薄算力硬件固定成本,提升服务器稼动率,这也是海外头部云厂商成熟运营思路,DeepSeek 率先在国内大模型 API 市场落地。
![]()
AI生成
产业层面,国内大模型调用量持续走高,但企业客户付费意愿对价格高度敏感。大量中小企业客户,对模型能力要求适中,但对推理成本非常敏感。降价策略,能够快速抢占中小开发者、SaaS 服务商客户群体,扩大模型生态,提升调用规模,形成规模效应之后进一步摊薄单位算力成本。
竞争格局上,国内大模型赛道玩家众多,各家持续更新模型版本,能力差距不断缩小。单纯比拼参数、基准测试分数已经很难拉开差距,成本控制、API 服务稳定性、场景适配能力,变成新竞争壁垒。短期价格战会压缩大模型厂商毛利,加速行业洗牌,资金实力弱、算力储备不足的中小模型厂商压力加剧。
长期来看,价格战不是终点,核心是找到可持续商业化路径。单纯降价不可持续,最终比拼底层算力调度、芯片优化、模型蒸馏技术。未来大模型厂商会持续分化:一部分聚焦通用大模型,争夺开发者生态;另一部分深耕垂直行业,靠行业解决方案赚取溢价。API 价格持续下行,会进一步降低 AI 应用创业门槛,催生更多 AI 原生应用落地。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.