网易首页 > 网易号 > 正文 申请入驻

是时候该给Token算算ROI的账了

0
分享至


谁能想到,AI时代最先爆炸的,不是员工的生产力,而是老板的账单。

去年,Token 消耗还是企业拥抱 AI、代表创新能力的指标。结果到了今年,风向全变了。

腾讯开始收紧 AI 预算,Palantir CEO 开始公开吐槽模型厂商收费太贵。AI 还没把员工替代,老板已经先开始研究怎么省 Token 了。

原因很简单,Token这个玩意儿,是真的贵啊!

德勤测算,一家年收入约 130 亿美元的企业,每年 AI 投入可能高达 7 亿美元。而且,这还只是开始。

根据国外研发管理平台Jellyfish的数据,在过去9个月内,每位开发者的人工智能支出增长了约 18.6 倍。

但老板的钱,向来不是白花的。既然钱花这么多,但产出呢?

Jellyfish数据显示,使用 Token 最多的工程师,生产力大约是低使用者的2倍,但消耗的 Token 却高达后者的10倍。

也就是说,Token 的增长速度,已经开始跑赢价值的增长速度。

或许,在奔向 AI 的星辰大海之前,企业也该给Token算算账了。


从“Token最大化”,转向“Token纪律”

去年,硅谷有很流行一个词,叫Tokenmaxxing。

意思很简单:鼓励员工尽可能多地使用 AI,甚至很多公司把 Token 消耗,当成 AI 采用程度和创新能力的代理指标。

但到了今年,画风突然变化,越来越多的企业开始算Token账了

最近,Palo Alto Networks CEO Nikesh Arora最近接受CNBC采访时表示:Token价格还需要再下降90%,企业才能真正大规模部署。

Palantir CEO Alex Karp的表达更直接。他批评OpenAI、Anthropic等公司的Token收费模式“完全错了”:企业付出大笔费用,买到的却可能是一堆没有创造价值的Token。

按照Karp的逻辑,如果AI真能帮助一家企业多赚10亿美元,模型公司完全可以拿走其中30%,而不是按 Token 收费。

类似的故事,今年屡屡上演。

一位Priceline员工透露,一次例行的Cursor合同续签费用竟然翻了4到5倍。Uber 更是在今年 4 月之前,就已经花光了全年 AI 编码预算。

AI 花钱的速度,可能远超你的想象。

据九派财经此前报道,今年 6 月之前,腾讯部分部门给员工的 AI 使用额度一度达到每人每月约 2000 美元,折合人民币约 1.3 万至 1.4 万元,几乎相当于一线城市一名正式员工的月薪。

即使 6 月调整后,不少员工每月仍有 1000 至 5000 元 的 Token 预算。

腾讯《2025 研发大数据报告》显示,截至 2025 年底,公司本部及直接管理全资子公司共有员工约 8.74 万人,其中产研人员占 76%,约 6.64 万人。

如果按每名产研人员每月 3000 元额度计算,仅名义上的年度 Token 预算,就接近 24 亿元。

企业整体投入更惊人。

德勤此前调研了 548 家大型企业,74% 的企业过去一年已经投资 AI,其中超过一半企业,AI 支出占整个数字化预算的 36%。

按德勤测算,一家年收入约130亿美元的企业,每年投入 AI 的预算可能高达7亿美元。

钱越花越多,收益呢?

国外研发管理平台 Jellyfish 曾做过一项调查,使用 Token 最多的工程师,生产力大约是低使用者的2倍,但消耗的 Token 却高达后者的10倍。

换句话说,AI的投入远远赶不上产出

为什么 AI 会这么烧钱?

原因在于,Agent 和传统软件的运行方式完全不同。

传统软件的执行路径基本固定,成本也相对可预测;而 Agent 会自主搜索、调用工具、反思、重试,并不断携带上下文,整个执行过程具有很强的不确定性。

很多企业直到月底收到云账单,才知道一个工作流到底循环了多少次,又烧掉了多少 Token。

去年一项针对 Agent 编程任务的研究发现,一个 Agent 完成同类任务,消耗的 Token 可能是普通代码问答的 1000 倍。即便是同一个模型、同一个任务,不同运行之间的 Token 消耗,最多也可能相差 30 倍。

更重要的是,Token 越多,并不意味着效果越好。研究发现,模型准确率通常会在中等 Token 消耗区间达到峰值,之后便进入明显的收益递减阶段。

就这样,去年还是创新指标的 Token,如今成了企业的成本中心。

Token效率最高,才是大模型的赢家

当Token的ROI摆在了所有人面前,模型分层几乎成为一种必然

简单来说,Claude Fable 5 这样的 SOTA 模型在少数高价值场景中依然不可替代,但对于绝大多数普通任务而言,性能已经出现了“过剩”,ROI很低,而这部分用户正在被便宜的开源模型分流。

这一趋势已经开始显现。

今年年初,a16z对100家大企业做了一个调研,2025年已有37%的企业同时使用5个以上模型。到2026年,81%的受访企业已经在测试或生产环境中使用三个以上模型家族,高于不到一年前的68%。

后来,a16z总结了企业的模型使用规律:对外、可见度高、性能敏感的任务,通常交给领先模型;而对内、标准化、重复性的任务,模型选择更多由成本决定。

当然,从目前企业实际支出来看,闭源前沿模型仍然占据绝对优势。

根据 The Information 今年5月报道,在其追踪的34家领先AI创业公司中,OpenAI 和 Anthropic 两家公司拿走了89%的收入。

逻辑很简单,在编程等前沿用途上,用户对价格并不特别敏感,愿意为了性能支付更高价格。

但并不是所有人都认为,这种格局会长期持续。AI投资人 Gavin Baker 最近提出了一个观点:

虽然目前绝大部分经济价值仍然集中在最智能的模型上,但未来市场份额可能逐渐向性价比更高的模型迁移。

但也有人并不这么认为。AI领域知名投资人Gavin Baker今天就提到一个观点:

尽管目前开源与低价模型处理了绝大部分Token,但大部分经济价值仍然集中在最智能的模型上。未来这种情况可能会发生变化,大模型市场份额将从头部模型转移到性价比更高的模型

背后的逻辑很简单,模型价格下降,意味着单位智能成本降低。同样的预算,可以调用更多 Token,也可以让更多业务接入 AI,最终提升企业的ROI。

说白了,最终模型层的赢家将属于Token效率最高的玩家。

Altimeter Capital 合伙人 Freda Duan 对此总结得非常直接:未来只有两种模型能够活下来——要么足够出色,要么足够便宜。

前者代表任务效率,后者代表成本效率。

未来最可能的场景是,企业开始通过智能路由进行任务的精准拆分:将最高价值的复杂推理交由前沿模型,将海量基础任务交由高性价比模型,从而实现单位成本下的产出最大化。

如果说,美国今天最大的优势仍然在于最前沿模型,那么中国最大的优势,则越来越体现在成本效率。

某种程度上说,DeepSeek就是大模型行业的“生死线”

如果一个模型只比 DeepSeek 强一点,但价格贵很多,它就没有长期存在的理由。对于企业和开发者而言,为微弱的能力溢价支付不成比例的成本,显然不符合基本的商业常识。

这种分层机制的存在,就是中美AI竞争最底层的逻辑。中国 AI 对海外生态的挤压,未必表现为中国模型公司在前台直接击溃美国巨头,而是一场更为隐秘的“底层平替”。

越来越多的美国 AI 应用公司,为了压降履约成本,开始将底层基础设施悄悄切换为 Kimi、Qwen 或 DeepSeek,再于前台封装自身的产品体验与工作流。比如,Perplexity刚刚发布了其计算机应用产品的新系统,就采用了中国 Z.ai 开源的 GLM 5.2 作为底层模型之一。

很多人觉得,大模型的终局是谁做出最聪明的模型。

但汽车产业的历史给出了另一个答案:法拉利定义了速度,丰田定义了产业效率。

AI或许也是如此。美国模型继续刷新智能的上限,而中国模型正在不断刷新智能的成本下限。当越来越多企业开始计算Token的ROI,真正决定产业格局的,未必是谁最强,而是谁能把智能做成一种人人都用得起的工业品。

这恰恰是中国模型最有机会的地方。

文/阿奇


特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
“23年未曾回过家、每天只睡0-2小时”,表彰大会一教师PPT分享感人事迹引争议,中南大学湘雅医学院:已下架相关文章,正调查是否夸大

“23年未曾回过家、每天只睡0-2小时”,表彰大会一教师PPT分享感人事迹引争议,中南大学湘雅医学院:已下架相关文章,正调查是否夸大

都市快报橙柿互动
2026-09-16 22:42:16
60岁老帅再出山,他曾执教广州和新疆

60岁老帅再出山,他曾执教广州和新疆

赛场名场面
2026-09-15 18:57:50
陪睡陪玩只是开胃菜,舔手指塞拳头、集体嫖娼、背后的事藏不住了

陪睡陪玩只是开胃菜,舔手指塞拳头、集体嫖娼、背后的事藏不住了

北海史记
2026-08-12 19:57:54
欧洲人都快被中国整崩溃了

欧洲人都快被中国整崩溃了

乌克兰小静
2026-09-15 07:59:44
人球分过造绝杀,贝林厄姆西甲成功过人仅次于姆巴佩和亚马尔

人球分过造绝杀,贝林厄姆西甲成功过人仅次于姆巴佩和亚马尔

懂球帝
2026-09-16 09:05:36
北京医院搬迁潮:大量三甲医院集体搬去五环外,究竟是利还是弊?

北京医院搬迁潮:大量三甲医院集体搬去五环外,究竟是利还是弊?

聚焦真实瞬间
2026-09-16 17:01:54
男人一天最多能几次?别盲目逞强!医生曝出透支上限,多数人都超了

男人一天最多能几次?别盲目逞强!医生曝出透支上限,多数人都超了

荔子言
2026-08-26 15:20:06
《兰香如故》杜翠雀算盘落空!原来,她撮合林绣芄和杜正,不是为哥哥,是为自己

《兰香如故》杜翠雀算盘落空!原来,她撮合林绣芄和杜正,不是为哥哥,是为自己

小椰的奶奶
2026-09-16 00:17:52
太反常!沉寂8年的33亿小盘股,竟被陈发树和外资巨头重仓

太反常!沉寂8年的33亿小盘股,竟被陈发树和外资巨头重仓

慧眼看世界哈哈
2026-07-12 10:01:59
史上最寒酸亚运会!日本办亚运会彻底翻车,多国代表团集体怒批

史上最寒酸亚运会!日本办亚运会彻底翻车,多国代表团集体怒批

行者聊官
2026-09-15 21:16:35
苹果听劝,中国版iPhone18 Pro的SIM卡,是全球最灵活的!

苹果听劝,中国版iPhone18 Pro的SIM卡,是全球最灵活的!

互联网.乱侃秀
2026-09-14 10:15:21
“鲶鱼须”已成历史,10后学生开始流行“呆毛”发型:头顶取一小撮头发,在距头皮2到3厘米剪断,留下的发根自然炸开

“鲶鱼须”已成历史,10后学生开始流行“呆毛”发型:头顶取一小撮头发,在距头皮2到3厘米剪断,留下的发根自然炸开

芒果都市
2026-09-15 14:32:37
莱昂纳多社媒发文:真诚的人永远不会输,再进一球让大家开心

莱昂纳多社媒发文:真诚的人永远不会输,再进一球让大家开心

懂球帝
2026-09-16 14:23:27
中纪委:严查“兵托”,纵容包庇“兵托”的,从严追责问责!

中纪委:严查“兵托”,纵容包庇“兵托”的,从严追责问责!

细说职场
2026-09-16 21:39:25
酒桶式穿搭,圆滚的身子也是有线条的!

酒桶式穿搭,圆滚的身子也是有线条的!

飛尚日记
2026-09-13 06:03:45
哈里梅根让俩娃火速退学,理由是怕堵车被暗杀?查尔斯:平民就别摆谱了

哈里梅根让俩娃火速退学,理由是怕堵车被暗杀?查尔斯:平民就别摆谱了

白露文娱志
2026-09-16 15:46:53
镇政府公职人员醉驾致夫妻俩身亡,肇事者下班后先回县城再返镇上聚餐,餐馆老板称5个人喝了一斤多白酒

镇政府公职人员醉驾致夫妻俩身亡,肇事者下班后先回县城再返镇上聚餐,餐馆老板称5个人喝了一斤多白酒

大风新闻
2026-09-16 17:41:06
日本想用技术封锁卡中国脖子怎么可能不碰壁?

日本想用技术封锁卡中国脖子怎么可能不碰壁?

烽火瞭望者
2026-09-16 04:27:08
新钟薛高回应罗永浩“吐槽”野人先生言论

新钟薛高回应罗永浩“吐槽”野人先生言论

新京报
2026-09-16 14:23:07
终于来了!全新一代特斯拉Model Y官宣发布,改动超出想象

终于来了!全新一代特斯拉Model Y官宣发布,改动超出想象

生活魔术专家
2026-09-14 09:03:10
2026-09-17 01:35:00
硅基观察Pro incentive-icons
硅基观察Pro
人工智能新时代的商业智库和价值灯塔
985文章数 74关注度
往期回顾 全部

科技要闻

赛力斯接管问界,撑得住华为给的身价吗?

头条要闻

父亲遛狗2岁娃独留家中从18楼坠亡 父亲发声:我很愧疚

头条要闻

父亲遛狗2岁娃独留家中从18楼坠亡 父亲发声:我很愧疚

体育要闻

对话西甲联盟高管:西班牙足球到底强在哪?

娱乐要闻

乔任梁去世十周年,陈乔恩悼念

财经要闻

邢自强:中美AI决胜点不在算力

汽车要闻

奔驰周娟:全新长轴距GLE SUV第一次拥有了"中国脑,中国心"

态度原创

时尚
教育
数码
艺术
手机

8年没换过|| 每次“垮脸”都靠它救,这笔小投资已值回本

教育要闻

“看到厨房,心里踏实多了!”这所学校食堂第一餐上新!

数码要闻

首款AI智能体手机努比亚NaviX Ultra发布:5499元起

艺术要闻

砸20亿!海南东方首个超五星酒店封顶,造型像“船帆”

手机要闻

消息称苹果iPhone Duo暂不支持微信平板模式,无法实现双设备登录同一账号

无障碍浏览 进入关怀版