DeepSeek一天“吞”下8万亿Token,AI的“白菜价”时代来了?
8万亿Token。这个数字大到让人一时失去概念。
闻览时评:换算一下,约等于5600万本《三体》三部曲的文字量,或者4万部完整电影剧本。而这一切,发生在一天之内。
8月3日,海外开发者平台OpenCode发布数据:DeepSeek V4 Flash在其平台上单日处理Token达8万亿,其中5万亿来自免费额度,3万亿为开发者付费调用。作为对比,接入了400多款模型的大模型路由平台OpenRouter,全平台日均处理量也不过6.6万亿。一款模型、一个入口,干翻了全行业400多款模型的总流水。


数字很吓人,账却算得明白。DeepSeek的定价是100万Token收2块钱——3万亿付费Token折算下来,流水不过600万。8万亿的体量,600万的收入,单价之低可见一斑。
但真正值得关注的,不是这600万流水,而是8万亿背后正在发生的一场行业剧变。
一、“斩杀线”来了
DeepSeek V4 Flash的定价有多狠?一百万个输出Token收2元人民币,而Anthropic的Claude Opus 4.8标准价格是25美元(约170元),两者相差约85倍。更夸张的是,美国研究机构Artificial Analysis的数据显示,DeepSeek V4 Flash的运行成本甚至只有Claude Fable 5得不到1/100。
这不是价格战,这是划出了一条“斩杀线”。
这条线斩掉的,不是最强模型——旗舰模型依然有它的用武之地。真正被斩的,是中间那一批“比DeepSeek强一点、但贵几十倍”的模型。当一款模型价格高出几十倍、性能领先却只有几个百分点时,开发者会用脚投票。多名海外AI初创创始人在X平台公开复盘:团队全线迁移至DeepSeek后,月度推理成本下降60%至85%。对于尚未盈利的小微AI公司,这样的成本差异足以决定项目能否活下去。
二、OpenAI慌了
DeepSeek的爆发式增长,直接触发了对手的应激反应。
7月31日,OpenAI宣布GPT-5.6 Luna降价80%,输出价格从每百万Token 6美元砍到1.2美元。然而,即便降价80%,DeepSeek V4 Flash的单任务成本仍比Luna低约60%。更尴尬的是,OpenAI核心产品负责人在OpenCode评论区打广告时,开发者直接回了一句: “我们希望得到DeepSeek的价格。” 
这一幕极具象征意义——当OpenAI以更低价格仍无法在成本与用户心智方面取胜时,国产开源模型正在将传统性价比概念带入全新的竞争阶段。
三、流量爆炸,成本也在爆炸
8万亿Token的另一面,是算力基础设施承受的极限压力。
AI优化服务器用电量一年涨了84%。DeepSeek近日宣布引入峰谷计费机制,工作日高峰时段调用价格翻倍——这本质上是把电网的规则搬到了算力市场。当算力需求像电力一样具有峰谷特性时,定价逻辑也必须向电力行业靠拢。
更深层的问题是:5万亿免费Token带来的用户增长,能否覆盖随之暴涨的服务器、电力和硬件成本? 目前来看,DeepSeek赌的是规模效应——用极低单价撬动天量用户,再用天量用户摊薄单位成本。这个模式能否持续,取决于工程优化和架构创新能否继续把成本压到极致。
四、AI的“白菜价”时代
8万亿Token,600万收入。这个数字组合揭示了一个趋势:AI正在从“奢侈品”变成“日用品” 。
当Token单价低到几乎可以忽略不计,AI的使用场景将从“偶尔调用”变成“全天候嵌入”。Agent任务的大量爆发正在印证这一点——过去问一个问题得到一段回答就结束了,现在的Agent会自己读文件、修改代码、运行程序、检查结果,一次任务可能消耗几十倍甚至几百倍的Token。
DeepSeek V4 Flash上线不到一周,使用量单日增长30%,新订阅用户同步增长30%。全球调用量排名前五全是国产大模型。这不是一家公司的胜利,而是一个产业逻辑的重写——当中国AI能以全球最低成本提供足够好的服务时,全球开发者的默认选择正在被重新定义。
当然,8万亿Token只是开始。随着Agent任务的进一步爆发,这个数字可能很快就会被刷新。到那时,我们要追问的或许不再是“一天消耗了多少Token”,而是 “这些Token创造了多少价值” 。
毕竟,流量从来不是目的,价值才是。(赵伟)

特此声明
本文为正观号作者或机构在正观新闻上传并发布,仅代表该作者或机构观点,不代表正观新闻的观点和立场,正观新闻仅提供信息发布平台。
分享至

闻览红星新媒体中心

闻览红星新媒体中心官方账号

+ 关注
查看更多文章

还没有评论,快来抢沙发吧!