8 万亿 tokens。一天。一家公司的消耗。

OpenCode 在 X 上发帖:「DeepSeek Flash did 8T tokens on August 1st. 5T of free usage + 3T on OpenCode Go.」79.8 万次浏览,连带着 #DeepSeek一天消耗了8万亿# 上了微博热搜——注意这是 OpenCode 一家的消耗。

OpenCode 是 Anomaly 出品的 AI 编程工具,套餐 10 美元/月。用户交了 10 美元,就能用 DeepSeek Flash 随便写代码,按网友说法:「怎么使劲用也用不完。」5T 来自免费额度,3T 来自 Go 订阅计划付费用户。微博用户评论称:「昨天刚买了,邀请还能获得 5 美元。」
X 上 Everlier 说:「Two years ago this would sound like a sci fi, crazy.」Ashish 更直接:「Opencode is in hurry to close Anthropic asap.」
8T tokens 这个数字意味着什么,值得展开。
先把时间线拉回两天前。7 月 31 日,DeepSeek 发布了 V4 Flash 0731。Artificial Analysis 给出的评测数据:Intelligence Index 得分 50,在 101 个模型中排第 3。排在它前面的:Claude Opus 5(61 分,$2.34/次)、Claude Fable 5(60 分)、GPT-5.6 Sol(59 分,$1.86/次)、Kimi K3(57 分,$0.86/次)、Grok 4.5(54 分,$0.69/次)。

V4 Flash 价格:$0.03/次。
Opus 5 多 11 分,贵 78 倍。GPT-5.6 Sol 多 9 分,贵 62 倍。能跟它拼价格的只有 DeepSeek 自家的 V4 Pro($0.05/次),但 Flash 智力得分也是 50,干翻了 Pro。
比 Deepseek V4 Flash 聪明的没它便宜,比它便宜的 —— 哦,没有比它便宜的。

架构没变:MoE 284B 总参数,13B 激活参数。DeepSeek 纯粹靠重新后训练把分数拉了上来。缓存命中价格 $0.003/百万 token,降了 98%。MIT 开源,权重在 Hugging Face 上。
这就是背景。V4 Flash 0731 发布后不到 48 小时,OpenCode 一家的单日消耗就冲到了 8T tokens。8T tokens 具体是什么概念?V4 Flash 的推理定价是 $0.12/百万 token 输入、$0.48/百万 token 输出。就算按混合价 $0.20/百万 token 粗略估算,8T tokens 对应的理论 API 定价是 160 万美元。当然,OpenCode 肯定拿了批发价,但量级摆在这里——一家 AI 编程工具,一天烧掉的 token 量,比大多数中小型 AI 公司一年的消耗还多。
而 OpenCode 才收用户 10 美元/月。
这背后的计算很简单。Cursor 的 Anthropic 模型成本上去了,Copilot 的 GPT-5.6 也不便宜。OpenCode 选了 DeepSeek Flash 作为底层模型,用极低推理成本做低价套餐,把 token 焦虑彻底打掉了。用户不需要看还剩多少额度,不需要纠结要不要切模型,写完代码、改 bug、重构、跑测试——全部用一套模型,不限量。
DeepSeek 这边的基本盘也很清楚。V4 Flash 的推理基础设施已经进入了「自来水」阶段——不是按滴计费,是按流量计费。8T tokens 一天,意味着平均每秒处理约 9200 万 tokens。如果 AI 编程工具市场继续增长,这个数字还会涨。OpenAI 和 Anthropic 各自有 API 生态,但如果在 AI 编程这个场景里,最便宜的模型和最贵的模型之间智力差距只有 11 分、价格差 78 倍,那么市场的选择方向已经很明确了。
国外网友总结道:「V4 Flash is my daily driver. I write code all day and it costs me a few cents. No token anxiety.」
8T tokens 之后,这句话有了更具体的注脚。
参考来源: