手机流量已经能买到 1 块钱 1G。本文只问一件事:Token 什么时候也能 1 块钱 1G。
中间夹一个观点:剂量单位别写 1B,改成 1G。因为 1B 没感觉,1G 能对上流量。
先把 Token 单位从 B 换成 G。
G 就是话费单上的 G。国外报价爱写 1B,B 是 billion,10 亿。1G 也是 10 亿:1G = 1000M,1B 也是 1000M。量一样。1B 大家没感觉,1G 十亿立刻能对上流量。所以下面全部用元/G。
Token 可以想成一小截字。OpenAI 写过:英文大约 4 个字母算 1 截。按这个算法,1G 字大约 2.5 亿截。中文会差一点,只差倍数,不差成百上千倍。
流量十年掉到 1 块

国内手机流量,单位:元/G
• 2014 年一百多块 1G。
• 2015 年起提速降费,2018 年取消漫游,均价掉到 8 块出头。
• 2023 年按工信部收入和流量粗算,大约 2 块。
• 现在大流量包能买到 1 块。
人多用、网铺开、上面按着降。Token 要走同一条路,也得靠规模和硬件把成本摊薄。
Token 今天 1G 多少钱

同一把尺子。绿线是流量的 1 元/G
• 重复送过的字(缓存):最便宜大约 12 块 1G。
• 你新发给它的字:便宜的大约 370 块,Gemini 3.8 大约 1260 块。
• 它写回来的字:大约一千到六千块。
• 对照:2020 年 GPT-3 大约十万块 1G。六年已经掉了两三个数量级。
预测:什么时候 1 块 1G
不能报一个总年份。要拆开:重复的字、新读的字、写出来的字,贵的不是同一种东西。
市场这边,DeepSeek 在打价格,Google 刚发的 3.8 是价不涨、能力涨。后面还会打。但实验室主要靠「写出来的字」赚钱,这一档会故意留着。
硬件这边,推理卡在显存带宽,不卡在广告上的算力数字。HBM 贵,电也是地板。有人按 70B 级显卡功耗粗算,光电费折到 1G,还可能上百块。芯片一年一茬、专用推理芯片、一次只激活一部分参数,才会把地板往下砸。
• 缓存:已经 12 块。这更像读内存,不太吃电。预测 2027 到 2028 年,重复用量能看到 1 块 1G。
• 新输入、便宜模型:现在大约 370 块。按近几年便宜档一年掉一半到三分之二估,2028 到 2030 年有机会碰到 1 块。如果 HBM 和电费钉死,也可能停在几块到几十块。
• 新输入、Gemini 3.8 这种干活模型:现在大约 1260 块。同样算法,2030 年前后才摸得到 1 块;更可能先停在「几块到几十块 1G」。
• 写出来的字:最吃显存和电。小模型也许 2028 年前后接近。Gemini 3.8 这种,2030 年前很难到 1 块,甚至到不了——除非本地小模型把这一档先打穿。
一句话:1 块钱 1G,会先出现在「同样的字再送一次」的账单上,大概两三年内。每次新算、尤其是它写出来的字,要看到五年左右,还得硬件配合。
一个观点:剂量单位从 B 改成 G
这只是观点,不是预测本身。大模型用量别再写 1B token。改成 1G。剂量和流量对齐,普通人一眼知道贵还是便宜。
流量数字来自工信部。换算来自 OpenAI 帮助中心。报价来自 Google、DeepSeek 官网。硬件判断来自公开的显存带宽和电费讨论,不是实验室内部账。2026-09-03。