摘要:8 月以来国内大模型集体涨价,DeepSeek V4-Pro 高峰输出价从 6 元涨到 27 元。很多人看到账单第一反应是"我是不是用多了"——其实用量没变,是单价涨了。本文拆开"账单=用量×单价"这三本账,并聊聊额度收紧后,简单任务该怎么省着花。
你月底看 AI 编程工具的账单,比上月贵了一截。第一反应多半是:这月是不是手滑用多了?
这个直觉很可能是错的。
三本账:你以为的"用多了"和真实的"涨了价"
把账单拆开看,其实是三本独立的账:
账一,厂家的标价(list price)在涨。摩根士丹利 8 月 9 日的研报《告别价格战,打响智力战》统计了字节、阿里、百度、腾讯、MiniMax、智谱、月之暗面、DeepSeek 八家的官方报价:2026 年第二季度,中国大模型平均 API 输入价已升到每百万 Token 4.9 元、输出价 21.9 元,相比 2025 年第一季度的 3.3 元和 12.2 元,分别涨了约 48% 和 80%[1]。
账二,你的用量其实没怎么变。写代码、改 bug、跑生成,节奏和上月一样。但账单的算法很简单:
账单 = 用量 × 单价单价翻一倍,账单就翻一倍——跟你用多用少没关系。
账三,所以"账单涨=我用多了"是个错觉。你正常用,钱就多了,因为单价上去了。这不是你的问题,是定价的问题。
图:账单=用量×单价。标价上去了、用量没变、账单自然上去——错不在你。
单价涨的实锤:不是一家,是一波
先看最刺眼的一例。DeepSeek 8 月 17 日零点起启用峰谷定价,旗舰 V4-Pro 在业务高峰时段(9:00–12:00、14:00–18:00)的输出价从 6 元/百万 Token 涨到 27 元,涨幅 350%;缓存命中输入价从 0.025 元飙到 0.30 元,涨幅 1100%,平均下来约 3.5 倍[2]。它甚至引入了闲时半价、高峰翻倍的机制——直接用价格杠杆逼你错峰。
这不是孤例,是 2026 年全行业的集体涨价潮:
- 腾讯混元核心模型部分涨幅达 463%[3];
- 智谱年内三次上调 API 价格,一季度累计涨幅 83%,涨价后调用量不降反升[3];
- 月之暗面 Kimi K3 输入价涨幅超 3 倍、输出价近 4 倍[3];
- 阿里、百度的 AI 算力产品集体上调 5%–34%[3]。
海外也在动,但方向是"分层双轨":旗舰档往上走——Claude Fable 5 输出定价每百万 Token 50 美元,是同期 Opus 系列的 2 倍;GPT-5.5 输入价 5 美元,8 个月涨了约 8 倍。但入门档在反向打地板(GPT-5.6 Luna 输入砍到 0.20 美元,降 80%)。所以"海外在降"也是个错觉,真相是贵的更贵、便宜的更便宜。
为什么涨?不是厂家变贪
根因就一个字:缺。
DeepSeek 今年 5 月连续崩溃,直接原因是用户量暴涨 66.7% 而算力储备只增长 8.3%,供需严重失衡[2]。中国日均 Token 调用量已突破 140 万亿,较两年前增长超 1000 倍[3]——需求是真旺,算力是真不够。
更深一层是商业模式的换轨:从"租机器"的 IaaS,转向"按 Token 结算"的 MaaS。计价尺度从"卡时"变成"任务成功率",厂家开始为能力(而非便宜)收溢价。这就是为什么它敢涨——你不是为了便宜的 token 付费,是为了"这活它能不能干成"付费。
一个很多人不愿明说的现实
我赌,还有不少公司压根没给员工配 token 额度。
走企业采购、统一结算的团队,涨价是财务部门的事,个人体感弱。但大量个人开发者、小团队、没走集采的项目组,用的是自己的账号、自己的钱包。这部分人对涨价的敏感度最高——因为每一分钱都从自己腰包或项目组小账上出。
也正是这部分人,最容易在涨价后产生那个幻觉。
幻觉:你以为消耗变多了,其实只是涨价了
涨价之后,明明还是照常写代码、照常让 AI 改 bug,却"明显感觉 token 消耗变多了"。
把这两句话分开看:
- “感觉消耗变多了”——是真的,因为同样的对话、同样的代码生成,这月比上月花得多;
- “真的消耗变多了”——未必。你的用量可能一点没变,是单价把同样的消耗标了更高的价。
这是个会计错觉:你盯的是"这次生成花了多少",但分母(单价)已经被悄悄改写了。你没多用,是世界变贵了。
没有富余额度时,简单任务切"文档模式"
那额度紧了怎么办?我的建议是:对简单任务,把 AI 从"执行者"退回"参谋",我管这叫文档模式。
现在多数人的习惯,是把整个 agent loop 全交给 AI——它自己读代码、改、跑测试、迭代、最后提交。每一步都烧 token,一次"帮我把这个改动提交一下",背后可能是几万 token 的上下文搬运。
文档模式反过来:让 AI 只产出一份文字方案——一段说明、一个伪 diff、一份步骤清单——然后你本人去编辑器里手改、自己跑测试、自己提交。AI 只"想"不"干",token 消耗从"全程托管"降到"一次性咨询",往往能砍掉一大半。
哪些活适合这么干:
- 让 AI提交一次代码(写 commit message、git add、git push 全包)——这种事你十秒就能做;
- 改一个简单 bug(明显的空指针、拼错变量名、漏了个 import);
- 加一个小函数、补一段样板代码。
这类任务你闭眼都能搞定,让 agent 全跑一遍纯属浪费额度。
代价要说清:文档模式省的是 token,占的是你自己的时间,也考验你自己的工程能力。真遇到复杂重构、跨文件改动、你不熟的领域,该交给 agent 还是交给 agent——这时候省下的时间远大于多花的 token。别把简单活硬扛,也别把重活硬省。
收尾:涨价不是末日,是把"无脑托管"的成本逼出来了
三件套对冲:
- 本地模型跑日常:我本机 Ollama 跑 qwen2.5-coder:14b/32b,API 涨价跟我半毛钱关系没有,数据还不出口;
- 云端走模型路由:轻任务走便宜档,重任务才上旗舰,别一刀切;
- 简单任务切文档模式:AI 出文档,你手搓修复、自己跑测试。
涨价潮不会停。但换个角度,它逼着我们把"反正有额度、随便造"的心态收回来——哪些活该 AI 干,哪些活该自己干,本来就该算清楚。
参考资料
[1] 摩根士丹利《告别价格战,打响智力战》(2026-08-09),转引自新浪财经:https://finance.sina.cn/2026-08-13/detail-inineuqm9874550.d.html
[2] DeepSeek API 8 月 17 日起峰谷调价,V4-Pro 高峰输出 27 元/百万 Token,转引自界面新闻/网易科技:https://www.163.com/dy/article/L4IAUQU305118O92.html
[3] 2026 年国产大模型集体涨价潮(腾讯混元 +463%、智谱 +83%、Kimi K3 输入输出近 4 倍、阿里百度 5%–34%),综合自钛媒体、凤凰网:https://www.tmtpost.com/7983681.html 、https://i.ifeng.com/c/8s4tFiQWD8n
作者:唐悦玮 | 从后端出发,用 AI 拓展到全栈的工程师。