news 2026/8/23 19:06:59

账单涨了,不是你用多了

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
账单涨了,不是你用多了

摘要:8 月以来国内大模型集体涨价,DeepSeek V4-Pro 高峰输出价从 6 元涨到 27 元。很多人看到账单第一反应是"我是不是用多了"——其实用量没变,是单价涨了。本文拆开"账单=用量×单价"这三本账,并聊聊额度收紧后,简单任务该怎么省着花。


你月底看 AI 编程工具的账单,比上月贵了一截。第一反应多半是:这月是不是手滑用多了?

这个直觉很可能是错的。

三本账:你以为的"用多了"和真实的"涨了价"

把账单拆开看,其实是三本独立的账:

账一,厂家的标价(list price)在涨。摩根士丹利 8 月 9 日的研报《告别价格战,打响智力战》统计了字节、阿里、百度、腾讯、MiniMax、智谱、月之暗面、DeepSeek 八家的官方报价:2026 年第二季度,中国大模型平均 API 输入价已升到每百万 Token 4.9 元、输出价 21.9 元,相比 2025 年第一季度的 3.3 元和 12.2 元,分别涨了约 48% 和 80%[1]。

账二,你的用量其实没怎么变。写代码、改 bug、跑生成,节奏和上月一样。但账单的算法很简单:

账单 = 用量 × 单价

单价翻一倍,账单就翻一倍——跟你用多用少没关系。

账三,所以"账单涨=我用多了"是个错觉。你正常用,钱就多了,因为单价上去了。这不是你的问题,是定价的问题。

图:账单=用量×单价。标价上去了、用量没变、账单自然上去——错不在你。

单价涨的实锤:不是一家,是一波

先看最刺眼的一例。DeepSeek 8 月 17 日零点起启用峰谷定价,旗舰 V4-Pro 在业务高峰时段(9:00–12:00、14:00–18:00)的输出价从 6 元/百万 Token 涨到 27 元,涨幅 350%;缓存命中输入价从 0.025 元飙到 0.30 元,涨幅 1100%,平均下来约 3.5 倍[2]。它甚至引入了闲时半价、高峰翻倍的机制——直接用价格杠杆逼你错峰。

这不是孤例,是 2026 年全行业的集体涨价潮:

  • 腾讯混元核心模型部分涨幅达 463%[3];
  • 智谱年内三次上调 API 价格,一季度累计涨幅 83%,涨价后调用量不降反升[3];
  • 月之暗面 Kimi K3 输入价涨幅超 3 倍、输出价近 4 倍[3];
  • 阿里、百度的 AI 算力产品集体上调 5%–34%[3]。

海外也在动,但方向是"分层双轨":旗舰档往上走——Claude Fable 5 输出定价每百万 Token 50 美元,是同期 Opus 系列的 2 倍;GPT-5.5 输入价 5 美元,8 个月涨了约 8 倍。但入门档在反向打地板(GPT-5.6 Luna 输入砍到 0.20 美元,降 80%)。所以"海外在降"也是个错觉,真相是贵的更贵、便宜的更便宜。

为什么涨?不是厂家变贪

根因就一个字:缺。

DeepSeek 今年 5 月连续崩溃,直接原因是用户量暴涨 66.7% 而算力储备只增长 8.3%,供需严重失衡[2]。中国日均 Token 调用量已突破 140 万亿,较两年前增长超 1000 倍[3]——需求是真旺,算力是真不够。

更深一层是商业模式的换轨:从"租机器"的 IaaS,转向"按 Token 结算"的 MaaS。计价尺度从"卡时"变成"任务成功率",厂家开始为能力(而非便宜)收溢价。这就是为什么它敢涨——你不是为了便宜的 token 付费,是为了"这活它能不能干成"付费。

一个很多人不愿明说的现实

我赌,还有不少公司压根没给员工配 token 额度

走企业采购、统一结算的团队,涨价是财务部门的事,个人体感弱。但大量个人开发者、小团队、没走集采的项目组,用的是自己的账号、自己的钱包。这部分人对涨价的敏感度最高——因为每一分钱都从自己腰包或项目组小账上出。

也正是这部分人,最容易在涨价后产生那个幻觉。

幻觉:你以为消耗变多了,其实只是涨价了

涨价之后,明明还是照常写代码、照常让 AI 改 bug,却"明显感觉 token 消耗变多了"。

把这两句话分开看:

  • 感觉消耗变多了”——是真的,因为同样的对话、同样的代码生成,这月比上月花得多;
  • 真的消耗变多了”——未必。你的用量可能一点没变,是单价把同样的消耗标了更高的价。

这是个会计错觉:你盯的是"这次生成花了多少",但分母(单价)已经被悄悄改写了。你没多用,是世界变贵了。

没有富余额度时,简单任务切"文档模式"

那额度紧了怎么办?我的建议是:对简单任务,把 AI 从"执行者"退回"参谋",我管这叫文档模式

现在多数人的习惯,是把整个 agent loop 全交给 AI——它自己读代码、改、跑测试、迭代、最后提交。每一步都烧 token,一次"帮我把这个改动提交一下",背后可能是几万 token 的上下文搬运。

文档模式反过来:让 AI 只产出一份文字方案——一段说明、一个伪 diff、一份步骤清单——然后你本人去编辑器里手改、自己跑测试、自己提交。AI 只"想"不"干",token 消耗从"全程托管"降到"一次性咨询",往往能砍掉一大半。

哪些活适合这么干:

  • 让 AI提交一次代码(写 commit message、git add、git push 全包)——这种事你十秒就能做;
  • 改一个简单 bug(明显的空指针、拼错变量名、漏了个 import);
  • 加一个小函数、补一段样板代码

这类任务你闭眼都能搞定,让 agent 全跑一遍纯属浪费额度。

代价要说清:文档模式省的是 token,占的是你自己的时间,也考验你自己的工程能力。真遇到复杂重构、跨文件改动、你不熟的领域,该交给 agent 还是交给 agent——这时候省下的时间远大于多花的 token。别把简单活硬扛,也别把重活硬省。

收尾:涨价不是末日,是把"无脑托管"的成本逼出来了

三件套对冲:

  1. 本地模型跑日常:我本机 Ollama 跑 qwen2.5-coder:14b/32b,API 涨价跟我半毛钱关系没有,数据还不出口;
  2. 云端走模型路由:轻任务走便宜档,重任务才上旗舰,别一刀切;
  3. 简单任务切文档模式:AI 出文档,你手搓修复、自己跑测试。

涨价潮不会停。但换个角度,它逼着我们把"反正有额度、随便造"的心态收回来——哪些活该 AI 干,哪些活该自己干,本来就该算清楚。


参考资料

[1] 摩根士丹利《告别价格战,打响智力战》(2026-08-09),转引自新浪财经:https://finance.sina.cn/2026-08-13/detail-inineuqm9874550.d.html
[2] DeepSeek API 8 月 17 日起峰谷调价,V4-Pro 高峰输出 27 元/百万 Token,转引自界面新闻/网易科技:https://www.163.com/dy/article/L4IAUQU305118O92.html
[3] 2026 年国产大模型集体涨价潮(腾讯混元 +463%、智谱 +83%、Kimi K3 输入输出近 4 倍、阿里百度 5%–34%),综合自钛媒体、凤凰网:https://www.tmtpost.com/7983681.html 、https://i.ifeng.com/c/8s4tFiQWD8n

作者:唐悦玮 | 从后端出发,用 AI 拓展到全栈的工程师。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/23 19:04:58

Codex 百万上下文怎么开?分享一下 8.17 更新后的配置方法

我今天看到 8 月 17 日关于 Codex 的一个更新:除了 API Key 的使用方式之外,通过 ChatGPT 账号登录 Codex 的用户,也可以使用百万级上下文了。刚好我平时也在用 Codex,所以研究了一下怎么配置,方法其实非常简单&#x…

作者头像 李华
网站建设 2026/8/23 19:01:09

自己动手写Agent Harness【hooks】:生命周期钩子实现

写在前面:系列是为了帮助大家更好的去理解Agent Harness基础设施,并不是想重复造轮子,真实开发建议选择一个成熟的SDK或Harness框架,才是最合适的选择~ 1. 引言:skill 和 rule 都不是强制层,底线靠谁 上一篇…

作者头像 李华
网站建设 2026/8/23 18:58:42

SpringBoot+Vue毕业生招聘平台开发实践

1. 项目概述 1.1 系统背景与意义 作为一名长期从事Java全栈开发的工程师,我最近完成了一个基于SpringBoot的毕业生信息招聘平台项目。这个系统的开发源于当前高校毕业生就业过程中存在的信息不对称问题。传统的校园招聘往往受限于时间和空间,而各类招聘…

作者头像 李华
网站建设 2026/8/23 18:58:04

嵌入式开发中IAR链接文件(.icf)配置详解与内存布局实战

1. 项目概述:链接文件,嵌入式开发的“城市规划图”如果你用IAR Embedded Workbench开发过ARM Cortex-M芯片,那你一定在工程里见过那个后缀为.icf的文件。很多新手第一次看到它,会直接忽略,或者从别的工程里复制一个过来…

作者头像 李华
网站建设 2026/8/23 18:50:35

机器学习实战:从数据工程到模型部署的完整工程化指南

1. 从“知道”到“做到”:为什么你的机器学习项目总在起点徘徊?我们可能都经历过这样的场景:在Coursera或者B站上刷完了吴恩达的《机器学习》课程,对梯度下降、逻辑回归、支持向量机这些名词如数家珍,甚至能在白板上推…

作者头像 李华