千问2.4T权重兑现、DeepSeek涨500%、OpenAI按下GPT-6暂停键 —— AI软件简报 08.08-08.12
每期覆盖 3-4 天的 AI 软件动态。个人视角,不追求面面俱到。周三、日更新。
这四天(8.8-8.12),AI 软件圈把一周前的传闻全部变成了官宣。阿里把 2.4T 的 Qwen3.8-Max 权重挂上了 Hugging Face;DeepSeek 给出了具体的涨价数字——输出 token 峰值涨到 27 元/M,涨幅 500%;OpenAI 干脆把 GPT-6(Astra)按下了暂停键,理由是网络攻击能力摸到了自家安全框架的"危险线"。三件事各说各话,但指向同一个结论:模型稀缺的时代结束了,安全、成本和交付能力开始定价。
价格屠夫,自己报了个吓人的价
8 月 13 日,DeepSeek 官宣 V4 Pro 正式版,同时宣布 8 月 17 日起 API 全面调价。输出 token 峰时从 6 元涨到 27 元(+350%);谷时缓存命中输入从 0.025 元涨到 0.15 元,涨幅 500%。[B]
我原以为涨价会有个渐进的过程,结果一步到位。
反常的是,这次涨价恰恰发生在它供不应求的时候。V4-Flash 在 OpenRouter 首周跑出 7.22 万亿 token,单日 8 万亿。需求涨 417%、供给只涨 128%,算力账单把"价格屠夫"顶到了墙角。
涨价最狠的档位是缓存命中输入——整个价格表里最低的一档,也是开发者入门顺手就用的一档。DeepSeek 不是简单抬价,是把引流入口收了。
注意一个细节:涨价前一周,Anthropic 反手把 Sonnet 5 锁在 $2/$10。中美两边的定价逻辑第一次如此对称——中国厂商开始算账,美国厂商在锁价抢企业订单。
千问 2.4T 的权重,终于来了
Qwen3.8-Max 以 Qwen3.8-2.4T-A95B 的名字,在 8 月 12-13 日凌晨同时上了 Hugging Face 和 ModelScope。2.4T 总参数、95B 激活、262K 上下文,千问头一次开放可下载的 Max 级旗舰。[B]
但真正值得读的,是那张许可证。
不是 Apache 2.0,也不是 MIT,是一份自定义的 Qwen3.8-Max License:月活过 1 亿或月收入过 $20M 的商业产品,必须显著展示模型名;做 MaaS 或 AI 工作助手、年收入过 $50M 的公司,要单独找阿里拿授权。我判断,这份许可比权重本身更有信息量——阿里要的是"开放生态里的控制权",不是把旗舰白送出去。
对照一下:Kimi K3 用分层商业许可,DeepSeek V4 用 MIT,Qwen3.8-Max 用自定义许可。三家的"开源"定义已经分化。开源从"能不能拿到"变成"拿到了能做什么"。
随行的 Qwen3.8-27B 还没发。4.9TB 的完整权重也不是普通开发者能跑的,Unsloth 用 1-bit 量化压到 397GB 才勉强本地可跑。权重兑现了,兑现带来的基础设施问题才刚开始。
OpenAI 把 GPT-6 按下了暂停键
8 月 7-10 日,OpenAI 暂停了代号 Astra(外界叫 GPT-6)的部分开发。内部评估"无法排除"它达到 Preparedness Framework 的最高风险等级 Critical——也就是能自主发现并利用针对真实系统的零日漏洞。[B]
这是头一个公开触发该级别的前沿模型。此前的 GPT-5.6-Sol 只是 High。
OpenAI 的做法是隔离环境、加密权重、全链路监控,把安全测试交给政府机构联合做。Altman 说"需要更多时间安全地推给大众",没给日期。传闻说 GPT-6 有 10T 参数。
有意思的对照:OpenAI 一边冻结 Astra,一边在 8 月 10 日前后发布 GPT-5.6-Cyber——一个专门训练来找零日漏洞的模型,评级是 High。冻结不是因为"能力太强不能用",而是"强过了自家安全框架的线"。这个分寸,比"AI 该不该发展"的争论更值得品。
GitHub 承认打输了,转身做平台
Nadella 在播客里亲口承认:GitHub Copilot 在编程助手市场的份额,一年内从近 100% 跌到 25%。[C]
他辩解说市场从 $5 亿涨到 $5-60 亿,“扩张比份额重要”。
但动作比表态诚实:GitHub 在 Universe 上发布 Agent HQ——把 GitHub 做成所有编码 Agent 的开放平台,连 OpenAI Codex 和 Anthropic Claude Code 都可以直接接入。1.8 亿开发者,所有竞品生成的仓库最后都落在 GitHub。
我赌这个转变是对的:单点助手打不过 Claude Code,就去做所有助手的底座。Claude Code 7 月签了 940 万条 commit,约是 Cursor Agent 的 20 倍——在这个数字面前,任何"再做一个更强助手"的策略都是给对手当分母。GitHub 选择了另一条路:谁都别跑,把路修好收过路费。
一句话速览
- Grok 4.6 发布:1.5T 参数,AAII 61 追平 GPT-5.6 Sol,定价 $2/$6 直接减半;xAI 内部动荡,Mistral 联创入职一个月离职。
- Google 新帅 Koray Kavukcuoglu 正式接掌 DeepMind,上任要接的摊子是又跳票一次的 Gemini 3.5 Pro。
- Lovable 融 $4 亿 C 轮、估值 $13.3B,腾讯和欧盟 €50 亿基金都进了——"AI 造应用"成了资本共识。
- CodeRabbit 融 $1.43 亿 A 轮、估值 $15 亿,AI 代码审查赛道出现独角兽。
- Meta 拒签欧盟 AI 治理准则,Llama 4 许可干脆排除欧盟居民——开源模型在三套监管里地位完全不同。
- arXiv 一篇论文用差分测试找出 307 个"技能诱发故障"——Agent Skills 热潮有了头一份负面报告。
本周趋势
上图:本周四条主线——DeepSeek 涨价落地、千问权重兑现、GPT-6 安全冻结、GitHub 平台化。
四条线其实是同一条:AI 软件的可竞争资源,从"谁参数多"换成了"谁能安全地交付"。DeepSeek 涨价是成本定价,OpenAI 冻结是安全定价,GitHub 做平台是分发定价,千问的开源许可则是控制权定价。模型本身在贬值,围绕模型的每一层都在重新定价。
我的判断
下周盯四件事:Qwen3.8-27B 何时放出、DeepSeek 涨价后流量迁去哪、Astra 会不会在 8 月硬上、GitHub Agent HQ 首批接入名单。DeepSeek 的 500% 会先考验"超廉价时代"的韧性——如果涨价后流量不降反升,说明托管稀缺性已经压过价格敏感度,那"低价换份额"这个故事就该改写。这一点数据不够,先不下结论,但值得赌一次。
参考来源
- DeepSeek发布API调价公告 新价格8月17日生效(21世纪经济报道)
- DeepSeek V4 Pro正式版API完成更新 定价显著高于V4-Flash(央广网)
- Qwen3.8-Max Open Weights(llm-stats)
- OpenAI slows Astra over critical cyber risk(The Next Web)
- Nadella on ‘Claude is going to kill Microsoft’(Times of India)
- Lovable Raises $400M Series C at $13.3B(Finsmes)
AI 辅助调研,人工视角解读。每周三、日更新。