news 2026/10/5 8:37:31

GPT-6.1 Astra定档下周?Kimi K4宣战?Fable 5.5内测作品流出!Nano Banana 2.5现身! | 10月4日 AI日报

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
GPT-6.1 Astra定档下周?Kimi K4宣战?Fable 5.5内测作品流出!Nano Banana 2.5现身! | 10月4日 AI日报

🎬视频版直达:https://www.bilibili.com/video/av117380248441259/

💡今日趋势速览:Tibo确认OpenAI下周发布GPT-6.1 Astra,发布计划提前六个月;月之暗面随即筹备Kimi K4,目标超越GPT-6 Astra;Fable 5.5内测视频流出,谷歌Nano Banana 2.5变体现身Arena,顶尖模型神仙打架,AI竞赛再度提速。

🎯 今日要点

  1. 传 GPT-6.1 Astra 下周发布:Tibo 确认新版本将至
  2. 泄露称月之暗面筹备 Kimi K4:目标超越 GPT-6 Astra
  3. Fable 5.5 内测视频作品集中流出

📋 今日内容汇总

🤖 AI动态

  1. 传 GPT-6.1 Astra 下周发布:Tibo 确认新版本将至
  2. 泄露称月之暗面筹备 Kimi K4:目标超越 GPT-6 Astra
  3. Fable 5.5 内测视频作品集中流出
  4. Nano Banana 2.5 变体 resplendent flash 现身
  5. 阿里通义千问新模型 qwen-image-2.1-pro 被检测到
  6. MiMo-V2.6-Pro-RL 出现无审查修改版
  7. Antigravity 为全部付费用户接入 Claude Opus 5.5
  8. Gemini 免费用户 10 月 9 日起默认改用 Flash-Lite
  9. AI2 开源 Olmo-core 模块化大模型训练库
  10. OpenAI 的 dot 会学习工作方式并协调 Codex 任务
  11. 亚马逊推出 Strands Decider 2B 开源决策模型,支持本地部署
  12. Aleph Alpha 开源德英双语混合专家模型 Kolibri-1
  13. OpenClaw v2026.9.8 发布:支持 GPT-6.1 Sol
  14. OpenAI 发布 GPT-6 系列模型选用指南
  15. SpaceXAI 发布实验性 TypeScript SDK 接入 Grok
  16. openJiuwen X-Router 自演进模型路由首发 昇腾亲和
  17. vLLM 语义路由器 Decision 2.0 发布
  18. llama.cpp 新增决策模型 systemone 端点
  19. manus 回归:发布 2.0 与个人智能体 cue
  20. 微信支付推出 AI 卡:为腾讯系外 Agent 提供支付通道

🧪 芯片半导体

  1. AMD 公布 EPYC 9006 处理器完整规格与定价

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. 传 GPT-6.1 Astra 下周发布:Tibo 确认新版本将至

知名爆料者Tibo确认OpenAI下周将发布新版本,具体内容仍保密,Codex社区预期为GPT-6.1 Astra。此前他称,尚未全面开放的Astra是最大竞争优势,生产力大幅提升,发布计划因此提前了六个月。

🔗 https://x.com/Codexresets_/status/2106334302728225110


2. 泄露称月之暗面筹备 Kimi K4:目标超越 GPT-6 Astra

泄露消息称月之暗面正筹备 Kimi K4,目标击败 GPT-6 Astra 与 Fable 5.1,为此寻求更多 Blackwell GPU。现役 K3 参数量 2.8 万亿,为最大开放权重模型;白宫曾指控其经泰国获取芯片,K4 规格未公布。

🔗 https://x.com/0x0SojalSec/status/2106432922932977813


3. Fable 5.5 内测视频作品集中流出

Fable 5.5 内测作品集中流出:有网友整理 33 个高播放视频合集,含一句话生成带配乐动画、与 Opus 5.5 同题对比及可玩小游戏;另有逐帧生成的迈克尔·杰克逊视频。模型归属以作者自述为准,官方未确认。以下是官方给出的 demo

🔗 https://x.com/0x0SojalSec/status/2106439886652019001


4. Nano Banana 2.5 变体 resplendent flash 现身

来源:原文 | Chetaslua (Twitter)

谷歌图像模型变体以代号 resplendent flash 现身 Arena,被称图像质量与准确性随时领先对手;测试者用长提示词实测多文字一致性稳定。此前 GEMPIX 2.5 Flash 字符串已现身,此次被视为走向公开可测。

🔗 https://x.com/abhinavflac/status/2106241851804328202


5. 阿里通义千问新模型 qwen-image-2.1-pro 被检测到

追踪账号在阿里 Model Studio 模型目录中检测到新模型 qwen-image-2.1-pro,开发方为阿里通义千问(Alibaba Qwen)。目前这只是目录层面的发现,官方尚未发布公告,该模型的能力细节与开放时间均有待确认。

🔗 https://x.com/aitrackerbot/status/2106262388920013154


6. MiMo-V2.6-Pro-RL 出现无审查修改版

开发者放出 MiMo-V2.6-Pro-RL 的无审查版,在权重层面移除了拒绝回答行为。版本保留 42B 激活参数,视觉、音频和视频能力完好;MMLU 成绩与基础模型相差不到一分,保留 DFlash 头,思考模式可开可关,关闭时 HarmBench 合规率达 94%,知识能力几乎未降。

🔗 https://x.com/0x0SojalSec/status/2106138226956341525


7. Antigravity 为全部付费用户接入 Claude Opus 5.5

来源:原文 | Claudeupdates11

有用户注意到,Antigravity 已为所有付费用户添加 Claude Opus 5.5 和 Sonnet 5.5。团队回应称,希望确保人们能够使用最优秀的尖端模型,并对 Gemini 4 Argon 的更广泛推出感到期待。两款 Claude 新模型现已面向全体付费用户开放。

🔗 https://x.com/_mohansolo/status/2106432039817998463


8. Gemini 免费用户 10 月 9 日起默认改用 Flash-Lite

来源:原文 | 小鹏Digital (Apple/Tech) (Twitter)

接上条新闻,Google 宣布自 10 月 9 日起调整 Gemini 模型策略:免费个人用户不再默认使用 Flash 或 Pro 模型,统一换用更轻量的 Flash-Lite;AI Plus 订阅用户也将失去 Pro 模型的访问权限,具体生效时间将通过邮件另行通知。

🔗 https://x.com/RocM301/status/2106295533732294857


9. AI2 开源 Olmo-core 模块化大模型训练库

AI2 开源为 OLMo 系列打造的模块化底层训练库 Olmo-core,集成官方全流程训练与退火脚本,即插即用,既兼容主流加速组件与低显存优化技术,也打通主流开源推理框架。开发者可直接基于成熟架构复现前沿大模型,无需从零搭建分布式基础设施。

🔗 https://x.com/Gorden_Sun/status/2106385174783266941


10. OpenAI 的 dot 会学习工作方式并协调 Codex 任务

OpenAI Developers 发文介绍 dot 的能力:它会学习用户的工作方式,跨应用保留上下文,自动协调 Codex 任务,并把需要用户关注的内容标记出来。开发者 dominik kundel 分享称,dot 配合 Codex 使用效果非常好,已成为他最喜欢的 Codex 使用方式,主动性简直是救星。

🔗 https://x.com/OpenAIDevs/status/2106152299026661641


11. 亚马逊推出 Strands Decider 2B 开源决策模型,支持本地部署

亚马逊 Strands Agents 团队宣布推出 Strands Decider 2B 决策模型,代码已在 GitHub 开源。该模型基于预训练的 Qwen3.5-2B 躯干构建。性能方面,它在 JevBench 公开数据集上排名 2B 级别第三。在本地常见硬件上,其决策时延中位数为 113ms,RTX 3090 上小型决策任务中位数时延约 153ms。

🔗 https://www.ithome.com/1/009/509.htm


12. Aleph Alpha 开源德英双语混合专家模型 Kolibri-1

来源:原文 | TestingCatalog (Twitter)

Aleph Alpha 开源德英双语混合专家模型 Kolibri-1:总参数 78B、激活仅 3B,上下文 260K;官方称其为欧洲主权 LLM 新作,评测略低于 Qwen3.8-27B,发布后在 Hacker News 引发热议,被视为欧洲自主大模型尝试。

🔗 https://x.com/Gorden_Sun/status/2106375183263256614


13. OpenClaw v2026.9.8 发布:支持 GPT-6.1 Sol

开源项目 OpenClaw 发布 v2026.9.8 版本,官方将其形容为一只趣味尺寸的龙虾。新版本支持 GPT-6.1 Sol,智能体回复可回传送达,内存占用更低,并修复了更新与 Windows 启动相关的问题。本次发布共合并 43 个 PR,由 8 位贡献者参与完成。

🔗 https://x.com/openclaw/status/2106247624634531889


14. OpenAI 发布 GPT-6 系列模型选用指南

OpenAI 10月2日发布GPT-6系列模型选用指南,不发新模型,而是教用户按工作负载选型,别默认用最强模型:Astra负责最难推理,Sol处理复杂编程,Luna承担批量重复任务。定价印证这一分工:Luna每百万输入0.1美元,Astra高达10美元,相差两个数量级,用Astra干Luna的活纯属烧钱。

🔗 https://x.com/wlzh/status/2106302515562397969


15. SpaceXAI 发布实验性 TypeScript SDK 接入 Grok

SpaceXAI 发布实验性 TypeScript SDK,一个 SDK 即可调用 Grok 的文本、语音、图像和视频模型,并内置实时 X 搜索、网页搜索、代码执行和远程 MCP 等工具。对正在使用 Grok 模型的开发者来说,这将明显简化多模态 AI 智能体的构建流程。以下是官方给出的 demo

🔗 https://x.com/ai_for_success/status/2106201007567118434


16. openJiuwen X-Router 自演进模型路由首发 昇腾亲和

openJiuwen首发X-Router自演进模型路由技术,昇腾亲和,实测减少50%以上Token消耗。之所以受关注,是因为并非所有任务都需要最强模型,AI助手常过度调用高成本大模型。而这套路由让每次请求智能匹配最适配模型,并持续优化选择,动态调度正成为Agent提效降本的核心路径。

🔗 https://hub.baai.ac.cn/view/58435


17. vLLM 语义路由器 Decision 2.0 发布

vLLM 项目发布语义路由器 Decision 2.0,开放模型覆盖 0.6B 到 27B。新版本一次前向传播即可回答关于单个请求的 64 个问题。模型采用 Apache-2.0 许可证,可通过 Transformers 加载,vLLM 团队致谢了 Xunzhuo 及其团队。

🔗 https://x.com/vllm_project/status/2106193438098256191


18. llama.cpp 新增决策模型 systemone 端点

llama.cpp server 新增决策模型支持,经 v1/systemone 端点提供服务,沿用 TypeSafe Jev 引入的 System One 格式。开发者发送状态与问题后,模型单次前向传播返回各选项概率,问题分 choice、score、noul 三类。

🔗 https://github.com/ggml-org/llama.cpp/pull/29818


19. manus 回归:发布 2.0 与个人智能体 cue

manus 团队宣布回归,发布 manus 2.0 并推出个人智能体应用 cue,对标 muse 和 dots。cue 拥有独立邮箱、电话、钱包和电脑,可接听电话并留下摘要,在用户预算内付款,支持多智能体在群聊协作,还能代为订餐排队。cue 早期体验阶段免费,需邀请码开通。

🔗 https://x.com/notjazii/status/2106349770696708125


20. 微信支付推出 AI 卡:为腾讯系外 Agent 提供支付通道

微信支付为腾讯体系外的 AI Agent 构建支付通道:AI 卡为独立充值余额账户,Agent 可消费、每笔需用户确认;开发者指南列出 OpenClaw 与 DeepSeek Harness 为可安装插件的外部 Agent。

🔗 https://x.com/poezhao0605/status/2106230258848367069


🧪 芯片半导体

21. AMD 公布 EPYC 9006 处理器完整规格与定价

AMD公布代号Venice的EPYC 9006系列完整规格与定价,最高256核心,顶配14904美元。该系列分SP7与SP8插座共31款,最低8核心售价700美元。SP7为高端共9款,支持16通道内存,功耗600瓦,四季度出货;SP8共22款。另有代号Verano的AI主机节点专用型号,预计2027年下半年出货。

🔗 https://news.mydrivers.com/1/1155/1155277.htm


📌 模型排行榜

22. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,智力榜头部由Anthropic系领跑:Claude Opus 5.5以58分居首,Claude Sonnet 5.5以56分次席,Claude Fable 5.1以53分第三。开源/国产方面,MiMo-V2.6-Pro位列第10名(46分),挤进前十实属不易。

🔗 https://artificialanalysis.ai/

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/10/5 8:36:51

YOLOv7打电话检测实战:数据集构建、模型训练与部署避坑指南

简介:一套面向YOLOv7目标检测实战的打电话行为识别资源包,适合刚接触PyTorch的算法学习者,以及需要快速落地驾驶舱、工位等场景打电话检测原型的开发者。资源将日常打电话动作整理为带标注的数据集,每张图片对应txt和xml两种标签格…

作者头像 李华
网站建设 2026/10/5 8:36:46

Java后端+n8n工作流:驯服Agent幻觉,Token消耗直降80%

1. 当 Java 后端遇上会"编故事"的 Agent,问题到底出在哪先说一个我亲身经历的场景。去年底我们团队做一个智能客服中台,Java 后端负责业务编排,前端接了一个基于大模型的 Agent 来做意图理解和多轮对话。上线第一周就炸了&#xff…

作者头像 李华
网站建设 2026/10/5 8:36:20

基于条件GAN的文字图像修复实战指南

简介:本资源是一套基于生成对抗网络(GAN)实现复杂背景文字图像修复的完整Python开源项目,面向计算机视觉方向的中级开发者与深度学习实践者,解决真实场景中遮挡、模糊或缺失文字区域的高保真重建问题,适用于…

作者头像 李华
网站建设 2026/10/5 8:35:20

Python网络入侵检测与防御系统实战:Scapy抓包与Flask可视化

简介:面向毕业设计与课程设计的网络入侵检测与防御项目,以Python为基底,整合实时流量分析、攻击检测、自动防御与可视化监控,适合网络安全方向学生快速搭建课设原型,也可作为毕设演示系统二次开发。资源共38个文件&…

作者头像 李华
网站建设 2026/10/5 8:32:46

OpenFOAM多孔介质建模:从Darcy-Forchheimer原理到fvOptions实战

1. 项目概述:为什么多孔介质建模是OpenFOAM里绕不开的硬核课题OpenFOAM里的多孔介质模型(porous media)不是个可有可无的插件,而是处理真实工业流体问题时几乎必然要直面的核心模块。我做风机叶片冷却通道仿真时,第一次…

作者头像 李华
网站建设 2026/10/5 8:32:43

在Cursor中通过MCP调用Veo生成1080p视频的完整指南

1. 为什么要在 Cursor 里直接生成视频第一次听说“在编辑器里生成 1080p 视频”这个玩法时,我的反应和大多数人一样:这不是得打开剪辑软件、跑一堆渲染队列、等上半小时才能出片的事吗?但实际用下来,Ace Data Cloud 提供的 Veo MC…

作者头像 李华