长期以来,前沿智能往往与高价绑定。但智谱今日开源的 GLM-5.3-Flash 挑战了这一现状。它参数性能出色,价格却大幅降低,还在国产芯片上完成验证。
GLM-5.3-Flash 有 320B 总参数、18B 激活参数,AA 综合智能指数 57 分,与 Claude Opus 4.8 持平,编程能力也相当。但其定价是 Opus 4.8 的 1/40,限时折扣内更是低至 1/20。
该模型采用稀疏注意力 + 线性注意力的混合架构,引入 IndexPool 池化机制,降低了注意力计算量和 KV 缓存。还用上流形约束超连接,提升模型 Scaling 能力,实现了架构级成本压缩。
GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型,将视觉能力集成进编码流程。在前端、游戏、3D 仿真开发中,能自主观察输出并迭代改进。
智谱以匿名模型 Ox-Alpha 在国产芯片上测试,成当周最受欢迎模型。构建专用推理引擎,端到端服务性能提升 3 倍,硬件效率和成本达主流英伟达 GPU 相当水平。
GLM-5.3-Flash 已全球开源,接入编码平台,纳入 GLM Coding Plan,还开放 API 调用,有望吸引更多开发者。
编辑观点:GLM-5.3-Flash 以高性价比和适配国产芯片的优势,有望推动前沿智能普惠,改变大模型市场格局。