AI日报 · 8月27日
今日聚焦:智谱 GLM-5.3-Flash 发布,6 个角度看懂这个爆点。







今日详情
- 谜底揭晓:刷屏的匿名模型 Ox Alpha 就是智谱 GLM-5.3-Flash
匿名模型 Ox Alpha 上线 OpenRouter 数日消耗 23.2T tokens,达历史第二名的 2.6 倍,还在 OpenCode 榜单终结了 DeepSeek 连续 56 天的霸榜。今天官方揭晓:它就是智谱 GLM-5.3-Flash。不少海外用户测完不相信这是国产模型。 - 57 分持平 Claude Opus 4.8,编程能力同一档
在 Artificial Analysis Intelligence Index 中 GLM-5.3-Flash 拿到 57 分,进入全球前沿模型区间,与 Claude Opus 4.8 持平;Deep-SWE 子集测试得分 63%,开源模型中帕累托最优,闭源里仅次于 Grok 4.6,与 V4 Pro、Gemini 3.7 Flash 同档。 - 320B 总参数、18B 激活:稀疏+线性注意力混血架构
总参数 320B,能力全面超越 GLM-5.2 的同时参数量减半。它是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型:激活参数 32B→18B,层数 92→45,相较 GLM-5.3 注意力计算量降 3.01 倍、KV 缓存降 4.44 倍, MIT 协议开源,所有国产卡都能跑。 - 原生多模态 + 1M 上下文:看图看视频写代码一条龙
GLM-5 系列首个原生多模态模型,视觉能力原生集成,可在前端开发、游戏开发、3D 仿真任务中自主观察并利用视觉反馈迭代。曾无外部素材自主运行 16 小时,搭建约 400 平方米的 3D 场景。上下文长度 1M。归藏实测:一张图一句话复刻 WebGL 玻璃立方体海报,材质参数一次到位。 - 价格屠夫:Opus 4.8 的 1/40,比 DeepSeek V4 Flash 还低
限时折扣价约为 Opus 4.8 的 1/40,远低于 DeepSeek V4 Flash 涨价后公示价。归藏评论:DeepSeek V4 Flash 是行业斩杀线,GLM-5.3 Flash 把这条线又向前推了一大步——便宜到离谱,但能力非常强。一次对话几毛钱的时代,Agent 才能真正渗透进普通人的工作流。 - CodeBuddy/WorkBuddy 内置支持,订阅用户可优先体验
GLM-5.3-Flash 已上架 API 并直接开源,Z Code 与智谱 Coding Plan 均可使用。CodeBuddy 宣布内置模型支持 GLM-5.3-Flash,现阶段对订阅用户优先开放,用量大时可能排队,资源充足后面向所有用户开放。此外针对 PPTX/PDF/DOCX/XLSX 等 Office 文档任务优化,金融法律场景生成即可交付。
数据来源:AIHOT
#AI日报 #人工智能
© 版权声明
文章版权归作者所有,未经允许请勿转载。


暂无评论内容