57 分打平 Opus 4.8,价格只要 1/40:GLM-5.3-Flash 来了
前沿智能第一次不需要省着用——这次是认真的。
你见过"同样的分数,1/40 的账单"吗?
今天智谱上线并开源了 GLM-5.3-Flash(320B-A18B),是 GLM-5 系列的第一个原生多模态模型。它在全球权威的 Artificial Analysis Intelligence Index(AA 综合智能指数)拿下 57 分,正好和 Anthropic 最受欢迎的 Claude Opus 4.8 持平;自研 Z.ai Code Bench 体测里,编程表现也和 Opus 4.8 相当。
价格呢?GLM-5.3-Flash 定价是 GLM-5.3 的 1/10,限时折扣到 1/20,折算下来只有 Opus 4.8 的 1/40。
同样智力,1/40 价格。过去我们默认"前沿智能 = 前沿价格",这次智谱把这个等式撕了。
一、先看数字:这不是"乞丐版",是另一套算法
很多人一看"Flash"就以为是大模型的青春版。GLM-5.3-Flash 恰恰相反——它 320B 总参数,能力超过参数量翻倍的 GLM-5.2,AA 指数 57 分摸进全球前沿区间。
价格体系有多夸张?以同门 GLM-5.3 作参照($1.40 输入 / $4.40 输出、缓存输入仅 $0.26/M),Flash 直接砍到 1/10;对比 Opus 4.8($5/$25)就是 1/40。第三方对比也印证了 GLM 家族的性价比路数:GLM-5.3 在 CyberGym、DeepSWE 1.1、FrontierSWE 等共享基准上 5/5 领先 Opus 4.8,SWE-Bench Verified 88.6%、Terminal-Bench 2.1 88.2%。
关键是,便宜不是靠缩水换来的。它激活参数量从 32B 砍到 18B、层数从 92 减到 45,配合 30T Token 多模态语料和全新架构——注意力计算量比 GLM-5.3 降 3.01 倍、KV 缓存降 4.44 倍。架构上首次把稀疏注意力 + 线性注意力混搭开源,长上下文成本被大幅压缩。
二、它开始"看"着写代码了
原生多模态是这代最值得玩味的地方。对前端、游戏、3D 这类"产物看得见"的任务,模型学会了什么时候该"观察"——自己渲染、自己看结果、自己改,直到画面和交互都对。
有个细节特别有画面感:没有任何外部素材的情况下,GLM-5.3-Flash 在 Blender 里自主跑了 16 个小时,搭出一套约 400 平方米的专业主厨自宅与测试厨房。几何、材质、光照、空间,全凭世界知识硬砌。
办公场景同样受益:PPTX / PDF / DOCX / XLSX 这类文档任务,新增的视觉能力让它可以"检查自己的输出";金融研报、合同批注、律师函这些活儿,官方演示里已经是"生成即可交付"的状态。
三、跑在国产芯片上,不是 PPT
最容易被忽略但最重的一击在最后:发布前,模型以匿名身份"Ox-Alpha"(社区戏称"牛来")在 OpenCode 和 OpenRouter 上被大规模调用,一度创下双平台调用量新高——而全部流量由国产芯片集群扛下。
为了克服单卡算力和内存的短板,智谱基于 SGLang 自研推理引擎,上了 EPD(编码—预填充—解码)分离式架构,配 W8A8 量化、混合缓存量化、Layer Split 等一系列优化。结果:与同一硬件基线相比端到端性能提升 3 倍,硬件效率和单 token 成本"已达到与主流英伟达 GPU 相当的水平"。加上 8 月 28 日 GLM-5.3 全量权重(744B)也即将开源,国产模型"好养"这事,正在从口号变成可验证的事实。
四、清醒一下:免费的背后
免费和低价总有两面,说几个别上头的地方:
- 57 分是官方口径。AA 指数、Code Bench 都是智谱自报数据,社区大规模第三方复现还没跟上——等一周实测再下结论不迟。
- 1/40 是限时折扣价。常态定价是 GLM-5.3 的 1/10,活动结束后会回调,薅要趁早。
- 国产芯片是首次大规模验证。自述"效率追平英伟达",但运维经验、长尾问题还需要时间检验。
- Flash 已开源,但全量权重等 8/28。想本地自托管的话,GLM-5.3 的 744B 才是完整形态,Flash 先走 API。
五、谁该上手
预算敏感的个人开发者、被 API 账单劝退的独立开发者、想给团队降本又不想降智的 Leader——GLM-5.3-Flash 就是为你们准备的。日常写代码、跑 Agent、做文档,先用它把账本降下来;核心业务再留一手付费兜底。
📣 福利时间:为了让更多新朋友能 0 成本上手体验 GLM-5.3-Flash,官方准备了一批 GLM Coding Plan 7 天体验卡(从未订阅过套餐的用户可领取),接下来一周每天限量发放 10,000 张;同时所有套餐用户账号内的体验卡数量也已重置。想白嫖的抓紧,先到先得:https://bigmodel.cn/activity/trial-card/PU9MTWG0PM
一句话总结:57 分打平 Opus 4.8 的那颗大脑,现在按 1/40 的价格卖,还送你 7 天体验卡——前沿智能的门票,第一次这么便宜。
相关链接:
- GLM-5.3-Flash 技术 Blog:https://z.ai/blog/glm-5.3-flash
- BigModel 开放平台(API):https://docs.bigmodel.cn/cn/guide/models/vlm/glm-5.3-flash
- GLM Coding Plan:https://bigmodel.cn/glm-coding
- 开源权重:https://huggingface.co/zai-org/GLM-5.3-Flash
- 在线体验:https://chat.z.ai
暂无评论。