实测GLM-5.3: 在神仙打架的一周杀回国模顶流,还按下了重置键

实测GLM-5.3: 在神仙打架的一周杀回国模顶流,还按下了重置键

💡 原文中文,约4100字,阅读约需10分钟。
📝

内容提要

智谱发布GLM-5.3编程模型,参数7000亿,通过后训练提升性能,编程能力比肩Fable 5和GPT-5.6 Sol,网络安全表现突出。开源后训练框架Slime,支持多系列模型。实测3D网页生成效果良好,但细节待优化。模型已上线Zcode等平台,API下周开放,权重两周内开源。

🔎

延伸解读

后训练成新战场

GLM-5.3 与上一版参数规模相近,提升主要来自后训练 Scaling,而非预训练。文章指出,后训练在某些程度上比预训练更有效,例如 DeepSeek V4 预览版与正式版的差距。智谱还开源了后训练框架 Slime,支持多系列模型,这或可降低后训练门槛,推动行业从拼参数转向拼训练技巧。

网络安全成新赛道

GLM-5.3 在网络安全测试中表现突出,与 Claude Mythos 5 持平,并在 ExploitGym 中完成 130 道题。智谱公开了漏洞披露账本,记录模型发现的历史漏洞,最古老可追溯至 40 年前。这显示大模型能力已延伸至攻防领域,但普通用户更应关注其日常编程和办公的实际提升。

实测体验与适配问题

实测中,GLM-5.3 在 3D 网页生成上效果不错,但细节待优化,如人体仿真较粗糙。在 Claude Code 中遇到自动审批命令的安全提示错误,说明第三方模型与工具链的适配仍需完善。切换到 ZCode 后,模型能持续优化,但耗时更长。用户需根据场景选择合适的平台。

同尺寸最强与定价预期

GLM-5.3 以 7000 亿参数实现与更大参数模型(如 Kimi K3 2.8T)相近的智能,被称为同尺寸最强。文章推测,由于参数规模相近,API 定价可能不会有太大变化。对于已购买 Coding Plan 的用户,从 5.2 升级到 5.3 能感受到明显差异,但 API 需等到下周二更新。

Q&A

GLM-5.3 的参数量是多少?

GLM-5.3 的参数量为 7000 亿(743B),与上一版本 GLM-5.2 相同。

GLM-5.3 在哪些方面表现突出?

GLM-5.3 在编程能力和网络安全方面表现突出,编程能力比肩 Fable 5 和 GPT-5.6 Sol,网络安全表现与 Claude Mythos 5 持平。

GLM-5.3 相比 GLM-5.2 提升的主要原因是什么?

GLM-5.3 的提升主要来自后训练 Scaling,即在相同基座上高效推进强化学习,进一步开发基座的智能上界。

智谱开源的 Slime 框架是什么?

Slime 是智谱开源的后训练框架,覆盖发布级模型后训练所需的完整工作流,支持对 GLM、Qwen、DeepSeek 系列部分模型以及 Llama 3 进行后训练。

GLM-5.3 在网络安全方面有哪些具体表现?

GLM-5.3 在网络安全任务中表现与 Claude Mythos 5 持平,在 ExploitGym 测试中,6小时内完成130道题。此外,智谱公开了网络安全披露账本,GLM 找到的最古老漏洞可追溯到约40年前。

GLM-5.3 在 3D 网页生成方面表现如何?

GLM-5.3 在 3D 网页生成方面效果良好,例如生成水母湖场景效果漂亮,但生成人体血液循环仿真时细节较粗糙,整体可用于教学场景。

GLM-5.3 目前可以通过哪些渠道使用?

GLM-5.3 已上线智谱官方 Agent 应用 Zcode 和效率工具 AutoClaw,并面向 GLM Coding Plan 用户全量开放。第三方平台如 WorkBuddy、QwenWork、TraeWork 也已开放抢先体验。API 预计下周二开放,权重两周内开源。

GLM-5.3 的 API 价格会变化吗?

目前官网显示的 API 价格还是 GLM-5.2 版本,但考虑到模型尺寸相同,预计 GLM-5.3 的 API 定价不会有太大变化。

🏷️

标签

➡️

继续阅读