内容提要
智谱发布开源模型GLM-5.3-Flash,匿名测试版Ox Alpha性能宣称追平Claude Opus 4.8,价格仅四十分之一,并跑在10万张国产芯片上。但实际使用中性能参差,价格含促销折扣,芯片效率“相当”而非超越,API条款严苛。开发者评价分化,建议用户实测、算清成本、关注生态。
延伸解读
性能宣传与现实落差
官方宣称GLM-5.3-Flash性能追平Claude Opus 4.8,但开发者反馈显示其表现参差不齐:在网页界面改版等任务上表现出色,但在复杂规划或代码生成任务中可能卡死,甚至不如Qwen 3.8 27B。这提醒我们,基准测试分数反映的是理想条件下的上限,实际效果需结合具体任务场景评估。
价格宣传的折扣陷阱
官方强调“四十分之一”的价格,但该数字基于限时五折促销价,且订阅额度涨幅与宣传不符。标准API价格虽低于Opus,但实际成本需按个人使用量计算。开发者应关注促销结束后的定价,避免被短期优惠误导。
国产芯片的里程碑与挑战
10万张国产芯片支撑免费测试被视为分水岭,但官方措辞为“相当”而非“超越”,且未指明对比的GPU型号。免费期间响应慢、延迟高,付费模式下的性能仍需验证。这表明国产芯片在真实生产环境中已迈出重要一步,但距离稳定商用还有优化空间。
开源与API条款的权衡
模型权重以MIT协议开源,获得好评,但Z.ai的API条款要求对输入输出的永久使用权,并可单方面终止账户。这引发对服务条款公平性的讨论。第三方托管服务可规避这些条款,但用户需权衡开源便利与服务风险。
Q&A
Ox Alpha是什么?它和智谱GLM-5.3-Flash有什么关系?
Ox Alpha是智谱在2026年8月26日发布的开源模型GLM-5.3-Flash的匿名预览版,此前在OpenRouter和OpenCode上以免费形式出现,引发广泛关注。
GLM-5.3-Flash的性能和价格与Claude Opus 4.8相比如何?
官方宣称性能追平Claude Opus 4.8,价格仅为后者的四十分之一。但实际性能在真实任务中表现参差,价格也包含限时五折促销因素。
GLM-5.3-Flash在真实使用中的表现如何?
在真实代码库中表现分化:能高效完成SwiftUI界面改版、从零搭建RPG Maker等任务,但在复杂规划任务上可能卡死,甚至不如Qwen 3.8 27B。
GLM-5.3-Flash真的跑在国产芯片上吗?效率如何?
是的,Ox Alpha期间所有流量由超过10万张国产AI芯片集群支撑,基于SGLang自研推理引擎实现3倍性能提升,硬件效率与主流英伟达GPU相当,但并非超越。
GLM-5.3-Flash的开源协议和API条款有什么需要注意的?
模型权重以MIT协议开源,可自由使用和商用,但Z.ai的API条款声称对输入输出拥有永久使用权,并可单方面终止账户且不退费,条款较为严苛。
开发者对GLM-5.3-Flash的评价如何?
开发者分为三派:一派认为价格便宜值得入手,一派认为刷榜严重实际不可用,还有一派观望等待促销结束再评估。
使用GLM-5.3-Flash有什么建议?
建议用户跑自己最烦人的任务测试,别只看benchmark;算清自己的Token用量和成本,别轻信四十分之一的口号;关注生态,如支持的软件、第三方托管和普通电脑可运行性。