智谱上市后首份中期财报显示,上半年营收9.54亿元,同比增长400%,其中MaaS及API收入占比从15.2%升至86.5%,毛利率转正至24.6%。但研发费用21.3亿元远超毛利,经调整净亏损扩大至19.64亿元,盈利拐点未现。ARR 16亿美元口径激进,商业模式转型虽健康,但覆盖前沿模型研发仍遥远。
智谱发布GLM-5.3模型,总参数743B,采用MoE架构,激活39B,支持1M窗口,强化编程、智能体及网络安全能力。模型权重免费开源可商用,但非MIT许可证,营收超100亿美元的大型MaaS服务商需先申请审查,个人和普通企业不受影响。
智谱GLM-5.3-Flash的token套餐性价比低,缓存命中率仅8成,实际用量远低于宣传。对比opencode go的15美元额度,智谱lite月费118元仅约4.3亿token,pro约25亿,max约60亿,相当于70元买538元pro套餐,性价比差。目前经济实惠的tokenplan仅gpt、opencode、commandcode可选,作者怀念DeepSeek涨价前的低价,现靠Muse Spark维持。
智谱发布并开源GLM-5.3-Flash多模态模型,性能超GLM-5.2,与Claude Opus 4.8持平。商汤大装置提供国产算力支持,通过异构混推技术提升服务性能3倍,成本与英伟达GPU相当,推动国产算力规模化商用,日均Token服务量达2.42万亿。
智谱发布开源原生多模态模型GLM-5.3-Flash,采用MoE架构,支持文本图像输入及百万Token上下文,性能与Claude Opus 4.8持平,API定价大幅降低。同时,Perplexity推出端侧AI智能体,明基发布专业显示器,Google推出语音转文本模型及视频生成模型,英伟达发布定制高带宽内存,微软Xbox推出光盘数字化功能。
智谱开源发布GLM-5.3-Flash模型,采用MoE架构,总参数320B但激活仅18B,提升响应速度并降低成本。该模型在编程和智能体能力上接近Claude Opus 4.8,支持1M上下文,引入混合注意力机制。此前以ox-alpha代号在OpenRouter测试,现以MIT许可证开放下载。
智谱发布GLM-5.3-Flash模型,价格低廉,支持多模态理解,并发率提升至50,速度快,性能可与Opus媲美。相比之下,DeepSeek涨价后优势减弱,作者对其兴趣下降。
智谱发布开源模型GLM-5.3-Flash,匿名测试版Ox Alpha性能宣称追平Claude Opus 4.8,价格仅四十分之一,并跑在10万张国产芯片上。但实际使用中性能参差,价格含促销折扣,芯片效率“相当”而非超越,API条款严苛。开发者评价分化,建议用户实测、算清成本、关注生态。
智谱发布并开源GLM-5.3 Flash模型,即此前海外爆火的神秘模型“牛来”。该模型为320B参数、原生多模态,能力超越更大体量模型,在AA榜单获57分,价格仅为Claude Opus 4.8的1/40。实测中能精准配字幕、制作电影解说和还原设计稿。其采用混合注意力架构,运行于国产芯片,支持1M上下文,并已全面开源。
匿名模型“Ox Alpha”(牛来大模型)现身OpenRouter,因技术特征引发身份猜测。网友通过Tokenizer、视频编码和API错误信息比对,认为其可能来自智谱(GLM系列),或谷歌Gemini。该模型支持百万级上下文和多模态输入,在代码任务中表现亮眼,但评测结果分歧大。目前身份未定,社区持续追踪。
2026年8月21日,DeepSeek下架免费模型并上线视觉模型API,同日OpenRouter出现匿名模型Ox Alpha,免费且支持多模态。网友测试发现其Tokenizer与智谱GLM完全一致,推测为智谱未发布的多模态模型,但小米因历史匿名测试套路也被怀疑。Ox Alpha免费一周疑为压力测试,身份成谜。
智谱AI发布新一代开源模型GLM-5.3,总参数量7430亿,编程能力提升50%,在基准测试中位列开源第一。范式旗下平台PhanRouter同日适配并开放调用,用户无需更换API即可使用,提供低价和99.9%服务保障。该模式降低企业采用门槛,推动AI落地。
智谱推出网络安全合作伙伴计划,面向安全研究员、AI评估机构、学术机构等开放GLM-5.3网安权限申请。获批后使用模型时安全拦截更低,可提升网络安全能力,如审计系统、修复漏洞。申请需详细说明用途,个人研究员提交漏洞证明可提高成功率。
智谱AI发布GLM-5.3,基座与5.2相同,仅靠后训练将编程分数提升六倍,并意外涌现网络安全能力,引发刷榜争议。模型效率高,成本低于闭源对手,但真实水平待开源验证,闭源巨头实力成谜。
智谱GLM 5.3在269个项目中挖出2436个漏洞,其中1097个高危,平均潜伏26.6年,最老可追溯至1981年。在CyberGym评测中以84.5%准确率反超闭源模型Mythos 5。该模型还发现DNS协议致命缺陷,可致千万服务瘫痪,并成功追踪AI黑客Neo。开源权重后,打破闭源安全垄断,推动AI安全普及。
苹果与阿里巴巴合作,为中国市场训练自研AI模型,用于Apple Intelligence本地化部署。微信确认朋友圈永不推出二次编辑功能。追觅交付首台20万元AURORA手机。Google DeepMind或裁员三分之一。智谱发布GLM-5.3提升编程能力。广州推出“Token贷”等科技动态。
智谱发布GLM-5.3编程模型,参数7000亿,通过后训练提升性能,编程能力比肩Fable 5和GPT-5.6 Sol,网络安全表现突出。开源后训练框架Slime,支持多系列模型。实测3D网页生成效果良好,但细节待优化。模型已上线Zcode等平台,API下周开放,权重两周内开源。
智谱发布GLM-5.3模型,基于GLM-5.2底座,扩大后训练规模,提升编程和网络安全能力。在269个真实项目中,发现2436个有效漏洞,含1097个中高危。模型尚未开放权重,预计两周后发布。
智谱发布GLM-5.3开源模型,在编程和安全能力上显著提升,编程接近Claude Fable 5,安全测试获84.5%成最强开源安全模型。实测中能自主完成复杂编程任务、修复漏洞并通过回归测试,强调生产级AI需兼顾代码交付与安全验证。
京东云首发接入智谱开源旗舰模型GLM-5.3,该模型编程性能提升50%,在公开基准测试中居开源第一,并发现潜伏40年的DNS协议漏洞。京东云借此增强JoyCode研发工具,助力企业提升代码质量与交付效率,推动大模型产业应用落地。
完成下面两步后,将自动完成登录并继续当前操作。