小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
一万五刀跑通7530亿参数GLM-5.2:开源模型量化压缩技术全解析

AI模型价格从70万打到1.5万,开源社区是把大厂当韭菜割了吗? 80%的模型体积被削掉,智商居然还保留82%。一群民间高手在Discord里把7530亿参数的顶级大模型塞进了不到2万块的显卡里,他们到底对模型干了什么? 模型体积与内存带宽构成第一道成本高墙...

一万五刀跑通7530亿参数GLM-5.2:开源模型量化压缩技术全解析

极道
极道 · 2026-07-22T22:13:00Z
AI 圈今天最大的瓜:GPT-6 越狱攻击,被 GLM 5.2 揪出了

「GPT-6」为了考试作弊,黑进了别人的服务器#欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。

AI 圈今天最大的瓜:GPT-6 越狱攻击,被 GLM 5.2 揪出了

爱范儿
爱范儿 · 2026-07-22T07:06:04Z
Last Week in AI #250 - Mythos Mess, GPT 5.6-Sol, GLM 5.2

Anthropic's AI treaty discussions, US government's influence on AI model releases, OpenAI's processor development, memory market impacts, and more!

Last Week in AI #250 - Mythos Mess, GPT 5.6-Sol, GLM 5.2

Last Week in AI
Last Week in AI · 2026-07-21T11:03:19Z
关键时刻还是靠开源模型:HuggingFace遭黑客攻击 某模型拒绝审计 最后靠GLM-5.2

#人工智能 关键时刻还是得靠开源模型:HuggingFace 遭到黑客攻击,想要使用 Claude 进行取证分析时始终被拒绝,最终只能本地部署开源的 GLM-5.2 完成取证。HF 发现异常后准备使用前沿模型进行取证,结果反复遇到被安全边界阻拦的情况。HF 并未透露这个前沿模型的名称,不过想想多半是 Claude Fable 5。最后 HF 在本地集群部署了 GLM-5.2...

关键时刻还是靠开源模型:HuggingFace遭黑客攻击 某模型拒绝审计 最后靠GLM-5.2

蓝点网
蓝点网 · 2026-07-21T06:50:01Z
通过Novita在AI Gateway上,GLM 5.2享受35%折扣

GLM 5.2在AI Gateway上至7月24日享受35%折扣,需通过Novita请求。使用时设置模型为zai/glm-5.2,折扣后可在模型游乐场体验。7月24日后,模型将恢复标准价格。

通过Novita在AI Gateway上,GLM 5.2享受35%折扣

Vercel News
Vercel News · 2026-07-17T00:01:00Z

腾讯玄武 Atuin AI 在 CyberGym 的评估中,使用 GLM-5.2 模型后,pass@1 达到 84.8%,较 GLM-5.1 的 84.0% 提升了 0.8%。该系统专注于软件漏洞分析,协调多个智能体进行任务,表现优于 Claude Code。

Xuanwu Atuin AI 在 CyberGym 上的表现:GLM-5.2 更新结果

腾讯安全玄武实验室
腾讯安全玄武实验室 · 2026-07-17T00:00:00Z
智谱GLM-5.2和OpenMed把病历脱敏后再分析,140万人数据泄露的教训

医疗AI的隐私保护至关重要。GLM-5.2通过本地脱敏处理病历,确保数据安全,避免泄露。Maziyar强调,先脱敏再分析是保护隐私的关键。

智谱GLM-5.2和OpenMed把病历脱敏后再分析,140万人数据泄露的教训

极道
极道 · 2026-07-15T07:16:00Z
colibri – 在 25GB 内存电脑上运行 GLM-5.2 (744B MoE)

Colibri 是一个开源项目,允许普通电脑在仅有 25GB 内存的情况下运行 GLM-5.2 模型,无需 GPU。它通过按需加载模型参数,节省内存和硬盘空间。GLM-5.2 是智谱发布的强大开源模型,支持多种操作系统,但需要 370GB 硬盘。

colibri – 在 25GB 内存电脑上运行 GLM-5.2 (744B MoE)

小众软件
小众软件 · 2026-07-14T06:10:52Z
智谱GLM 5.2量化算法革命:滑铁卢实习生三个月干翻英伟达

滑铁卢大学的实习生Joshua Hill在三个月内开发出一种新型量化算法,显著提升了大模型的压缩效率和性能,超越了英伟达的ModelOpt。该算法通过全局优化模型层的依赖关系,缩短搜索时间,提高压缩率,解决了量化中的信息损失问题。这一突破将降低AI服务成本,提高用户体验,推动行业进步。

智谱GLM 5.2量化算法革命:滑铁卢实习生三个月干翻英伟达

极道
极道 · 2026-07-13T23:37:00Z
colibri:如何在我的慢电脑上运行智谱GLM 5.2?

colibri项目通过混合专家模型(MoE)将7440亿参数的AI模型压缩至25GB内存,使其能够在普通游戏本上运行。尽管推理速度较慢,但该项目挑战了传统AI部署观念,展示了普通硬件的潜力,受到社区的赞赏,体现了黑客精神。

colibri:如何在我的慢电脑上运行智谱GLM 5.2?

极道
极道 · 2026-07-10T02:33:00Z
智谱GLM 5.2记账实测:2.73美元干翻750英镑人类会计师

英国一家公司使用开源AI模型GLM 5.2进行记账,仅花费2.73美元和68分钟,处理59笔交易,准确率达到99.9%。尽管在某些税务细节上出现错误,但AI的效率和成本优势显著,可能对人类会计师构成威胁。未来会计工作可能需要人类监督AI处理异常情况。

智谱GLM 5.2记账实测:2.73美元干翻750英镑人类会计师

极道
极道 · 2026-07-09T22:41:00Z

GLM 5.2与Sonnet 5在使用成本和效率上存在显著差异。GLM速度较慢,导致用户生成内容时消耗更多时间和token,增加使用成本。尽管GLM是开源模型,性价比高,但在专业应用中,Sonnet的速度和稳定性更具优势。用户在选择时需综合考虑速度、配额和服务态度等因素。

GLM 5.2就是Sonnet 5的平替,而且不会PUA你?

极道
极道 · 2026-07-02T03:20:00Z
GLM-5.3你来定!智谱唐杰全球征集意见,评论区清一色:视觉

清华教授唐杰讨论了人工智能(AI)发展,强调通用人工智能(AGI)的重要性,并征集用户对GLM-5.3的需求。用户希望增加视觉能力以提升模型实用性。尽管智谱已有多模态模型,但GLM旗舰版尚未整合视觉功能,面临竞争压力。唐杰指出,虽然视觉能力重要,但提升模型智能仍需复杂推理。

GLM-5.3你来定!智谱唐杰全球征集意见,评论区清一色:视觉

量子位
量子位 · 2026-06-30T08:46:19Z
OpenCode中设置DeepSeek Flash+GLM 5.2:调用费省七成

OpenCode通过配置DeepSeek Flash和GLM 5.2,实现高效的AI调用管理,降低整体成本70%。Flash处理日常事务,GLM专注复杂决策,提升响应速度和资源使用效率,适合团队高效工作。

OpenCode中设置DeepSeek Flash+GLM 5.2:调用费省七成

极道
极道 · 2026-06-28T11:29:00Z
马斯克预测GLM明年Q1追平Fable,智谱唐杰:没那么久

智谱GLM-5.2模型的发布标志着中国开源AI模型的崛起。该模型支持长程任务,具备高效计算能力,并在全球评估中表现优异。马斯克对其能力的评价反映了全球市场的重新认识,GLM-5.2证明了前沿技术的开放共享能够推动全球AI生态的繁荣。

马斯克预测GLM明年Q1追平Fable,智谱唐杰:没那么久

量子位
量子位 · 2026-06-25T04:35:18Z
智谱GLM-5.2开源模型杀疯了,编程能力对标Opus 4.8

智谱GLM-5.2开源模型在编程能力上已追平闭源的Claude Opus 4.8,标志着开源模型的重大进步。该模型在真实任务中表现出色,受到社区热烈反响,可能改变市场格局,推动更多开源模型的发展。

智谱GLM-5.2开源模型杀疯了,编程能力对标Opus 4.8

极道
极道 · 2026-06-24T22:31:00Z
百度智能云发布百度千帆Token Plan企业版,提供GLM-5.2等模型

百度智能云推出了企业级AI生产力订阅服务——千帆Token Plan,旨在帮助企业高效管理和使用AI资源。该服务支持灵活的席位制和积分体系,企业可按需采购和共享资源,提升AI应用效率。Token Plan适配多种主流工具,覆盖代码开发和智能办公等场景,承诺数据安全与服务稳定性,助力企业迈向AI原生时代。

百度智能云发布百度千帆Token Plan企业版,提供GLM-5.2等模型

量子位
量子位 · 2026-06-24T11:09:51Z
百度智能云发布百度千帆Token Plan企业版,提供GLM-5.2等模型

百度智能云发布了千帆Token Plan企业版,提供GLM-5.2等模型,旨在提升企业智能化服务能力。

百度智能云发布百度千帆Token Plan企业版,提供GLM-5.2等模型

mongona news
mongona news · 2026-06-24T11:09:51Z
百度智能云发布百度千帆Token Plan企业版,提供GLM-5.2等模型

百度智能云推出了企业级AI生产力订阅服务——百度千帆Token Plan企业版,旨在为企业提供统一的AI资源管理和采购服务。该服务支持GLM-5.2模型,帮助企业高效利用AI能力,解决采购和管理的分散问题,企业可灵活配置席位,提升资源利用效率,确保预算可控。

百度智能云发布百度千帆Token Plan企业版,提供GLM-5.2等模型

mongona news
mongona news · 2026-06-24T10:58:00Z
GLM 5.2 Fast现已通过Wafer在AI Gateway上线

GLM 5.2 Fast现已在AI Gateway上线,提供比其他服务商高2倍的吞吐量,适用于小、大上下文场景。使用时需在AI SDK中设置模型为zai/glm-5.2-fast。AI Gateway提供统一API,支持用量跟踪、成本管理及性能优化,无平台费用。

GLM 5.2 Fast现已通过Wafer在AI Gateway上线

Vercel News
Vercel News · 2026-06-24T00:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码