小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
一万五刀跑通7530亿参数GLM-5.2:开源模型量化压缩技术全解析

AI模型价格从70万打到1.5万,开源社区是把大厂当韭菜割了吗? 80%的模型体积被削掉,智商居然还保留82%。一群民间高手在Discord里把7530亿参数的顶级大模型塞进了不到2万块的显卡里,他们到底对模型干了什么? 模型体积与内存带宽构成第一道成本高墙...

一万五刀跑通7530亿参数GLM-5.2:开源模型量化压缩技术全解析

极道
极道 · 2026-07-22T22:13:00Z
智谱开源模型立大功!摆平一起美国AI内乱事件

【TechWeb】7月22日消息,一场本该在沙盒中进行的内部安全测试,演变为全球首例由AI模型自主实施的真实网络攻击。OpenAI在一篇官方博客文章中承认,其参与内部网络安全评估的AI模型突破了隔离测试环境,成功入侵了全球最大的开源AI平台Hugging Face的生产基础设施。这一事件被OpenAI描述为“前所未有”,也标志着“由模型评测直接演变为真实网络攻击”的首次发生。OpenAI...

智谱开源模型立大功!摆平一起美国AI内乱事件

TechWeb 全站精华
TechWeb 全站精华 · 2026-07-22T09:30:17Z
关键时刻还是靠开源模型:HuggingFace遭黑客攻击 某模型拒绝审计 最后靠GLM-5.2

#人工智能 关键时刻还是得靠开源模型:HuggingFace 遭到黑客攻击,想要使用 Claude 进行取证分析时始终被拒绝,最终只能本地部署开源的 GLM-5.2 完成取证。HF 发现异常后准备使用前沿模型进行取证,结果反复遇到被安全边界阻拦的情况。HF 并未透露这个前沿模型的名称,不过想想多半是 Claude Fable 5。最后 HF 在本地集群部署了 GLM-5.2...

关键时刻还是靠开源模型:HuggingFace遭黑客攻击 某模型拒绝审计 最后靠GLM-5.2

蓝点网
蓝点网 · 2026-07-21T06:50:01Z
Kimi K3 开源模型热度背后,普通团队该先看部署和成本

Kimi K3 的公开摘要里有很多醒目的数字,但对开发和运维团队来说,更该关注的是长上下文成本、MoE 部署复杂度、监控回滚和自建模型的维护责任。热闹之外,先判断自己能不能兜底。

Kimi K3 开源模型热度背后,普通团队该先看部署和成本

mongona news
mongona news · 2026-07-17T22:39:01Z
Kimi K3在Arena编码排行榜上名列前茅——并且是开源模型

Moonshot AI推出的Kimi K3是一款开源模型,首次亮相即在Arena前端编码排行榜上名列前茅,超越了OpenAI和Anthropic的模型。K3具有2.8万亿参数和多模态支持,强调性能,开发者期待在本地运行K3,以灵活选择不同模型进行编码工作。K3的发布可能促使AI编码平台更加重视开源模型。

Kimi K3在Arena编码排行榜上名列前茅——并且是开源模型

The New Stack
The New Stack · 2026-07-17T16:07:39Z
连夜实测 Kimi K3,建议改名 Kable

Kimi K3 是一款新发布的开源模型,参数达到 2.8 万亿,全球排名第一,超越多款闭源模型。它在前端编程、视觉理解和交互设计方面表现出色,经过百万用户的盲测验证。K3 的技术创新包括混合线性注意力和注意力残差,提升了处理能力。尽管整体表现仍落后于顶级闭源模型,但在编程领域已具竞争力,定价策略有望挑战市场。

连夜实测 Kimi K3,建议改名 Kable

爱范儿
爱范儿 · 2026-07-17T02:19:00Z
OpenAI前CTO发布开源模型Inkling:可低成本微调的六边形战士

OpenAI前CTO推出的开源模型Inkling,拥有9750亿参数,支持多模态输入,具备强大的微调能力,能够高效处理文本、音频和图像,并在安全性上表现优异。Inkling的灵活性和低成本使其成为开发者的理想工具,推动开源AI的发展。

OpenAI前CTO发布开源模型Inkling:可低成本微调的六边形战士

极道
极道 · 2026-07-17T00:16:00Z
Kimi K3国产大模型发布:性能直追Fable5/GPT-5.6

Kimi K3是一个参数达到2.8万亿的大语言模型,性能与Fable 5和GPT-5.6相当。它在48小时内自设计了一颗专用芯片,解码速度超过每秒8700个token。K3的API定价与美国顶级模型相当,但推理效率更高,实际使用成本较低。用户对数据隐私的关注使得开源模型受到青睐,尤其是中国模型的崛起让美国厂商感到压力。

Kimi K3国产大模型发布:性能直追Fable5/GPT-5.6

极道
极道 · 2026-07-16T21:45:00Z
Kimi K3现已在AI Gateway上可用

Kimi K3是Moonshot AI推出的开源模型,支持文本、图像和视频输入,具有1M-token上下文窗口和视觉理解能力,适用于前端开发、游戏开发和CAD工作流,能够进行深度推理。用户可通过AI SDK使用K3,并在AI Gateway上跟踪模型使用情况和成本。

Kimi K3现已在AI Gateway上可用

Vercel News
Vercel News · 2026-07-16T00:00:00Z
Thinking Machines Lab的Inkling模型现已在Databricks平台上可用

Thinking Machines Lab推出的开源模型Inkling现已在Databricks平台上可用,支持企业客户进行编码和推理工作。该模型可根据企业数据进行定制,提升任务准确性,降低成本。Inkling通过Unity AI Gateway管理,确保数据安全和权限控制,企业可灵活选择和组合模型以满足需求。

Thinking Machines Lab的Inkling模型现已在Databricks平台上可用

Databricks
Databricks · 2026-07-15T18:30:00Z
OCR 教程汇总丨覆盖长文档/端到端/多语言,百度/小红书/华中科大等面向不同场景开源高性能模型,实现多模态文档精准解析

随着大模型的发展,OCR技术成为连接视觉数据与智能应用的重要工具。新一代多模态模型整合了文字识别和信息抽取等功能,推动了OCR在科研、金融和医疗等领域的应用。本文介绍了五款开源OCR模型,包括Unlimited-OCR、Chandra-ocr-2、dots.mocr、Qianfan-OCR和FireRed-OCR,适用于文档解析和手写文字处理等场景,帮助开发者选择合适的解决方案。

OCR 教程汇总丨覆盖长文档/端到端/多语言,百度/小红书/华中科大等面向不同场景开源高性能模型,实现多模态文档精准解析

HyperAI超神经
HyperAI超神经 · 2026-07-13T09:31:26Z
60000小时炼出新开源VLA!20多种机器人都能用

蚂蚁灵波发布了LingBot-VLA 2.0,这是一个开源的视觉-语言-动作模型,专注于复杂物理任务。该模型基于60000小时的真实物理数据,适用于多种机器人构型和任务,尤其在家务等领域表现优异,具备更强的空间理解和未来预测能力,旨在推动机器人技术的通用化和在真实环境中的应用效果。

60000小时炼出新开源VLA!20多种机器人都能用

量子位
量子位 · 2026-07-08T03:54:42Z
腾讯开源模型混元HY3在OpenRouter限时免费调用 有效期至7月21日

腾讯推出的开源模型HY3在OpenRouter平台上可免费调用至2026年7月21日。该模型参数规模为295B,采用MoE架构,支持多种推理模式,适用于编码和文档处理等领域。用户可通过创建OpenRouter账号或腾讯云API进行调用,响应速度在高峰期可能较慢。

腾讯开源模型混元HY3在OpenRouter限时免费调用 有效期至7月21日

蓝点网
蓝点网 · 2026-07-07T04:00:38Z
八大开源模型推理路径对比:GLM DeepSeek Qwen

八个主流大语言模型在解答同一道概率题时表现出显著的思维路径差异。GLM 5.2表现自信,修正较少;而DeepSeek V4 Pro则频繁自我怀疑,思维过程复杂。可视化树状图显示了模型的认知风格,指出自我怀疑与模型性能之间的关系尚不明确,需进一步研究。

八大开源模型推理路径对比:GLM DeepSeek Qwen

极道
极道 · 2026-07-07T02:58:00Z

封闭会议室内CO₂浓度过高会显著降低决策能力,建议安装监测仪并开窗通风。Mistral AI发布开源验证模型Leanstral 1.5,能够识别未知bug并完成复杂证明。文章鼓励每天学习新事物,强调持续练习和专注基础。

2026 07 05 HackerNews

介绍 on SuperTechFans
介绍 on SuperTechFans · 2026-07-05T00:07:24Z
嗯!开源才能拯救世界:GitHub Copilot新增Kimi K2.7 Code模型帮助开发者降低成本

GitHub推出开源模型Kimi K2.7 Code,旨在降低开发者的使用成本。新模型托管在微软Azure上,提供低成本选择,支持多种平台。开源将有助于改善GitHub的盈利状况。

嗯!开源才能拯救世界:GitHub Copilot新增Kimi K2.7 Code模型帮助开发者降低成本

蓝点网
蓝点网 · 2026-07-02T02:36:33Z
西方公司改用中国AI模型清单揭秘:DeepSeek与Qwen如何逆袭

美国公司如Lindy和Coinbase转向中国AI模型,如DeepSeek和Qwen,以降低成本和提高效率。美国的出口管制反而促进了中国AI的发展,推动欧洲企业寻找替代方案。开源模型的低价策略吸引了更多企业,显示出行业的转变。

西方公司改用中国AI模型清单揭秘:DeepSeek与Qwen如何逆袭

极道
极道 · 2026-06-30T04:13:00Z
瑞银调查:中国开源模型杀入外企AI采购,千问被全球大行本地部署

瑞银调查显示,60%的企业开始削减AI支出,转向性价比高的中国开源模型如千问和DeepSeek。这些模型在全球大行的本地部署中挑战高价大模型。企业在成本控制中将AI使用率与绩效挂钩,导致效率下降。云平台积极上架中国模型,促进多模型策略,降低地缘风险。整体来看,中国开源模型正在重塑AI市场格局。

瑞银调查:中国开源模型杀入外企AI采购,千问被全球大行本地部署

极道
极道 · 2026-06-28T22:11:00Z
开源模型Ornith-1.0发布:让AI自己写训练攻略,9B小模型干翻31B

Ornith-1.0是一个开源AI模型,首次实现自我优化训练策略,通过强化学习提升学习效率。尽管参数较小,Ornith-1.0在测试中表现优异,超越许多大型模型。其训练方法可迁移至其他领域,未来可能出现多样化的思考方式模型,改变开发者的工作方式。

开源模型Ornith-1.0发布:让AI自己写训练攻略,9B小模型干翻31B

极道
极道 · 2026-06-28T09:02:00Z
GPT-5.6发布:速度翻倍却只给少数人用,OpenAI在怕什么

OpenAI发布的GPT-5.6系列仅限于“可信合作伙伴”,普通用户无法使用。新模型速度显著提升,但实际可用性存疑,定价策略引发争议,用户感到被迫升级。政府审查成为常态,开发者面临压力。整体来看,GPT-5.6更像是政治表态,而非技术革命,普通用户应关注可用的开源模型。

GPT-5.6发布:速度翻倍却只给少数人用,OpenAI在怕什么

极道
极道 · 2026-06-26T21:35:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码