小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Mistral希望开源权重AI能参与前沿竞争,为此刚融资35亿美元。

Mistral完成3亿欧元D轮融资,估值超210亿欧元,将扩展前沿研究、算力与基础设施。其战略是构建覆盖开源模型、算力、基础设施及产品的全栈,让客户摆脱对单一供应商的依赖,并回应了Anthropic CEO Amodei关于开源权重只是转移算力集中的质疑。

Mistral希望开源权重AI能参与前沿竞争,为此刚融资35亿美元。

The New Stack The New Stack · 2026-09-10T19:37:30Z
一分钟读论文:《同一份权重,换个接口就从不会调工具变成 0.96 分》

香港城市大学研究发现,Agent评测中的工具调用率受“模型加接口栈”整体影响,接口错配会静默丢弃调用,导致分数失真。实验显示,仅更换接口配置,同一模型分数可从0.00变至0.96。机制上,单独修改模板或解析器无效,需两者匹配。此问题也影响训练信号,但修复接口仅恢复测量,不提升模型能力。

一分钟读论文:《同一份权重,换个接口就从不会调工具变成 0.96 分》

Micropaper Micropaper · 2026-09-04T00:00:00Z
Z.ai的GLM-5.3开放权重,但新许可证瞄准超大规模云服务商

中国AI实验室Z.ai发布旗舰模型GLM-5.3,开放权重但采用限制性许可证,要求年收入超100亿美元的公司托管前需安全审查。模型性能接近美国前沿实验室,但许可证比DeepSeek等更严格,此举或为商业化考虑,因Nvidia和Stripe正收购模型平台,开源模型可能成为带条款的分发渠道。

Z.ai的GLM-5.3开放权重,但新许可证瞄准超大规模云服务商

The New Stack The New Stack · 2026-08-28T17:42:54Z

本文介绍AOTInductor(PyTorch编译器后端)如何将模型权重存储在共享库外,并在推理时线程安全地更新权重。通过设置`package_constants_in_so`为False、`freezing`为False及`always_keep_tensor_constants`为True,权重可外部保存。C++端使用`load_constants`加载权重到非活动缓冲区,再通过`swap_constant_buffer`和`free_inactive_constant_buffer`实现双缓冲安全交换,支持热更新,避免GPU内存峰值。

AOTInductor外部权重存储与权重流式更新

Lei Mao's Log Book Lei Mao's Log Book · 2026-08-27T07:00:00Z
AI 范式雷达:《不再调权重:Agent 的自进化搬进了 Harness》

三篇论文提出Agent自进化新方向:从模型权重转向外部执行框架(Harness)。Recuris通过三层记忆架构和结构化证据实现组件级修补,在τ²-Bench上提升显著;StarHarness用分层搜索优化prompt和工具接口;SkillForge验证技能质量。核心模式是“结构化证据+组件级修补+验证门”,但依赖可验证环境,迁移有条件,归因准确率有限。

AI 范式雷达:《不再调权重:Agent 的自进化搬进了 Harness》

Micropaper Micropaper · 2026-08-26T00:00:00Z
S1-mini:Superwhisper 发布 462MB 开源权重文本规范化模型,将原始 ASR 转录转为整洁书面文本

Superwhisper发布S1系列,其中S1-mini为开源0.6B文本规范化模型,基于Qwen3微调,将ASR转录转为整洁文本,支持风格、结构、上下文三轴控制。Q4量化仅462MB,可本地部署。需关闭思考模式并贪心解码,测试token准确率94.8%。云端S1-Voice和S1-Language提供转录与格式化服务。

S1-mini:Superwhisper 发布 462MB 开源权重文本规范化模型,将原始 ASR 转录转为整洁书面文本

实时互动网 实时互动网 · 2026-08-21T02:50:45Z
“开放权重远非充分解决方案”:Dario Amodei回击AI权力集中论

Anthropic CEO Dario Amodei认为,AI技术因扩展定律天然集中权力,开放权重并非充分解决方案,因计算资源仍受控于少数巨头。他反对“监管即权力集中”的硅谷观点,主张对前沿模型实施强制安全测试,同时豁免小开发者,以平衡竞争与安全。

“开放权重远非充分解决方案”:Dario Amodei回击AI权力集中论

The New Stack The New Stack · 2026-08-17T16:58:51Z
至知研究院提出大模型可解释性新路线:拆权重,数据成本不到1%

该文介绍了一种新方法“稀疏权重分解”(SWD),用于直接分解预训练大模型的权重矩阵,无需训练替代网络。SWD将稠密权重分解为两个稀疏矩阵,形成可独立干预的瓶颈单元,从而高效抽取任务回路。实验表明,SWD在GPT-2、Qwen等模型上,以不到1%的数据成本实现高保真替换,并通过充分性和必要性测试,支持语义审计和定向编辑,为机制可解释性提供了轻量、可扩展的路径。

至知研究院提出大模型可解释性新路线:拆权重,数据成本不到1%

量子位 量子位 · 2026-08-15T06:42:23Z
智谱推出GLM-5.3 重点提升编程开发和网络安全能力 将在两周后开放权重下载

智谱发布GLM-5.3模型,基于GLM-5.2底座,扩大后训练规模,提升编程和网络安全能力。在269个真实项目中,发现2436个有效漏洞,含1097个中高危。模型尚未开放权重,预计两周后发布。

智谱推出GLM-5.3 重点提升编程开发和网络安全能力 将在两周后开放权重下载

蓝点网 蓝点网 · 2026-08-14T09:22:55Z
DeepSeek V4 Pro现已在AI Gateway上运行更新权重

DeepSeek V4 Pro更新权重,现已在AI Gateway上默认使用,调用deepseek/deepseek-v4-pro无需改代码。新版本模型ID为deepseek/deepseek-v4-pro-0813,可通过AI SDK或编码代理配置使用。AI Gateway按提供商定价,无加价或平台费,支持BYOK。

DeepSeek V4 Pro现已在AI Gateway上运行更新权重

Vercel News Vercel News · 2026-08-12T07:00:00Z

本文探讨Transformer模型的可解释性,核心在于区分解释的“合理性”与“忠实性”。注意力权重高并不等同于因果贡献大,梯度、遮挡和探针等方法各有局限,只能证明信息存在而非被实际使用。大语言模型的自我解释(如思维链)常听起来合理但不忠实,对齐训练可能加剧这一问题。文章强调需结合多层证据,避免将表面解释误认为真实机制。

【Transformer 与注意力机制】52|可解释性入门:注意力权重真的是“解释”吗

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-08-06T00:00:00Z
通过深度低秩残差蒸馏锁定预训练权重

本文提出DLR-Lock方法,通过将预训练MLP替换为深度低秩残差网络,利用自动微分的推理-训练不对称性,增加微调时的激活内存和计算开销,并造成架构不匹配,从而有效防御自适应攻击者修改权重,同时保持模型原有性能。实验验证了该方法的有效性。

通过深度低秩残差蒸馏锁定预训练权重

Apple Machine Learning Research Apple Machine Learning Research · 2026-08-06T00:00:00Z
开放权重模型到底如何搭建收费网络

开放权重模型并非免费送技术,而是通过主权AI定制、云机房代运营、系统集成认证及Token销售等路径盈利,核心是提供可控性与确定性。中国因美国封锁获得市场,以开放权重策略突围,但资本差距仍是中美AI竞争关键。未来格局或如操作系统,中国走Linux路线,追赶需三至五年。

开放权重模型到底如何搭建收费网络

硕鼠的博客站 硕鼠的博客站 · 2026-08-03T10:30:00Z

本文介绍如何在PyTorch多进程推理中通过CUDA IPC共享模型权重,避免GPU显存重复占用。示例展示了使用`model.share_memory()`共享权重,以及AOTInductor通过`load_constants`绑定父进程权重的方法。文中还讨论了配置要点、TorchScript的局限及程序依赖的重复问题,旨在提升单GPU多进程推理效率。

PyTorch多进程推理中的进程间权重共享

Lei Mao's Log Book Lei Mao's Log Book · 2026-07-31T07:00:00Z
DeepSeek V4 Flash现已在AI Gateway上运行更新权重

DeepSeek V4 Flash更新权重,代理能力显著增强,Terminal-Bench得分从56.9升至82.7。AI Gateway默认使用新权重,模型ID不变,代码无需修改。目前仅DeepSeek提供更新,其他供应商下周接入。用户可通过AI SDK设置模型,或在编码代理中配置使用。

DeepSeek V4 Flash现已在AI Gateway上运行更新权重

Vercel News Vercel News · 2026-07-31T07:00:00Z
黄仁勋为何急推开放权重

黄仁勋首次公开支持开放权重倡议,获77家签署,但并非完全开源。其动机源于商业考量:担忧闭源模型促使大厂自研芯片,削弱英伟达地位;更忌惮中国开源模型适配自家算力,动摇CUDA生态。倡议核心在于为蒸馏留空间、反对禁令、鼓励美国自研开放模型。然而美国缺乏资金、商业模式和数据支撑,难以成事,最终或为中国模型扩大发展空间。

黄仁勋为何急推开放权重

硕鼠的博客站 硕鼠的博客站 · 2026-07-28T00:30:00Z
Anthropic三招围堵开放权重:AI安全焦虑本质是场语言游戏

Anthropic发文讨论开放权重AI模型的安全风险,提出芯片管制、限制蒸馏和强制安全测试三项建议。网友批评其立场矛盾,认为这是保护商业利益而非人类安全。文章指出开放权重已成趋势,监管应由多方参与,而非由利益相关者主导。

Anthropic三招围堵开放权重:AI安全焦虑本质是场语言游戏

极道 极道 · 2026-07-28T00:20:00Z
Anthropic主张测试而非禁令,OpenAI和谷歌支持开放权重

Anthropic CEO Dario Amodei反对禁止开源权重模型,提议对高能力模型实施强制安全测试,并加强芯片出口管制与反蒸馏措施。测试门槛未明确,引发争议。OpenAI、谷歌等支持,Anthropic未加入Nvidia开源联盟。全球测试机制依赖国际合作,前景不明。

Anthropic主张测试而非禁令,OpenAI和谷歌支持开放权重

The New Stack The New Stack · 2026-07-28T00:02:25Z
Moonshot开源Kimi K3权重——但鲜有人能运行它

Moonshot AI发布开源大模型Kimi K3,拥有2.8万亿参数,支持百万token上下文,面向企业编码和知识工作。模型采用MoE架构,部署需大量GPU,成本高昂。K3在编程任务上性能接近Claude Fable 5,但速度较慢。公司否认蒸馏美国模型指控,但面临地缘政治审查。开源模式提供控制权,但基础设施投资巨大。

Moonshot开源Kimi K3权重——但鲜有人能运行它

The New Stack The New Stack · 2026-07-27T19:10:17Z
英伟达、Palantir、Hugging Face等34家公司加入联盟,共同抵御开源权重AI面临的网络威胁

33家科技公司成立开放安全AI联盟,旨在通过开源工具快速识别和修补漏洞,保障AI基础设施安全。联盟成员包括英伟达、微软等,但OpenAI和Anthropic缺席。专家认为,监管需转向基础设施层,关注模型来源和部署身份,而非仅模型本身。联盟强调开放模型对网络安全和创新的重要性,但需全球化和包容性发展。

英伟达、Palantir、Hugging Face等34家公司加入联盟,共同抵御开源权重AI面临的网络威胁

The New Stack The New Stack · 2026-07-27T09:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码