小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
黄仁勋为何急推开放权重

黄仁勋为何急推开放权重 黄仁勋首次在X发帖,推动77家企业和机构支持开放权重,但这并不是一场单纯的开源理想主义运动。本文厘清开放权重、开源AI与开放软件的区别,拆解签署联盟的商业利益结构,以及Anthropic为何缺席。更关键的是,文章从英伟达CUDA生态、自研AI芯片、中国开放模型与主权AI部署等角度,分析黄仁勋的近期焦虑和远期风险,并借Borland与Eclipse的亲历案例说明:美国...

黄仁勋为何急推开放权重

硕鼠的博客站
硕鼠的博客站 · 2026-07-28T00:30:00Z
Anthropic三招围堵开放权重:AI安全焦虑本质是场语言游戏

7万张GPU训练一个模型,结果连自家安全员都睡不着觉,这算哪门子未来?...

Anthropic三招围堵开放权重:AI安全焦虑本质是场语言游戏

极道
极道 · 2026-07-28T00:20:00Z
国产世界模型登顶李飞飞团队榜单!适配国产昇腾算力、代码权重全开源

给它一张图,还你整个世界

国产世界模型登顶李飞飞团队榜单!适配国产昇腾算力、代码权重全开源

量子位
量子位 · 2026-07-24T14:19:06Z
RoboTTT——面向机器人策略的上下文扩展:将TTT集成至VLA中形成序列模型(记忆信息被压缩至快速权重中,训练和推理时皆可更新),如此将视觉-运动上下文扩展到 8K 个时间步

摘要:本文提出RoboTTT方法,通过将测试时训练(TTT)机制整合到机器人基础模型中,实现了8K时间步的长视觉-运动上下文建模。该方法采用快速权重机制,在训练和推理时动态更新模型参数,将历史信息压缩至权重空间,解决了长上下文建模的三大挑战。实验表明,RoboTTT-8K相比单步基线在复杂任务中性能提升87%,首次证明扩展上下文长度能稳定提升闭环性能(比1K上下文模型提升63%)。创新性地结...

RoboTTT——面向机器人策略的上下文扩展:将TTT集成至VLA中形成序列模型(记忆信息被压缩至快速权重中,训练和推理时皆可更新),如此将视觉-运动上下文扩展到 8K 个时间步

结构之法 算法之道
结构之法 算法之道 · 2026-07-21T15:49:12Z
如果AI模型开源了权重,这算不算"AI倾销"新玩法

100亿美元AI模型开源,这算不算"AI倾销"新玩法?短期狂欢背后藏着长期减速铁律 前沿大模型的开源正撕裂AI圈。支持者说这是创新加速器,反对者说这是砸盘式倾销。但双方都忽略了一个更隐蔽的问题:当百亿训练成本的成果被免费扩散,短期应用层的狂欢可能正在掏空下一代基座模型的研发血液。 围绕大模型训练成本、消费者剩余、研发激励和竞争格局,开放权重正在引发技术社区与资本市场最激烈的争论。...

如果AI模型开源了权重,这算不算"AI倾销"新玩法

极道
极道 · 2026-07-20T23:47:00Z
谷歌将Gemini权重焊死在Frozen专用芯片:性能碾压自家TPU十倍

谷歌这次玩得够狠,自家AI芯片直接比TPU快6到10倍,这不是造芯,这是要造核弹吧? 谷歌被自家AI模型逼疯了,干脆造了一款专供Gemini“开小灶”的芯片,速度直接飙到TPU的10倍,但万一模型架构换口味,这宝贝可能变砖头。 谷歌被自己养的AI怪兽逼到墙角造了个偏科芯片...

谷歌将Gemini权重焊死在Frozen专用芯片:性能碾压自家TPU十倍

极道
极道 · 2026-07-20T23:14:00Z

python脚本之批量查询网站权重

像清水一般清澈透明
像清水一般清澈透明 · 2026-07-18T08:05:58Z

python脚本之批量查询网站权重2.0

像清水一般清澈透明
像清水一般清澈透明 · 2026-07-18T08:05:58Z

本文介绍了如何使用Python脚本批量查询网站权重。用户需将待查询的网站保存在同一目录下的websites.txt文件中,并在命令行或集成环境中运行脚本。

python脚本之批量查询网站权重

像清水一般清澈透明
像清水一般清澈透明 · 2026-07-17T14:14:20Z

本文介绍了Python脚本的批量查询网站权重2.0版本,支持任意URL,自动识别域名,使用更加方便。用户可参考1.0版本的使用方法。

python脚本之批量查询网站权重2.0

像清水一般清澈透明
像清水一般清澈透明 · 2026-07-17T14:14:20Z
开放权重模型交易量激增至29%,代币价格趋于平稳

2026年7月的AI网关生产指数显示,6月代币交易量增长29%,支出增长27%。开放权重模型占29%的代币,DeepSeek成为第三大模型。Anthropic占61%的支出,OpenAI在图像生成中领先。Claude Fable 5发布后因美国出口管制暂停访问。整体AI投资持续增长,企业在模型支出上更加战略性。

开放权重模型交易量激增至29%,代币价格趋于平稳

Vercel News
Vercel News · 2026-07-13T07:00:00Z
T-WAM——用于富接触操作的视觉-触觉世界动作模型:在统一的流匹配框架下联合学习未来视觉预测、触觉形变预测以及动作预测(且在插入透明导管场景中增大触觉的权重)

VT-WAM是一种视觉-触觉世界动作模型,旨在提升机器人在复杂环境中的操作能力。它结合视觉和触觉信息,通过非对称MoT注意力和接触门控机制优化动作预测,强调触觉动态的重要性,以克服视觉信息的主导偏差。

T-WAM——用于富接触操作的视觉-触觉世界动作模型:在统一的流匹配框架下联合学习未来视觉预测、触觉形变预测以及动作预测(且在插入透明导管场景中增大触觉的权重)

结构之法 算法之道
结构之法 算法之道 · 2026-07-12T07:42:05Z

精通炼丹的同学都知道,步长调度,或者说学习率调度(LR Schedule),对模型最终效果来说至关重要。我们在前几篇文章中已经推导过,即便只考虑SGD,终点收敛的最优学习率函数也具有Warmup...

让炼丹更科学一些(七):步长调度与权重平均

科学空间|Scientific Spaces
科学空间|Scientific Spaces · 2026-07-06T02:03:00Z
Kimi K2.7 Code 进入 GitHub Copilot:开放权重模型正在走向开发工具主入口

GitHub Copilot 新增 Kimi K2.7 Code 开放权重模型,首次引入开放模型选择。这一变化标志着代码助手的分发渠道从闭源转向可比较的模型组合,提升了开发者的选择空间。开放权重模型在真实项目中接受检验,开发者需关注数据处理和合规性,对国内开发者生态产生积极影响,鼓励多样化选择和提高代码质量。

Kimi K2.7 Code 进入 GitHub Copilot:开放权重模型正在走向开发工具主入口

mongona news
mongona news · 2026-07-02T22:39:18Z
从 Anthropic 创始人观点看:AI 开源为什么不能只看权重是否公开

Anthropic创始人Dario Amodei指出,AI开源并非简单问题,涉及代码、训练数据和流程等多个方面。开放模型可以降低实验门槛并促进创新,但也存在滥用风险。因此,应分层讨论开源问题,关注模型的具体开放程度,而非仅仅是“开源”标签。开发者在选择模型时需考虑约束和实际需求。

从 Anthropic 创始人观点看:AI 开源为什么不能只看权重是否公开

mongona news
mongona news · 2026-06-30T22:39:19Z

GLM-5.2是新一代开放权重模型,性能接近顶级闭源模型GPT-5.5,成本仅为其三分之一。该模型拥有7000亿参数,实际运行时激活400亿,推理能力显著提升。推理过程消耗token较多,最大强度下需42000个token。用户可通过调整推理强度优化性价比,日常任务使用中等强度即可。尽管在非幻觉率测试中表现优异,但缺乏视觉输入能力,API稳定性需改进。

开放权重模型新王者GLM-5.2:顶级性能平民价格

极道
极道 · 2026-06-17T12:02:00Z
开放权重模型如何改变了人工智能领域

开放权重模型在人工智能领域带来了变革。不同团队通过共享技术报告和模型参数,促进了合作与创新。主要架构为混合专家(MoE),各团队在注意力策略、专家数量和训练方法上有所不同。这种开放生态系统推动了技术进步,尽管闭源团队也在进行创新。

开放权重模型如何改变了人工智能领域

ByteByteGo Newsletter
ByteByteGo Newsletter · 2026-06-16T15:31:09Z
Modular:零日:MiniMax M3在Modular云上的开放权重

MiniMax M3是最新的开源模型,优化了编码和多模态任务。其稀疏注意力机制显著提高了计算效率,减少了每个令牌的计算需求,提升了速度。该模型在Modular平台上可供企业客户使用,支持实时患者对话的灵活推理。

Modular:零日:MiniMax M3在Modular云上的开放权重

Modular Blog
Modular Blog · 2026-06-11T00:00:00Z
Miso Labs发布MisoTTS:一款拥有开放权重的80亿情感文本转语音模型

Miso Labs发布了MisoTTS,这是一款拥有80亿参数的文本转语音模型,采用残差矢量量化技术,能够根据文本和音频上下文生成富有表现力的语音。该模型的词汇量可扩展至约2048³²,支持半双工传输,API访问正在开发中。

Miso Labs发布MisoTTS:一款拥有开放权重的80亿情感文本转语音模型

实时互动网
实时互动网 · 2026-06-05T03:07:15Z
Galaxea G0.5——升级“VLA自回归建模”范式:摒弃VLM上添加动作专家的模式,而是构建统一模型,用一套权重,在同一个自回归token序列中同时生成推理与动作(含VLA-0的详解)

星海图提出的G0.5模型将视觉语言模型与动作生成统一为单一自回归序列,通过共享权重实现推理与动作的耦合,提升机器人控制效率。该模型采用可学习的动作分词器和视觉记忆模块,优化动作生成过程,减少离散化负担,能够在零样本条件下分解任务,直接生成动作,增强对复杂场景的适应能力。

Galaxea G0.5——升级“VLA自回归建模”范式:摒弃VLM上添加动作专家的模式,而是构建统一模型,用一套权重,在同一个自回归token序列中同时生成推理与动作(含VLA-0的详解)

结构之法 算法之道
结构之法 算法之道 · 2026-06-04T10:18:09Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码