黄仁勋为何急推开放权重

黄仁勋为何急推开放权重

💡 原文中文,约9400字,阅读约需23分钟。
📝

内容提要

黄仁勋首次公开支持开放权重倡议,获77家签署,但并非完全开源。其动机源于商业考量:担忧闭源模型促使大厂自研芯片,削弱英伟达地位;更忌惮中国开源模型适配自家算力,动摇CUDA生态。倡议核心在于为蒸馏留空间、反对禁令、鼓励美国自研开放模型。然而美国缺乏资金、商业模式和数据支撑,难以成事,最终或为中国模型扩大发展空间。

🔎

延伸解读

开放权重不等于开源

开放权重模型允许下载、检查和修改参数,但通常不提供训练代码和数据,许可证也可能有限制。这与完整开源AI不同,后者要求提供训练代码、数据及再分发权利。签署倡议的77家并非追求完全开源,而是争夺模型的控制权和分发权,避免一刀切禁止可下载模型。

利益联盟而非理想主义

签署方中真正训练模型的仅占三成,其余七成靠模型扩散获利或获得议价权。例如AMD、英伟达支持,但英特尔、博通缺席;Anthropic因安全顾虑未签,亚马逊、甲骨文因押注闭源伙伴未签。这显示倡议是商业利益联盟,而非自由软件宣言。

美国开放模型面临三重障碍

美国要发展自己的开放权重模型,需克服资金(需数十亿至上百亿美元)、商业模式(开源难盈利)和数据路径依赖(应用公司更倾向用中国模型微调)。此外,美国公司受前沿实验室条款限制,难以蒸馏闭源模型,而中国公司可蒸馏美国模型,且拥有内卷级人才和封闭市场,这些条件美国均不具备。

历史类比:Eclipse成功与AI困境

作者以Borland经历类比:IBM通过开源Eclipse击败Borland,因软件迭代成本低且可插件化。但大模型训练成本高昂,且不可拆分,无法像软件那样逐步改进。即使美国公司训练出模型,也需与中国众多开源模型竞争,胜算不大。

Q&A

黄仁勋为什么突然发布公开信支持开放权重?

黄仁勋推动开放权重倡议主要是出于商业考量。他担心闭源模型会促使大厂自研芯片,削弱英伟达的地位;更忌惮中国开源模型适配自家算力,动摇CUDA生态。因此他呼吁美国发展自己的开放权重模型,以维持英伟达在AI算力市场的优势。

开放权重和完整开源AI有什么区别?

开放权重(open weights)允许模型参数下载、检查和修改,但通常不提供训练代码和数据,许可证也可能有限制。完整开源AI(按OSI定义)除了权重,还需提供训练代码、数据信息以及使用、研究、修改和再分发的权利。开放权重不等于完整开源。

哪些公司签署了开放权重倡议?哪些没有?

签署的公司包括英伟达、AMD、Meta、Mistral、Cohere、OpenAI、谷歌、微软等,共77家。未签署的包括Anthropic、亚马逊、甲骨文、英特尔、博通、高通和Arm。中国模型厂商均未签署。

Anthropic为什么没有签署开放权重倡议?

Anthropic没有签署是因为其CEO达里奥·阿莫迪一直认为,能力强的模型一旦开放权重就再也收不回来,别人可以修改模型,原开发者无法控制其后续用途,可能被坏人利用。

开放权重倡议书的核心主张有哪些?

倡议书的核心主张包括:给合法蒸馏留出空间;鼓励美国自己的开放权重模型;承认风险但反对禁令;避免过早限制开放模型。

美国发展开放权重模型面临哪些困难?

美国面临三大困难:资金不足(训练大模型需几十亿甚至上百亿美元);商业模式不成熟(开源模型难以盈利);数据与路径依赖(美国AI公司更倾向于直接使用中国开源模型进行后训练,从头训练不划算)。

中国为什么能做出开源大模型而美国不能?

中国具备三个特殊条件:人才密度高(内卷级);可以蒸馏美国模型(省去昂贵的数据标注);封闭市场(OpenAI和谷歌禁止中国使用,使得本土模型得以发展)。这些条件美国都不具备。

黄仁勋的开放权重倡议最终可能产生什么结果?

文章判断,由于商业环境、资金、模型不可分拆性以及中国工程师的竞争,倡议大概率不会成功,最终可能只是为中国开源模型扩大发展空间。

🏷️

标签

➡️

继续阅读