零一万物发布千亿参数模型 Yi-Large,李开复:中国大模型赶上美国,立志比肩 GPT-5

零一万物发布千亿参数模型 Yi-Large,李开复:中国大模型赶上美国,立志比肩 GPT-5

💡 原文中文,约4700字,阅读约需12分钟。
📝

内容提要

中国大模型公司零一万物发布了第二款闭源模型Yi-Large,该模型在全球头部大模型的中英文双语PK中表现出色。Yi-Large在AlpacaEval 2.0的模型排行榜上排名世界第二,英语能力主要指标LC Win Rate排名世界第一。零一万物还宣布启动下一代Yi-XLarge MoE模型训练,冲击GPT-5的性能与创新性。此外,零一万物发布了一站式AI工作平台「万知」,提供会议纪要、周报、写作助手等功能。

🔎

延伸解读

评测成绩的含金量

Yi-Large在AlpacaEval 2.0的LC Win Rate排名世界第一,Win Rate世界第二,仅次于GPT-4 Turbo。但需注意,AlpacaEval主要衡量英语指令遵循能力,且LC Win Rate通过控制回复长度来减少长度偏差,仍不能完全代表模型综合能力。此外,SuperCLUE四月基准中Yi-Large位列国产大模型之首,说明其中文能力也得到认可。读者应理性看待榜单,结合具体任务评估模型适用性。

开源与闭源的双线布局

零一万物同时推进闭源模型Yi-Large和开源模型Yi-1.5系列。闭源模型面向API商业调用,开源模型则吸引开发者生态。Yi-1.5提供34B、9B、6B三个版本及Chat微调模型,在数学推理和代码能力上表现优于同参数量级模型,甚至优于Llama-3-8B-Instruct。这种双线策略既可通过开源扩大影响力,又能通过闭源API实现商业变现,但需平衡两者间的资源投入和潜在竞争。

AI普惠与商业落地挑战

李开复强调AI普惠点,即降低推理成本,让更多用户用得起。零一万物推出万知平台,免费提供会议纪要、周报、PPT制作等功能,旨在提升个人工作效率。然而,AI生成内容仍需用户负责,可能存在错误或幻觉,用户需自行修改。李开复透露海外生产力应用总用户近千万,今年ToC单一产品收入达1亿元,ROI约1,显示商业化初具成效,但可持续性仍需观察。

下一代模型与行业竞争

零一万物已启动下一代Yi-XLarge MoE模型训练,目标冲击GPT-5的性能与创新性。李开复认为中国大模型已赶上美国一年前发布的顶尖产品,但未来需沉淀与展望。国内大模型竞争激烈,2024年将进入商业落地阶段,用户按应用效果投票。零一万物采取务实AGI路线,追求最低成本训练最佳模型,并寻找TC-PMF。这种策略能否在巨头环伺中突围,值得关注。

🏷️

标签

➡️

继续阅读