内容提要
B站于9月16日上线“AI无限竞技场”,汇集UP主对上百个大模型的真实场景测评。首期榜单中GPT-6 Astra居首,前五名国产模型占三席。平台不限主题,以真实工作流同题PK呈现模型差异,排名实时更新并开放报名。B站AI内容消费时长同比增长72%,月均观看用户超1.9亿。
延伸解读
测评机制:真实工作流取代传统跑分
B站AI无限竞技场不设固定主题或测评维度,由UP主以真实工作流、专业应用或趣味脑洞自主命题,在同题PK中呈现模型差异。这种模式更贴近实际使用场景,能反映模型在具体任务中的表现,而非仅依赖标准化跑分。首期榜单已涵盖DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千问、Hy、MiniMax等主流模型。
首期榜单看点:GPT-6 Astra登顶,国产模型占三席
在首期榜单中,GPT-6 Astra在10个UP主测评中拿下榜首,击败GLM-5.3获得榜首次数冠军。前五名中国产大模型占据三席,显示出国产模型在真实场景测评中的竞争力。榜单排名将实时更新,并持续面向全站UP主开放报名,后续更多测评案例加入可能改变排名格局。
B站AI生态:消费时长与用户规模双增长
过去一年,B站AI知识内容消费时长同比增长72%,月均观看AI内容的用户超过1.9亿。直播、视频、弹幕等形态适配AI爱好者的信息获取与交流需求,大模型测评在社区沉淀,涌现大量各领域测评内容。AI无限竞技场作为测评集合广场,顺势整合这些分散内容,为用户提供集中了解模型能力边界的入口。
Q&A
B站AI无限竞技场是什么?
B站AI无限竞技场是B站于9月16日上线的平台,汇集了UP主对上百个大模型的真实场景测评,涵盖代码、推理、协作、知识等多种主题。
首期榜单中排名第一的AI模型是哪个?
GPT-6 Astra在10个UP主测评中拿下榜首,排名第一。
AI无限竞技场的测评方式有什么特点?
不设主题或测评维度限制,UP主以真实工作流、专业应用、趣味脑洞等自主命题,在同题PK中直观呈现各模型的实际表现差异。
过去一年B站AI生态的增长数据如何?
AI知识内容消费时长同比增长72%,月均观看AI内容的用户超过1.9亿。
如何参与AI无限竞技场的排名?
竞技场排名实时更新,并持续面向全站UP主开放报名。
首期榜单涵盖了哪些主流模型?
涵盖DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千问、Hy、MiniMax等主流模型。