匿名牛来大模型被扒出智谱血缘,也有人怀疑Cursor拿开源GLM训的

匿名牛来大模型被扒出智谱血缘,也有人怀疑Cursor拿开源GLM训的

💡 原文中文,约4000字,阅读约需10分钟。
📝

内容提要

匿名模型“Ox Alpha”(牛来大模型)现身OpenRouter,因技术特征引发身份猜测。网友通过Tokenizer、视频编码和API错误信息比对,认为其可能来自智谱(GLM系列),或谷歌Gemini。该模型支持百万级上下文和多模态输入,在代码任务中表现亮眼,但评测结果分歧大。目前身份未定,社区持续追踪。

🔎

延伸解读

技术指纹:Tokenizer与视频编码的“DNA鉴定”

社区通过Tokenizer分词一致性、视频token消耗模式等底层技术细节,将Ox Alpha与智谱GLM系列关联。例如,相同文本下Ox Alpha与GLM-5.3的token计数呈固定偏移,视频编码的采样策略和token增长率也高度吻合。这些特征涉及模型架构和预处理设计,难以通过简单模仿复制,因此成为身份猜测的重要依据。

身份猜测的局限:外部行为不等于训练来源

尽管技术指纹指向智谱,但社区也指出,模型外部行为可能受蒸馏、后训练或第三方部署影响。例如,API错误信息相似可能源于服务层配置,而非模型本身。文章强调,仅凭外部测试难以确定“谁训练的”和“谁部署的”,这反映了当前AI模型匿名化和复用趋势下的识别难题。

评测分歧:小样本测试与真实性能的差距

Ox Alpha在社区测试中表现亮眼(如10个任务完成8个),但Abacus.AI CEO等反馈其低于预期,沃顿教授也认为“一般”。文章指出,小样本测试不具代表性,且不同测试条件(如推理强度、视觉任务)可能导致结果差异。这提醒读者,对匿名模型的性能评价需谨慎,应参考多来源、大规模基准。

Q&A

牛来大模型(Ox Alpha)是什么?它有什么特点?

牛来大模型(Ox Alpha)是一个匿名出现在OpenRouter上的模型,具有104.86万token的上下文窗口,单次最多输出13.1万token,支持文本、图片和视频输入,专注于代码、长周期Agent和复杂推理任务。

网友为什么猜测牛来大模型是智谱的?

网友通过Tokenizer测试发现Ox Alpha与GLM-5.3的token计数高度一致,视频编码和token预算与GLM-5V-Turbo相似,API错误信息也与智谱相关服务相似,因此猜测它可能来自智谱。

为什么也有人认为牛来大模型是谷歌的Gemini?

因为Ox Alpha的产品画像(超长上下文、原生多模态、面向Agent)与Gemini方向一致,且谷歌有未发布的Gemini 3.5 Pro,加上DeepMind员工的模糊发言,引发了猜测。

牛来大模型在代码任务上的表现如何?

在包含10个真实软件工程任务的社区测试中,Ox Alpha完成了8个,成功率80%,高于Fable 5(65%)、GLM-5.3(62%)和GPT-5.6 Sol(52%),但这是小样本测试,不代表综合能力。

牛来大模型有哪些负面评价?

Abacus.AI CEO表示测试表现低于预期,沃顿商学院教授Ethan Mollick认为惊艳程度一般,也有开发者发现它在低推理强度下表现一般,视觉任务弱于Gemini系列。

牛来大模型的使用量如何?

OpenCode公开数据显示,Ox Alpha累计使用量达250B token级别,拥有约8500名独立用户和超过11万次完成会话。

牛来大模型的身份最终确定了吗?

目前尚未确定,社区仍在追踪。OpenRouter匿名期结束后可能会揭晓,但现阶段没有公开证据确认其开发者。

🏷️

标签

➡️

继续阅读