内容提要
OpenRouter匿名上线union-alpha模型,宣称一周免费无限使用,但实测吞吐仅每秒15-19个token,速度远逊主流模型。其跑分图用截断坐标轴夸大编程能力,实际指令遵循差、任务常无有效产出。所谓无限受每日50次配额限制。该模型身份成谜,疑似中国实验室盲测,实战表现不佳,免费背后用户数据或被用于训练。
延伸解读
跑分图表的视觉误导
union-alpha的跑分图采用截断坐标轴,横坐标从60起步,放大了微小差距。这种手法在数据可视化中常见,容易误导读者。实际编程能力需结合真实任务评估,不能仅凭图表判断。
免费无限的真实限制
宣传的免费无限使用受OpenRouter平台规则限制:账户余额低于10美元时,每天最多调用50次免费模型。加上每秒15-19 token的吞吐量,实际可用性大打折扣。用户需注意配额和速度瓶颈。
匿名模型的盲测风险
匿名发布让厂商获得无品牌偏见的反馈,但用户贡献测试数据却面临模型随时下线、数据被用于训练的风险。参与盲测时,避免输入敏感信息,用公开任务测试即可。
编程能力的隐藏维度
除跑分外,真实编程还需指令遵循、长上下文一致性和工具调用稳定性。union-alpha在这些方面表现不佳,有用户反馈其拒绝执行规则、任务无有效产出。评估模型时需多维度测试。
Q&A
union-alpha模型在OpenRouter上宣称免费无限使用,实际有哪些限制?
实际使用受OpenRouter免费模型规则限制:账户余额少于10美元时,每天最多调用50次;余额超过10美元时,每天上限1000次。此外,模型吞吐量仅每秒15-19个token,速度远慢于主流模型。
union-alpha的跑分图表为什么被质疑误导?
跑分图表的横坐标不是从0开始,而是从60或更高位置起步,这种截断坐标轴的手法会放大模型间原本微小的差距,使union-alpha在Deep SWE测试中看起来领先,但实际编程体验与图表严重脱节。
union-alpha的实际生成速度是多少?与主流模型相比如何?
实测吞吐量为每秒15-19个token,约每秒10个中文汉字。相比之下,GPT-4o为每秒80-120个token,Claude 3.5 Sonnet为每秒60-90个token,Gemini 2.0 Flash超过每秒200个token。union-alpha速度只有主流模型的四分之一到十分之一。
用户将union-alpha接入Codex或Claude Code等编程工具后遇到了什么问题?
有用户反馈,模型拒绝执行规则文件,修改规则后花费约30分钟修改工单文件,但最终未交付任何有效代码,总结称“实际上并没有真正交付代码”。指令遵循差,任务常无有效产出。
union-alpha的匿名发布模式对厂商和用户各有什么利弊?
对厂商:可获取无品牌滤镜的真实评价,制造话题热度,若翻车可悄悄撤下,损失可控。对用户:贡献免费测试数据和bug报告,但换来的是随时可能下线的匿名端点,且数据可能被用于训练模型。
使用类似union-alpha的免费匿名模型时,有哪些自保建议?
三条建议:1. 先用小任务测试速度,若每秒token数低于30,避免用于超过5分钟的复杂任务;2. 在多轮对话中测试指令遵循,观察是否死守规则;3. 清楚免费背后的数据代价,避免用涉及公司内部业务、客户数据或未公开项目的任务。