内容提要
Moonshot AI发布开源模型Kimi K3,定位专业编程工具,价格仅为Anthropic Fable 5的三分之一。测试显示,Kimi K3在三个真实编码任务中与Fable 5结果一致,但耗时是其四倍,总成本2.13美元对5.98美元。Kimi K3虽成本低,但速度慢,需提升效率才能与竞品抗衡。
延伸解读
成本优势背后的代价
Kimi K3 的 API 定价仅为 Fable 5 的三分之一,但测试显示其总成本(2.13 美元)也恰好约为 Fable(5.98 美元)的三分之一。然而,这一优势完全来自更低的单价,而非更高的效率——Kimi 实际消耗了更多 token(3.3M vs 2.4M)。对于开发者而言,若时间成本敏感,单纯的低价可能不足以构成选择理由。
速度是当前最大短板
在三个真实编码任务中,Kimi K3 的总耗时超过 28 分钟,而 Fable 5 不到 7 分钟,差距达 4 倍。尤其在重构任务中,Kimi 耗时 14 分 50 秒,成为作者近期测试中最慢的一次。尽管 Kimi 在验证行为未变上更为细致(如快照二进制),但速度劣势可能限制其在生产环境中的实用性。
开源与生态的潜在影响
Kimi K3 是 2.8 万亿参数的开源权重模型,为中国最大。虽然目前尚未集成到 Cursor 等主流工具,但开源特性可能吸引开发者自行集成或微调。不过,作者指出当前 AI 工具仍处于免费试用时代,速度比成本更重要,因此 Kimi 需在后续迭代中大幅提升速度,才能与 Claude、GPT 等成熟产品竞争。
Q&A
Kimi K3和Claude Fable 5在三个编码任务上的结果和成本对比如何?
在三个真实编码任务中,Kimi K3与Claude Fable 5的结果完全一致,但Kimi K3的总成本为2.13美元,而Fable 5为5.98美元,Kimi K3的成本约为Fable 5的三分之一。
Kimi K3的定价是多少?与Anthropic的Fable 5相比如何?
Kimi K3的API定价为每百万输入token 3美元,每百万输出token 15美元。Anthropic的Fable 5定价为每百万输入token 10美元,每百万输出token 50美元。Kimi K3的输入和输出价格均约为Fable 5的三分之一。
Kimi K3在三个编码任务中分别耗时多少?与Fable 5相比速度如何?
在三个任务中,Kimi K3分别耗时3分7秒、14分50秒和10分21秒,总计约28分钟;而Fable 5分别耗时1分4秒、3分11秒和2分34秒,总计不到7分钟。Kimi K3的速度约为Fable 5的四分之一。
Kimi K3在测试中使用了多少token?与Fable 5相比如何?
Kimi K3在三个任务中总共使用了约330万token,而Fable 5使用了约240万token。Kimi K3的token消耗量高于Fable 5。
Kimi K3在测试中表现如何?是否与Fable 5的结果一致?
在三个编码任务中,Kimi K3与Fable 5的结果完全一致,包括修复bug、重构代码和添加新功能。例如,在修复bug任务中,两个模型都删除了src/main.rs中的同一行代码,且所有测试均通过。
Kimi K3在测试中遇到了哪些问题?
Kimi K3在测试中遇到的主要问题是速度慢,耗时是Fable 5的四倍。此外,在测试开始时,由于API账户余额不足,命令挂起并出现429错误,但充值后获得了5美元的赠金。
作者对Kimi K3的总体评价是什么?
作者认为Kimi K3的结果扎实,但速度太慢,在当前竞争激烈的市场中难以立足。作者指出,虽然成本低,但速度比成本更重要,Kimi K3需要将速度提升约5倍才能与竞品抗衡。不过,作者也认为这是K3的第一个公开版本,未来有望改进。