内容提要
作者对比了Fable 5、Opus 5、Codex 5.6 Sol和Kimi K3四款AI模型的主观体验。Fable 5最强,适合核心项目;Opus 5作为辅助;Codex 5.6耐用且性价比高;Kimi K3智商不错但算力不足。作者认为Anthropic在编程领域的垄断地位将结束,期待更多竞争。
延伸解读
模型分工策略
作者根据各模型特点进行分工:Fable 5用于核心项目,Opus 5作为其子代理,Codex 5.6 Sol用于日常任务,Kimi K3用于短任务。这种策略可提高效率,但需注意各模型的限额和适用场景。
算力与限额的权衡
Kimi K3虽智商不错,但算力不足,5小时限制很快触发,不适合长任务。而Codex 5.6 Sol Max非常耐用,即使API成本高,也因重置而用不完。选择模型时需权衡性能与可用性。
竞争格局变化
作者认为Anthropic在编程领域的垄断地位将结束,因为Codex 5.6和Kimi K3的追赶超出预期。这预示着更多竞争,可能带来更丰富的选择和更快的进步。
Q&A
Fable 5、Opus 5、Codex 5.6 Sol 和 Kimi K3 这四款模型的主观体验对比如何?
作者主观认为 Fable 5 最强,适合核心项目;Opus 5 作为 Fable 的辅助;Codex 5.6 Sol 介于两者之间且非常耐用;Kimi K3 智商不错但算力不足。
Fable 5 在 xHigh effort 下的表现如何?
Fable 5 在 xHigh effort 下依然最强,即使被削弱,也能一次生成可用产出,并能指导 subagent 取得不错结果。
Opus 5 相比 Opus 4.8 有何改进?作者如何使用它?
Opus 5 比 Opus 4.8 更好,但单独讨论需求和实现不太靠谱,需要多次交互。作者将其作为 Fable 5 的 subagent 使用。
Codex 5.6 Sol Max 的优势是什么?
Codex 5.6 Sol Max 比 Opus 5 好,但不如 Fable 5,介于中间。它非常耐用,额度经常用不完,适合在 Fable 用完后顶上。
Kimi K3 Max 有哪些优缺点?
Kimi K3 智商不错,可与 Codex 5.6 相比,且限制较少。但它的 Kimi Code 不如前两家,且算力不足,5小时限制很快触发,不适合长任务。
作者对编程领域竞争格局的看法是什么?
作者认为 Anthropic 在编程领域的垄断地位将结束,Kimi K3 的出现令人意外,期待更多竞争。