内容提要
模型、框框(harness)和算力是三个常被混淆的概念。模型是大脑,负责生成回复;框框是外壳,提供工具、任务循环和记忆,决定模型能否干活;算力是资源,影响速度和稳定性。选模型看性格,选框看实际任务,额度不足则需运维解决。判断框的好坏,可离开片刻看其自主推进任务的能力。
延伸解读
模型、框框、算力:三层概念为何常被混淆
文章指出,模型、框框(harness)和算力是三个常被混淆的概念,因为在实际使用中它们表现为同一个“它”。答错、干不动活、转圈圈,都被归咎于同一个对象。这种混淆导致错误归因,例如将框的不足归咎于模型,或将限流误认为模型变笨。作者建议在抱怨前先自问:是不聪明(模型)、够不着(框)还是没力气(算力),以便对症下药。
框框(harness)的实际影响:同一模型,不同表现
文章强调,同一个模型装在不同的框框中,实际能力差异巨大。例如,Claude模型在网页聊天框中无法访问本地文件,但在Claude Code中能自主完成质检任务。框框提供工具集、任务循环、上下文管理和记忆等功能,决定模型能否实际执行任务。因此,当模型表现不佳时,可能是框框的限制,而非模型本身的问题。
判断框框好坏:泡杯茶的测试法
作者提供了一个简单实用的方法来判断框框的好坏:离开片刻,观察其能否自主推进任务。能自己规划、试错并推进工作的框才是真正有效的。这个测试强调框框的自主性和实用性,而非依赖评测榜或他人体感。因为框框没有榜单,其好坏完全取决于实际任务的需求。
Q&A
模型、框框和算力分别指什么?
模型是大脑,负责生成回复;框框(harness)是外壳,提供工具、任务循环和记忆;算力是资源,影响速度和稳定性。
为什么同一个模型在不同工具中表现差异巨大?
因为模型只是大脑,实际能力取决于框框(harness)提供的工具和任务循环。例如,同一个Claude模型在网页聊天框中无法访问本地文件,但在Claude Code中能自主完成质检任务。
如何判断一个框框(harness)的好坏?
可以离开片刻,观察它能否自主规划、试错并推进任务。能自己往前拱的框才是真正有效的。
算力不足时应该怎么解决?
算力不足通常通过运维手段解决,比如账号轮换,与模型智能无关。
为什么人们常常将模型、框框和算力混为一谈?
因为在使用时它们表现为同一个“它”,答错、干不动活、转圈圈都会归咎于它,导致错误归因,如将框的不足归咎于模型,或将限流误认为模型变笨。
选模型时应该考虑什么?
选模型如同挑搭档,取决于个人风格。例如,激进的人可能喜欢Claude,保守的人可能喜欢OpenAI的codex系模型。