内容提要
Anthropic将Claude聊天与Cowork合并为统一界面,可自动路由任务,与OpenAI的Work模式趋同。作者用三项开发者任务对比测试:两者准确率相同,ChatGPT速度更快、输出token少约22%,但Claude细节更丰富,如补充API限制、标注舍入判断和百分位方法。作者最终选择Claude,认为细节更重要。
延伸解读
统一界面背后的产品逻辑
Anthropic将Claude聊天与Cowork合并,是为了解决用户选择模式的困扰,让系统自动路由任务。这与OpenAI的Work模式思路一致,后者也整合了Chat和Work。这种趋同表明,AI助手正从多模式分立转向统一入口,以降低使用门槛。但合并后,用户可能失去对任务执行方式的显式控制,需要适应自动路由的决策。
速度与细节的权衡
在三个开发者任务测试中,ChatGPT速度更快,输出token少约22%,但Claude提供了更多细节,如API限制、舍入判断和百分位方法。作者最终选择Claude,认为细节更重要。这反映出在准确率相同的情况下,用户对效率与深度的偏好不同。对于需要审计或高可靠性的任务,额外细节可能比节省时间更有价值。
测试结果的局限性
测试仅基于三个任务,且由单一作者执行,样本有限。虽然覆盖了API研究、代码生成和数据分析,但未涉及更复杂或交互式场景。此外,Claude的额外输出可能包含无关内容,而ChatGPT的简洁也可能遗漏关键上下文。因此,结论不宜过度推广,实际选择应结合具体工作流和容错要求。
Q&A
Anthropic 把 Claude 聊天和 Cowork 合并后有什么变化?
合并为统一界面,用户无需再选择模式,只需提问或交办多步骤任务,Claude 会自动路由。该更新先向 Pro 和 Max 订阅者推出,免费和团队版后续跟进。
OpenAI 的 Work 模式和 Claude 的新界面有什么相似之处?
两者都提供统一界面,自动路由任务,无需用户手动切换模式。OpenAI 的 Work 模式是一个沙盒环境,包含浏览器、代码执行和文件输出,与 Chat 切换并列在同一窗口。
在开发者任务测试中,Claude 和 ChatGPT 的准确率如何?
两者准确率相同。在所有测试中,每个字段、每个测试用例、每个数字都匹配,并且都引用了真实文档。
Claude 和 ChatGPT 在速度和输出 token 上有什么差异?
ChatGPT 在每个任务上都更快,并且输出 token 比 Claude 少约 22%(ChatGPT 1,933 个,Claude 2,468 个)。
Claude 在细节方面比 ChatGPT 多提供了哪些内容?
Claude 补充了 API 限制(如 GitHub Actions 令牌限制、Twilio 队列窗口、OpenAI 层级阈值)、标注了舍入判断(0.5 秒向上取整是选择)、说明了百分位方法(线性插值),并提供了额外上下文。
作者最终推荐哪个工具,为什么?
作者选择 Claude,因为它在所有三项测试中都提供了更有意义的细节,包括额外的 API 上下文、舍入判断和百分位方法。在 AI 可能编造信息的今天,细节更重要。