内容提要
SpaceXAI发布Grok 4.6模型,专注长时程任务和可视化交互,经补充训练提升软件工程、编程等能力,并增强自我测试。基准测试表现持平或略逊于竞品。定价为输入2美元、输出6美元、缓存0.5美元每百万,超200K部分翻倍,快速模式加倍。现已在Cursor和Grok Build提供。
延伸解读
定价策略解析
Grok 4.6 的定价为输入 2 美元、输出 6 美元、缓存 0.5 美元每百万 token,超过 200K 部分价格翻倍。快速模式定价为标准模式的两倍,超出部分则为四倍。这种阶梯式定价鼓励开发者优化 token 使用,但长上下文或高频调用成本可能显著增加。
基准测试的局限性
文章指出 Grok 4.6 在基准测试中与 GPT-5.6 SOL 持平或低于 Claude Fable 5,且部分竞争数据来自公开系统卡,未经独立验证。因此,基准分数仅供参考,实际性能需通过开发者日常使用来评估,尤其在长时程任务和交互式可视化场景中。
应用场景与限制
Grok 4.6 的增强能力主要体现在长时程任务和交互式视觉项目,如跨文件代码修改和原型开发,但实际效果取决于任务复杂度、工具调用环境及用户需求理解。目前仅在 Cursor 和 Grok Build 中提供,首周订阅用户可获两倍额度,开发者可通过 API 调用。
Q&A
Grok 4.6 模型的主要特点是什么?
Grok 4.6 是 SpaceXAI 推出的新模型,专注于长时程任务和交互式可视化复杂任务,提升了代码开发、软件工程、知识工作等能力,并加强了自我测试和结果验证能力。
Grok 4.6 在哪些任务上进行了重点训练?
Grok 4.6 在软件工程、知识工作、通用编程、内核优化、网页开发和计算机辅助设计等任务上进行了重点训练。
Grok 4.6 的定价是多少?
Grok 4.6 的定价为:输入每百万 token 2 美元,输出每百万 token 6 美元,缓存每百万 token 0.5 美元。超过 200K token 的部分价格翻倍,快速模式价格为标准定价的两倍。
Grok 4.6 在基准测试中的表现如何?
Grok 4.6 在基准测试中的表现比之前版本更好,但整体上没有特别领先,与 GPT-5.6 SOL 持平或低于 Claude Fable 5 等模型,处于头部但未领先。
Grok 4.6 目前可以在哪些平台使用?
Grok 4.6 目前已在 Cursor 和 Grok Build 中提供,开发者也可以通过 API 调用,其他模型平台也会陆续提供。
Grok 4.6 的模型窗口和知识库时间是什么?
Grok 4.6 的模型窗口为 500K,知识库时间截止到 2026 年 2 月 1 日。