SpaceXAI发布Grok 4.6模型,专注长时程任务和可视化交互,经补充训练提升软件工程、编程等能力,并增强自我测试。基准测试表现持平或略逊于竞品。定价为输入2美元、输出6美元、缓存0.5美元每百万,超200K部分翻倍,快速模式加倍。现已在Cursor和Grok Build提供。
该研究提出了一种利用大型语言模型的框架,用于对新颖物体和未知任务进行操作,并用于指导长时程任务执行中动态运动基元轨迹的生成和调整。实验证明该框架在涉及新对象的熟悉任务和新颖但相关任务上的有效性,显示了大型语言模型在提升机器人系统的多功能性和适应性方面的潜力。
完成下面两步后,将自动完成登录并继续当前操作。