➡️
继续阅读
-
把Agent放进真实尺度香港,上交大/新加坡国立大学/美团等提出UrbanGround,测试多模态模型城市探索能力
该文章介绍了一项关于多模态大语言模型(MLLM)在城市导航中能力的研究。研究团队构建了基于香港真实地理数据的URBANGROUND交互环境,评测了GPT-...
-
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
星尘智能发布SmoothRL框架,解决真实机器人异步执行中的在线强化学习问题。该框架仅对实际执行的动作进行学习,并保持训练与部署节奏一致。在投掷、戴笔帽、...
-
一分钟读论文:《推理链里的顿悟时刻,多半是预算给的错觉》
该预印本指出,LLM推理轨迹研究中“顿悟时刻”和早期内部信号预测成败的结论多为测量伪影。通过重启对照和难度基线实验,发现前者仅1/178案例有效,后者AU...
-
早报|苹果将迎来史上最大产品发布潮/微信小微内测Agent间沟通/何庭波发布「韬定律」新论文
苹果将迎来史上最大产品发布潮,包括折叠屏iPhone和iPhone 18 Pro;GPT-6 Astra全量发布;Anthropic用Claude完成费马...
-
2026 09 05 HackerNews
OpenAI发布GPT-6 Astra,号称最智能且对齐最好的模型,在多项基准测试中表现优异,几乎无越权行为,已开始向部分用户推出。同时,研究发现Open...
-
“对混乱的发布感到抱歉”:OpenAI推出GPT-6 Astra,但开发者被拒之门外
OpenAI发布GPT-6 Astra,但发布过程混乱,CEO Sam Altman道歉。API和ChatGPT订阅用户尚未获得广泛访问权限,预计先从Pr...