➡️
继续阅读
-
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
星尘智能发布SmoothRL框架,解决真实机器人异步执行中的在线强化学习问题。该框架仅对实际执行的动作进行学习,并保持训练与部署节奏一致。在投掷、戴笔帽、...
-
这个世界模型训练完就“退场”,机器人反而更能干了
光象科技联合清华发布物理原生世界模型ActEffect,训练时预测动作后果并优化策略,执行时退出部署以降低成本。在LIBERO等基准测试中成功率领先,已用...
-
微软称几乎无人通过其聊天机器人获取《纽约时报》文章
微软在版权诉讼中辩称,其AI助手Copilot极少复制新闻或书籍内容。在820万条聊天记录中,仅不到1%包含至少16个匹配词,与《纽约时报》等出版商作品有...
-
少年承载了太多年长者的恶臭投射
我在《 为什么尝试理解年轻人的年长者都略显笨拙? 》中提到,有很多自以为懂得年轻人的年长者仅仅是把年轻人当成行为一致的整体来看,而不关注具体的人。他...
-
Facet-0——用价值引导的 RL 教会 VLA 精密装配:动作–力觉联合预测,让接触可预测、可估值(把价值写进接触那一瞬)
Facet-0是一种面向高精度接触操作的机器人基础模型,结合视觉-语言骨干与流匹配动作专家,联合预测动作及未来腕部扭矩,将接触视为可预测结果。基于Manu...
-
BPG 连接建立失败问题
好久没有更新「抓包破案」系列了,最近遇到的一个 case 适合拿出来考一考读者,需要一点点的 BGP 前置知识 […]Continue reading...