➡️
继续阅读
-
2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体
亮源新创提出Physical AI三段范式:规模化预训练、对齐与部署,并发布三项技术。LightParkour用强化学习将单个动作扩展为可泛化技能分布;L...
-
VLA-Precision——用于在线RL的VLA非对称协同自举方法:以人工纠偏行为克隆提速、渐进价值校准稳策、相对优势更新防漂移
论文提出VLA-Precision框架,以解决真实世界VLA在线强化学习中的算法稳定性与系统效率瓶颈。算法层面提出ACoB,结合快速行为学习与渐进价值校准...
-
探索RSI,生数新世界模型让机器人开始自我进化
生数科技发布世界模型Motus2,集行动、预测、评估于一体,形成“生成动作—预测后果—评估结果—更新策略”闭环,初步探索机器人自进化。该模型新增触觉与记忆...
-
为善去恶的决策模型
作者以招募前同事为例,分享两个善恶决策模型:一是相信命中注定,坦然接受福祸;二是借鉴王阳明“为善去恶”的心学,在无人监督时依良知做出正确选择。
-
NVIDIA把供应链专家经验训练进模型,关键不是换一个更大模型
NVIDIA供应链案例表明,专用30B模型经专家决策轨迹训练后,在内部基准上超越更大通用模型。关键在于记录专家决策时的所见、理由与结果,并避免数据泄漏。企...
-
ChatGPT服务10亿周用户后,最难扩展的可能不是模型
OpenAI披露Habitat存储平台,每秒处理超7000万请求、500PB数据,支撑10亿周用户。该平台从Python客户端库演变为统一服务,2026年...