REFACTOR-VLA是一种通过“唤醒/睡眠”架构学习可复用技能的系统,利用行为等价核聚类动作片段,并生成类型化lambda程序。在LIBERO基准测试中,增大世界模型参数反而降低性能,而加入InfoNCE辅助对比损失显著提升技能聚类质量,各套件NMI值达0.462至0.915。
完成下面两步后,将自动完成登录并继续当前操作。