BeingBeyond发布首个基于人类视频数据的隐式触觉世界动作模型Being-H0.8,将触觉纳入“预测-执行-反馈”链路。模型通过TactoHand从无触觉标注视频中推断接触,通用触觉编码器统一信号,TopoHand对齐动作,并利用超50万小时数据训练,实现包中取物、毛笔写字等精细任务。
完成下面两步后,将自动完成登录并继续当前操作。