ACE-Ego-0:统一具身视角人类与机器人数据的 VLA 预训练框架
一种统一的视觉-语言-动作预训练框架,通过可靠性感知训练方法整合异构数据源(包括人类自我中心视角视频和机器人轨迹),提升具身AI任务性能。
查看原文解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。
一种统一的视觉-语言-动作预训练框架,通过可靠性感知训练方法整合异构数据源(包括人类自我中心视角视频和机器人轨迹),提升具身AI任务性能。
查看原文