Text-to-3D Policy进阶
T3DP:细粒度语言-行为对齐提升文本到3D策略的未见过规格泛化
本文提出T3DP框架,通过在指令token和局部行为表示之间建立双向细粒度对齐,让3D扩散策略能执行训练中未出现的精细行为规格。在Meta-World、ManiSkill和RoboTwin上,T3DP较全局语言-行为对齐平均成功率提升11.0至14.2个百分点;在真实机器人上平均成功率从47.5%升至65.0%。该工作为预印本,尚未经过同行评审。
机器人与具身智能领域的最新论文,以及每篇对产业的意义。
本文提出T3DP框架,通过在指令token和局部行为表示之间建立双向细粒度对齐,让3D扩散策略能执行训练中未出现的精细行为规格。在Meta-World、ManiSkill和RoboTwin上,T3DP较全局语言-行为对齐平均成功率提升11.0至14.2个百分点;在真实机器人上平均成功率从47.5%升至65.0%。该工作为预印本,尚未经过同行评审。
论文来自 arXiv 机器人领域。尚未生成摘要的论文,显示摘要开头部分。