Text-to-3D Policy中級
T3DPが未見仕様の汎化を改善、言語と3D行動の局所アライメントで成功率向上
本プレプリントは、3Dビジオモータポリシーが学習時に見ていない細粒度な行動仕様を言語から実行する問題に取り組み、T3DPと呼ぶ枠組みを提案した。T3DPは指示のトークンと行動セグメントの局所的な対応関係を双方向に学習し、類似仕様を混同しない言語表現を獲得する。シミュレーション3ベンチマークで平均成功率をグローバルアライメント比11.0〜14.2ポイント、実機で47.5%から65.0%へ17.5ポイント改善した。