Xiao-xiao Long
収録論文 2本 ・ フィジカルAI/ロボット学習
sim2realVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BeyondRetarget: 単眼動画から直接ヒューマノイド動作を学習sim2real2026/9/24
人間の動作表現を介さず、単眼RGB動画から直接ヒューマノイドロボットの動作を生成するエンドツーエンドフレームワークを提案し、接触を考慮した最適化で実行成功率と精度を向上させた。
- PEAfowl: 知覚強化型マルチビュー視覚-言語-行動モデルによる両腕マニピュレーションVLA2026/1/1
両腕ロボット操作のためのVLAモデル。トークンごとの深度分布予測と微分可能な3Dリフティングで視点間の幾何学的整合性を高め、Perceiver型のテキスト認識読み出しで指示の接地を改善。訓練時のみの深度蒸留でノイズの多い深度を補い、RoboTwin 2.0で成功率を23ポイント向上させた。