Yufei Liu
収録論文 8本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DreamHand: ビデオ拡散モデルを転用した、遮蔽に頑健な自己中心視点3D手動作復元手動作復元2026/8/20
ビデオ拡散モデルを決定的な幾何エンコーダとして転用し、遮蔽やフレーム外の手の動きを復元する新しい手法を提案。5つのベンチマークでSOTAを達成し、特に遮蔽の多いデータで誤差を大幅に削減した。
- ビデオ拡散モデルの手の動き再構築における驚くべき有効性手の動き再構築2026/6/29
事前学習済みのビデオ拡散モデルの表現を活用し、自己中心視点のビデオから4Dの両手のポーズを再構築する手法を提案。検出器やテスト時最適化を不要とし、既存手法を大幅に上回る性能を達成した。
- ACE-Ego-0: 自己中心視点の人間とロボットデータを統合したVLA事前学習VLA2026/6/1
ロボットの軌跡データ収集のコストを抑えるため、大規模な自己中心視点の人間ビデオを擬似行動ラベルに変換し、ロボットデータと統合してVLAモデルを事前学習するフレームワークを提案した。
- VTouch++: バイマニュアル操作のための視覚ベース触覚拡張を備えたマルチモーダルデータセットデータセット/触覚/バイマニュアル操作2026/4/1
両手操作の接触を伴うタスクを改善するため、視覚ベースの触覚センシングを用いた大規模マルチモーダルデータセットVTOUCHを構築し、その有効性を実験と実ロボット評価で示した。
- GeoLoco: 視覚基盤モデルの3D幾何学的先験知識を活用したRGBのみによる頑健な人型ロコモーション歩行2026/3/1
深度センサーに頼らず、単眼RGB画像と視覚基盤モデルの幾何学的先験知識を用いて、シミュレーションのみで訓練した人型ロボットの歩行制御を実現し、実機へのゼロショット転送を可能にした。
- InternVLA-A1:ロボットマニピュレーションのための理解・生成・行動の統合VLA2026/1/1
シーン理解・視覚的予測・行動実行の3つの専門家をMixture-of-Transformersで統合したVLAモデルを提案し、実世界12タスクで既存手法を上回る性能を達成した。
- MILE: 巧みな操作のデータ収集のための機械的同型ハンドエクソスケルトンと視触覚ロボットハンドテレオペレーション/触覚2025/12/1
人間の手の構造に基づくエクソスケルトンと、それに対応する視触覚ロボットハンドを開発し、巧みな操作の実演データを同期収集できるテレオペレーションシステムを構築した。
- Astra:階層型マルチモーダル学習による汎用移動ロボットの実現移動ロボットナビゲーション2025/6/1
マルチモーダルLLMとマルチタスクネットワークを組み合わせた二重モデルアーキテクチャにより、多様な屋内環境で移動ロボットのナビゲーションを実現した。