Lingjie Liu
収録論文 9本 ・ フィジカルAI/ロボット学習
動画生成VLAマニピュレーションモーション生成/模倣学習sim2real動作予測
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PhysStream: 構造化シーンメモリと細粒度運動制御による物理に基づくストリーミング動画生成動画生成2026/9/15
生成途中でも物理的に意味のある速度変化信号で動画内の物体運動を細かく操作できる自己回帰型の画像から動画への生成モデルを提案し、物理的一貫性と軌道精度を改善した。
- PointAction: 3D点群をロボット制御の普遍的な行動表現として用いるVLA2026/6/2
ビデオ生成モデルを基盤に、将来のRGBフレームと動的3D点群を同時予測し、その点群の動きを行動デコーダでロボットの実行可能な行動に変換するフレームワークを提案。RGBのみの行動基盤の曖昧さを低減し、限られた行動教師データで異なるタスクやロボットへの転移を実現。
- OmniGuide:汎用ロボットポリシーを強化する万能ガイダンス場VLA2026/3/1
3D基盤モデルやVLMなどの多様なガイダンスを微分可能なエネルギー関数として表現し、VLAモデルの行動サンプリングを誘導することで、複雑な操作タスクの成功率と安全性を向上させるフレームワーク。
- 動画からのシーン内物体操作のゼロショット再構成マニピュレーション2025/12/1
単眼RGB動画から、シーン内での物体操作を再構成する初のシステムを提案。データ駆動型基盤モデルで初期化し、2段階最適化で把持から操作までの手と物体の動きをシーンに整合させて復元する。
- ModSkill: 身体キャラクタースキルのモジュール化モーション生成/模倣学習2025/2/1
全身の複雑な運動スキルを身体部位ごとのモジュール型スキルに分解し、生成モデルによる適応的サンプリングで学習を強化することで、高精度な全身モーショントラッキングと再利用可能なスキル埋め込みを実現した研究。
- 外挿的な都市ビュー合成ベンチマークsim2real2024/12/1
自動運転向けの新規視点合成(NVS)において、訓練視点から大きく外れた視点での性能を評価する初のベンチマークEUVSを構築し、既存手法が訓練視点に過適合しやすいことを示した。
- MotionWavelet: ウェーブレット多様体学習による人体動作予測動作予測2024/11/1
ウェーブレット変換と拡散モデルを組み合わせ、空間周波数領域で人体動作の時系列パターンを学習することで、将来の動作を高精度に予測するフレームワークを提案した。
- Holodeck: Language Guided Generation of 3D Embodied AI Environments2023/12/1
- State of the Art on Diffusion Models for Visual Computing2023/10/11