Xiaojian Ma
Delta Intelligence
収録論文 20本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SEED-UMI: 人間とロボットで外骨格を共有する一対一の器用なデモンストレーションマニピュレーション2026/9/10
人間とロボットが同じ外骨格を装着し、関節エンコーダと手首カメラの計測を共有することで、接触の多いタスクの模倣学習を効率化するフレームワークを提案。
- パノラマ認識型VLAによる全身遠隔操作を用いた移動操作の学習VLA2026/8/1
全身遠隔操作システムとパノラマ認識型VLAポリシーを開発し、移動操作タスクの成功率を大幅に向上させた。
- AdaReP: モデルミスマッチ下での適応的再計画によるニューラルワールドモデル予測制御モデル予測制御2026/6/1
ニューラルワールドモデルを用いたMPCの再計画頻度を、予測誤差の蓄積と局所感度に基づいてオンラインで適応させる手法を提案し、計算コストを削減しつつ性能を維持する。
- インタラクション推論ベンチマーク(COIN):推論と身体化インタラクションの融合ベンチマーク/操作2026/4/1
部分観測下での長期的なインタラクション推論を評価する新しいベンチマークCOINを提案し、ロボット操作タスクにおける既存手法の限界を明らかにした。
- FlowDreamer: フローベースの動作表現を用いたロボットマニピュレーションのためのRGB-Dワールドモデルワールドモデル2025/5/1
3Dシーンフローを明示的な動作表現として用い、U-Netと拡散モデルを組み合わせてロボット操作のためのRGB-Dワールドモデルを構築し、映像予測と視覚計画タスクで性能を向上させた。
- Falcon: 部分ノイズ除去による高速視覚運動ポリシーVLA2025/3/1
拡散ポリシーの推論を高速化するため、過去の行動の部分ノイズ除去結果を再利用する学習不要の手法を提案し、性能を維持しつつ2〜7倍の速度向上を実現した。
- GROOT-2: 弱教師ありマルチモーダル指示追従エージェントVLA2024/12/1
ラベルなしデモで多様な行動を学びつつ、少数のラベル付きデモで人間の意図に合わせる半教師あり学習手法を提案し、マルチモーダル指示追従性能を向上させた。
- 3Dシーンにおけるマルチモーダル状況推論VLA2024/9/1
3Dシーン内の状況理解のための大規模マルチモーダル質問応答データセットMSQAとナビゲーション評価ベンチマークMSNNを提案し、既存モデルの限界とマルチモーダル入力の重要性を示した。
- OmniJARVIS:統合視覚言語行動トークン化によるオープンワールド指示追従エージェントVLA2024/6/27
Minecraftのオープンワールドで、行動軌跡を自己教師あり学習で離散トークン化し、推論・計画・行動を単一のVLAモデルで統合的に実行できるようにした研究。
- An Embodied Generalist Agent in 3D World2023/11/18
- Adversarial Option-Aware Hierarchical Imitation Learning2021/6/1
- Robust Robotic Pouring using Audition and Haptics2020/3/1
- A Mobile Robot Hand-Arm Teleoperation System by Vision and IMU2020/3/1
- Reinforcement Learning from Imperfect Demonstrations under Soft Expert Guidance2019/11/1
- Imitation Learning from Observations by Minimizing Inverse Dynamics Disagreement2019/10/1
- Making Sense of Audio Vibration for Liquid Height Estimation in Robotic Pouring2019/3/1
- Vision-based Teleoperation of Shadow Dexterous Hand using End-to-End Deep Neural Network2018/9/1
- PointNetGPD: Detecting Grasp Configurations from Point Sets2018/9/1
- Task Transfer by Preference-Based Cost Learning2018/5/1
- Learning and Inferring Movement with Deep Generative Model2018/5/1