Mouli Sivapurapu
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA模倣学習/操作マニピュレーション非人型ロボット/HRI模倣学習データ収集3D表現/ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FineART: 両手マニピュレーションのための細粒度注釈付きロボット軌道データセットと視覚-言語-行動モデルVLA2026/9/29
40,543エピソード・1,718時間・533,913サブタスクからなる密注釈付き両手操作データセットFineARTを構築し、次のサブタスクを自己予測するVLAモデルFineART-VLAを提案した。中間学習により長期的タスクの成功率が大幅に向上し、新ロボットへの少データ適応とゼロショット汎化も示した。
- MoMo: 時空間アクションのトークン化によるロボット操作の動作モード制御模倣学習/操作2026/7/1
ロボット操作の実行スタイル(動作モード)をタスクから分離して学習し、指示に応じて動作の速さや滑らかさを変えられる2段階の模倣学習フレームワークMoMoを提案した。
- EgoDex:大規模一人称視点動画からの巧みな操作の学習マニピュレーション2025/5/1
Apple Vision Proで収集した829時間の一人称視点動画と3D手・指トラッキングデータからなる大規模データセットEgoDexを構築し、模倣学習のベンチマークを提供した。
- ELEGNT:非人型ロボットのための表現的で機能的な動作設計非人型ロボット/HRI2025/1/1
ランプ型ロボットを題材に、機能と表現の両立を目指す動作生成フレームワークを提案し、ユーザー研究で表現重視の動作がエンゲージメントとロボットの印象を高めることを示した。
- ARMADA: 拡張現実によるロボット操作とロボット不要のデータ収集模倣学習データ収集2024/12/1
Apple Vision Proに仮想ロボットのリアルタイムフィードバックを重ねるARシステムを構築し、実機なしでもロボット模倣学習用の高品質な人間データを収集できることを15人のユーザー研究で示した。
- 埋め込みポーズグラフ:コンパクト表現で3D基盤モデル機能を実現3D表現/ナビゲーション2024/3/1
ポーズグラフのノードに基盤モデルの特徴量を付与することで、ボクセルや点群より軽量かつスケーラブルに3D空間を表現し、開語彙クエリや言語誘導ナビゲーション、再位置推定などを可能にする手法を提案した。