Meiling Wang
Beijing Institute of Technology
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OmniNav: 動的環境における堅牢な長期的目標ナビゲーションナビゲーション2026/9/8
動的環境での長期的な目標ナビゲーションを、シーン記憶の更新、信念修正、操作可能なエンドポイント選択を統合した因子化タスク状態推定として定式化し、頑健な探索と操作を実現するシステムを提案した。
- 単一の人間ビデオから数秒でロボットが操作スキルを獲得操作スキル獲得2026/7/1
ロボットが1本の人間のデモ動画から、数秒で新しい操作スキルを獲得しつつ、既存スキルを保持できるフレームワークHOSTを提案した。
- 一度見れば実行できる:ワンショット動画デモからタスクを学習する視覚-言語-行動モデルVLA2025/12/1
テスト時に1本の専門家デモ動画を見るだけで新しい操作スキルを獲得できるVLAモデルViVLAを提案し、未見タスクで30%以上の性能向上を達成した。
- FMimic: 基盤モデルによる人間動画からの細粒度行動学習模倣学習2025/7/1
少数の人間動画から基盤モデルを用いてロボットの細かい行動スキルを直接学習する手法を提案し、RLBenchや実世界タスクで大幅な性能向上を達成した。
- OpenIN: 動的な家庭環境におけるオープン語彙インスタンス指向ナビゲーションナビゲーション2025/1/1
よく使う物とその置き場所(キャリア)の関係を表すオープン語彙のシーングラフを構築・更新し、LLMの常識と視覚言語特徴の類似度を用いて、移動する特定の物体へ効率的にナビゲートする手法を提案した。
- VLMimic: 視覚言語モデルによる細粒度動作の視覚的模倣学習模倣学習2024/10/1
少数の人間動画から、視覚言語モデルを用いて細かい動作レベルまで直接学習し、ロボットの模倣学習を効率化する手法を提案。
- OpenObject-NAV: 動的な運搬関係シーングラフに基づくオープン語彙物体指向ナビゲーション物体ナビゲーション2024/9/1
頻繁に使う物体とその運搬元の関係を表すオープン語彙シーングラフを構築・更新し、LLMの常識と視覚言語特徴の類似度でナビゲーションを計画する手法を提案。シミュレータと実機で移動した物体への効率的な到達を実証した。
- 点群位置合わせのためのポイントツリートランスフォーマー点群位置合わせ2024/6/1
点群の階層的な特徴木を構築し、木構造に沿って注意領域を重要な点へと段階的に絞り込む新しい注意機構により、線形計算量で局所・大域特徴を効率的に抽出する点群位置合わせ手法を提案した。
- Human Demonstrations are Generalizable Knowledge for Robots2023/12/1