Meng Liu
収録論文 7本 ・ フィジカルAI/ロボット学習
ナビゲーション社会的ロボティクス動作予測メモリ/エージェント空間推論触覚/表現学習マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RAO-Nav: 統合言語モデルによるゼロショット音声視覚ナビゲーションの探求ナビゲーション2026/9/26
音声と視覚を統合した大規模言語モデルをゼロショットの音声視覚ナビゲーションに適用し、学習データなしで既存手法を上回る性能を実現した。
- InterSocialBench:コンパニオンロボットの社会的行動に対する人間とLLMの選好を評価するベンチマーク社会的ロボティクス2026/9/14
家庭内の210シナリオと18の高レベル行動について、100人の人間の判断と7つのLLMの応答を収集し、コンパニオンロボットの社会的行動選択における人間とLLMの選好の違いを評価するベンチマークを提案した。
- どこからどのようにへ:自己中心視点ビデオからの連続4Dインタラクション予測動作予測2026/9/8
自己中心視点ビデオから将来の3Dインタラクション位置と全身動作を連続的に予測する手法を提案し、大規模データセットと評価指標も導入した。
- ECHO: 認知に着想を得た監査可能なメモリプレーンによる長期的エージェントメモリ/エージェント2026/8/22
長期的なタスクを扱うエージェント向けに、エピソード記憶や再固定化などの認知機能に着想を得た監査可能なメモリアーキテクチャ「ECHO」を提案し、検索性能を評価した。
- SpaceEra++: ビデオにおける3次元空間推論のための統合フレームワーク空間推論2026/7/2
本論文は、ビデオから3次元空間推論を行うための統合フレームワークSpaceEra++を提案する。フレーム選択戦略と空間整合手法を導入し、空間理解の精度を向上させた。
- TacGen: 触覚は物理世界表現に不可欠な次元である -- スケーラブルな視覚-触覚アライメントと生成による触覚データ不足への対処触覚/表現学習2026/6/1
触覚データ不足を解決するため、視覚と触覚のコントラスト学習と潜在空間での視覚から触覚への生成モデルを組み合わせ、RGB画像から触覚表現を合成してデータを拡張する手法を提案した。
- Gen2Real: 生成動画を活用したデモ不要の巧みなマニピュレーションマニピュレーション2025/9/1
生成動画から手と物体の軌道を抽出し、物理整合性を考慮した最適化と強化学習でロボットハンドの把持スキルを学習する手法を提案。シミュレーションで77.3%の成功率を達成し、実機でも動作を実証した。