Miao Liu
収録論文 10本 ・ フィジカルAI/ロボット学習
世界モデルデータセットVQA/ベンチマーク視覚運動協調
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MOSH-WM: マスク接地ソフトハミルトン力学によるオブジェクト中心世界モデル世界モデル2026/8/24
オブジェクト中心の世界モデルで、マスクの空間モーメントから位置・運動量状態を構成し、学習したエネルギーでソフトな方向バイアスを与えて将来映像を予測する手法を提案。OBJ3DとCLEVRERで既存手法より高精度な予測を達成。
- InteracVid: ライブチャット動画から構築した実インタラクティブ音声視覚応答データセットデータセット2026/8/2
ライブ配信動画から、外部刺激に対する実際のインタラクティブな音声・視覚応答を抽出した大規模データセットを構築し、マルチモーダルAIの応答生成性能を向上させた。
- EgoProx: 認知階層にわたる自己中心3D近接推論におけるMLLMの評価VQA/ベンチマーク2026/5/23
自己中心視点での3D近接推論を評価するベンチマークEgoProxを提案し、多様なQAペアを生成するデータエンジンを設計。既存のMLLMの性能を分析し、空間知識はあるものの推論には課題があることを示した。
- 視覚運動協調の予測学習視覚運動協調2025/3/1
一人称視点の映像と身体運動から頭部姿勢・視線・上半身の動きを予測する拡散ベースのモデルを提案し、大規模データセットで汎化性能を示した。
- Learning Multi-Objective Curricula for Robotic Policy Learning2021/10/1
- Characterization and Thermal Management of a DC Motor-Driven Resonant Actuator for Miniature Mobile Robots with Oscillating Limbs2020/2/1
- Learning for Multi-robot Cooperation in Partially Observable Stochastic Environments with Macro-actions2017/7/1
- Scalable Accelerated Decentralized Multi-Robot Policy Search in Continuous Observation Spaces2017/3/1
- Semantic-level Decentralized Multi-Robot Decision-Making using Probabilistic Macro-Observations2017/3/1
- Socially Aware Motion Planning with Deep Reinforcement Learning2017/3/1