Junyi Ma
収録論文 15本 ・ フィジカルAI/ロボット学習
ビジュアルサーボ自己中心視点予測脳波デコードベンチマーク/事故理解模倣学習動作予測VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WM-VS: 進捗整合型ワールドモデルによる閉ループビジュアルサーボビジュアルサーボ2026/9/17
目標領域との対応からサーボ座標を定義し、行動結果が誤差を減らすかを予測するワールドモデルと反応型方策を学習。実機7自由度系で高精度な閉ループ視覚サーボと未学習目標への転移を実現した。
- HAP: 手駆動型能動的知覚による自己中心視点の頭部運動予測フレームワーク自己中心視点予測2026/9/16
手の動きと対象物の遮蔽関係から将来の頭部6自由度運動を予測する枠組みHAPを提案し、新データセットBottleで既存手法より高精度を示した。
- EEG-VID: タスク誘導型潜在予測事前学習による脳波デコードと支援的ターゲット選択脳波デコード2026/9/1
脳波デコードのためのタスク誘導型潜在予測事前学習フレームワークを提案し、セッションや被験者の変化に対する頑健性を向上させた。
- CrashSight: 事故現場理解と推論のための位相認識型・インフラ中心ビデオベンチマークベンチマーク/事故理解2026/4/1
路側カメラ映像を用いた事故理解のための大規模ビジョン言語ベンチマークを構築し、既存のVLMが時間的・因果的推論に課題があることを示した。
- 人間のビデオからのロボット学習:サーベイ模倣学習2026/4/1
ロボットが人間の行動ビデオからスキルを獲得する手法を包括的にレビューし、タスク・観察・行動指向の転移経路とデータ基盤を整理したサーベイ論文。
- Uni-Hand: 一人称視点における汎用手動作予測動作予測2025/11/1
一人称視点の動画から、頭部と手の動きを拡散モデルで同時に予測し、手首・指先の2D/3D軌道や物体との接触状態まで推定する汎用手動作予測フレームワークを提案。
- 一人称視点動画におけるゼロショット時間的インタラクション定位VLA2025/6/1
一人称視点動画で人間と物体の把持動作のタイミングを、大規模視覚言語モデルと3D手の速度を活用してゼロショットで高精度に定位する手法EgoLocを提案した。
- Explicit Interaction for Fusion-Based Place Recognition2024/2/1
- PC-NeRF: Parent-Child Neural Radiance Fields Using Sparse LiDAR Frames in Autonomous Driving Environments2024/2/1
- LCPR: A Multi-Scale Attention-Based LiDAR-Camera Fusion Network for Place Recognition2023/11/1
- PC-NeRF: Parent-Child Neural Radiance Fields under Partial Sensor Data Loss in Autonomous Driving Environments2023/10/1
- PCPNet: An Efficient and Semantic-Enhanced Transformer Network for Point Cloud Prediction2023/4/1
- CVTNet: A Cross-View Transformer Network for Place Recognition Using LiDAR Data2023/2/1
- SeqOT: A Spatial-Temporal Transformer Network for Place Recognition Using Sequential LiDAR Data2022/9/1
- OverlapTransformer: An Efficient and Rotation-Invariant Transformer Network for LiDAR-Based Place Recognition2022/3/1