Boyu Ma
Nanyang Technological University
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 高速計画と忠実な行動:階層型視覚言語行動モデルにおける計画・実行ギャップの解消VLA2026/9/25
階層型VLAの計画器と実行器の不一致を分析し、ブロック自己回帰デコーディングと正規化ゴール変調で計画遅延を8.7倍削減しつつ計画の活用を改善した。
- GCS-Bridging: 凸集合の非連結性を回復するグラフ・オブ・凸集合運動計画運動計画2026/8/23
凸集合のグラフ(GCS)に基づく運動計画で、開始・目標領域が異なる連結成分にある場合に、衝突回避経路と凸領域の膨張で連結性を回復する手法を提案。シミュレーションで99.8%の成功率、実機でも有効性を確認。
- 統一条件・行動モデリングによる高精度ワンステップ行動生成マニピュレーション2026/8/17
条件と行動を共有トークン空間で統一的にモデリングするUCA-Flowを提案し、推論速度を大幅に向上させつつ成功率を9.3ポイント改善した。
- 物理的インタラクションの学習:触覚・力覚を考慮したロボット学習のサーベイ触覚・力覚学習2026/8/1
触覚・力覚センシングを統合したロボット学習手法を、マルチモーダルかつ多段階のシステム設計の観点から統一的な分類学TF-ARTを用いて整理し、今後の研究課題を考察したサーベイ論文。
- FORGE: キーポイント軌道推論による機能的一般化を目指したツール使用マニピュレーション2026/7/1
ロボットが特定の道具にしか使えない問題を解決するため、道具の機能に基づく一般化を実現する手法を提案。キーポイント軌道を中間表現として用い、機能推論と動作実行を分離する2段階ポリシーを開発し、未見の道具での成功率を2倍以上向上させた。
- 統一空間意味プロンプトによる身体化視覚追跡と潜在ダイナミクス学習視覚追跡2026/6/24
身体化視覚追跡において、言語のみのターゲット指示では曖昧さが生じる問題を解決するため、空間的・意味的プロンプトを統合したフレームワークUSSを提案し、実ロボット実験で有効性を示した。
- ADAPT: 解析的擾乱認識型ポリシートレーニングによる人型ロコモーション歩行2026/6/1
外力による擾乱を物理モデルに基づく観測器で推定し、その情報をポリシーに直接入力することで、人型ロボットの外乱に対する頑健性と速度追従精度を向上させるフレームワークを提案した。
- GIVE: 視覚言語行動モデルにおける人間のジェスチャーの接地VLA/ジェスチャー理解2026/6/1
人間のジェスチャーを視覚・意味の2経路でVLAモデルに統合し、曖昧な指示でも物体接地と操作意図の推定を改善する手法を提案。実世界実験で成功率を大幅に向上させた。
- Gaze2Act: 視線条件付き視覚言語行動ポリシーによる対話的ロボット操作VLA2026/5/1
人間の視線を意図信号として活用し、ロボット操作の精度を高める新しいVLAフレームワークを提案した論文。
- CompassAD: 機能が競合する物体における意図駆動型3Dアフォーダンス接地3Dアフォーダンス接地2026/4/1
複数の物体が同じ機能を持つ場合に、自然言語の意図に基づいて正しい物体の3Dアフォーダンス領域を特定する新しいタスクを提案し、ベンチマークと手法を構築した。
- WaveMan: ヒューマノイドロボットのためのミリ波による部屋規模の人間インタラクション知覚ヒューマンロボットインタラクション2026/1/1
ミリ波センシングを用いて、ユーザーの位置に依存せずプライバシーを守りながら部屋規模で人間のインタラクションを認識するシステムを提案し、未学習の位置でも高精度を実現した。
- NEDS-SLAM: 3Dガウシアンスプラッティングを用いたニューラル明示的密セマンティックSLAMフレームワークセマンティックSLAM2024/3/1
3Dガウシアン表現に基づく密セマンティックSLAMシステムを提案し、空間的に一貫した特徴融合と軽量エンコーダ・デコーダ、仮想カメラビュープルーニングにより、リアルタイムで高品質な3Dセマンティックマッピングとカメラトラッキングを実現した。
- NNPP: A Learning-Based Heuristic Model for Accelerating Optimal Path Planning on Uneven Terrain2023/8/1