Minh Nhat Vu
収録論文 44本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GloVLA: 幾何学的移動と局所VLAの相互作用による非構造環境での頑健な物体中心操作マニピュレーション2026/9/5
物体中心操作を幾何学的な移動制御と局所的なVLAポリシーに分離するハイブリッドフレームワークを提案し、非構造環境での成功率と推論コストを改善した。
- 自己改善型VLAポリシー:スプリアスロバストなアクション平滑化のための選択的拡散ノイズVLA/ロバスト性2026/6/1
拡散ベースのVLAポリシーのテスト時ロバスト性を高めるため、拡散ノイズ空間を制御可能な自由度として利用し、スプリアスな視覚相関への依存を減らしつつ滑らかなアクションを生成するノイズ選択手法SDNを提案した。
- 多視点ロボット点検のための経路と配置の連成最適化経路計画2026/6/1
9自由度ロボットによる点検視点の巡回順序と各視点での逆運動学配置を同時に最適化する統一フレームワークを提案し、モジュール型手法より短時間で衝突のない経路を生成する。
- ReFineVLA: 教師ガイドによるファインチューニングを用いたマルチモーダル推論対応の汎用ロボットポリシーVLA2026/4/1
VLAモデルに推論能力を組み込むため、専門家教師モデルが生成した推論根拠をデータセットに追加し、事前学習済みVLAをファインチューニングする手法を提案。シミュレーション操作ベンチマークで評価し、視覚・言語・行動の整合性と汎化性能の向上を示した。
- 受動関節ダイナミクスを有するブームクレーンの自律ブロック組立:統合ビジョンMPC制御クレーン制御2026/3/1
建設現場でのプレハブブロック組立を目的に、受動関節による振り子状の揺れを抑制しながら、ビジョンによる位置推定、衝突回避Bスプライン経路計画、非線形モデル予測制御を統合した自律制御フレームワークを提案し、実験で検証した。
- XFlowMP: シュレーディンガー橋によるタスク条件付き生成ロボット運動計画運動計画2025/12/1
タスク条件を入力とし、シュレーディンガー橋を用いた生成モデルで衝突回避・動的制約を満たすロボット軌道を計画する手法を提案。
- 物体中心・幾何グラウンディングによる clutter に頑健な VLA モデルVLA2025/12/1
VLA の知覚と行動を分離し、タスク関連物体の領域選択と3D構造の強調を行う知覚モジュールを導入することで、 clutter や背景変化に強い操作を実現した。
- 効率的な幾何認識ビジョンエンコーダによるロボットマニピュレーションの改善マニピュレーション2025/9/1
幾何認識型の視覚表現を模倣学習に組み込むことで成功率が最大6.5%向上することを示し、さらにVGGTを蒸留した高速・軽量なエンコーダeVGGTを提案した論文。
- Lang2Lift: 言語ガイドによる屋外産業用パレットハンドリングのための自律フォークリフトシステム屋外自律フォークリフト2025/8/1
自然言語指示で指定したパレットを認識・姿勢推定し、屋外で自律的にフォーク挿入・持ち上げを行うフォークリフトシステムを構築・実機評価した。
- 森林クレーン向け長尺リンクの効率的衝突検出:ユークリッド距離場における新手法衝突検出2025/7/1
森林クレーンのような長く細いリンクを持つマニピュレータの衝突検出を、従来の球近似より効率的かつ正確に行うアルゴリズムを提案し、実LiDARデータで検証した。
- 3Dシーングラフとロボットオントロジーを統合した実行可能な知識ベースの生成知識表現2025/7/1
多様なシーン記述形式をUSDに統一し、セマンティック注釈を介してロボットオントロジーと統合することで、認知ロボット制御に必要な実行可能な知識を生成する手法を提案した。
- DoublyAware: ヒューマノイド歩行のための時間差学習における計画と方策の二重不確実性認識歩行2025/6/1
ヒューマノイド歩行のモデルベース強化学習において、不確実性を計画と方策に分解し、Conformal PredictionとGroup-Relative Policy Constraintで対処するTD-MPC拡張手法を提案。
- 木材用クレーンのための準時間最適ハイブリッド動作計画マニピュレーション2025/6/1
油圧駆動と受動関節を持つ木材用クレーンに対し、ポンプ流量制約と衝突コストを考慮した改良VP-STOによる大域的計画と、受動関節動力学を考慮した局所計画を組み合わせたハイブリッド動作計画を提案した。
- 吊り下げ型空中マニピュレーションプラットフォームの階層制御フレームワークにおける振り上げ動作の学習空中マニピュレーション2025/6/1
階層制御と強化学習を組み合わせ、吊り下げ型空中マニピュレーションプラットフォームが振り上げ動作を行い、推力だけでは到達できない位置に止まる手法を提案し、数値シミュレーションで検証した。
- モデルテンソルプランニングMPC2025/5/1
テンソルサンプリングとスプライン補間で高エントロピーな制御軌道を生成し、探索と活用を両立させるサンプリングベースMPCフレームワークを提案。
- TD-GRPC: 群相対方策制約を用いた時間差分学習によるヒューマノイド歩行歩行2025/5/1
TD-MPCにGRPOと方策制約を組み合わせ、計画と学習の整合性を保ちながらヒューマノイドの歩行・動的運動を安定化させる手法を提案。
- ReFineVLA:推論を考慮した教師ガイド付き転移ファインチューニングVLA2025/5/1
専門家モデルが生成した推論根拠でデータセットを拡張し、VLAモデルに行動の理由を考えさせるファインチューニング手法を提案。複雑な操作タスクでの汎化性能と解釈性を向上させた。
- 混雑環境における劣駆動林業クレーンのGPU加速動作計画マニピュレーション2025/3/1
GPU加速確率最適化と軌道最適化を組み合わせた2段階手法で、劣駆動林業クレーンの衝突回避経路を高速に生成し、動的制約を満たす軌道へ精緻化する。
- FlowMP: 条件付きフローマッチングによるロボット計画のための運動場学習運動計画2025/3/1
フローマッチングを拡張して軌道の二次ダイナミクス(加速度)を考慮し、滑らかで物理的に実行可能なロボット運動を生成する計画手法を提案。ベンチマークで成功率と軌道品質が向上。
- RoboDesign1M:ロボット設計理解のための大規模データセットデータセット2025/3/1
科学論文から収集した100万件のマルチモーダルデータでロボット設計理解のための大規模データセットを構築し、設計生成や質問応答などのタスクでベンチマークを提供した。
- インコンテキスト模倣学習におけるアクショントークナイザの重要性模倣学習2025/3/1
インコンテキスト模倣学習において、既存のアクショントークナイザが時間的な滑らかさを保てない問題を指摘し、Lipschitz条件を課すVAE「LipVQ-VAE」を提案して安定した動作生成を実現した。
- 林業クレーンによる自律的な丸太把持に向けて:シミュレータとベンチマークマニピュレーション2025/2/1
林業クレーンの丸太把持・持ち上げを強化学習で自律化するため、MuJoCoベースの8自由度クレーンシミュレータを構築し、カリキュラム学習による速度制御で96%の成功率を達成、オープンソースのベンチマークを提供した。
- 不規則物体を動的に把持するためのオンライン軌道再計画マニピュレーション2025/1/1
不規則な物体を把持するため、10秒以内のオフライン初期軌道計画と100ms以内のオンライン軌道再計画を組み合わせた軌道最適化フレームワークを提案し、視覚の姿勢推定誤差や外乱に対応する。
- Robotic-CLIP: ロボット応用のための行動データによるCLIPの微調整VLA2024/9/1
大規模な行動動画データでCLIPを対照学習により微調整し、動的な行動理解を可能にしたRobotic-CLIPを提案。言語駆動型ロボットタスクで既存CLIPモデルを上回り、実世界の把持タスクでも有効性を示した。
- GraspMamba: 階層的特徴学習を備えたMambaベースの言語駆動型把持検出フレームワークマニピュレーション2024/9/1
Mambaビジョンと階層的特徴融合を用いて、乱雑な画像や長いテキスト記述でも高速・高精度に把持位置を検出する言語駆動型モデルを提案した。
- ネガティブプロンプト誘導を用いた言語駆動型6自由度把持検出マニピュレーション2024/7/1
自然言語の指示に基づき、散らかった点群の中から目的の物体を6自由度で把持する手法を提案。大規模データセットGrasp-Anything-6Dと、不要物体を避けるネガティブプロンプト誘導拡散モデルを導入した。
- マスク誘導アテンションによる言語駆動型把持検出マニピュレーション2024/7/1
セグメンテーションマスクと言語指示をTransformerのアテンションで統合し、遮蔽に強い言語駆動型の把持検出を実現した研究。
- 条件付き一貫性モデルによる軽量な言語駆動型把持検出マニピュレーション2024/7/1
拡散モデルを軽量化した一貫性モデルと言語プロンプトを組み合わせ、高速推論を実現する言語駆動型把持検出法を提案し、実機実験で有効性を示した。
- 言語駆動の閉ループ把持:モデル予測による軌道再計画マニピュレーション2024/6/1
言語コマンドで対象物を指定し、6D姿勢推定とオンライン軌道計画を組み合わせた閉ループ制御により、動く物体を滑らかに把持するゼロショットのモジュール型フレームワークを提案した。
- Hierarchical Motion Planning and Offline Robust Model Predictive Control for Autonomous Vehicles2024/2/1
- 動的に変化するウェイポイントを用いたシリアルマニピュレータのモデル予測軌道最適化マニピュレーション2024/2/1
上位タスク計画から与えられる動的に変化するウェイポイントをオンラインで扱うため、ウェイポイント到達時に計画ホライズンを分割・短縮するモデル予測制御手法を提案し、KUKAロボットでの動的ピック&プレースで有効性を示した。
- Observer-based Controller Design for Oscillation Damping of a Novel Suspended Underactuated Aerial Platform2024/1/1
- Autonomous Catheterization with Open-source Simulator and Expert Trajectory2024/1/1
- Real-time 6-DoF Pose Estimation by an Event-based Camera using Active LED Markers2023/10/1
- Grasp-Anything: Large-scale Grasp Dataset from Foundation Models2023/9/1
- Language-Conditioned Affordance-Pose Detection in 3D Point Clouds2023/9/1
- Open-Vocabulary Affordance Detection using Knowledge Distillation and Text-Point Correlation2023/9/1
- Hierarchical control strategy for planar bipedal walking robots based on reduced order model2023/3/1
- Open-Vocabulary Affordance Detection in 3D Point Clouds2023/3/1
- Two-Step Online Trajectory Planning of a Quadcopter in Indoor Environments with Obstacles2022/11/1
- Machine Learning-based Framework for Optimally Solving the Analytical Inverse Kinematics for Redundant Manipulators2022/11/1
- Singularity Avoidance with Application to Online Trajectory Optimization for Serial Manipulators2022/11/1
- Sampling-Based Trajectory (re)planning for Differentially Flat Systems: Application to a 3D Gantry Crane2022/9/1
- CathSim: An Open-source Simulator for Endovascular Intervention2022/8/1