S. Talha Bukhari
収録論文 6本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション強化学習ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- リーマン平均流による行動多様体上の高速視覚運動方策学習VLA2026/9/24
ロボットの行動系列が滑らかな多様体上に定義されることに着目し、リーマン条件付きフローマッチングを基盤としたフローマップ整合性目的で、1回のネットワーク評価で多様体上の行動生成を可能にするRMFPを提案した。
- リー群制約付きMeanFlowによる高速生成的把持マニピュレーション2026/8/26
リー群上のMeanFlowを用いて、少数のネットワーク評価で高品質な把持を生成する手法を提案し、ACRONYMデータセットで既存手法と同等の性能を達成しつつ最大39倍の高速化を実現した。
- 空間平滑化による価値学習強化学習2026/2/1
オフライン目標条件付き強化学習において、距離的制約を局所空間測度の期待値として再解釈し、微分演算子を必要とせずに構造化された価値表現を学習する手法を提案。
- VLAD-Grasp: 視覚言語モデルによるゼロショット把持検出マニピュレーション2025/11/1
視覚言語モデルを活用し、学習なしで物体の把持姿勢を検出するゼロショット手法を提案。仮想円筒プロキシを生成して3D点群を整合させ、実機ロボットで汎化性能を示した。
- SE(3)上の把持拡散のための変分形状推論マニピュレーション2025/8/1
形状の変分推論と拡散モデルを組み合わせ、SE(3)多様体上で多様な安定把持を生成する手法を提案。ノイズや点群の疎さに頑健で、実世界の家庭用品操作にもゼロショット転移できる。
- 動的屋内環境におけるロボットナビゲーションのための微分可能な複合ニューラル符号付距離場ナビゲーション2025/2/1
RGB-Dセンサのみを用い、複数のニューラルSDFを合成して動的屋内環境での軌道最適化を行う二段階ナビゲーション手法を提案し、iGibson 2.0で98%の成功率を達成した。