Gongxin Yao
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAクロスモーダル位置認識位置合わせ/クロスモーダル/強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- フローマッチングVLA方針のための自己教師あり軌道分布最適化によるオンライン進化戦略VLA2026/9/30
フローマッチングに基づくVLAモデルの行動軌道分布を、進化戦略を用いてオンラインで適応的に改善する手法を提案。
- TAO-Force: 接触の多いマニピュレーションのための力認識知覚と高速・低速制御の統合VLA2026/9/16
力フィードバックを視覚言語モデルに注入し、接触時のみ高速なアドミタンス制御に切り替える枠組みを提案し、接触の多い操作タスクでの有効性を示した。
- VLA-RAIL: VLAモデルとロボットのためのリアルタイム非同期推論リンカーVLA2025/12/1
VLAモデルの推論とロボット制御を非同期化し、軌道平滑化とチャンク融合により動作のジッターや停止を抑えて高速・連続的な動作を実現するフレームワーク。
- LiDARマップにおける単眼視覚位置認識:クロスモーダル状態空間モデルとマルチビューマッチングクロスモーダル位置認識2024/10/1
RGB画像からLiDARマップ内の3Dシーンを検索するクロスモーダル位置認識のため、VMambaをバックボーンにピクセル・ビュー・シーン統合学習と可視3D点重複に基づくマルチビュー監視を組み合わせた効率的な記述子学習フレームワークを提案。
- CMR-Agent: 反復的な画像-点群位置合わせのためのクロスモーダルエージェント学習位置合わせ/クロスモーダル/強化学習2024/8/1
画像とLiDAR点群の位置合わせを反復的なマルコフ決定過程として再定式化し、強化学習と模倣学習でクロスモーダルエージェントを訓練することで、高精度かつ高速なカメラ姿勢推定を実現した。