Juexiao Zhang
収録論文 5本 ・ フィジカルAI/ロボット学習
SLAMVLAナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Chain-SLAM:連鎖ループ閉じ込みによるマルチセッションLiDAR SLAMのグローバルに一貫したバックエンドSLAM2026/9/10
複数セッションで取得したLiDAR地図を、連鎖的なループ閉じ込みと因子グラフ最適化によりオンラインで統合し、大規模環境でもグローバルな幾何一貫性を保つSLAMバックエンドを提案。
- 意図から実行へ:Vision-Language-Actionモデルの汎化境界を探るVLA2025/6/1
VLAモデルの汎化能力を体系的に評価するため、言語・視覚・物体に関する50のシミュレーションタスクを用意し、最先端モデルが知覚や計画は得意でも、分布外の状況では動作実行が崩れることを示した。
- CityWalker: Web規模の動画から身体性を伴う都市ナビゲーションを学習ナビゲーション2024/11/1
Web上の街歩き・運転動画から行動教師信号を抽出し、地図なし・路上外でも動ける都市ナビゲーション方策を大規模模倣学習で獲得した研究。
- VLMが見て、ロボットが動く:人間のデモ動画からロボット行動計画を生成VLA2024/10/1
視覚言語モデル(VLM)を用いて人間のデモ動画を解釈し、ロボットのタスク計画を自動生成する手法SeeDoを提案。キーフレーム選択と視覚認識、VLM推論を統合し、シミュレーションと実機で有効性を検証した。
- どこにいるか教えて:マルチモーダルLLMによる場所認識VLA2024/6/1
視覚基盤モデルで候補地点を検索し、マルチモーダルLLMが各候補を言語推論で比較して最終決定する、追加学習不要の視覚的場所認識手法を提案。