Zishuo Wang
収録論文 7本 ・ フィジカルAI/ロボット学習
ソーシャルナビゲーションナビゲーションナビゲーション支援視覚ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- どこに加わるべきか?言語誘導型目標予測によるロボットのグループ参加ソーシャルナビゲーション2026/9/23
自然言語で指定されたグループにロボットが参加するため、言語条件付きモデルでグループを特定し、人間の隊形事前分布を用いて社会的に適切な参加位置を予測する手法を提案した。
- SOPD-SocialNav: 視覚言語ソーシャルナビゲーションのための選択的オンポリシー蒸留ナビゲーション2026/7/1
大規模な視覚言語モデルから軽量な学生モデルへ、エントロピーに基づくトークン選択と温度制御付きJSダイバージェンスを用いて社会的ナビゲーション知識を蒸留する手法を提案。実機ロボットでの検証も行った。
- CANINE: 視覚障害者へのロボット盲導犬を用いた対話的ナビゲーションのコーチングナビゲーション支援2026/5/1
視覚障害者がロボット盲導犬と協調してナビゲーションするスキルを、個別適応的な音声フィードバックで自動コーチングするシステムを提案し、実験で学習効率と最終性能の向上を実証した。
- 看板を頼りに地図なしで移動するロボットの視覚的看板グラウンディングナビゲーション2026/2/1
実世界の看板の意味を3Dシーンに結びつける「看板グラウンディング」を定式化し、VLMに適した空間・意味表現SignSceneを提案。地図なしで看板のみを使ったSpotロボットのナビゲーションを実現した。
- MUSON: 都市環境における社会的規範に沿ったナビゲーションのための推論指向マルチモーダルデータセットナビゲーション2025/12/1
歩行者との社会的規範を考慮したナビゲーションのための、5段階の思考連鎖で注釈付けされた1万件超の一人称視点マルチモーダルデータセットを構築し、複数の視覚言語モデルを評価した。
- MAction-SocialNav: 推論強化プロンプトチューニングによる複数行動対応の社会的配慮ナビゲーションナビゲーション2025/12/1
社会的に配慮したナビゲーションにおいて、1つの状況で複数の妥当な行動が存在する曖昧さに対応するため、視覚言語モデルとメタ認知プロンプトを提案し、複数行動データセットと評価指標を構築した研究。
- InFeR: 学習済み視覚ナビゲーション制御における情報に基づく故障回復視覚ナビゲーション2025/10/1
模倣学習ポリシーに変分情報ボトルネックとGrad-CAMを組み合わせ、追加データなしで分布外故障の検出・原因特定・自律回復を可能にするフレームワークを提案。