Bingtao Wang
収録論文 6本 ・ フィジカルAI/ロボット学習
ナビゲーションヒューマノイド/ジェスチャー生成VLAセグメンテーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- オープンボキャブラリ・インスタンスナビゲーションのための物体-経路グラフによるトポロジカル表現ナビゲーション2026/9/21
物体と経路を統合したグラフ表現を提案し、密な地図構築なしにオープンボキャブラリな意味推論とトポロジカルナビゲーションを実現した。
- EmoPose: 視覚言語モデルが導く感情を考慮したヒューマノイドロボットのジェスチャー生成ヒューマノイド/ジェスチャー生成2026/9/20
視覚言語モデルがジェスチャーの種類や強度を選び、ロボット側の動作ライブラリで実行する枠組みを提案し、社会的文脈に応じた表情豊かなジェスチャーを実現した。
- SSTG-Nav: 再利用可能な物体ナビゲーションのための計量基盤型空間意味トポロジカルグラフナビゲーション2026/8/1
サービスロボットが同じ環境で長期間運用される際、事前の探索情報を再利用可能な意味メモリとして構築し、物体ナビゲーションの成功率と効率を大幅に向上させる手法を提案した。
- 遅延耐性を持つクラウド・エッジ協調型視覚言語行動モデル:創発的表現特化による実現VLA2026/8/1
クラウド上の大規模VLAモデルとエッジの軽量ヘッドを組み合わせ、通信遅延があってもロボット制御を維持する手法を提案。遅延フレームと現在フレームを同じ行動目標で学習させ、クラウド表現にタスク情報を、エッジに状態補正を担わせる。
- LiteViLNet: 効率的な道路セグメンテーションのための軽量ビジョン-LiDAR融合ネットワークセグメンテーション2026/5/1
RGBとLiDARの情報を軽量に融合し、エッジデバイスでも高速動作する道路セグメンテーションネットワークを提案した。
- Omni-LIVO: 測光マイグレーションとESIKF融合による堅牢なRGBカラー多カメラ視覚慣性LiDARオドメトリVLA2025/9/1
多カメラの視覚・慣性・LiDARを密結合し、非重複視野間の測光一貫性を保つ直接位置合わせとESIKFの多視点更新により、広範囲で高精度な自己位置推定と色付き地図生成を実現した研究。