Henghui Ding
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA3D視覚グラウンディング/自動運転/マルチセンサ能動的知覚触覚/サーベイ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 履歴行動軌跡からのスキル学習:世界行動モデルのための行動経験辞書VLA2026/9/30
過去の行動軌跡を共有埋め込みとして辞書化し、操作タスク間でスキルを再利用できるようにした世界行動モデルを提案。
- Talk2Sensors: センサ適応型物理的手がかりマッチングによる自動運転の3D視覚グラウンディング3D視覚グラウンディング/自動運転/マルチセンサ2026/8/5
カメラ・LiDAR・4Dレーダーのマルチセンサデータを用いた自動運転向け3D視覚グラウンディングのデータセットと、言語クエリに応じてセンサ情報を動的に統合するTransformerベースのフレームワークを提案した。
- 探索してセグメント化:パノラマ参照セグメンテーションのための能動的知覚能動的知覚2026/7/2
エージェントが360度環境を能動的に探索し、ユーザーの指示に従って対象物体をセグメンテーションする新しいタスク「能動的パノラマ参照セグメンテーション」を提案し、空間記憶を持つVLMベースのエージェントPanoSeekerを開発した。
- 身体化知能における触覚ベースのマルチモーダル融合:視覚・言語・接触駆動パラダイムのサーベイ触覚/サーベイ2026/5/1
触覚と視覚・言語を統合するマルチモーダル触覚融合の研究を包括的に調査し、データセットと手法の階層的分類法を提案した論文。
- AutoFly: 実環境でのUAV自律ナビゲーションのための視覚-言語-行動モデルVLA2026/2/1
RGB入力から擬似深度特徴を抽出するエンコーダと二段階学習を組み合わせ、粗い指示のみでUAVが自律的に経路計画と障害物回避を行うVLAモデルを提案し、自律行動に焦点を当てた新データセットも構築した。
- AerialMind:UAVシナリオにおける参照マルチオブジェクト追跡に向けてVLA2025/11/1
UAV(ドローン)映像で自然言語指示に基づくマルチオブジェクト追跡を行うための大規模ベンチマークAerialMindと、半自動ラベリング手法COALA、追跡手法HawkEyeTrackを提案した論文。