Chao Wang
収録論文 28本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CR-VLA-Force: 制御認識型コンプライアンスVLAモデルによる頑健な接触豊富なロボット操作の学習VLA/力覚制御2026/9/5
力覚認識を統合したVLAモデルが精密な力追従と迅速な調整に弱い問題を解決するため、マルチモーダルMoEと多段階訓練、適応コンプライアンス制御を備えたCC-VLAフレームワークを提案し、実機実験で有効性を示した。
- ハイブリッド光電子ニューラルネットワークによるロボット視覚検査における低データ空間欠陥検出のためのハードウェア・ソフトウェア統合設計視覚検査2026/6/1
ロボット視覚検査におけるデータ過多と形状レベルのアノテーション非効率を解決するため、DMDを物理光学畳み込み層として再構成し、圧縮センシングとCLIPガイダンスを組み合わせた低データ欠陥検出アーキテクチャを提案した。
- HiL-ResRL: 人間参加型残差強化学習によるモデル非依存のファインチューニングアダプタロボットマニピュレーション2026/6/1
模倣学習のVLAモデルに対して、モデル非依存でプラグイン可能な残差ポリシーを強化学習で訓練し、実ロボットで1.5時間の学習で成功率95%以上を達成するファインチューニング手法を提案した。
- MERGE: 人間とロボットの相互作用におけるマルチアクターイベント推論とグラウンディングのための誘導型視覚言語モデルHRI/視覚言語モデル2026/3/1
動的な人間とロボットのグループ相互作用において、アクター、物体、イベントを状況に応じてグラウンディングするシステムMERGEを提案。軽量な知覚パイプラインでVLMを選択的に呼び出し、効率と推論能力を両立し、新規データセットで性能を向上させた。
- XR³: 社会的身体的ヒューマンロボットインタラクションのための拡張現実プラットフォームHRI2026/1/1
同じ物理空間を共有する2つのVRヘッドセットを使い、操作者の動き・表情・触覚を仮想ロボットにリアルタイムで写像することで、身体的接触を伴う社会的ヒューマンロボットインタラクションを研究できるプラットフォームを提案した。
- ミラースキン:ロボット皮膚上での触覚意図のその場可視化触覚2025/12/1
ロボット皮膚に鏡のような高解像度ディスプレイを貼り、人間の身体部位を触れる場所に映すことで、触覚インタラクションの意図(誰が・どこを・いつ触るか)を直感的に伝える手法を提案し、ユーザー研究で有効性を示した。
- 混合現実での人間のデモンストレーションから学習したリアルタイムなロボット感情表現の生成感情表現2025/8/1
混合現実空間で人間の表情や動きをロボットにマッピングし、フローマッチングで多様な感情表現をリアルタイム生成する枠組みを提案。
- CARMA: 視覚言語モデルと物体・行動認識を組み合わせた人間-ロボット群集団インタラクションの状況認識状況認識2025/6/1
複数人とロボットの協調作業において、視覚言語モデルと物体・行動認識を統合し、行為者・物体・行動の三つ組を生成することで状況認識を実現するシステムを提案。
- 異種制約下での安全な群衆ナビゲーションのための階層型学習強化MPC群制御2025/6/1
強化学習で訓練したグラフニューラルネットワークでコスト・トゥ・ゴーを推定し、時空間経路探索とMPCを組み合わせて動的環境での安全なロボットナビゲーションを実現した。
- ミラーアイ: 一目でわかる説明可能なヒューマンロボットインタラクションヒューマンロボットインタラクション2025/6/1
ロボットの頭部に鏡のような目を実装し、注視領域を目に映すことで、人間がロボットの意図を直感的に理解し、誤りを早期に発見できることを示した研究。
- 建設現場における記憶駆動型LLMエージェントによる解釈可能な歩行予測歩行予測2025/4/1
建設現場での外骨格支援に向け、音声と視覚入力を用いたLLMエージェントに短期・長期記憶を組み合わせ、歩行モードを高精度かつ信頼性高く予測する手法を提案した。
- PMM-Net: パッチ埋め込みと明示的モーダル変調による単段階マルチエージェント軌道予測軌道予測2024/10/1
歩行者などの複数エージェントの将来軌道を予測するため、パッチベースの時間特徴抽出とグラフベースの社会特徴抽出を組み合わせ、明示的モーダル変調で統合する単段階推論フレームワークを提案した論文。
- 人間に理解しやすいロボット表現を引き出す手法:人とロボットのインタラクション支援に向けてHRI2024/10/1
人間の模倣とジェスチャー引き出し研究を組み合わせ、非ヒューマノイドロボットが好奇心や注意を引く意図を伝える理解しやすい非言語表現を設計・検証する手法を提案した。
- 助けるか助けないか:LLMに基づく人間とロボットのグループインタラクションへの注意深い支援人間ロボットインタラクション2024/3/1
LLMの常識推論を活用し、人間グループの状況を理解して必要な時だけ物理的支援を行うロボットの対話・行動生成手法を提案し、多様なシナリオで評価した。
- LaMI: Large Language Models for Multi-Modal Human-Robot Interaction2024/1/1
- CoPAL: Corrective Planning of Robot Actions with Large Language Models2023/10/1
- Communicating Robot's Intentions while Assisting Users via Augmented Reality2023/8/1
- Interactive Trajectory Planner for Mandatory Lane Changing in Dense Non-Cooperative Traffic2023/3/1
- Understanding the Uncertainty Loop of Human-Robot Interaction2023/3/1
- SEIHAI: A Sample-efficient Hierarchical AI for the MineRL Competition2021/11/1
- Towards robust and domain agnostic reinforcement learning competitions2021/6/1
- Human-Vehicle Cooperation on Prediction-Level: Enhancing Automated Driving with Human Foresight2021/4/1
- Designing Interaction for Multi-agent Cooperative System in an Office Environment2020/2/1
- Shield Synthesis for Real: Enforcing Safety in Cyber-Physical Systems2019/8/1
- Distributed Simulation Platform for Autonomous Driving2017/5/1
- Implementing a Cloud Platform for Autonomous Driving2017/4/1
- Multi-Agent Continuous Transportation with Online Balanced Partitioning2015/11/1
- Collision free autonomous navigation and formation building for non-holonomic ground robots2014/2/1