Can Wang
収録論文 7本 ・ フィジカルAI/ロボット学習
自動運転/V2X協調画像編集VLA模倣学習/ロボット操作行動認識軌道生成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- V2X-WAM: 協調型ワールドアクションモデルによるエンドツーエンド自動運転自動運転/V2X協調2026/9/29
車車間・路車間協調で得た情報から信頼性を考慮した時空間表現を作り、将来の交通環境の予測と軌道計画を相互にフィードバックして精度と安全性を高める自動運転モデルを提案した。
- DecFlowEdit: ガイダンス分離による自己局所化フローベース画像編集画像編集2026/9/28
フローベース画像編集において、局所化と編集性のためのガイダンススケールを分離することで、背景を保ちながら編集精度を向上させる学習不要・逆変換不要の手法を提案。
- EgoTSR++: 一人称視点の時空間推論によるタスク進捗理解VLA2026/9/23
一人称視点の2つの観測からタスクの進捗を順序に依存せず判断するフレームワークEgoTSRを提案し、順序バイアスを診断するベンチマークと双方向監督データ、段階的CoTカリキュラムを導入した。
- 逆転して前進:逆転した易しいタスクからの低コストな熟練ポリシー学習模倣学習/ロボット操作2026/7/1
難しいタスクの逆方向(易しいタスク)の軌道を反転させて教師信号とし、高価なテレオペレーションデータ収集コストを削減する枠組みを提案。自動収集・階層的リファインメント・反復学習で高精度な操作タスクを学習する。
- 条件付けが重要:拡散画像編集における反転と注意の安定化画像編集2026/6/12
テキスト条件付けの精度が拡散モデルの反転安定性と編集品質に与える影響を理論・実験で示し、条件付けの改良とトークン単位の注意制御を備えたSimEditを提案した。
- ロボット視点からの行動認識による自然な人間-ロボットインタラクション行動認識2025/7/1
移動ロボット視点での人間行動認識のための大規模データセットACTIVEと、遠距離でも高精度に認識する手法ACTIVE-PCを提案した論文。
- 障害物環境における全方向マルチロータ航空機の6次元軌道生成軌道生成2024/4/1
立体投影で姿勢を3次元ベクトルにパラメータ化し、凸多面体で表される障害物環境下で全方向マルチロータの安全で動的に実行可能な6次元SE(3)軌道を最適化により生成する手法を提案。