Yixiao Wang
収録論文 18本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Astrobee用テレオペ自由飛行マニピュレーションのための展開可能な4指ペイロードテレオペレーション2026/9/22
国際宇宙ステーション内の自由飛行ロボットAstrobeeに搭載する4指ハンドと、VRによる遠隔操作パイプラインを提案し、無重力シミュレータで貨物輸送タスクの予備実験を行った。
- 片手での組立と操作のための再構成可能な双対向アーキテクチャマニピュレーション2026/9/19
4本の独立駆動指を2つの仮想指対向に分け、再構成可能な掌で相対配置を制御することで、片手での2部品の同時把持とハンド内組立・操作を実現するハンドを提案。
- CARF: 失敗誘導フローマッチングの対比的引力-斥力模倣学習2026/9/18
失敗軌道から「進展する部分」は模倣し「失敗を招く部分」は回避する非対称な学習を、フローマッチングで統一的に実現する手法を提案。
- 逐次ロボットタスクにおける構成的一般化の診断ロボット操作2026/7/1
逐次ロボット操作タスクで、指示の組み合わせに対する一般化の失敗原因を分解し、訓練データのカバレッジ構造が重要であることを示した論文。
- 軟質油圧駆動による器用で柔軟なグリッパー:微小重力操作向けグリッパー/宇宙ロボティクス2026/5/1
国際宇宙ステーションでの自由飛行ロボットAstrobee用に、2本指6自由度の器用で柔軟なグリッパーDexCoHandを開発し、シミュレーションと地上実験でその性能を実証した。
- データ効率的なロボット模倣学習のためのマルチカメラ視点スケーリング模倣学習2026/4/1
デモ収集時に複数のカメラ視点を用いて擬似デモを生成し、データ効率と汎化性を向上させる模倣学習フレームワークを提案した。
- DADP: ドメイン適応拡散ポリシーVLA2026/2/1
拡散ポリシーにドメイン表現を組み込み、未知の遷移力学にゼロショット適応する制御手法を提案。
- VER: 基盤モデル蒸留と動的ルーティングによるロボット学習のための視覚エキスパートトランスフォーマーVLA2025/10/1
複数の視覚基盤モデルを蒸留してエキスパートライブラリを構築し、軽量なルーティングネットワークでタスクに応じた専門家を動的に選択することで、17種類のロボットタスクで最先端性能を達成した。
- Interleave-VLA:画像とテキストの交互入力でロボット操作を強化VLA2025/5/1
画像とテキストを交互に与える指示でロボットを学習させ、未知の物体への汎化性能を2倍に高め、手描きスケッチなどの柔軟な指示にも対応できるVLAモデルを提案。
- 自動運転のためのChain-of-Thought:包括的サーベイと今後の展望自動運転2025/5/1
自動運転におけるChain-of-Thought推論の研究を体系的に整理し、動機・手法・課題・将来方向を分析したサーベイ。自己学習との組み合わせによる自己進化の可能性も提案。
- 模倣学習の汎化能力に関する統一的理解模倣学習2025/4/1
模倣学習の汎化ギャップを情報理論とデータ分布の観点から理論的に解析し、事前学習エンコーダの扱い方やデータ多様性の重要性を明らかにした研究。
- 物理特性を考慮したオンラインマスキング推論によるロボットパレタイズマニピュレーション2025/2/1
強化学習とオンライン学習で動的に更新する行動空間マスキングを用い、箱の密度や剛性といった物理特性を考慮して積み付け計画を立てる手法を提案し、実機のロボットパレタイザで有効性を検証した。
- 想像的ポテンシャルゲーム:対話的行動のシミュレーション・学習・評価のためのフレームワークソーシャルナビゲーション2024/11/1
各エージェントが他者との仮想的な協力ゲームを想像する分散ポテンシャルゲームで人間らしい相互作用をシミュレートし、対話型ナビゲーションの学習・評価環境を提供する。
- DexHandDiff: 適応的巧みな操作のための相互作用を考慮した拡散計画マニピュレーション2024/11/1
接触を伴う巧みな操作のための拡散計画フレームワーク。接触前後の二段階拡散とLLMによるガイダンス生成で、訓練分布外の目標にも適応できる。
- スパース拡散方策:ロボット学習のためのスパースで再利用可能かつ柔軟な方策VLA2024/7/1
Transformerベースの拡散方策にMixture of Expertsを組み込み、タスクごとに専門家を選択的に活性化することで、マルチタスク学習や継続学習を効率化する手法を提案した。
- 事後サンプリングによる歩行者軌道の同時予測軌道予測2024/4/1
歩行者の過去と未来の軌道をまとめて拡散モデルで学習し、事後サンプリングによりノイズや欠損のある入力でも頑健に予測・生成できる手法GFTDを提案した。
- 適応的エネルギー正則化による四足歩行の自律的歩容遷移と省エネルギー化歩行2024/3/1
エネルギー消費を最小化する適応的な報酬設計により、四足ロボットが速度に応じて歩容を自律的に切り替え、省エネで安定した移動を実現する手法を提案した。
- Learning Agile Flight Maneuvers: Deep SE(3) Motion Planning and Control for Quadrotors2022/9/1