Yifei Yang
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MobileWAM: 世界行動モデルをチェーン・オブ・フォーサイトで移動操作に橋渡しする移動操作2026/8/5
移動操作のための世界行動モデルを提案し、事前学習済みのビデオ拡散トランスフォーマーと軽量な行動エキスパートを融合させ、移動と操作の異種ダイナミクスを扱う。また、中間表現が未来の潜在チャンクを逐次予測するCoFを導入し、実機でも高い性能を示した。
- AR Forcing: 長期的ロボットナビゲーションのためのワールドモデルに向けてナビゲーション2026/5/1
拡散ベースのナビゲーションワールドモデルにおける訓練と推論の分布ずれを解消するため、自己回帰訓練戦略AR Forcingを提案し、長期的な予測の安定性と精度を向上させた。
- 方向が鍵:力の方向を学習することで接触の多い操作のSim-to-Real転移を実現sim2real2026/2/1
シミュレーションで人間設計の位置・力制御器を教師として使い、接触力の方向を予測する方策を学習。実機では力覚アダミタンス制御器を構成し、電子レンジ開けやペグ挿しなど4タスクで高い成功率と頑健性を示した。
- 見て行動し、プロンプトで指定する:視覚言語行動ポリシーのベイズ分解VLA2025/12/1
VLAモデルのファインチューニングで生じる言語忘却と視覚ショートカットを、ポリシーを視覚行動事前と言語条件付き尤度にベイズ分解することで解決し、未知の指示・物体・環境への汎化性能を向上させた。
- 身体構成に同変な視覚-言語-行動ポリシーに向けてVLA2025/9/1
ロボットの身体構成の変化に対して同変性を持つように視覚-言語-行動ポリシーを設計し、新しい機体構成への汎化と効率的なファインチューニングを実現した研究。
- TOP: ヒューマノイドロボットの安定かつ高精度な立位マニピュレーションのための時間最適化ポリシーマニピュレーション2025/8/1
上半身の動作時間を調整する時間最適化ポリシーを導入し、下半身の強化学習制御と組み合わせることで、ヒューマノイドの立位マニピュレーションの安定性と精度を両立させた。
- 雑然環境における言語条件付きピック&プレースのための無条件行動事前分布の効率的アラインメントマニピュレーション2025/3/1
視覚・言語・行動の基盤モデルの事前知識を統合し、1つのアテンション層で無条件行動事前分布を3D視覚言語事前分布にアラインメントすることで、少ないデータで学習しつつゼロショット汎化を保ち、雑然環境での言語条件付きピック&プレースを効率的に実現する手法A²を提案。
- 把持タスクにおけるグリッパ状態の曖昧性解消:擬似触覚フィードバックによる純粋シミュレーション学習の実現マニピュレーション2025/3/1
把持タスクで問題となるグリッパ状態の曖昧性を、力制御グリッパを触覚センサとして用いる擬似触覚フィードバックで解消し、追加データ収集なしにシミュレーションのみでロバストな模倣学習を可能にした。
- ν-DBA: ニューラル陰的密バンドル調整による画像のみの走行シーン再構成SLAM/3D再構成2024/4/1
3Dニューラル陰的表面で地図を表現し、密オプティカルフローに導かれた幾何誤差で軌跡と地図を同時最適化する密バンドル調整フレームワークを提案し、走行シーンの軌跡推定と密再構成精度を向上させた。
- Open-Set Object Detection Using Classification-free Object Proposal and Instance-level Contrastive Learning2022/11/1