Yixuan Wang
SJTU
収録論文 27本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 流れの中の骨格:グラフ構造フローマッチングによる人間動作予測動作予測2026/9/26
骨格の時空間グラフ上で条件付きフローマッチングを行い、骨長を保ちながら多様で整合的な未来の動作軌道を生成する手法を提案。
- HapticWorld:リアルタイムトルクフィードバックを備えたインタラクティブ世界シミュレータ触覚2026/9/25
学習した世界モデルにトルク予測とリアルタイムの力覚提示を組み込み、接触の多い操作タスクのデータ収集効率と方策性能を向上させ、実世界評価の代替プラットフォームとしても機能することを示した。
- Streaming-WAM: 非同期ロボットマニピュレーションのための行動条件付きワールドアクションモデルマニピュレーション2026/9/24
未来の視覚予測を行動条件付きで行い、推論とロボット動作を非同期に重ねることで待ち時間を削減しつつ高い成功率を実現したモデル。
- Hydra-0: 汎用世界モデリングと制御のためのアクションフロー世界モデル2026/8/18
ロボットの動作をピクセル運動として表現するアクションフローを用いた汎用世界モデルを提案し、動作誤差を大幅に低減し、ゼロショット合成やデータ効率的な適応を実現した。
- SCP-NL2TL: 自然言語から時相論理仕様への選択的適合予測と意味検証形式仕様変換2026/8/5
自然言語の指示を形式仕様に変換する際、信頼できない翻訳を拒否する選択的翻訳フレームワークを提案。逆翻訳の忠実度と翻訳の分散を組み合わせたスコアで信頼性を評価し、適合予測で誤受理率を制御する。
- PLAN-S: 潜在スタイルダイナミクスと計画を橋渡しする自動運転ワールドモデル自動運転2026/6/1
自動運転の潜在ワールドモデルにおいて、運転スタイルを条件付けた4チャンネルのセマンティックコストマップを復号し、計画モジュールに統合することで、リスクや運転スタイルの明示的な制御を可能にする新しいブリッジ手法を提案した。
- 生成的強化学習を安定したロボット制御へ導く強化学習/制御2026/6/1
拡散・フローベースの生成的方策を学習し、その確率的な潜在変数サンプリングを決定的な潜在アクターに置き換えることで、探索と制御を分離し、安定かつ高精度なロボット制御を実現するフレームワークを提案した。
- 不確実性を考慮した人間からロボットへの組立遠隔操作における意図予測遠隔操作/意図予測2026/6/1
人間の手のデモデータで事前学習し、限られたロボット遠隔操作データで微調整する階層的転移学習と、統計的保証付きのコンフォーマル予測、VLMによるセグメント修正を組み合わせ、組立遠隔操作中の行動認識・意図予測・誤り検出を高精度化した。
- 実世界からシミュレーション、そして実世界へ:共有自律による効率的で信頼性の高い遠隔操作遠隔操作/共有自律2026/3/1
実世界の遠隔操作データから学習した人間の代理モデルを用いて、シミュレーションで残差コパイロットポリシーを訓練し、実世界の微細な操作タスクで人間の遠隔操作を支援する共有自律フレームワークを提案。
- ロボット政策の訓練と評価のためのインタラクティブ世界シミュレータ世界モデル2026/3/1
一貫性モデルを用いて高速かつ安定なインタラクティブ世界モデルを構築し、ロボット政策の訓練と評価を可能にするフレームワークを提案。世界モデル内で収集したデータで訓練した政策が実世界データと同等の性能を示し、シミュレーションと実世界の性能に強い相関があることを実証。
- 動的環境における時間考慮型のConformal Predictionを用いた動作計画動作計画2025/11/1
Conformal Predictionを活用し、不確実な障害物挙動下でも安全な経路計画を実現するグローバル・ローカルプランナを提案。適応的分位点機構で安全性と軌道実現性を両立。
- CodeDiffuser: VLM生成コードによる曖昧な指示に対応する注意強化拡散ポリシーVLA2025/6/1
VLMが自然言語指示を解釈してタスク固有のコードを生成し、そのコードから3D注意マップを作って拡散ポリシーを誘導することで、曖昧な指示下のロボットマニピュレーションを実現するフレームワーク。
- DemoGen: データ効率の良い視覚運動方策学習のための合成デモンストレーション生成模倣学習2025/2/1
タスクごとに1回の人間デモから、3D点群編集と行動軌道の適応により空間的に多様な合成デモを自動生成し、実世界のマニピュレーション方策の性能を大幅に向上させる手法を提案。
- CuriousBot: 操作可能な3D関係物体グラフによる対話型移動探索移動探索2025/1/1
物体間の多様な関係を表す3D関係物体グラフを構築し、移動ロボットが能動的な操作を通じて環境を探索するシステムを提案。VLMのみの手法を上回る性能を示した。
- ドメイン適応と報酬拡張模倣による動力学シフト下の強化学習sim2real2024/11/1
動力学が異なる環境間で方策を転移するため、報酬修正によるドメイン適応と模倣学習を組み合わせたDARAILを提案し、ベンチマークで性能向上を示した。
- GenDP: カテゴリレベル汎化を実現する3Dセマンティックフィールド拡散ポリシーVLA2024/10/1
マルチビューRGBDから大規模視覚モデルで3D記述子場を生成し、参照記述子と比較して意味場を得ることで、拡散ポリシーの未見物体への汎化性能を20%から93%に向上させた。
- 3D-ViTac:視触覚センシングによる繊細なマニピュレーションの学習マニピュレーション2024/10/1
低コストで柔軟な高密度触覚センサと視覚情報を統合した3D表現を用い、拡散ポリシーによる模倣学習で両手巧みな操作を実現するシステムを提案。
- ニューラルネットワーク制御システムの実行時安全性検証:ケーススタディ安全性検証2024/8/1
LiDARを用いたTurtlebotナビゲーションにおいて、ニューラルネットワーク制御システムの実行時安全性をPOLAR-Expressで検証し、検証結果に基づく安全なコントローラ切替戦略を提案・評価した。
- RoboPack: 触覚情報を活用した動力学モデルによる高密度パッキング触覚2024/7/1
視覚と触覚を組み合わせたリカレントグラフニューラルネットワークで物体状態を推定し、モデル予測制御により非把持操作や高密度パッキングを実現する手法を提案。
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Kinematics-aware Trajectory Generation and Prediction with Latent Stochastic Differential Modeling2023/9/1
- D$^3$Fields: Dynamic 3D Descriptor Fields for Zero-Shot Generalizable Rearrangement2023/9/1
- Predicting Object Interactions with Behavior Primitives: An Application in Stowing Tasks2023/9/1
- Safety-Assured Speculative Planning with Adaptive Prediction2023/7/1
- Dynamic-Resolution Model Learning for Object Pile Manipulation2023/6/1
- Physics-Aware Safety-Assured Design of Hierarchical Neural Network based Planner2022/1/1
- Tracking Partially-Occluded Deformable Objects while Enforcing Geometric Constraints2020/11/1