Mengdi Xu
Tsinghua University
収録論文 21本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboCoach: 世界モデルを能動的コーチとして用いた構成可能なロボットスキルの改善マニピュレーション2026/9/30
世界モデル内で想像した失敗を診断し、次に教えるべきサブタスクと更新すべき専門家を選ぶことで、少ない実演データで長期的なロボット操作スキルの組み合わせを効率的に改善するフレームワークを提案。
- フローマッチングにおける条件付きアニーリングによる因果的行動トークン化の再考VLA2026/9/28
フローマッチングを段階的にアニーリングして因果構造を持つ行動トークンを抽出するCATokを提案し、VLAモデルの再構成精度・推論効率・タスク成功率を向上させた。
- Uni-VLaT:ヒューマノイドの移動操作のためのVLAポリシーへの全身触覚適応VLA2026/9/28
全身触覚を視覚言語行動ポリシーに統合し、未来の触覚・固有感覚・視覚表現を予測する補助タスクで学習することで、接触を伴う移動操作タスクの成功率を大幅に向上させた。
- ヒューマノイドバドミントン:限られた人間動作データからの動的ラケットスキル学習マニピュレーション2026/9/25
三段階の階層型強化学習により、限られた人間のバドミントン動作データからヒューマノイドがフォアハンド・バックハンド・ジャンプ返球などの動的ラケットスキルを獲得し、実機で人間とのラリーを実現した。
- Weave: 人間-物体インタラクションから全身巧みな移動操作を学習する全身移動操作2026/9/15
人間の物体操作デモを接触を考慮してロボット用に変換し、29体関節と12指関節を協調制御する全身移動操作ポリシーを学習するフレームワーク。
- Dex-X: シミュレーションによるインタラクションを用いた人間のビデオからの視覚-触覚器用操作学習マニピュレーション2026/9/7
人間のビデオデモから、シミュレーションで触覚情報を補完し、視覚と触覚を統合した器用な操作ポリシーを学習するフレームワークを提案。実機へのゼロショット転送を達成した。
- R2S-Eval: 視覚言語モデルによる実機からシミュレーションへのキャリブレーションを用いたロボット評価評価2026/9/3
ロボット操作ポリシーの評価を、実機からシミュレーションへのキャリブレーションと視覚言語モデルによる選好評価を組み合わせて行うパイプラインを提案し、実機評価の不安定性やコストを低減する。
- 運用型デジタルツインクリニックによる具現化AIのタスクベース評価具現化AI評価2026/8/12
日常の診療画像をシミュレータ対応のデジタルツインに変換し、具現化AIのタスク評価を可能にする手法を提案。眼科クリニックの39シーンで再構成品質やロボット動作の実現性を検証した。
- 検証のスケーリングは視覚-言語-行動の整合性において方策学習のスケーリングより効果的になり得るVLA2026/2/1
視覚-言語-行動モデルの指示と行動のずれを減らすため、テスト時に言い換え指示と行動候補を増やして検証する手法CoVerを提案し、方策事前学習のスケーリングより高い性能を示した。
- MoMaGen: ソフト・ハード制約下で多段階両腕移動マニピュレーションのデモを生成sim2real2025/10/1
移動ベースと両腕の多段階タスク向けに、到達可能性などのハード制約と視認性などのソフト制約を満たすデータ生成を制約付き最適化として定式化し、多様なデモを自動生成する手法を提案。
- ダイナミクスをプロンプトに:文脈内学習によるSim-to-Realシステム同定sim2real2024/10/1
過去の相互作用履歴を文脈として用いる文脈内学習により、勾配更新なしでシミュレーション環境のパラメータを実世界のダイナミクスにオンライン適応させる手法を提案し、物体すくい上げとエアホッケーで有効性を示した。
- Adaptive Online Replanning with Diffusion Models2023/10/1
- Creative Robot Tool Use with Large Language Models2023/10/1
- Guardians as You Fall: Active Mode Transition for Safe Falling2023/10/1
- What Went Wrong? Closing the Sim-to-Real Gap via Differentiable Causal Discovery2023/6/1
- Embodied Executable Policy Learning with Language-based Scene Summarization2023/6/1
- Hyper-Decision Transformer for Efficient Online Policy Adaptation2023/4/1
- Curriculum Reinforcement Learning using Optimal Transport via Gradual Domain Adaptation2022/10/18
- Prompting Decision Transformer for Few-Shot Policy Generalization2022/6/1
- Task-Agnostic Online Reinforcement Learning with an Infinite Mixture of Gaussian Processes2020/6/1
- CMTS: Conditional Multiple Trajectory Synthesizer for Generating Safety-critical Driving Scenarios2019/10/1