Tairan He
収録論文 23本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ヒューマノイドのピクセル入力から行動へのポリシー転移におけるSim-to-Realの扉を開くsim2real2025/12/1
GPU加速のフォトリアルシミュレーションと教示者-生徒-ブートストラップ学習を用い、RGB画像のみからヒューマノイドが多様な扉を開けるロコマニピュレーションポリシーをシミュレーションだけで学習し、実機でゼロショット転移を実現した。
- SONIC: 自然なヒューマノイド全身制御のための運動追跡の超大規模化ヒューマノイド制御2025/11/1
運動追跡をスケーラブルなタスクと位置づけ、モデル容量・データ・計算量を大規模化することで、自然で堅牢な全身運動が可能な汎用ヒューマノイド制御器を構築した研究。
- 残差強化学習によるデータ生成で自己改善する視覚言語行動モデルVLA2025/11/1
VLAモデルの失敗領域を残差RLで探索し、展開分布に沿った軌道を収集・蒸留することで、追加の人間デモなしに性能を自己改善させるフレームワークPLDを提案。
- VIRAL: ヒューマノイドの移動操作に向けた大規模視覚Sim-to-Realsim2real2025/11/1
シミュレーションのみでヒューマノイドの移動を伴う操作スキルを学習し、実機にゼロショット転移する視覚ベースのフレームワークを提案。大規模ドメインランダム化と実機整合により、Unitree G1上で連続的な移動操作を実現した。
- HDMI: 人間の動画から対話型ヒューマノイド全身制御を学習全身操作2025/9/1
単眼RGB動画から人間と物体の軌道を抽出・再ターゲットし、強化学習でヒューマノイドの全身物体操作スキルを学習、実機にゼロショット展開するフレームワーク。
- ビールをこぼさず運べ:ヒューマノイドの優雅な歩行とエンドエフェクタ安定化制御歩行2025/5/1
上半身と下半身を異なる周波数・報酬で制御する2エージェントフレームワークSoFTAを提案し、歩行中のエンドエフェクタの加速度を2〜5倍低減して、ほぼ満杯のカップをこぼさず運ぶなどの繊細な作業を可能にした。
- 能動探索を用いたサンプリングベースシステム同定による脚ロボットのSim2Real学習sim2real2025/5/1
脚ロボットの物理パラメータを並列サンプリングで同定し、フィッシャー情報量を最大化する能動探索で実世界データを収集することで、シミュレーションと実機のギャップを縮め、移動タスクの性能を42〜63%向上させた。
- FALCON: 力適応型ヒューマノイド移動操作の学習移動操作2025/5/1
下半身と上半身を別々の強化学習エージェントで制御し、力のカリキュラム学習で外力に適応するヒューマノイドの移動操作フレームワークを提案。実機で荷物運搬やカート牽引、ドア開けを実現した。
- 視覚強化学習から創発するシミュレーション人型ロボットの能動的知覚と器用さVLA2025/5/1
自己中心視覚のみを入力とする強化学習フレームワークPDCを提案し、シミュレーション人型ロボットが物体探索・把持・配置・関節物体操作などの家事タスクを単一ポリシーで遂行できることを示した。
- ヒューマノイド方策~ヒューマン方策VLA2025/3/1
一人称視点の人間の操作データをヒューマノイドロボットの学習に活用するため、人間とロボットの状態行動空間を統合したHuman Action Transformer (HAT)を提案し、汎化性能とロバスト性を向上させた。
- ASAP: シミュレーションと実世界物理の整合による俊敏なヒューマノイド全身スキルの学習sim2real2025/2/1
シミュレーションと実世界のダイナミクス差を補正する残差行動モデルを実機データから学習し、事前学習済みの運動追従方策を微調整することで、ヒューマノイドの俊敏な全身動作を実現する二段階フレームワークを提案した。
- 適応性と安全性の橋渡し:多様な物理環境下での俊敏な衝突回避歩行の学習歩行2025/1/1
俊敏ポリシーと回復ポリシーを物理パラメータ推定器と到達回避価値ネットワークで切り替え、未知の摩擦や積載量にも適応する脚式ロボット歩行手法BASを提案した。
- HOVER: ヒューマノイドのための汎用全身制御ニューラルコントローラヒューマノイド全身制御2024/10/1
全身の運動模倣を共通の抽象表現として活用し、ナビゲーションや卓上操作など複数の制御モードを単一の方策に蒸留統合したヒューマノイド全身コントローラを提案した。
- OmniH2O:汎用的で器用な人間からヒューマノイドへの全身遠隔操作と学習遠隔操作2024/6/1
VR・音声・RGBカメラなど多様な入力で人間がヒューマノイド全身を遠隔操作できる学習ベースのシステムを構築し、実世界でのスポーツや物体操作を実現した。
- WoCoCo: 連続接触を伴う全身ヒューマノイド制御の学習全身制御2024/6/1
接触の連続を要する全身ヒューマノイドタスクを接触段階に分解し、タスク非依存の報酬とsim-to-real設計で効率的に強化学習するフレームワークを提案。
- 人間からヒューマノイドへのリアルタイム全身テレオペレーションの学習テレオペレーション2024/3/1
RGBカメラ1台で人間の動きを捉え、強化学習で訓練した全身運動模倣器により、等身大ヒューマノイドをリアルタイムで遠隔操作するフレームワークH2Oを提案した。
- Agile But Safe: Learning Collision-Free High-Speed Legged Locomotion2024/1/1
- Safe Reinforcement Learning via Hierarchical Adaptive Chance-Constraint Safeguards2023/10/1
- Safe Deep Policy Adaptation2023/10/1
- State-wise Safe Reinforcement Learning: A Survey2023/2/1
- AutoCost: Evolving Intrinsic Cost for Zero-violation Reinforcement Learning2023/1/1
- Probabilistic Safeguard for Reinforcement Learning Using Safety Index Guided Gaussian Process Models2022/10/1
- Safety Index Synthesis via Sum-of-Squares Programming2022/9/1