Xiao Chen
収録論文 15本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VT-Bridge: 軽量残差適応で事前学習済み基盤VLAをVTLAへ橋渡しVLA2026/9/18
事前学習済みVLAモデルに軽量な残差アダプタを追加するだけで、触覚情報を活用した接触の多いマニピュレーションを少ないデータで実現する手法を提案。
- 文脈条件付き相互作用事前分布による物理ベース人型ロボットの統合的操作人型ロボット制御2026/9/6
本論文は、歩行と物体操作を統合する物理ベースの人型ロボット制御フレームワークCHIPを提案し、異種の動作データから再利用可能なスキルを学習する。
- 人型ロボットのためのスケーリング行動基盤モデル人型ロボット制御2026/7/1
人型ロボットの制御を大規模行動データで学習する行動基盤モデル(BFM)のスケーリング手法を提案し、学習パラダイム、データ、モデル構造の協調により性能が向上することを示した。
- ReactiveBFM: 汎用ヒューマノイド全身制御に向けたリアクティブ閉ループ動作計画ヒューマノイド制御2026/6/1
既存の行動基盤モデルは事前定義された動作しか実行できず環境変化に弱いため、生成型プランナーと追跡制御を閉ループで統合し、曝露バイアスを軽減するリアクティブな全身制御フレームワークを提案した。
- Imagine2Real: ビデオ生成事前知識によるヒューマノイドと物体のゼロショット対話の実現ヒューマノイド操作2026/5/1
3Dデータ不足を補うため、ビデオ生成モデルから得た4D点軌跡と少数の重要点追跡を用いて、幾何モデル不要でヒューマノイドと物体の対話動作をゼロショットで生成するフレームワークを提案した。
- RADAR: 実世界ダイナミクス・空間物理知能・自律評価による視覚言語行動モデルの汎化ベンチマークVLA2026/2/1
VLAモデルの実世界汎化を評価するため、物理ダイナミクス・空間推論タスク・3D指標による完全自律評価を統合したベンチマークRADARを提案し、既存モデルを監査した。
- 適応的な動作追従による柔軟なヒューマノイド制御ヒューマノイド制御2025/10/1
単一の参照動作からキーフレームを抽出・編集してデータを拡張し、追従速度を調整するアダプタを学習することで、ヒューマノイドが多様な実環境条件に動作パターンを保ちながら適応できる手法を提案。
- 遠隔リハビリテーションのためのオンライン技能伝達と適応遠隔操作2025/10/1
療法士と患者側のロボットを双方向遠隔操作で結び、6自由度の動きをR^3×S^3空間で符号化してリハビリ動作を再現・適応させる枠組みを提案した。
- セラピスト入力から形状適応型支援必要量リハビリ政策を学習リハビリテーションロボティクス2025/10/1
セラピストの介入を潜在空間の経由点として符号化し、患者の運動嗜好に応じて参照軌道を適応的に変形する支援必要量リハビリ政策を学習する遠隔操作フレームワークを提案した。
- PhysHSI:実世界で汎化可能な自然なヒューマノイド・シーンインタラクションシステムヒューマノイド2025/10/1
シミュレーションでの敵対的動作事前分布に基づく方策学習と、LiDARとカメラを組み合わせた粗から細への物体位置推定により、ヒューマノイドが実世界で物体運搬や着座などの多様なインタラクションを自然に自律実行できるシステムを構築した。
- GLEAM: 複雑な3D屋内環境における能動的マッピングのための汎化可能な探索方策の学習能動的マッピング/探索2025/5/1
合成・実スキャンの1,152シーンからなる大規模ベンチマークGLEAM-Benchを構築し、意味表現と長期目標・ランダム化戦略で未知の複雑シーンでも高被覆・高精度に探索する汎化可能な能動的マッピング方策を提案した。
- SharedAssembly:共有テレアセンブリによるデータ収集手法遠隔操作2025/3/1
リーダー側とフォロワー側の両方に組立特化の知能を組み込んだ共有自律バイラテラル遠隔操作フレームワークを提案し、サブミリ単位の高精度組立タスクで97%の成功率を達成した。
- 多様な姿勢からのヒューマノイド起立制御の学習sim2real2025/2/1
強化学習により、多様な姿勢から実機ヒューマノイドが滑らかに起立できる制御則を学習し、シミュレーションから実世界への転移を実現した。
- GenNBV: 能動的3D再構成のための汎化可能な次善視点ポリシー能動的3D再構成2024/2/1
強化学習を用いて、任意の視点から撮影できるドローンの次善視点ポリシーを学習し、未知の大規模物体でも高い被覆率で3D再構成を自動化した。
- EmbodiedScan: A Holistic Multi-Modal 3D Perception Suite Towards Embodied AI2023/12/1