Xin Xu
収録論文 23本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 大規模マルチロボットシステムにおけるステルスアクチュエータ攻撃下での分散型セキュア学習制御群制御2026/9/7
マルチロボットシステム向けに、強化学習と分散モデル予測制御を統合し、悪意あるステルスなアクチュエータ攻撃に対抗する分散型セキュア学習制御フレームワークを提案した論文。
- マルチモーダルアライメントを超えて:応答置換と順序実行による物理言語の認証マルチモーダル学習2026/8/19
異なるセンサーが同じ実行可能な意味を持つか、新しい行動の組み合わせで意味が保たれるかを検証するための運用能力階層と証明書(DBOSC)を導入し、触覚・音声・加速度表現の応答空間での近接性や順序実行の能力を実験的に評価した。
- Koopman Dreamer:安定した世界モデル想像のためのスペクトル制約付き潜在ダイナミクス世界モデル2026/7/1
Dreamerスタイルの世界モデルにKoopman理論に基づくスペクトル制約付きの決定論的潜在ダイナミクスを導入し、長期ロールアウトの安定性と制御性能を向上させた。
- 潜在世界モデルは何を知り得るか?マルチモーダル予測表現における物理パラメータの識別可能性世界モデル2026/7/1
潜在世界モデルが物理量を内部化する条件を、視覚的に同一で質量・抵抗・接触剛性が異なる物体を持つ環境で介入実験により解明した。予測目標が保持する物理量を決定し、剛性は触覚予測時のみ潜在表現に入るが、抵抗はどの決定論的予測目標でも学習されないことを示した。
- 線形埋め込み空間での強化学習によるソフトロボット構成横断的な汎用制御ソフトロボティクス/強化学習2026/6/1
ソフトロボットの多様な形態・構成に迅速に適応できる汎用制御システムを、共有の線形Koopman埋め込み空間での強化学習により実現した。33構成で検証し、転移サンプルを75倍削減しつつ堅牢な性能を示した。
- 深層クープマン作用素を用いた学習予測制御による自動運転車両の運動計画自動運転/運動計画/強化学習2026/6/1
自動運転車両の運動計画において、非線形・不確かな車両ダイナミクスを深層クープマン作用素で線形化し、アクタークリティック強化学習による閉ループ状態フィードバックポリシーを生成する学習予測制御フレームワークを提案した。非凸な障害物制約を凸近似とポテンシャル場で扱い、安全性を確保する。
- USER: 実世界オンライン方策学習のための統合拡張可能システム実世界オンライン学習/システム2026/2/1
実世界のロボット群をGPUと同様に扱うハードウェア抽象化と非同期学習基盤を提供し、オンライン模倣・強化学習やVLAモデルを長期実験で効率的に訓練できるシステムを構築した。
- 拡散モデルによる合成デモンストレーションを用いた敵対的模倣学習模倣学習2025/12/1
拡散モデルで疑似専門家デモを生成し、優先リプレイで効率的に模倣学習する手法を提案。Hopperタスクで最先端を上回る性能を達成。
- 価値条件付き最適化による拡散ポリシーを用いたオフライン強化学習オフライン強化学習2025/11/1
オフライン強化学習において、拡散モデルをアドバンテージ値で重み付けして訓練し、高リターン行動を選択的に拡張することで、保守性と探索性のバランスを取る手法DIVOを提案した論文。
- 信頼できる初期姿勢に基づく適応的ICP LiDARオドメトリLiDARオドメトリ2025/9/1
密度フィルタリングによる粗位置合わせと運動予測を比較して信頼できる初期姿勢を選び、履歴誤差に応じて適応的に閾値を調整するICPベースのLiDARオドメトリを提案。
- NVSPolicy: 適応的な新規視点合成による汎化可能な言語条件付き政策学習VLA2025/5/1
入力画像から情報量の多い視点を選んで新規視点画像を合成し、その特徴を意味特徴と残差特徴に分離して階層的政策ネットワークに入力することで、言語条件付きロボット操作の汎化性能を高めた手法。
- 誘導ベクトル場を用いた一般化フォーメーションによる多用途分散マニューバリング群制御2025/5/1
2つの仮想座標でロボットの運動を捕捉・包囲に分解し、特異点のない誘導ベクトル場と合意形成でフォーメーション追従・目標包囲・周回などの多様な分散マニューバを実現する手法を提案。
- 未知環境における協調探査のためのマルチロボットシステム:サーベイ群制御2025/3/1
未知の大規模環境での協調探査を実現するマルチロボットシステムについて、自己位置推定・地図統合、協調行動計画、通信制約などの構成要素を体系的に整理したサーベイ論文。
- パラメータ空間におけるスキル拡張と合成強化学習2025/2/1
スキルをLoRAモジュールとして管理し、パラメータ空間で合成・動的選択することで、新たなタスクに効率的に適応する強化学習フレームワークPSECを提案。
- スケーラブルなマルチロボット制御に向けて:分散MPCにおける高速方策学習群制御2024/12/1
分散モデル予測制御(DMPC)の計算負荷を削減するため、オンライン分散アクター・クリティックにより明示的な閉ループ方策を学習する分散学習ベース予測制御(DLPC)を提案し、大規模マルチロボット系の協調制御を効率化した。
- オフライン強化学習のための適応的アドバンテージ誘導方策正則化オフライン強化学習2024/5/1
VAEと拡張挙動方策から高アドバンテージ行動を抽出し、OOD行動への保守性を保ちつつ方策改善を促すオフラインRL手法A2PRを提案。D4RLで最先端性能を達成。
- 不確かなダイナミクスを持つ移動ロボットの運動計画のためのベクトル場誘導学習予測制御運動計画2024/5/1
ベクトル場で安全な目標軌道を生成し、深層Koopman作用素とスパースGPで不確かなダイナミクスを学習して予測制御に組み込む二段階の運動計画法を提案し、ドローンと地上ロボットで検証した。
- Learning-based Near-optimal Motion Planning for Intelligent Vehicles with Uncertain Dynamics2023/8/1
- StereoVAE: A lightweight stereo-matching system using embedded GPUs2023/5/1
- Learning Practically Feasible Policies for Online 3D Bin Packing2021/8/1
- A LiDAR Assisted Control Module with High Precision in Parking Scenarios for Autonomous Driving Vehicle2021/5/1
- Synchronous Maneuver Searching and Trajectory Planning for Autonomous Vehicles in Dynamic Traffic Environments2019/9/1
- Baidu Apollo Auto-Calibration System - An Industry-Level Data-Driven and Learning based Vehicle Longitude Dynamic Calibrating Algorithm2018/8/1