Xinlei Chen
収録論文 39本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 因果的作用効果の再重み付けによるワールドモデル学習の改善ワールドモデル2026/8/31
アクション条件付きビデオ生成のワールドモデル学習において、背景トークンに偏った損失を避け、アクションの影響を受けるトークンに重点を置く再重み付け手法を提案した。
- ActiveFly-Bench: 空中身体知覚のための身体化質問応答と視覚言語行動の統合UAV/身体化知覚2026/7/1
UAVの能動的知覚を評価する初のベンチマークを提案し、高次タスク理解から低次制御までを階層的に評価するエージェントを開発した。
- Worldscape-MoE: スケーラブルな異種行動制御のための統一Mixture-of-Experts世界モデル世界モデル2026/7/1
異なる行動モダリティ(カメラ軌道、ロボット動作、手の関節信号など)を統一的に扱える拡張可能な世界モデルを提案し、MoEアーキテクチャにより異種の行動制御を共有の世界ダイナミクスに統合する。
- LAMP: 潜在運動事前分布による実世界での器用な手操作学習のガイドマニピュレーション2026/7/1
高次元の手の動作を扱う実世界学習の不安定さを解決するため、潜在運動事前分布モジュールを導入し、模倣学習とオンライン強化学習を組み合わせた3段階の学習フレームワークを提案。実ロボット4タスクで高い成功率を達成。
- WorldFly: UAVナビゲーションのためのワールドモデル基盤の視覚言語行動モデルナビゲーション2026/6/4
UAVナビゲーションのための新しいVLAフレームワークで、将来の映像予測と行動を同時生成するデュアルブランチ結合フローマッチング機構を導入し、空間想像による意思決定を強化する。
- STEAM: 実世界ロボット学習のための自己教師あり時間アンサンブル優位性モデリングロボット学習2026/6/1
専門家のデモからフレーム間の時間オフセットを自己教師ありで学習し、ロールアウトデータの各フレームの優位性を評価する手法を提案。混合品質データの保守的なスコアリングにより、ポリシー学習の成功率を向上させた。
- HCLM: 二足四脚ロボットによる協調ロコ操作のための階層的フレームワーク群制御2026/5/1
二足四脚ロボットのペアによる協調的な移動操作を実現する階層的フレームワークを提案。高レベルの協調推論と低レベルの堅牢な動作実行を分離し、シミュレーションと実世界での検証を行った。
- WorldVLN: 空中視覚言語ナビゲーションのための自己回帰的世界行動モデルVLA2026/5/1
空中VLNを予測駆動の世界行動問題として捉え、自己回帰ビデオバックボーンで世界状態遷移を予測し、実行可能なウェイポイント行動に直接デコードする初のモデルWorldVLNを提案。2段階訓練と強化学習により、ベンチマークで12%以上の成功率向上を達成し、実ドローンへのゼロショット転送も実証。
- WorldMAP: 生成的世界モデルを用いた視覚言語ナビゲーション軌道予測のブートストラップナビゲーション2026/4/1
生成的世界モデルが生成した未来映像から教師信号を作り、視覚言語入力から直接ナビゲーション軌道を予測する軽量モデルを訓練する教師-学生フレームワークを提案した。
- SCOPE: 骨格グラフに基づく計算効率の高い自律UAV探索フレームワークUAV探索2026/2/1
未知環境でのUAV探索において、リアルタイム骨格グラフと階層的計画により計算コストを平均86.9%削減しつつ高性能を実現するフレームワークを提案。
- USER: 実世界オンライン方策学習のための統合拡張可能システム実世界オンライン学習/システム2026/2/1
実世界のロボット群をGPUと同様に扱うハードウェア抽象化と非同期学習基盤を提供し、オンライン模倣・強化学習やVLAモデルを長期実験で効率的に訓練できるシステムを構築した。
- 3D空間における長期的視覚生成とナビゲーションのための航空世界モデルナビゲーション2025/12/1
UAVのナビゲーション向けに、過去のフレームと行動から将来の視覚観測を予測する世界モデルANWMを提案し、候補軌道を意味的妥当性で評価することで大規模3D環境での自律飛行性能を向上させた。
- ArtiSG: 人間の実演による関節物体操作を用いた機能的3Dシーングラフ構築シーングラフ2025/12/1
人間の操作実演から6自由度軌跡と関節軸を推定し、開語彙の階層的3Dシーングラフに組み込むことで、隠れた取っ手などの機能要素も発見できるロボット記憶を構築するフレームワーク。
- すべての回転を数え、すべての回転が重要:プロペラセンシングによるドローン動態の探求ドローンセンシング2025/11/1
イベントカメラでプロペラの回転数を高精度に計測し、ドローンの飛行コマンドや動態を推測する手法を提案。
- イベントカメラを用いた高頻度クロスモダリティ視覚測位サービスによるドローン着陸の高精度化視覚測位/ドローン着陸2025/10/1
イベントカメラを活用したドローン向け視覚測位システムEV-Poseを提案し、高頻度かつ高精度な6自由度姿勢推定により正確な着陸を実現した。
- ドローンの地面効果を活用した高精度エッジ検出システムAirTouchセンシング2025/9/1
ドローンの姿勢センサーと飛行指令から地面効果の変化を解析し、視覚に頼らず低消費電力で環境の境界(エッジ)を検出する新手法を提案。
- COMPASS: 能動的センシング戦略による狭所マニピュレーション計画マニピュレーション2025/9/1
狭く混雑した環境でのマニピュレーションのため、近接場スキャンで局所衝突マップを作り、情報量と操作しやすさを両立する視点を選び、障害物制約を守る操作姿勢を生成する多段階探索・操作フレームワークを提案した。
- JuggleRL: 深層強化学習によるクアッドロータのボールジャグリング習得sim2real2025/9/1
クアッドロータにラケットを搭載し、深層強化学習でボールジャグリングを実現した研究。シミュレーションで学習した方策を実機にゼロショット転移し、平均311回・最大462回の連続ヒットを達成した。
- mmE-Loc: 超高速ローカライゼーションによるドローン着陸の高精度化ローカライゼーション2025/7/1
イベントカメラとmmWaveレーダーを融合し、ドローンの着陸を高精度・低遅延で支援する地上ローカライゼーションシステムを開発した。
- AirScape: 運動制御可能な空中生成ワールドモデル世界モデル2025/7/1
6自由度ドローンの視覚入力と運動意図から将来の観測を予測する世界モデルを構築し、運動意図に沿った3D空間想像力で既存モデルを大幅に上回った。
- RLはVLAの汎化に何をもたらすか?実証研究VLA2025/5/26
VLAモデルの汎化性能を評価するベンチマークを構築し、RL微調整(特にPPO)がSFTより意味理解と実行頑健性を大幅に向上させることを示した実証研究。
- CityNavAgent:階層的意味計画とグローバルメモリによる都市空中ビジョン言語ナビゲーション空中VLN2025/5/1
ドローンが自然言語指示に従って都市環境をナビゲートする空中VLNタスクに対し、LLMを活用した階層的意味計画と履歴をトポロジカルグラフで保持するグローバルメモリを組み合わせたエージェントを提案し、最先端性能を達成した。
- イベントカメラとモバイル身体知覚:抽象化・アルゴリズム・高速化・応用イベントカメラ/モバイル知覚2025/3/1
イベントカメラを用いたモバイルセンシングについて、2014〜2025年の研究を抽象化・アルゴリズム・ハード/ソフト高速化・応用の観点から包括的にサーベイした論文。
- 未知環境における協調探査のためのマルチロボットシステム:サーベイ群制御2025/3/1
未知の大規模環境での協調探査を実現するマルチロボットシステムについて、自己位置推定・地図統合、協調行動計画、通信制約などの構成要素を体系的に整理したサーベイ論文。
- 異種マスク付き自己回帰による実世界の行動-映像ダイナミクスの学習映像生成/世界モデル2025/2/1
異なるロボットの身体・環境・タスクの観察と行動列を統合的に事前学習し、マスク付き自己回帰で映像を予測するモデルHMAを提案。従来のロボット映像生成より高品質かつ15倍高速で、ポリシー評価や合成データ生成に使える映像シミュレータとして機能する。
- 超高速調和:mmWaveレーダーとイベントカメラがドローン着陸を高精度化センサーフュージョン2025/2/1
イベントカメラとmmWaveレーダーを組み合わせ、時間的一貫性と空間的相補性を活かした高精度・低遅延のドローン着陸位置推定システムを提案。
- VolleyBots:運動制御と戦略的プレーを統合したマルチドローン・バレーボール競技のテストベッド群制御2025/2/1
複数ドローンがバレーボールで協調・対戦するテストベッドを構築し、運動制御と戦略を組み合わせたタスクで強化学習やゲーム理論の手法を評価した。階層型方策が3対3で69.5%の勝率を達成し、シミュレーションから実機へのゼロショット転移も示した。
- MR-COGraphs: 3Dシーングラフによる通信効率の良いマルチロボットオープンボキャブラリマッピングシステムマルチロボットマッピング2024/12/1
物体をノード、空間隣接関係をエッジとする3DシーングラフCOGraphを構築し、特徴圧縮と復元により通信量を80%以上削減しつつ、複数ロボットの地図を統合してオープンボキャブラリなマッピングを実現した。
- SniffySquad: ガス分布のまだら性を考慮したマルチロボット協調によるガス源探知群制御2024/11/1
ガス漏れ現場でのガス源特定のため、ガスのまだらな分布に対応する能動センシングと役割適応を組み合わせたマルチロボット嗅覚システムを提案し、成功率と経路効率を大幅に改善した。
- EmbodiedCity:実世界都市環境における身体性エージェントのためのベンチマークプラットフォーム身体性AI/都市シミュレーション2024/10/1
実在都市の建物や道路を再現した高精細3Dシミュレータ上で、歩行者・車両の流れを再現し、身体性AIの評価タスクと入出力インターフェースを提供するベンチマークを構築した。
- 異種ロボットデータによる自己受容・視覚学習のスケーリングVLA2024/9/1
異なるロボット身体とタスクのデータを大規模に事前学習し、共有可能なポリシー表現を学習するHPTを提案。未知タスクでの微調整性能を20%以上向上させた。
- Range-SLAM: 超広帯域信号による煙環境対応のリアルタイム自己位置推定と地図構築SLAM2024/9/1
LiDARやカメラが使えない煙などの劣悪環境で、UWB信号の距離とRSSIのみを用いて2次元占有格子地図をリアルタイム構築し、重み付き最小二乗法で高精度に自己位置推定する軽量SLAMシステムを提案。
- LVCP: LiDARと視覚の緊密結合による協調的リアルタイム相対位置推定位置推定2024/7/1
GPSや事前地図がない環境で、ドローンとUGVの相対位置をLiDAR点群と単眼カメラの情報を緊密に統合してリアルタイム推定する手法を提案。
- TransformLoc: 異種ドローン群における移動型測位インフラへの変換群制御2024/3/1
高性能ドローンを移動型の測位基地として活用し、低コストな小型ドローンの位置推定精度を向上させるフレームワークを提案・実機検証した。
- Underwater Motions Analysis and Control of a Coupling-Tiltable Unmanned Aerial-Aquatic Vehicle2023/12/1
- Path Generation for Wheeled Robots Autonomous Navigation on Vegetated Terrain2023/6/1
- Seeing the Un-Scene: Learning Amodal Semantic Maps for Room Navigation2020/7/1
- Embodied Visual Recognition2019/4/1
- PixelNet: Representation of the pixels, by the pixels, and for the pixels2017/2/1