Chao Gao
Shanghai AI Laboratory
収録論文 17本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- InternW0-Δ: 予測ダイナミクスと行動を橋渡しする20K時間超のオープンデータによるワールドアクションモデルVLA2026/9/25
視覚ダイナミクスと行動生成を統合したワールドアクションモデルを、20,000時間超の異種オープンデータで事前学習し、シミュレーションと実機で従来手法を上回る性能を達成した。
- FootQuery: 予測接地位置に基づく深度履歴検索による知覚型ヒューマノイド歩行歩行2026/9/18
各足の次回接地位置予測を用いて過去の深度フレームから必要な地形情報を検索し、複雑地形を歩行するヒューマノイド制御を実現した研究。
- NavArena: 3Dガウススプラッティング再構成からの目標指向ナビゲーションベンチマークの自動構築ナビゲーション2026/9/4
固定された3DGS再構成を、到達可能性や衝突判定、意味的目標を備えたナビゲーションベンチマークへ自動変換するフレームワークを提案し、2,000以上のシーンで2,220万の専門家軌道を生成して評価する。
- WorldToken: ロボット模倣学習のための時間優先シーケンスモデリング模倣学習2026/8/23
ロボットポリシーにおいて、各タイムステップの多視点画像やプロプリオセプションなどの観測を1つのワールドトークンに融合し、時間方向にTransformerでモデル化する新しい手法を提案。RoboCasaタスクで高い成功率を達成し、データ量やモデルサイズの影響を分析した。
- PL-LIT: 点・線特徴と熱画像マッピングを用いたLiDAR-慣性-熱SLAMSLAM2026/6/1
熱画像の課題を解決するため、点・線特徴抽出と光度校正を組み合わせたLiDAR-慣性-熱SLAMシステムを提案し、長距離熱赤外データセットで最先端性能を達成した。
- AirDreamer: ワールドモデルを用いた汎用ドローンナビゲーションナビゲーション2026/6/1
動物のナビゲーション行動に着想を得て、強化学習ポリシーとワールドモデルによる環境理解を組み合わせたドローンのナビゲーションフレームワークを提案。手作りの報酬整形なしで複雑な未見環境を航行し、シミュレーションと実機で有効性を実証した。
- 不確かで時変なダイナミクスを持つ非線形システムのための共分散調整型再帰クープマン学習システム同定2026/6/1
時変なダイナミクス下でのロボットのオンライン学習を安定化するため、共分散の爆発やパラメータ凍結を防ぐ2つの戦略を備えた再帰クープマン学習フレームワークを提案し、実機実験で有効性を示した。
- 資源制約ハードウェア上での羽ばたきロボットのニューロモルフィック制御制御2026/5/1
ESP32マイコン上でスパイキングニューラルネットワークを用いた階層的制御により、羽ばたき飛行ロボットの完全オンボード閉ループ飛行を実現した。
- NORM-Nav: 自然言語による行動制約を用いたゼロショット移動ロボットナビゲーションナビゲーション2026/5/1
LLMを用いて自然言語の行動指示をコストマップに変換し、幾何・意味・方向・速度の制約を統合することで、人間らしい軌道生成を実現するゼロショットナビゲーション手法を提案した。
- オンボード姿勢制御を備えた26gの無尾蝶型羽ばたきロボット羽ばたきロボット2026/2/1
26gの無尾蝶型羽ばたきロボット「AirPulse」を開発し、位相領域の羽ばたき制御とオンボード姿勢制御により、非係留でのピッチ・方向追従を実現した。
- 軌道品質を重視した群衆ナビゲーション性能向上のための新手法群衆ナビゲーション2025/12/1
群衆ナビゲーションの評価指標の優先順位を整理し、軌道の曲率を明示的に最適化する報酬設計を提案して、2D/3D実験で従来手法を上回る性能を示した。
- TopoDiffuser: トポメトリックマップを用いた拡散ベースのマルチモーダル軌道予測モデル軌道予測2025/8/1
トポメトリックマップの構造情報を条件付き拡散モデルのノイズ除去過程に組み込み、道路形状に自然に従う多様な将来軌道を予測する手法を提案し、KITTIで最先端性能を達成した。
- 地上車両における複数LiDARとGNSS支援INSのための共同最適化に基づくターゲットレス外部キャリブレーションキャリブレーション2025/7/1
人工ターゲットや視野重複を必要とせず、GNSS支援INSの既知の設置高さを利用した観測モデルと共同最適化により、複数LiDARとGNSS-INS間の外部キャリブレーションを平面運動下でも高精度に行う手法を提案した。
- DSFormer: 視覚的位置認識のためのデュアルスケールクロス学習Transformer視覚的位置認識2025/7/1
二つのCNN層から得た特徴を双方向にクロス学習するTransformerモジュールとブロッククラスタリング戦略を組み合わせ、環境変化や視点変動に頑健な視覚的位置認識を実現した。
- OpenBench:スマート物流におけるセマンティックナビゲーションの新ベンチマークとベースラインナビゲーション2025/2/1
OpenStreetMapと基盤モデル(LLM/VLM)を組み合わせ、事前地図作成なしで屋外配送ナビゲーションを実現するシステムと、住宅街での実世界配送を評価する新ベンチマークを提案した。
- ETGL-DDPG: 疎な報酬の連続制御のための深層決定論的方策勾配アルゴリズム強化学習2024/10/1
疎な報酬の連続制御タスクにおいて、探索手法εt-greedy、二重経験再生バッファGDRB、最長nステップリターンをDDPGに統合し、標準ベンチマークで性能を向上させた。
- Semi-automated Signal Surveying Using Smartphones and Floorplans2017/11/1