Gang Wang
収録論文 28本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボット構成空間における異種制約のための実行可能性距離場マニピュレーション2026/9/21
関節空間の距離場として異種制約を統一的に扱い、衝突・関節限界・器用さ・トルクなどを同一尺度で合成できる枠組みを提案し、ニューラル近似で評価した。
- FlowPilot: 俊敏なUAVナビゲーションのためのリアルタイム世界行動モデリングUAVナビゲーション2026/8/1
深度画像から将来のシーンと軌道を同時に生成するコンパクトな世界行動モデルを提案し、シミュレーションと実機で高速・高機動な飛行を実現した。
- AeroAct: 言語条件付きクワッドローター飛行のためのアクション中心のワールドアクションモデル飛行制御2026/7/1
言語指示によるクワッドローター飛行を実現するため、事前学習済みビデオ拡散トランスフォーマーを応用し、視覚・状態・言語から局所的な軌道アクションを予測するアクション中心のワールドアクションモデルを提案した。実機飛行で初めて実証された。
- 文脈的対比メタ強化学習による自律空中マニピュレーション強化学習/空中マニピュレーション2026/6/7
クワッドローターが多様なペイロードを自律的に把持・輸送・配送するための、文脈エンコーダと対比学習を組み合わせたメタ強化学習手法を提案。シミュレーションのみで訓練し、実機へ直接展開可能。
- マッピング認識型ワールドモデルによるアジャイルなクアッドローター飛行飛行制御2026/6/1
クアッドローターの視覚ベース飛行において、生画像再構成ではなく占有・可視性グリッドマップと自己運動を再構成する幾何学認識型ワールドモデルを提案し、シミュレーションと実機で有効性を示した。
- 潜在誘導フローマッチングによる視覚言語行動ポリシーの改善VLA2026/6/1
視覚言語行動ポリシーに、成功可能性の軌跡を学習する自己誘導型フローマッチングを導入し、外部批評家なしで最良の行動選択を可能にする手法を提案した。
- DexJoCo: MuJoCo上でのタスク指向巧みな操作のためのベンチマークとツールキット巧みな操作2026/5/1
巧みなロボットハンドの操作能力を評価するための、11の機能ベースのタスクとデータ収集システムを含むベンチマークとツールキットを提案し、現代のモデルの性能を分析した。
- 世界モデルの混合:モジュール型潜在ダイナミクスによるマルチタスク強化学習のスケーリングマルチタスクRL/世界モデル2026/2/1
タスクごとにモジュール化したVAEと専門家混合型Transformerで世界モデルを構成し、Atari 100kとMeta-Worldで高効率・高性能なマルチタスク強化学習を実現した。
- MMDrive: マルチ表現融合による視覚を超えた対話的シーン理解VLA2025/12/1
占有マップ・LiDAR点群・テキスト記述を統合し、質問に応じて適応的に融合する自動運転向けマルチモーダル視覚言語モデルを提案。DriveLMとNuScenes-QAで高精度を達成。
- アクションチャンキングにおける地平線の混合VLA2025/11/1
VLAモデルで問題となる行動チャンク長(地平線)のトレードオフを解消するため、異なる地平線のセグメントを並列処理して統合するMixture of Horizons戦略を提案し、性能と汎化性を向上させた。
- VLMベースロボットマニピュレーションのための中間表現の再考マニピュレーション2025/11/1
VLMが理解しやすく汎用性の高い中間表現SEAMを提案し、語彙と文法に分解することで多様な未見タスクに対応。さらに検索拡張少数ショット学習による開放語彙セグメンテーションを設計し、実世界実験でSOTA性能を示した。
- DiffAero: クアッドロータの効率的な方策学習のためのGPU加速微分可能シミュレーションフレームワークsim2real2025/9/1
GPU上で物理とレンダリングを完全並列化した軽量・微分可能なクアッドロータ用シミュレータを提案し、微分可能・ハイブリッド学習アルゴリズムの研究基盤を提供するとともに、民生ハードで数時間以内に堅牢な飛行方策を学習できることを実機実験で示した。
- CORB-Planner: 高速飛行におけるRLプランニングのための観測としてのコリドー飛行制御/強化学習2025/9/1
安全飛行コリドーを低次元観測として用い、Bスプライン軌道生成と強化学習を組み合わせることで、様々なドローン機体で高速自律飛行を実現するリアルタイム軌道計画フレームワークを提案した。
- SPGrasp: 動的シーンにおける時空間プロンプト駆動型把持合成マニピュレーション2025/8/1
動画ストリーム上でユーザープロンプトと時空間文脈を統合し、低遅延かつ時間的一貫性を保った把持姿勢をリアルタイム生成するフレームワークを提案。
- カリキュラム強化学習による回転卓球ボールのシミュレーション捕球sim2real2025/3/1
カリキュラム強化学習とReal2Sim転移を用いて、強い回転がかかった卓球ボールをロボットが捕球できるようにする手法を提案した論文。
- 状態レベルの軌道スティッチングによるロバストなオフライン模倣学習模倣学習2025/3/1
混合品質のオフラインデータから、状態ベースの探索で軌道断片を繋ぎ合わせ、多様で有益な訓練軌道を生成することで、模倣学習の汎化性能と成功率を向上させる手法を提案。
- 安全強化学習による障害物環境での時間最適飛行飛行制御2024/6/1
安全強化学習を用いて、障害物の多い環境でドローンをウェイポイントに沿って衝突回避しつつ最短時間で飛行させる手法を提案した論文。
- CCTNet: 可動物体の遮蔽に対応するLiDAR位置認識のための円形畳み込みTransformerネットワーク位置認識2024/5/1
LiDARの位置認識において、円形畳み込みとTransformerを組み合わせて受容野を広げ、可動物体による遮蔽に頑健な軽量ネットワークを提案した。
- Learning Hybrid Policies for MPC with Application to Drone Flight in Unknown Dynamic Environments2024/1/1
- Learning Agility and Adaptive Legged Locomotion via Curricular Hindsight Reinforcement Learning2023/10/1
- Soft Decomposed Policy-Critic: Bridging the Gap for Effective Continuous Control with Discrete RL2023/8/20
- Efficient and Robust Time-Optimal Trajectory Planning and Control for Agile Quadrotor Flight2023/5/1
- Time-attenuating Twin Delayed DDPG Reinforcement Learning for Trajectory Tracking Control of Quadrotors2023/2/1
- Acoustic SLAM based on the Direction-of-Arrival and the Direct-to-Reverberant Energy Ratio2022/9/1
- Deep learning-based Crop Row Detection for Infield Navigation of Agri-Robots2022/9/1
- Balancing Value Underestimation and Overestimation with Realistic Actor-Critic2021/10/19
- DA4AD: End-to-End Deep Attention-based Visual Localization for Autonomous Driving2020/3/1
- 2D LiDAR Map Prediction via Estimating Motion Flow with GRU2019/2/1