Guangming Wang
収録論文 27本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SwingRL: ワールドモデル予測を用いた適応的観測強化学習によるケーブル吊り下げホイスティング制御マニピュレーション2026/9/27
遅延・欠損した視覚観測と不確実なダイナミクスに対処するため、経過時間を考慮したワールドモデルと古典的制振制御を組み合わせた残差強化学習フレームワークを提案し、建設現場での吊り荷の精密挿入タスクにおける有効性を示した。
- Track2Art: 2D点トラッカーからの運動中心型関節物体モデル復元関節物体認識2026/9/23
RGB-D動画から物体の点追跡を3D軌跡に変換し、運動の一貫性を手がかりに関節物体の剛体部品と関節関係を推定する手法を提案。
- 脳に着想を得たゼロショットロボットタスク推論と実行のための階層的フレームワークタスク計画2026/9/5
オープンな言語指示に従うロボットのための、脳の役割分担に着想を得たゼロショット階層的フレームワークを提案し、視覚認識、言語接地、コストベースの計画、実行検証を統合して、長期的なタスク分解と物理的検証を実現した。
- BendTwin: 曲げを考慮した微分可能なばね-質量モデルによるロバストな密から疎への物理再構成物理シミュレーション/変形物体再構成2026/8/6
ビデオ観測から変形物体の物理的特性を再構成するため、曲げ剛性と減衰を導入した微分可能なばね-質量モデルを提案し、従来の軸方向ばねのみの手法より安定した再構成と将来予測を実現した。
- 一度触れるだけ:単一触覚接触からの6自由度物体姿勢推定触覚/姿勢推定2026/6/1
視覚が使えない状況でも、2点の同時触覚接触から物体の6自由度姿勢を推定するシステムYOTOを提案。接触を点群として物体表面に位置合わせし、閉形式解法で姿勢を復元する。
- RoboFlow4D: リアルタイムフロー誘導ロボット操作のための軽量フローワールドモデルマニピュレーション2026/5/1
視覚観察とテキスト指示から3Dフローを直接予測し、動作生成を誘導する軽量なエンドツーエンドのフローワールドモデルを提案し、シミュレーションと実世界で操作成功率と計算効率を向上させた。
- PhySPRING: GNNによる物理情報ツインの構造保存型縮約シミュレーション/モデル縮約2026/5/1
物理ベースのデジタルツインの複雑さを、GNNを用いてタスクに必要な物理的複雑さまで自動的に縮約する手法を提案し、計算速度を向上させつつ物理的・視覚的忠実度を維持する。
- 人間のビデオからのロボット学習:サーベイ模倣学習2026/4/1
ロボットが人間の行動ビデオからスキルを獲得する手法を包括的にレビューし、タスク・観察・行動指向の転移経路とデータ基盤を整理したサーベイ論文。
- OGScene3D: シーン理解のための漸進的オープンボキャブラリ3Dガウシアンシーングラフマッピングシーン理解2026/3/1
ロボットが環境を漸進的に探索しながら、オープンボキャブラリの3Dセマンティックマップとシーングラフを構築するシステムを提案した。
- 視覚・音・言語・行動パラダイムに向けて:音中心操作のためのHEARフレームワーク操作2026/3/1
音をリアルタイムに活用した操作を実現するため、視覚・音声・言語・行動を統合した連続制御パラダイムVSLAを提案し、その実装としてHEARフレームワークを導入した。
- ActionReasoning: LLMによる3D空間でのロボット動作推論とブロック積み上げマニピュレーション2026/2/1
LLMの物理的知識をマルチエージェント構成で活用し、ブロック積み上げタスクにおいて物理的に整合した動作計画を生成するフレームワークを提案した。
- 進化し続けるスキル知識を持つ視覚言語行動モデルVLA2025/11/1
VLAモデルにパラメータを増やさずに継続的模倣学習を導入し、知識誘導型エキスパートルーティングでタスク特化を実現するフレームワークStellar VLAを提案。
- ロボティクスにおける3Dガウシアンスプラッティング:サーベイ3D表現2024/10/1
ロボティクス分野での3Dガウシアンスプラッティング(3DGS)の応用と技術進歩を包括的に調査し、課題と将来展望をまとめたサーベイ論文。
- DSLO: 不整合な時空間伝播に基づく深層シーケンスLiDARオドメトリLiDARオドメトリ2024/9/1
LiDAR点群の時系列から自己位置推定を行う深層学習手法を提案し、空間特徴の再利用やゲート付き階層的姿勢精緻化、時間的特徴伝播により、KITTIとArgoverseで精度と速度を両立した。
- RL-GSBridge: 3Dガウシアンスプラッティングによるロボットマニピュレーション学習のためのReal2Sim2Real手法sim2real2024/9/1
3Dガウシアンスプラッティングを強化学習シミュレーションに組み込み、メッシュベースの編集と物理シミュレータ同期により、視覚ベースの深層強化学習でゼロショットのsim-to-real転移を実現した。
- ロボティクスにおけるNeRF:サーベイNeRF2024/5/1
NeRFのロボティクスへの応用と、ロボティクス展開に向けたNeRF自体の改良に関する研究を体系的にまとめたサーベイ論文。
- LHMap-loc: LiDAR点群ヒートマップを用いたクロスモーダル単眼自己位置推定自己位置推定2024/3/1
LiDAR点群マップをヒートマップ化して圧縮し、単眼カメラ映像からオプティカルフローと空間アテンションでリアルタイムに自己位置を回帰する手法を提案。
- 自動運転向けハイブリッド伝播によるオフボード占有予測の精緻化自動運転/3Dシーン理解2024/3/1
車載の視覚ベース3D意味シーン補完(SSC)予測を、オフボードで局所・大域の二段階伝播により高精度化するフレームワークOccFinerを提案し、SemanticKITTIで最先端性能を達成した。
- SemGauss-SLAM:密なセマンティックガウシアンスプラッティングSLAMセマンティックSLAM2024/3/1
3Dガウシアン表現にセマンティック特徴を埋め込み、セマンティック情報を活用したバンドル調整でカメラ姿勢と3D表現を同時最適化する密なセマンティックSLAMを提案。
- SNI-SLAM: Semantic Neural Implicit SLAM2023/11/1
- End-to-end 2D-3D Registration between Image and LiDAR Point Cloud for Vehicle Localization2023/6/1
- Pseudo-LiDAR for Visual Odometry2022/9/1
- Unsupervised Learning of 3D Scene Flow from Monocular Camera2022/6/1
- Interactive Multi-scale Fusion of 2D and 3D Features for Multi-object Tracking2022/3/1
- DetFlowTrack: 3D Multi-object Tracking based on Simultaneous Optimization of Object Detection and Scene Flow Estimation2022/3/1
- Unsupervised Learning of Monocular Depth and Ego-Motion Using Multiple Masks2021/4/1
- Learning of Long-Horizon Sparse-Reward Robotic Manipulator Tasks with Base Controllers2020/11/1