Lin Wang
Nanyang Technological University
収録論文 32本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- V2X-WAM: 協調型ワールドアクションモデルによるエンドツーエンド自動運転自動運転/V2X協調2026/9/29
車車間・路車間協調で得た情報から信頼性を考慮した時空間表現を作り、将来の交通環境の予測と軌道計画を相互にフィードバックして精度と安全性を高める自動運転モデルを提案した。
- SphMind: 360度カメラを用いた学習不要のVLMベース全方位空間推論フレームワークVLA2026/9/27
360度カメラの歪みや不連続性に対応するため、意味理解と幾何推論を分離し、球面調和空間グラフと推論時幾何接地でMLLMを再学習なしに全方位空間推論へ適応させる手法を提案。
- MotionForge:動的物体の長期的操作のためのデータ生成パイプラインと大規模ベンチマーク動的マニピュレーション2026/9/22
動的環境でのロボット操作を評価するため、11種類の運動パターンを含む40タスクと長期タスク17件を備えた大規模シミュレーションベンチマークとデータ生成パイプラインを提案し、ドメインシフト下での汎用ポリシーの限界を明らかにした。
- 人間中心マルチモーダル観測からの能動的ロボット行動推論VLA2026/9/20
明示的な指示なしに、人間と環境のマルチモーダルな手がかりからロボットが取るべき行動を判断する「能動的ロボット行動推論」を定式化し、実世界データセットProActionと参照モデルMMC2Actを提案した。
- GRAVA: 自動運転のための接地推論から行動への表現と学習VLA2026/9/14
自動運転VLAモデルにおいて、推論を物理的な場面証拠に接地させ、実行可能な行動と結びつけるGRAフレームワークを提案し、NAVSIMベンチマークで最先端性能を達成した。
- 具現化エージェントシステムにおけるレジリエンスの重要性:新指標、体系的評価、最適化評価指標2026/8/24
具現化エージェントシステムの信頼性を評価するために、結果指標では捉えられない回復力(レジリエンス)を定義し、新しい評価フレームワークと指標群を提案した。400の家庭タスクと10のシステムで評価し、プロセスレベルの差異を明らかにした。
- エネルギー構造化潜在世界モデルとニューラル時間場による物理整合的なオープンワールド動作計画動作計画2026/8/1
潜在世界モデルの潜在状態にエネルギーと運動量を明示的に組み込み、物理整合的な予測を実現するELWMを提案し、それをEikonal方程式に基づく時間場に統合してナビゲーションポリシーを構築した。
- 物理誘導による生体力学的歩容適応:極端な傾斜地形での人型ロボット歩行歩行2026/7/1
急斜面での人型ロボットの頑健な歩行を実現するため、傾斜適応ZMP正則化と生体力学的歩容適応器を組み合わせた二段階フレームワークを提案した。シミュレーションから実機への転移実験で、姿勢劣化を抑え、盲目的な連続移動を可能にした。
- VistaVLA: 幾何・意味認識型3Dガウス基底VLAによるロボット操作VLA/操作2026/7/1
3Dガウスプリミティブを用いて幾何と意味を統合した3D認知表現を構築し、VLAポリシー学習のためのコンパクトな文脈トークンとして接地する新しい2段階フレームワークを提案。
- PhysVLA: 物理に基づく身体化ロボット操作のためのVLAマニピュレーション2026/6/11
既存のVLAモデルは物理法則を無視するため、推論時に物理的整合性を補正するプラグアンドプレイのフレームワークPhysVLAを提案し、成功率と安定性を向上させた。
- VL2Spike: スパイク駆動蒸留によるVLMから低消費電力ロボット視覚認識への橋渡しスパイクニューラルネットワーク2026/6/1
スパイクニューラルネットワーク(SNN)の性能向上のため、視覚言語モデル(VLM)の知識をスパイク変換器モデルに蒸留するフレームワークVL2Spikeを提案した。
- LiMoDE: 動的エキスパートの混合の視点から生涯ロボット操作を再考する生涯学習/操作2026/6/1
ロボットが連続的に新しいタスクに適応するための生涯学習手法を提案。動的MoE構造で事前学習し、適応段階では凍結したエキスパートと新しいエキスパートを組み合わせて知識転移を実現する。
- GeoTLM: 動的物体の接触運動方向推論のための幾何認識触覚言語モデル触覚2026/6/1
触覚言語モデルが動的物体の回転や滑り方向の推論に弱い問題を解決するため、接触せん断場の幾何構造を保持する軽量な微分可能幾何表現(DGR)を導入したGeoTLMを提案した。
- 人間のように映画を観る:身体化されたコンパニオンのための自己中心視点の感情理解感情理解2026/4/17
映画を自己中心的なスクリーン視点で観るロボットの感情理解を扱い、新しいデータセットとマルチモーダル推論フレームワークを提案した論文。
- PanoSAM2: 360度ビデオ物体分割のためのSAM2の軽量な歪み・メモリ適応ビデオ物体分割2026/4/9
360度ビデオ物体分割のためのSAM2の軽量な歪み・メモリ適応手法を提案し、投影歪みや左右の意味的不整合、メモリ内の物体情報の疎さを解決する。
- 解析的力学正則化による物理情報を活用した方策最適化強化学習2026/3/1
ロボット制御の強化学習に、シミュレータから得られる微分可能なラグランジュ残差を正則化項として導入し、物理的に一貫した方策学習を効率化する手法PIPERを提案した。
- OneOcc: 単一パノラマカメラによる脚式ロボットの意味的占有予測意味的占有予測2025/11/1
脚式ロボット向けに、単一のパノラマカメラ映像から360度の3D意味的占有を予測するフレームワークOneOccを提案。歩行時の揺れ補償や二重投影融合などの工夫で高精度を実現し、新たなベンチマークも公開。
- オープンワールド機械学習における情報理論:基礎・枠組み・今後の方向性オープンワールド学習2025/10/17
オープンワールド機械学習において、エントロピーや相互情報量などの情報理論的概念が不確実性の定量化や知識獲得の記述にどう役立つかを体系的にレビューし、今後の研究方向を整理した論文。
- イベントカメラ誘導による動的人体とシーンの3Dガウシアンスプラッティング再構成3D再構成/イベントカメラ2025/9/1
単眼イベントカメラ映像から、動く人体と静的シーンを3Dガウシアンスプラッティングで同時再構成する手法を提案。イベント誘導損失で高速運動時のブレを抑え、人体マスク不要で高精度を実現した。
- ニューラルブレイン:身体性エージェントのための神経科学に着想を得たフレームワーク身体性AI2025/5/1
身体性エージェントの中核となる知能システム「ニューラルブレイン」の統一フレームワークを提案し、マルチモーダル能動センシング、知覚・認知・行動の統合、神経可塑性に基づく記憶、ニューロモーフィック最適化を組み合わせた生物学的着想アーキテクチャを示した。
- HumanoidPano:ヒューマノイドロボットのための球面パノラマ-LiDARハイブリッドクロスモーダル知覚クロスモーダル知覚2025/3/1
パノラマ視覚とLiDARを球面ビジョントランスフォーマーで融合し、ヒューマノイドの自己遮蔽と狭視野を克服する360度BEV知覚フレームワークを提案。
- 単一参照画像からの未見物体6自由度姿勢推定とロボット統合姿勢推定2025/3/1
ロボット操作中に撮影した1枚の参照RGB-D画像だけから、未見物体の6自由度絶対姿勢を推定する手法SinRef-6Dを提案し、実機ロボットシステムに統合した。
- AC-LIO: 選択的フレーム内平滑化によるLiDAR慣性オドメトリの歪み漸近補償LiDAR-Inertial Odometry2024/12/1
LiDARフレーム内の残留運動歪みを、収束基準に基づき更新項を漸近的に逆伝播して補償するLIOフレームワークを提案し、長期・大規模環境での位置推定精度を向上させた。
- DiffRoad: 自動運転車テストのための現実的で多様な道路シナリオ生成自動運転テスト/シナリオ生成2024/11/1
拡散モデルを用いて、ホワイトノイズから現実的な3D道路シナリオを生成し、自動運転車のテスト用にOpenDRIVE形式で自動変換する手法を提案。
- Robo-GS: ロボットアームのための物理整合的な時空間ハイブリッド表現モデルsim2real2024/8/1
メッシュ・3Dガウシアン・物理属性を統合したハイブリッド表現により、ロボットアームのReal2Simを高精度かつ物理的に整合する形で実現する手法を提案。
- Chasing Day and Night: Towards Robust and Efficient All-Day Object Detection Guided by an Event Camera2023/9/1
- Spectrum Sharing between High Altitude Platform Network and Terrestrial Network: Modeling and Performance Analysis2023/6/1
- Self-supervised Learning of Event-guided Video Frame Interpolation for Rolling Shutter Frames2023/6/1
- UAV Assisted Data Collection for Internet of Things: A Survey2022/11/1
- SiamEvent: Event-based Object Tracking via Edge-aware Similarity Learning with Siamese Networks2021/9/1
- Deceiving Image-to-Image Translation Networks for Autonomous Driving with Adversarial Perturbations2020/1/1
- Distributed sampled-data control of nonholonomic multi-robot systems with proximity networks2016/9/1