Jia Pan
The University of Hong Kong
収録論文 116本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CAMP: 制約空間における協調的なアーム・ハンド動作計画マニピュレーション2026/9/24
アームとハンドの協調動作を必要とする制約環境でのマニピュレーションに向け、ハンド探索とアーム緩和を組み合わせた高成功率な動作計画手法CAMPを提案した。
- CALM: 電流整合型リンクマニピュレーションによる単腕での大型物体持ち上げマニピュレーション2026/9/24
モータ電流を関節負荷フィードバックとして活用し、前腕や肘を含む腕全体で大型物体を持ち上げる長期的接触操作をシミュレーションで学習し、実機へ転移するフレームワークを提案した。
- 双腕モバイルマニピュレーションのための自動ラベリングマニピュレーション2026/9/21
同期した運動信号を位相に分割し、視覚言語推論で意味づけを行うことで、双腕モバイルマニピュレーションのサブタスクに自動でラベルを付与するパイプラインを提案し、実タスクで有効性を検証した。
- 2D GauSS-MI: 視覚と幾何の品質を両立する効率的な能動的シーン再構成能動的再構成2026/9/18
2Dガウシアンスプラッティングに基づき、相互情報量を用いた視点選択で視覚・幾何品質と計算効率を両立する能動的再構成フレームワークを提案。
- 手先内での物体の6D姿勢到達を学習するマニピュレーション2026/9/12
把持した物体を指の協調動作で手のひら基準の目標6D姿勢へ移動させる強化学習フレームワークPOISEを提案し、シミュレーションと実機で有効性を示した。
- SRL-MPC: 形状を考慮した強化学習モデル予測制御ナビゲーション2026/8/21
異なる形状のロボット群や群衆の中での安全で効率的なナビゲーションを実現するため、強化学習でMPCのパラメータを適応的に調整する手法を提案した。
- ロボットのための視覚ベース触覚知能:センシング、学習、身体化された操作触覚2026/8/16
視覚ベース触覚センサ(VBTS)のハードウェア、学習手法、シミュレーション、データセットを統合したレビュー論文。接触による変形を画像化するVBTSのパイプライン全体を俯瞰し、今後の課題と方向性を示す。
- EvoHIL: 自己進化型報酬とフローマッチングによるポリシー最適化を用いた堅牢な人間参加型強化学習強化学習2026/8/1
人間参加型強化学習において、報酬モデル・行動生成・視覚ドメインの3つの限界を同時に適応させる統一フレームワークEvoHILを提案し、照明変化下の6つの操作タスクで性能を向上させた。
- SSC: 双腕操作ラベリングのための検証可能な構造化表現マニピュレーション2026/8/1
長期的な操作デモを意味的なサブタスクに分割するための新しい構造化表現「Structured Subtask Chain (SSC)」を提案。自然言語の柔軟性とテンプレートの厳格性を橋渡しし、状態遷移ルールによる自動検証と未指定フィールドの補完を可能にする。
- ReTouch: オンライン更新型触覚予測による接触豊富な器用操作の実現触覚/操作2026/8/1
触覚予測を実行時のフィードバックでオンライン更新するVLAモデルReTouchを提案し、接触を伴う器用操作の成功率を大幅に向上させた。
- 分解と再構成:デモから学習したプリミティブと視覚運動ポリシーによる計画操作計画2026/7/1
人間のデモを接触関係に基づいて原子スキルに分解し、視覚運動ポリシーとTAMPを統合して長期的な操作タスクを計画するフレームワークDR-LfDを提案した。
- iFLYTEK-Embodied-Omni技術報告VLA2026/6/24
視覚・言語・行動を単一のOmniフレームワークで統合したマルチモーダル基盤モデルを提案し、脳と小脳の協調に例えられる設計で、指示理解から行動生成までを一貫して行う。
- GEAR-VLA: 汎用ロボット操作のための幾何認識行動表現の学習VLA/操作2026/6/7
VLAモデルの実世界での汎化を改善するため、幾何認識型の行動表現を学習するGEAR-VLAを提案。粗密行動学習、3D特徴の整合、エンボディメント正準化により、未見物体や異なるロボットへの汎化を実現した。
- キーポーズ探索:効率的な自動軌道ラベリングとクロスエンボディメントポリシー転送模倣学習/転移学習2026/6/1
把持関連タスクのデモからキーポーズを自動抽出するパイプラインを提案し、キーポーズ条件付き拡散ポリシーを訓練して、到達可能性マップによるフィルタリングで異なるロボットへのゼロショット転送を試みた。
- BIM-Loc: BIM統合型の不一致認識LiDAR屋内位置推定位置推定2026/6/1
設計段階のBIM(建物情報モデル)を直接利用し、特徴が乏しい屋内環境でも高精度・高ロバストな位置推定を実現する手法を提案。実環境とBIMの不一致もオンラインで検出する。
- IR-SIM: ナビゲーション、学習、ベンチマークのための軽量スキルネイティブシミュレータシミュレーション2026/6/1
YAML設定だけでシナリオを定義できる軽量なナビゲーション用シミュレータIR-SIMを提案し、テキストからのシナリオ生成や学習データ生成、高忠実度シミュレータや実機への橋渡しを実現した。
- ロボット操作のためのワールドモデル:サーベイサーベイ2026/6/1
ロボット操作におけるワールドモデルの研究を、予測する未来表現、行動との接続、使用タイミングの3つの観点から体系的に整理し、5つの表現ファミリーと機能的分類を提案したサーベイ論文。
- SSI-Policy: 視覚言語ロボット操作のための構造化シーンインターフェース学習VLA/操作2026/6/1
RGB画像のみから深度特徴・言語接地オブジェクト配置・指示条件付き2D動作軌跡を統合する構造化シーンインターフェース(SSI)を導入し、少数デモで高精度な操作を実現するフレームワークを提案した。
- ピクセルを超えて:少数のデモから実世界ロボットの不変報酬を学習する報酬学習2026/5/1
少数のデモンストレーションから、視覚的な変化に不変な記号的報酬関数を学習するフレームワークを提案し、実世界の位置・視点・物体の変化に対してゼロショットで汎化することを示した。
- 行動残差を超えて:ボトルネック潜在強化学習による実世界ロボットポリシーの操縦強化学習/模倣学習/操作2026/5/1
事前学習済みの模倣ポリシーを、行動空間ではなくボトルネック潜在空間で強化学習により微調整する手法ZPRLを提案し、シミュレーションと実世界の操作タスクで性能を向上させた。
- インピーダンス駆動の異方性誘導場による共有自律支援共有自律/遠隔操作2026/5/1
ロボットの意図を人間に物理的・直感的に伝えるため、インピーダンス制御に着想を得た誘導場を共有自律制御に組み込み、タスク性能と協調性を向上させた。
- 意味的に構造化されたMixture-of-Expertsによる構成ロボット操作マニピュレーション2026/5/1
拡散ベースのポリシーにMoEを組み合わせ、VLMのオフライン注釈でスキル予測器を訓練し、意味的タスク構造に基づいて専門家をルーティングするフレームワークを提案。パラメータ効率と汎化性能を向上させた。
- RichMap: 高精度・高効率・柔軟性を両立するリッチなロボット操作タスクのための到達可能マップマニピュレーション2026/4/1
本論文は、ロボット操作タスクのための高精度な到達可能マップ表現RichMapを提案し、精度・効率・柔軟性のバランスを実現する。理論的な被覆保証と非同期パイプラインにより、高い予測精度と高速なクエリを達成し、クロスエンボディメントでのポリシー転送改善を示す。
- ビデオから制御へ:時間的視覚データから操作インターフェースを学習する手法のサーベイ操作学習/サーベイ2026/4/1
ロボットの行動ラベルを使わない時間的ビデオデータから、ロボット操作のための制御インターフェースを学習する手法を分類・分析したサーベイ論文。
- 失敗を考慮した両腕テレオペレーションのための保守的価値誘導支援テレオペレーション2026/2/1
成功・失敗のオフラインデータから保守的価値学習で成功率を推定し、両腕テレオペレーション中に触覚支援として失敗回避の動きを誘導する枠組みを提案した。
- UniBiDex:ロボット両手巧み操作のための統合遠隔操作フレームワーク遠隔操作2026/1/1
VRとリーダーフォロワの両入力に対応し、ヌル空間制御で両腕の衝突回避・特異点回避を実現する統合遠隔操作フレームワークを提案し、長期キッチン片付けタスクで有効性を示した。
- iFlyBot-VLM 技術報告VLA2025/11/1
視覚と言語を統合し、ロボットの知覚と動作制御をつなぐ汎用VLMを提案。10のベンチマークで最高性能を達成し、データと重みを公開予定。
- 帰納バイアスを用いた非線形制御のリアプノフ安定性学習非線形制御2025/11/1
リアプノフ条件を帰納バイアスとして組み込み、制御リアプノフ関数と制御器をエンドツーエンドで学習する手法を提案し、従来法より高い収束率と大きな吸引領域を達成した。
- 視覚なしロボットによる協調組立の政策学習マニピュレーション2025/11/1
視覚を持たないロボットと人間が協力してボードをフレームに挿入するタスクにおいて、アドミタンス制御を活用した強化学習により、成功率と作業時間を改善する手法を提案した。
- iFlyBot-VLA 技術報告VLA2025/11/1
人間とロボットの大規模操作動画で学習した潜在行動モデルと、二段階の行動表現でVLMと行動エキスパートを同時に訓練する新しいVLAフレームワークを提案し、LIBEROベンチマークと実機で有効性を示した。
- 省エネ・自己衝突回避を実現する1自由度過拘束ロボット肢の設計機構設計2025/9/1
閉ループ機構を持つ1自由度の過拘束ロボット肢を計算設計し、所望の空間軌道を省エネかつ自己衝突なく全周期で動かせるようにした。
- ロボットによる布の展開把持選択のためのデータセットとベンチマーク:ICRA 2024布コンペティションマニピュレーション2025/8/1
空中でのロボット布展開における把持姿勢選択を評価するベンチマークとICRA 2024コンペティションを開催し、679回の実世界デモンストレーションを含むデータセットを公開した。
- CollaBot: 視覚言語ガイドによる同時協調マニピュレーション協調マニピュレーション2025/8/1
視覚言語モデルを活用し、複数ロボットが大型物体を協調して把持・運搬するための汎用フレームワークを提案。実環境を含む実験で従来手法を上回る72%の成功率を達成した。
- 物理シミュレータと世界モデルによる身体性知能の学習:サーベイ身体性AI/サーベイ2025/7/1
物理シミュレータと世界モデルを組み合わせて身体性AIを学習する最近の研究を体系的にレビューし、両者の補完的な役割とsim-to-realの課題を整理したサーベイ。
- SViP: 物体中心の動作プリミティブによる両腕視覚運動ポリシーのシーケンス化マニピュレーション2025/6/1
人間のデモを両腕・片腕操作に分割し、視覚運動ポリシーとタスク・動作計画を統合することで、少ないデモでも長期的な両腕操作タスクを汎化可能にするフレームワークを提案。
- 群衆内の内部状態を能動的情報収集で推定する手法ヒューマンロボットインタラクション2025/5/1
ロボットが能動的に働きかけて人間の性格特性を推定する手法を提案し、シミュレーションと実ユーザ実験で予測誤差と不確実性を大幅に削減した。
- GauSS-MI: ガウススプラッティングとシャノン相互情報量による能動的3次元再構成能動的3次元再構成2025/4/1
3Dガウススプラッティングの各ガウスに確率モデルを導入し、シャノン相互情報量で視覚的不確かさを評価して次に撮影すべき視点を選ぶ能動的3次元再構成手法を提案した。
- ロボットマニピュレーションにおける生成AI:サーベイマニピュレーション2025/3/1
GAN・VAE・拡散モデルなどの生成モデルをロボットマニピュレーションに応用する研究を、データ生成から方策学習まで階層的に整理したサーベイ。
- LP-ICP: 極限非構造環境でのロバストな位置推定のための一般化局所化可能性対応点群レジストレーションSLAM2025/1/1
点と線、点と面の距離を組み合わせたICPフレームワークを提案し、局所化可能性検出と最適化により非構造環境でのLiDAR SLAMの精度とロバスト性を向上させた。
- 強化学習による混合交通の効率最適化:トポロジー非依存アプローチとベンチマーク交通制御/強化学習2025/1/1
自動運転車が収集したデータで人間運転車に影響を与え、多様な道路トポロジーで交通効率を最適化する強化学習手法を提案し、20カ国444シナリオの実世界混合交通ベンチマークを公開した。
- 動画から粒子を理解する:視覚-触覚学習による粒状材料の特性推定触覚2024/12/1
粒状材料との相互作用動画から、視覚-触覚学習フレームワークを用いて粒子サイズと密度の相対値を推定する手法を提案。訓練後は視覚情報のみで特性を分析できる。
- EROAM: イベントカメラによる実時間回転オドメトリとマッピングオドメトリ/イベントカメラ2024/11/1
イベントカメラのデータを単位球面に投影する球面表現とES-ICPという幾何最適化を導入し、カメラ回転の推定とパノラマ再構成を実時間で高精度に行うシステムを提案した。
- 粒状材料中の埋没物体に対する触覚ベースの近接センシングシステム触覚2024/11/1
粒状材料中の埋没物体を、プローブと粒子の相互作用による触覚フィードバックとガウス過程回帰で近接検知するシステムを提案し、様々な材料で0.5〜7cm手前から物体を認識できることを示した。
- 会場マップを活用した看板認識型オープンワールド探索探索2024/10/1
拡散モデルによる看板テキスト認識と会場マップを組み合わせ、未知のショッピングモール内で目的の店舗を効率的に探索するロボットシステムを提案した。
- Semantic2D: 2D LiDAR単独で意味的シーン理解を実現LiDARセグメンテーション2024/9/1
単一の2D LiDARのみを用いた意味的シーン理解のワークフローを提案し、初の公開2D LiDAR意味セグメンテーションデータセットと細粒度セグメンテーションアルゴリズムを開発した。
- 言語拡張型記号プランナによるオープンワールドタスク計画タスク計画2024/7/1
大規模言語モデルを組み合わせて、不完全な知識しかないオープンワールド環境でも記号プランナが動作できるようにし、実行エラーを診断しながら知識を段階的に構築する手法を提案した。
- BiKC: 双腕ロボット操作のためのキーポーズ条件付き一貫性ポリシーマニピュレーション2024/6/1
双腕操作を高レベルなキーポーズ予測と低レベルな軌道生成に分けた階層的模倣学習フレームワークを提案し、高速推論と成功率・効率の向上を実現した。
- 一振りでゴールへ:環境認識型ダイナミクスによる目標条件付き布投げ操作変形物体マニピュレーション2024/6/1
布の形状や物性、環境との相互作用を考慮したグラフベースのダイナミクスモデルを学習し、1回の高速投げ操作で目標状態に到達させる制御手法を提案した。
- POMDPに基づく能動的な力探索によるロボット挿入マニピュレーション2024/4/1
接触状態の情報を活用し、POMDPとして定式化した探索戦略でロボット挿入を効率化する手法を提案。
- 混合交通を操る:横方向制御と階層型強化学習による交通流の振り付け群制御2024/3/1
ロボット車と人間運転車が混在する交差点で、ロボット車の縦横制御を階層型強化学習で行い、平均待ち時間を最大54%削減する手法を提案した。
- NeuPAN: 点群ロボットのためのエンドツーエンドモデルベース直接ナビゲーションナビゲーション2024/3/1
生の点群データから直接衝突回避動作を生成する、地図不要で環境に依存しないリアルタイム動作計画手法を提案し、実機実験で有効性を示した。
- 変形物体を扱う双腕ロボットによる自動袋詰めパイプラインマニピュレーション2024/3/1
袋の変形特性を事前知識なしにリアルタイム視覚フィードバックで推定し、GMMによる状態推定とCBiRRT・MPCを組み合わせて双腕ロボットで物体を袋詰めするシステムを構築した。
- CafkNet: ケーブル駆動パラレルロボットの順運動学モデリングを実現するGNN順運動学/GNN2024/2/1
ケーブル駆動パラレルロボットの順運動学問題を、グラフニューラルネットワークでトポロジーを学習して高速・高精度に解く手法CafkNetを提案し、異なる構成へのゼロショット汎化とsim2realギャップの橋渡しを実証した。
- Bimanual Deformable Bag Manipulation Using a Structure-of-Interest Based Neural Dynamics Model2024/1/1
- Large-scale Mixed Traffic Control Using Dynamic Vehicle Routing and Privacy-Preserving Crowdsourcing2023/11/1
- Evaluating Explanation Methods for Vision-and-Language Navigation2023/10/1
- Overconstrained Locomotion2023/10/1
- Simultaneous Synchronization and Calibration for Wide-baseline Stereo Event Cameras2023/9/1
- GRAINS: Proximity Sensing of Objects in Granular Materials2023/7/1
- Long-term Microscopic Traffic Simulation with History-Masked Multi-agent Imitation Learning2023/6/1
- Fast Event-based Double Integral for Real-time Robotics2023/5/1
- Target-free Extrinsic Calibration of Event-LiDAR Dyad using Edge Correspondences2023/5/1
- CCIL: Context-conditioned imitation learning for urban driving2023/5/1
- TacGNN:Learning Tactile-based In-hand Manipulation with a Blind Robot2023/4/1
- S$^2$MAT: Simultaneous and Self-Reinforced Mapping and Tracking in Dynamic Urban Scenariosorcing Framework for Simultaneous Mapping and Tracking in Unbounded Urban Environments2023/4/1
- Polymer-Based Self-Calibrated Optical Fiber Tactile Sensor2023/3/1
- Tight Collision Probability for UAV Motion Planning in Uncertain Environment2023/3/1
- Mixed Traffic Control and Coordination from Pixels2023/2/1
- Learning to Control and Coordinate Mixed Traffic Through Robot Vehicles at Complex and Unsignalized Intersections2023/1/1
- Siamese Object Tracking for Vision-Based UAM Approaching with Pairwise Scale-Channel Attention2022/11/1
- RDA: An Accelerated Collision Free Motion Planner for Autonomous Navigation in Cluttered Environments2022/10/1
- Hierarchical Temporal Transformer for 3D Hand Pose Estimation and Action Recognition from Egocentric RGB Videos2022/9/1
- Monocular Camera-based Complex Obstacle Avoidance via Efficient Deep Reinforcement Learning2022/9/1
- A Generalized Continuous Collision Detection Framework of Polynomial Trajectory for Mobile Robots in Cluttered Environments2022/6/1
- DynamicFilter: an Online Dynamic Objects Removal Framework for Highly Dynamic Environments2022/6/1
- Reinforcement Learned Distributed Multi-Robot Navigation with Reciprocal Velocity Obstacle Shaped Rewards2022/3/1
- Autofocus for Event Cameras2022/3/1
- Visual-Tactile Sensing for Real-time Liquid Volume Estimation in Grasping2022/2/1
- An Intelligent Self-driving Truck System For Highway Transportation2021/12/1
- DiffSRL: Learning Dynamical State Representation for Deformable Object Manipulation with Differentiable Simulator2021/10/1
- Learning Selective Communication for Multi-Agent Path Finding2021/9/1
- Encirclement Guaranteed Cooperative Pursuit with Robust Model Predictive Control2021/8/1
- Challenges and Outlook in Robotic Manipulation of Deformable Objects2021/5/1
- An Interval Branch-and-Bound-Based Inverse Kinemetics Algorithm Towards Global Optimal Redundancy Resolution2021/4/1
- Learning-based Optoelectronically Innervated Tactile Finger for Rigid-Soft Interactive Grasping2021/1/1
- Design of an Optoelectronically Innervated Gripper for Rigid-Soft Interactive Grasping2020/12/1
- Crowd-Driven Mapping, Localization and Planning2020/12/1
- Optimization-Based Framework for Excavation Trajectory Generation2020/10/1
- Autonomous Social Distancing in Urban Environments using a Quadruped Robot2020/8/1
- Time Variable Minimum Torque Trajectory Optimization for Autonomous Excavator2020/6/1
- Rigid-Soft Interactive Learning for Robust Grasping2020/3/1
- A Configuration-Space Decomposition Scheme for Learning-based Collision Checking2019/11/1
- Reciprocal Collision Avoidance for General Nonlinear Agents using Reinforcement Learning2019/10/1
- Learning Resilient Behaviors for Navigation Under Uncertainty2019/10/1
- DeepMNavigate: Deep Reinforced Multi-Robot Navigation Unifying Local & Global Collision Avoidance2019/10/1
- Intervention Aided Reinforcement Learning for Safe and Practical Policy Optimization in Navigation2018/11/1
- Deep Learning Scooping Motion using Bilateral Teleoperations2018/10/1
- Getting Robots Unfrozen and Unlost in Dense Pedestrian Crowds2018/10/1
- CATCH-919 Hand: Design of a 9-actuator 19-DOF Anthropomorphic Robotic Hand2018/9/1
- Robust Shape Estimation for 3D Deformable Object Manipulation2018/9/1
- Safe Navigation with Human Instructions in Complex Scenes2018/9/1
- Fully Distributed Multi-Robot Collision Avoidance via Deep Reinforcement Learning for Safe and Efficient Navigation in Complex Scenarios2018/8/1
- Considering Human Behavior in Motion Planning for Smooth Human-Robot Collaboration in Close Proximity2018/7/1
- CrowdMove: Autonomous Mapless Navigation in Crowded Scenarios2018/7/1
- Learning-based Feedback Controller for Deformable Object Manipulation2018/6/1
- Cloth Manipulation Using Random-Forest-Based Imitation Learning2018/2/1
- Manipulating Highly Deformable Materials Using a Visual Feedback Dictionary2017/10/1
- 3D Deformable Object Manipulation using Fast Online Gaussian Process Regression2017/9/1
- Towards Optimally Decentralized Multi-Robot Collision Avoidance via Deep Reinforcement Learning2017/9/1
- A Novel GPU-based Parallel Implementation Scheme and Performance Analysis of Robot Forward Dynamics Algorithms2016/9/1
- Deep-Learned Collision Avoidance Policy for Distributed Multi-Agent Navigation2016/9/1
- Parallel Dynamics Computation using Prefix Sum Operations2016/9/1
- Efficient Multi-Agent Global Navigation Using Interpolating Bridges2016/7/1
- DoraPicker: An Autonomous Picking System for General Objects2016/3/1
- Analyzing the Utility of a Support Pin in Sequential Robotic Manipulation2015/12/1
- Efficient Penetration Depth Computation between Rigid Models using Contact Space Propagation Sampling2015/11/1