Kai Xu
収録論文 34本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FoLD: 力情報を活用した関節物体の巧みな操作学習マニピュレーション2026/9/27
人間の実演から補償力場を計算し、残差ポリシーでロボットの手の動きを接触要求に適応させることで、関節物体の巧みな操作を実現するフレームワーク。
- InterMASH: 把持合成のための統一幾何表現マニピュレーション2026/9/16
球面固定アンカーと球面調和関数で手と物体の局所形状・接触を統一的に符号化し、拡散Transformerで手形状と接触を同時生成する把持合成手法を提案。
- PAIWorld: ロボット操作のための3D整合性を持つ世界基盤モデル世界モデル2026/6/1
複数視点の3D整合性を保つ世界基盤モデルを提案し、ロボット操作のための予測と計画を改善した。
- DynaMOMA: 動的物体のモバイル操作のための把持姿勢の瞬時予測モバイルマニピュレーション2026/6/1
動的物体を移動しながら把持するために、アンカーベース拡散モデルで短期的な把持軌道を予測し、全身強化学習ポリシーと統合するフレームワークを提案。シミュレーションと実機で有効性を実証。
- PaintBench: 精密な視覚編集の決定的評価視覚編集2026/5/29
PaintBenchは、幾何変換や構造操作など20種類の精密な視覚編集操作を評価するベンチマークで、手続き生成とピクセル単位の評価によりバイアスを排除し、既存モデルの性能が低いことを示した。
- IMR-LLM: 大規模言語モデルを用いた産業用マルチロボットタスク計画とプログラム生成タスク計画/LLM2026/3/1
産業用マルチロボットの複雑なタスクを、LLMと決定的解法を組み合わせて計画し、プロセスツリーで低レベルプログラムを生成するフレームワークを提案。専用ベンチマークで既存手法を上回る性能を示した。
- フレキシブル製造のための身体性知能:サーベイ身体性知能/製造2026/2/1
フレキシブル製造における身体性知能の研究を、知覚(Industrial Eye)、制御(Industrial Hand)、意思決定(Industrial Brain)の3視点から整理し、認知強化・技能移行・システム進化からなる3段階の発展モデルを提案したサーベイ。
- RoboBPP: 物理シミュレーションによるロボットオンライン箱詰めのベンチマークマニピュレーション2025/12/1
物理シミュレータ上で実スケールのロボットアームと箱を扱うオンライン箱詰めベンチマークを構築し、実産業データセットと安定性・安全性の新指標を導入した。
- AdaPower: 予測的マニピュレーションのための世界基盤モデルの特化マニピュレーション2025/12/1
汎用世界基盤モデルを推論時適応と記憶持続で軽量に特化させ、事前学習済みVLAを再訓練なしで強化するフレームワークを提案。
- ピンプレッショングリッパの設計とオンライン把持調整を伴う巧みな把持の学習マニピュレーション2025/5/1
ピンプレッション玩具に着想を得た、各指に独立伸縮可能なピンアレイを持つ平行グリッパを開発し、強化学習とカリキュラム学習で把持中の再配向を含む巧みな把持スキルを学習させ、実機転移も実証した。
- LaDi-WM: 予測的マニピュレーションのための潜在拡散ベース世界モデルマニピュレーション2025/5/1
事前学習済み視覚基盤モデルの潜在空間を拡散モデルで予測する世界モデルを提案し、予測状態を活用した拡散ポリシーによりマニピュレーション性能を大幅に向上させた。
- 梱包構成木に基づく3Dビンパッキングの計画手法マニピュレーション2025/4/1
オンライン3Dビンパッキング問題に対し、梱包構成木(PCT)という階層表現を導入し、深層強化学習と木探索を組み合わせて大規模・多様な制約下での計画を可能にした。
- PIN-WM: 非把持マニピュレーションのための物理情報に基づく世界モデル学習sim2real2025/4/1
微分可能物理シミュレーションとGaussian Splattingを組み合わせ、視覚観測から3D剛体ダイナミクスの世界モデルを少数の軌道で学習し、物理を考慮したランダム化でSim2Real転移を実現した。
- CogNav: LLMによる物体目標ナビゲーションの認知プロセスモデリング物体目標ナビゲーション2024/12/1
大規模言語モデルを用いて人間の物体探索時の認知状態遷移を有限状態機械でモデル化し、未知環境での物体目標ナビゲーションの成功率を向上させた研究。
- LLMで強化したシーングラフ学習による家庭内整理タスクシーングラフ/LLM/整理タスク2024/8/1
家庭内の物の配置換えタスクに向けて、LLMを活用してシーングラフを拡張し、物の機能とユーザー選好を考慮した配置計画を可能にする手法を提案した。
- 異なる多自由度ハンド間で転移可能な把持・リーチング方策の学習マニピュレーション2024/4/1
グリッパに依存しないキーポイント変位予測とグリッパ固有の適応モデルを組み合わせ、異なる多自由度ハンドへ把持方策を転移できる統一的枠組みを提案した。
- 協調mTSPによる同期型双腕再配置マニピュレーション2024/3/1
双腕ロボットの再配置を協調コストを共有するmTSPとして定式化し、注意機構付き強化学習とコスト予測器で効率的に計画する手法を提案した。
- Learning Dual-arm Object Rearrangement for Cartesian Robots2024/2/1
- 3D-Aware Object Goal Navigation via Simultaneous Exploration and Identification2022/12/1
- Learning Physically Realizable Skills for Online Packing of General 3D Shapes2022/12/1
- NIFT: Neural Interaction Field and Template for Object Manipulation2022/10/1
- Learning High-DOF Reaching-and-Grasping via Dynamic Representation of Gripper-Object Interaction2022/4/1
- Inverse Kinematics and Dexterous Workspace Formulation for 2-Segment Continuum Robots with Inextensible Segments2021/10/1
- Learning Practically Feasible Policies for Online 3D Bin Packing2021/8/1
- Autonomous Outdoor Scanning via Online Topological and Geometric Path Optimization2020/12/1
- Towards Target-Driven Visual Navigation in Indoor Scenes via Generative Imitation Learning2020/9/1
- Deep Differentiable Grasp Planner for High-DOF Grippers2020/2/1
- Reinforcement Learning-based Visual Navigation with Information-Theoretic Regularization2019/12/1
- New Formulation of Mixed-Integer Conic Programming for Globally Optimal Grasp Planning2019/9/1
- NeoNav: Improving the Generalization of Visual Navigation via Generating Next Expected Observations2019/6/1
- Globally Optimal Joint Search of Topology and Trajectory for Planar Linkages2019/5/1
- Generating Grasp Poses for a High-DOF Gripper Using Neural Networks2019/3/1
- Caging Loops in Shape Embedding Space: Theory and Computation2018/7/1
- Object-Aware Guidance for Autonomous Scene Reconstruction2018/5/1