Zhibin Li
収録論文 70本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 現実ギャップを埋める:器用な力制御把持と操作のためのゼロショットsim-to-real展開器用操作/sim2real2026/7/1
触覚とトルク情報を活用した強化学習により、シミュレーションのみで訓練した5本指ハンドの制御ポリシーを実機に直接展開し、把持力制御と物体の向き変更を実現した。
- 大規模言語モデルを用いた具現化プランニングには系統的な安全リスクが存在する安全性評価2026/4/1
大規模言語モデルをロボットのプランナーとして使う際の安全性を評価するベンチマークDESPITEを導入し、計画能力が高くても危険な計画を生成するリスクが高いことを示した。
- SCDP: 混合観測蒸留による部分観測下でのヒューマノイド歩行学習歩行2026/3/1
オンボードセンサのみを用い、明示的な状態推定なしでヒューマノイドの歩行制御を実現する拡散ポリシーSCDPを提案。混合観測訓練により特権的な未来状態を教師として部分観測下の動力学を学習し、実機G1で50Hzのロバストな歩行を実証した。
- 現実ギャップの解消:力ベースの巧みな把持と操作のためのゼロショットSim-to-Real展開sim2real2026/1/1
高密度触覚フィードバックと関節トルクセンシングを活用した強化学習フレームワークを構築し、シミュレーションのみで訓練した五指ハンドの制御方策を実機にゼロショット転移させ、把持力追従と物体の再配向を実現した。
- DemoBot:第三者視点の人間動画から器用な両手マニピュレーションを効率的に学習マニピュレーション2026/1/1
1本の注釈なしRGB-D動画から両腕多指ロボットの操作スキルを獲得する学習フレームワークを提案し、動きの事前分布と強化学習を組み合わせて長期的な両手組み立てタスクを実現した。
- 共有自律によるエンドツーエンドの器用な腕・手VLAポリシー:自律ハンドVLAポリシーで拡張したVRテレオペレーションによる効率的なデータ収集VLA2025/11/1
VRテレオペレーションで腕を人間が操作し、手は自律VLAポリシーが触覚・視覚フィードバックで制御する共有自律フレームワークを提案し、効率的に高品質な腕・手協調のデモを収集してエンドツーエンドVLAポリシーを学習、多様な物体で90%の成功率を達成した。
- RoboBallet: グラフニューラルネットワークと強化学習によるマルチロボット到達計画マルチロボット計画2025/9/1
強化学習とグラフニューラルネットワークを用いて、障害物の多い共有空間で複数ロボットのタスク割り当て・スケジューリング・動作計画を同時に解くフレームワークを提案し、8台のロボットによる40の到達タスクでゼロショット汎化を実証した。
- 四脚ロボットの全身マニピュレーションと移動を統合する効率的な方策学習マニピュレーション2025/7/1
マニピュレータの運動学モデルを強化学習に組み込み、四脚ロボットの全身移動・操作を統合した方策を効率的に学習する手法を提案し、実機で有効性を示した。
- 物理シーンのスプラッティング:不完全なロボットデータからのエンドツーエンド実世界→シミュレーションsim2real2025/6/1
3Dガウススプラッティングと物理シミュレーション用メッシュを統合し、生のロボット軌道から物体形状・見た目・ロボット姿勢・物理パラメータを微分可能レンダリングと微分可能物理で同時最適化する実世界→シミュレーション手法を提案。
- Astra:階層型マルチモーダル学習による汎用移動ロボットの実現移動ロボットナビゲーション2025/6/1
マルチモーダルLLMとマルチタスクネットワークを組み合わせた二重モデルアーキテクチャにより、多様な屋内環境で移動ロボットのナビゲーションを実現した。
- AIとロボット科学者による科学発見のスケーリング則自律実験/ロボット科学者2025/3/1
エージェントAIと身体性ロボティクスを統合した自律型汎用科学者(AGS)を構想し、研究ライフサイクル全体の自動化と新たなスケーリング則の可能性を論じた論文。
- 四足歩行の俊敏な移動を実現するスキル切替基準の発見歩行2025/2/1
深層強化学習と最適化を組み合わせ、目標位置に応じて歩容(トロット・バウンド・ギャロップ)を自動的かつ自然に切り替える多スキル四足歩行ポリシーを学習し、実機でも転倒からの復帰を含めて実証した。
- 連鎖型符号付距離場に基づく高ダイナミック無条件反射の動作計画マニピュレーション2025/2/1
マニピュレータに脊髄反射のような高速な回避動作を実現するため、連鎖型SDFを用いたオンライン動作計画法を提案し、静的・動的環境での有効性を示した。
- 複雑環境下での適応型流体力学モデルをNeural ODEで学習sim2real2024/10/1
水陸両用四足ロボットの水中適応能力を高めるため、Neural ODEとアテンション機構を組み合わせたデータ駆動型流体力学モデルを開発し、リアルタイムセンサデータから力状態を予測できることを示した。
- 物体中心事前分布を用いた3D特徴蒸留3Dビジョン言語2024/6/1
単視点RGB-Dから物体中心の事前分布を活用して3D CLIP特徴を蒸留し、言語による3Dグラウンディングとセグメンテーション精度を向上させる手法を提案。
- DexSkills: 触覚データによるスキル分割で長期的な器用マニピュレーションを自律学習マニピュレーション2024/5/1
人間のデモンストレーションを固有感覚と触覚データのみで原始スキルに分割し、ロボットが長期的な器用操作タスクをワンショットで実行できるようにする教師あり学習フレームワークを開発した。
- インターネット動画からの汎用ロボット学習に向けて:サーベイVLA2024/4/1
インターネット上の大規模動画を活用してロボット学習のデータ不足を補う「動画からの学習(LfV)」の研究動向を体系的に整理し、課題と将来展望を論じたサーベイ論文。
- 解釈可能なロボット歩行のための強化学習方策の蒸留:勾配ブースティングマシンと記号回帰歩行2024/3/1
強化学習で訓練したニューラルネット方策を、勾配ブースティングや記号回帰などの解釈可能なモデルに蒸留し、歩行・トロット・バウンド・ペーシングの各歩容で有効性を検証した。
- Modular Neural Network Policies for Learning In-Flight Object Catching with a Robot Hand-Arm System2023/12/1
- Language-guided Robot Grasping: CLIP-based Referring Grasp Synthesis in Clutter2023/11/1
- Intrinsic Language-Guided Exploration for Complex Long-Horizon Robotic Manipulation Tasks2023/9/1
- Pose-Graph Attentional Graph Neural Network for Lidar Place Recognition2023/9/1
- Feasibility Retargeting for Multi-contact Teleoperation and Physical Interaction2023/8/1
- Hierarchical generative modelling for autonomous robots2023/8/1
- RObotic MAnipulation Network (ROMAN) -- Hybrid Hierarchical Learning for Solving Complex Sequential Tasks2023/7/1
- Learning Fine Pinch-Grasp Skills using Tactile Sensing from A Few Real-world Demonstrations2023/7/1
- Value Functions are Control Barrier Functions: Verification of Safe Policies using Control Theory2023/6/1
- Identifying Important Sensory Feedback for Learning Locomotion Skills2023/6/1
- Learning Quadruped Locomotion using Bio-Inspired Neural Networks with Intrinsic Rhythmicity2023/5/1
- Dexterous In-Hand Manipulation of Slender Cylindrical Objects through Deep Reinforcement Learning with Tactile Sensing2023/4/1
- Instance-wise Grasp Synthesis for Robotic Grasping2023/2/1
- Agile and Versatile Robot Locomotion via Kernel-based Residual Learning2023/2/1
- Perceptive Locomotion with Controllable Pace and Natural Gait Transitions Over Uneven Terrains2023/1/1
- Real-time Digital Double Framework to Predict Collapsible Terrains for Legged Robots2022/9/1
- A New Calibration Method for Industrial Robot Based on Step-Size Levenberg-Marquardt Algorithm2022/8/1
- Collaborative Bimanual Manipulation Using Optimal Motion Adaptation and Interaction Control2022/6/1
- Achieving Dexterous Bidirectional Interaction in Uncertain Conditions for Medical Robotics2022/6/1
- Multi-Contact Motion Retargeting using Whole-body Optimization of Full Kinematics and Sequential Force Equilibrium2022/6/1
- A Novel Quadratic Interpolated Beetle Antennae Search for Manipulator Calibration2022/4/1
- A New Robot Arm Calibration Method Based on Cubic Interpolated Beetle Antennae Search Approach2022/4/1
- An Advancing Ensemble with Diversified Algorithms for Robot Arm Calibration2022/4/1
- Learning Perceptual Locomotion on Uneven Terrains using Sparse Visual Observations2021/9/1
- Fine Manipulation and Dynamic Interaction in Haptic Teleoperation2021/9/1
- Accessibility-Based Clustering for Efficient Learning of Locomotion Skills2021/9/1
- Robust Impedance Control for Dexterous Interaction Using Fractal Impedance Controller with IK-Optimisation2021/9/1
- Learning Vision-Guided Dynamic Locomotion Over Challenging Terrains2021/9/1
- Learning Autonomous Mobility Using Real Demonstration Data2021/8/1
- Metrics for 3D Object Pointing and Manipulation in Virtual Reality2021/6/1
- Reachability Map for Diverse Balancing Strategies and Energy Efficient Stepping of Humanoids2021/5/1
- Considerations and Challenges of Measuring Operator Performance in Telepresence and Teleoperation Entailing Mixed Reality Technologies2021/3/1
- Meta-Reinforcement Learning for Adaptive Motor Control in Changing Robot Dynamics and Environments2021/1/1
- Trajectory optimization for contact-rich motions using implicit differential dynamic programming2021/1/1
- The Challenges in Modeling Human Performance in 3D Space with Fitts' Law2021/1/1
- Multi-expert learning of adaptive legged locomotion2020/12/1
- Efficient Learning of Control Policies for Robust Quadruped Bounding using Pretrained Neural Networks2020/11/1
- Learning Hybrid Locomotion Skills -- Learn to Exploit Residual Dynamics and Modulate Model-based Gait Control2020/11/1
- Contact-Implicit Trajectory Optimization using an Analytically Solvable Contact Model for Locomotion on Variable Ground2020/7/1
- Learning natural locomotion behaviors for humanoid robots using human knowledge2020/5/1
- Variable Autonomy of Whole-body Control for Inspection and Intervention in Industrial Environments using Legged Robots2020/4/1
- Multimodal Interfaces for Effective Teleoperation2020/3/1
- Robust High-Transparency Haptic Exploration for Dexterous Telemanipulation2020/3/1
- Learning Whole-body Motor Skills for Humanoids2020/2/1
- Force-guided High-precision Grasping Control of Fragile and Deformable Objects using sEMG-based Force Prediction2020/2/1
- Reaching, Grasping and Re-grasping: Learning Multimode Grasping Skills2020/2/1
- Optimisation of Body-ground Contact for Augmenting Whole-Body Loco-manipulation of Quadruped Robots2020/2/1
- Learning Pregrasp Manipulation of Objects from Ungraspable Poses2020/2/1
- Emergence of Human-comparable Balancing Behaviors by Deep Reinforcement Learning2018/9/1
- Comparison Study of Nonlinear Optimization of Step Durations and Foot Placement for Dynamic Walking2018/5/1
- Recurrent Deterministic Policy Gradient Method for Bipedal Locomotion on Rough Terrain Challenge2017/10/1
- iDRM: Humanoid Motion Planning with Real-Time End-Pose Selection in Complex Environments2016/7/1