Bin He
収録論文 29本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OccluDex: 自己遮蔽下での一人称視点巧みな操作のための階層的3D視触覚表現学習マニピュレーション2026/9/30
一人称視点で手が物体を隠してしまう自己遮蔽に対処するため、部分的3D形状と触覚情報を階層的に統合する視触覚表現学習フレームワークを提案し、蛇口回しや物体の向き変更タスクで従来手法を上回る精度を達成した。
- RobotEQ-Video:世界状態タクソノミーを用いた社会的前向き知能の動画中心ベンチマーク社会的前向き知能/動画ベンチマーク2026/9/18
動画から人間の状態やニーズを推論し、社会的に適切な先回り支援を行う「社会的前向き知能」を評価するため、4階層の世界状態タクソノミーに基づく2K以上の動画ベンチマークを構築した。
- 衝突ベースの遅延探索による高速マルチマニピュレータ計画マニピュレーション2026/7/1
複数マニピュレータの動作計画を高速化するため、遅延評価と事前計算を組み合わせた新しいアルゴリズムCBLSを提案した。
- 動力学不一致に頑健な効果アライメントによるマルチエージェント制御のSim-to-Real転送手法sim2real2026/6/1
マルチエージェント制御のSim-to-Real転送において、動力学の不一致に影響されにくい効果アライメント手法を提案。ランダム環境構造と離散意味行動を閉ループ制御で組み合わせ、行動同期機構でエージェント間のタイミングずれを軽減し、実世界での成功率を向上させた。
- RobotEQ: 具身AIにおける受動的知能から能動的知能への移行具身AI/ベンチマーク2026/5/1
ロボットが明示的な指示なしに社会的規範を理解し遵守できるかを評価する、能動的知能のための最初のベンチマークRobotEQを提案した論文。
- ROSClaw: 異種マルチエージェント協調のための階層的意味-物理フレームワークマルチエージェント2026/4/1
大規模言語モデルとロボットを統合し、異種ロボットの協調タスクを統一VLMコントローラで実行するフレームワークを提案。物理制約を考慮したsim-to-realマッピングとデータ収集機構により、長期的なタスク実行とポリシー最適化を実現する。
- MorphoGuard: 形態に基づく全身インタラクティブ動作制御全身制御2026/4/1
ロボットが肘でドアを押し開けながら物体を掴むなど、単一の運動連鎖上で動的な複数接触を扱う全身制御の課題に対し、任意の接触組み合わせを明示的に管理する形態制約付きWBCネットワークを提案し、実機・シミュレーションで評価した。
- 低重力4脚跳躍のための二重時間軸ハイブリッド内部モデルとハードウェアインザループ検証歩行2026/3/1
月面重力下での連続跳躍を可能にするため、短・長の二つの時間スケールを捉える内部モデルを提案し、滑車とトレッドミルを用いたハードウェアインザループ環境で実機検証した。
- 異種モジュラーロボットの形態形成アセンブリと適応制御モジュラーロボット2026/2/1
異種モジュールを移動マニピュレータで組み立ててロボットを構成し、GPU加速MPPI制御で未知の構成でもリアルタイムに動かせるようにする枠組みを提案した論文。
- HAFO: 強力な相互作用環境におけるヒューマノイドロボットのための力適応制御フレームワークヒューマノイド制御2025/11/1
二重エージェント強化学習により、ヒューマノイドの歩行と上半身操作を同時に最適化し、強い外力下でも安定した全身制御を実現するフレームワークを提案。
- VO-DP: 視覚のみのロボットマニピュレーションのための意味・幾何適応拡散ポリシーマニピュレーション2025/10/1
視覚基盤モデルを活用し、意味特徴と幾何特徴を融合する視覚のみの拡散ポリシーを提案。点群ベース手法に匹敵または凌駕する成功率を実世界タスクで達成。
- 未知の散乱環境における触覚ベースの対話型動作計画触覚2025/9/1
触覚知覚から物体の接触モデルをオンラインで構築し、それを制約として組み込んだ反応型プランナで、密集した未知環境でも安全に動作空間を拡張するフレームワークを提案した。
- LLMプランニングと視覚知覚による言語誘導長期的変形物体操作変形物体操作2025/9/1
LLMベースのプランナーとVLMベースの知覚を統合し、言語指示から多段階の布折り畳みを実現するフレームワークを提案。シミュレーションと実機で有効性を検証。
- Embodied Arena:具現化AIのための包括的・統合・進化型評価プラットフォーム評価基盤2025/9/1
具現化AIの能力を3階層・7能力・25次元で体系化し、22のベンチマークと30以上のモデルを統合評価する進化型プラットフォームを構築した。
- PaiP: 未知のキャビネット環境のための操作認識型インタラクティブプランナマニピュレーション2025/9/1
視覚遮蔽や狭い空間に対応するため、触覚知覚で物体とのインタラクション特性を推定し、操作コストマップを生成してサンプリングベース計画を拡張する実時間閉ループ動作計画手法を提案。
- 複雑地形におけるUAV-四足歩行ロボットの能動的姿勢調整と制約考慮制御による自律ドッキングドッキング/歩行/制御2025/9/1
四足歩行ロボットの姿勢を強化学習で安定化させ、UAVが視野制約下で追従・着陸する自律ドッキング手法を提案し、階段や急斜面での実機検証に成功した。
- LLM誘導適応補償器:大規模言語モデルによる自動制御系への適応性の導入適応制御2025/7/1
未知システムと参照システムの応答差をLLMに提示し、補償器を設計させることで、モデル参照適応制御の枠組みで適応性を実現する手法を提案し、ソフトロボットとヒューマノイドで有効性を示した。
- 標準化を伴う効率的なロボットによる衣類操作の学習マニピュレーション2025/6/1
双腕マルチプリミティブ方策と新しい報酬関数を用いて、しわの寄った衣類を広げながら標準的な形状・向きに整えるAPS-Netを提案し、シミュレーションと実機で有効性を示した。
- Kaiwu:ロボット学習と人間-ロボット協調のためのマルチモーダル操作データセットとフレームワークマニピュレーション2025/3/1
組立作業を対象に、人間・環境・ロボットの同期マルチモーダルデータを収集するフレームワークと大規模データセットを構築し、細粒度アノテーションを付与した。
- SSFold: 人間の実演からグラフダイナミクスを学習し任意のしわくちゃ布を折り畳む変形物体マニピュレーション2024/11/1
人間の実演データと部分点群から布の全体形状を推定する二流構成の政策モデルを提案し、しわくちゃな布を滑らかにして折り畳む作業を実機で高成功率に実現した。
- 人間の生動画からロボットスキルを学ぶ:対比・模倣・適応VLA2024/8/1
人間の生動画を対比してタスク事前知識を、軌道模倣で行動事前知識を学習し、新しい状況に適応する3段階のロボットスキル学習フレームワークCIAを提案。
- LLMと身体性知識グラフによるサービスロボットの安全制御安全制御2024/5/1
サービスロボットの安全な動作を実現するため、大規模言語モデルに身体性ロボット制御プロンプトと身体性知識グラフを組み合わせ、生成された行動を知識グラフで検証する枠組みを提案した。実世界タスクで従来手法より安全基準への適合率が高いことを示した。
- UAVと大規模言語モデルの統合:現状と将来への道筋VLA2024/5/1
UAVに大規模言語モデル(LLM)を統合する研究をレビューし、アーキテクチャの適合性やスペクトルセンシング・意思決定への応用可能性を整理した。
- A Survey on Robotic Manipulation of Deformable Objects: Recent Advances, Open Challenges and New Frontiers2023/12/1
- Robot Learning in the Era of Foundation Models: A Survey2023/11/1
- Goal-Conditioned Reinforcement Learning with Disentanglement-based Reachability Planning2023/7/1
- Communication and Control in Collaborative UAVs: Recent Advances and Future Trends2023/2/1
- Weakly Supervised Disentangled Representation for Goal-conditioned Reinforcement Learning2022/2/1
- Enhance Accuracy: Sensitivity and Uncertainty Theory in LiDAR Odometry and Mapping2021/11/1