Peng Li
収録論文 21本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EmbodiedMemory-Bench:長期的な身体性タスクにおける身体性記憶のベンチマーク身体性記憶/ベンチマーク2026/9/23
長期的な身体性インタラクションにおける記憶能力を評価するEMem-Benchを提案し、空間・イベント・シーン記憶を統合する外部記憶システムEMemと8BポリシーEMem-8Bを開発した。
- GigaBrain-0.7:三系統アーキテクチャによる創発的能力へのスケーリングVLA2026/8/16
視覚言語行動モデルのスケーリングとアーキテクチャ改善により、多様なロボットへの汎化を大幅に向上させた基盤モデルを提案。
- State2State: 環境から導出された中間学習によるLLMエージェントの訓練LLMエージェント2026/8/5
外部タスク指定なしに環境との相互作用のみでエージェントを訓練する手法を提案。探索した環境状態を目標状態に変換し、ルールベースの状態一致で検証することで、スケーラブルで検証可能な訓練目標を提供する。
- LP-NavOA: 限られた知覚下での人型ロボットの統合ローカルナビゲーションと障害物回避歩行2026/6/1
短距離・部分観測のセンシングしか持たない人型ロボット向けに、障害物回避とゴール復帰を両立するナビゲーション手法を提案。強化学習で歩行制御を学習後、A*教師から蒸留した再帰型プランナーが指令を上書きし、マップ不要で高い到着率を達成した。
- TacMamba: 高速反射と低速VLA推論を橋渡しする触覚履歴圧縮アダプタ触覚/VLA2026/3/1
触覚データの高周波処理と視覚ポリシーの低周波処理のギャップを埋めるため、Mambaベースの触覚履歴圧縮器を導入し、VLAモデルにプラグイン可能な高速触覚融合を実現した。
- FRoM-W1: 言語指示による汎用人型全身制御フレームワークVLA2026/1/1
自然言語から人型ロボットの全身動作を生成・実行する2段階フレームワークを提案し、Unitree H1/G1で動作追従精度の向上を実証した。
- EmboTeam: PDDLを介してLLM推論を反応型ビヘイビアツリーに接地する身体性マルチロボット協調マルチロボット協調2026/1/1
LLMで指示をPDDL問題に変換し、古典的プランナで計画を最適化した後、ビヘイビアツリーにコンパイルして異種ロボットチームの長期タスクを反応的に実行するフレームワークを提案。
- GigaBrain-0: ワールドモデルを活用した視覚-言語-行動モデルVLA2025/10/1
ワールドモデルで生成した多様なデータを活用し、実機データへの依存を抑えつつ汎化性能を高めたVLA基盤モデルを提案。RGBD入力と身体性Chain-of-Thoughtで長期的・移動を伴う器用な操作タスクの実世界性能を向上させた。
- LiloDriver: ロングテール自動運転シーンにおける閉ループ運動計画のための生涯学習フレームワーク自動運転/運動計画2025/5/1
大規模言語モデルと記憶拡張型プランナ生成を組み合わせ、再学習なしで新たなロングテール走行シーンに適応する生涯学習型の閉ループ運動計画フレームワークを提案し、nuPlanベンチマークで有効性を示した。
- Dual-AEB: ルールベースとマルチモーダル大規模言語モデルを融合した緊急ブレーキシステム自動運転2024/10/1
マルチモーダル大規模言語モデルによるシーン理解と従来のルールベースAEBを組み合わせ、開放的な状況でも迅速に緊急ブレーキを判断できるシステムを提案した。
- Bench4Merge: 実環境に近い高密度交通におけるマイクロインタラクティブ車両との合流のための包括的ベンチマーク自動運転/合流/ベンチマーク2024/10/1
高密度交通への合流を評価する閉ループベンチマークを提案し、他車両を大規模データで学習させて多様性を高め、LLMで合流性能を評価する。
- MANGO: 大規模言語モデルのマッピングとナビゲーション能力を評価するベンチマークベンチマーク2024/3/1
テキストベースの迷路探索における大規模言語モデルのマッピングとナビゲーション能力を評価するベンチマークMANGOを提案し、GPT-4でも人間には簡単な質問に苦戦することを示した。
- Statler: State-Maintaining Language Models for Embodied Reasoning2023/6/1
- LF-VISLAM: A SLAM Framework for Large Field-of-View Cameras with Negative Imaging Plane on Mobile Agents2022/9/1
- A Closed-Loop Perception, Decision-Making and Reasoning Mechanism for Human-Like Navigation2022/7/1
- LF-VIO: A Visual-Inertial-Odometry Framework for Large Field-of-View Cameras with Negative Plane2022/2/1
- PanoFlow: Learning 360{\deg} Optical Flow for Surrounding Temporal Understanding2022/2/1
- Learning to Navigate in a VUCA Environment: Hierarchical Multi-expert Approach2021/11/1
- Making Robots Draw A Vivid Portrait In Two Minutes2020/5/1
- Real-time Trajectory Generation for Quadrotors using B-spline based Non-uniform Kinodynamic Search2019/4/1
- Development of an Autonomous Sanding Robot with Structured-Light Technology2019/3/1