Bo Li
収録論文 31本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VBVR-Pro: ネイティブ視覚推論のためのスケーラブルで検証可能なスイート視覚推論2026/8/26
視覚生成を推論の媒体として扱うネイティブ視覚推論の研究を進めるため、300の手続き生成タスクからなる閉ループテストベッドVBVR-Proを導入し、検証可能な報酬スコアラと制御されたモダリティ比較を提供する。
- エピソード評価を超えて:連続的身体化質問応答における記憶アーキテクチャのボトルネック身体化AI/記憶アーキテクチャ2026/7/1
身体化質問応答(EQA)を連続的に評価した際、既存の記憶保持だけでは不十分で、視覚的意味情報を保持する構造化された空間的記憶(3D幾何学に基づく)が必要であることを示した論文。
- LLaVA-OneVision-2:次世代知覚知能に向けてVLA2026/5/25
動画を圧縮ビットストリームとして扱い、適応的な時間グループと空間的証拠の選択によりトークン予算を効率的に配分する新しい視覚言語モデルを提案。大規模なオープン監視データで学習し、動画理解や時間的・空間的接地、操作トレース推論などで高性能を達成。
- 身体性AIにおける安全性:リスク、攻撃、防御のサーベイ安全性2026/5/1
身体性AIの安全性に関する研究を、知覚から計画、行動、相互作用までのパイプライン全体にわたって体系的にレビューし、攻撃と防御の多層的な分類法を提案した論文。
- 超大規模動画推論スイート動画推論2026/2/1
200種類の推論タスクと100万本以上の動画からなる大規模データセットVBVRと、ルールベースで検証可能な評価ベンチマークVBVR-Benchを構築し、動画推論のスケーリング則と未見タスクへの汎化の兆候を示した。
- PvP: 固有感覚と特権情報の対照表現によるデータ効率の良いヒューマノイドロボット学習全身制御2025/12/1
固有感覚状態と特権状態の相補性を活かした対照学習で、ヒューマノイドの全身制御を少ないデータで効率的に学習する手法を提案し、評価用フレームワークも構築した。
- マルチモーダル基盤モデルによる空間知能のスケーリングVLA2025/11/1
800万件の多様な空間データでマルチモーダル基盤モデルを訓練し、空間知能ベンチマークで大幅な性能向上を達成するとともに、データスケーリングや創発的汎化の兆候を分析した。
- マルチモーダルLLMの空間知能を包括的に評価するEASI空間知能評価2025/8/1
GPT-5など最先端マルチモーダルモデルの空間理解・推論能力を、統一的なタスク分類に基づく8つのベンチマークで大規模に評価し、人間との差や限界を明らかにした。
- 行動基盤モデルサーベイ:ヒューマノイドロボットの次世代全身制御システム全身制御2025/6/1
ヒューマノイドの全身制御に向けた行動基盤モデル(BFM)の研究動向を、事前学習パイプラインや応用、課題、今後の展望まで体系的にまとめたサーベイ論文。
- SafeAuto: マルチモーダル基盤モデルによる知識強化型安全自動運転自動運転2025/3/1
交通ルールを一階述語論理と確率グラフィカルモデルで組み込み、マルチモーダルRAGと新損失関数を統合することで、MLLMベースの自動運転の安全性と精度を向上させたフレームワーク。
- 低遅延ロボット支援ハンド・物体インタラクションのための階層的手順フレームワークマニピュレーション2024/5/1
RGB画像から手の3D再構成を行い、階層的な制御でロボットによる手と物体のインタラクションを支援するフレームワークを提案し、0.3秒以下の遅延を実現した。
- Octopus: Embodied Vision-Language Programmer from Environmental Feedback2023/10/1
- Rethinking Imitation-based Planner for Autonomous Driving2023/9/1
- GrowSP: Unsupervised Semantic Segmentation of 3D Point Clouds2023/5/1
- SLAMesh: Real-time LiDAR Simultaneous Localization and Meshing2023/3/1
- Perception Simplex: Verifiable Collision Avoidance in Autonomous Vehicles Amidst Obstacle Detection Faults2022/9/1
- Verifiable Obstacle Detection2022/8/1
- Generalizing Goal-Conditioned Reinforcement Learning with Variational Causal Reasoning2022/7/1
- SafeBench: A Benchmarking Platform for Safety Evaluation of Autonomous Vehicles2022/6/1
- On the Robustness of Safe Reinforcement Learning under Observational Perturbations2022/5/1
- Test Against High-Dimensional Uncertainties: Accelerated Evaluation of Autonomous Vehicles with Deep Importance Sampling2022/4/1
- A Survey on Safety-Critical Driving Scenario Generation -- A Methodological Perspective2022/2/1
- Constrained Variational Policy Optimization for Safe Reinforcement Learning2022/1/1
- On Enhancing Ground Surface Detection from Sparse Lidar Point Cloud2021/5/1
- Multi-Robot Task Allocation -- Complexity and Approximation2021/3/1
- Multimodal Safety-Critical Scenarios Generation for Decision-Making Algorithms Evaluation2020/9/1
- GP-SLAM+: real-time 3D lidar SLAM based on improved regionalized Gaussian process map reconstruction2020/8/1
- Relative Pose Estimation of Calibrated Cameras with Known $\mathrm{SE}(3)$ Invariants2020/7/1
- GAPS: Generator for Automatic Polynomial Solvers2020/4/1
- 3D Fully Convolutional Network for Vehicle Detection in Point Cloud2016/11/1
- Vehicle Detection from 3D Lidar Using Fully Convolutional Network2016/8/1