Xiao Li
収録論文 31本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 少ないステップでより良い行動:VLAポリシーのフローマッチング推論の再考VLA2026/9/18
フローマッチングベースのVLAポリシーにおいて、積分ステップ数を増やす代わりに、軽量なTransformerで終点補正を行うことで、推論コストを削減しつつ成功率を向上させる手法を提案。
- NeuralParker: 不規則な駐車環境のための強化学習プランナー駐車計画/強化学習2026/8/25
配送車両などが不規則な環境で任意の姿勢に駐車するための強化学習ベースのハイブリッドプランナーを提案。環境全体の障害物と境界を目標相対表現で符号化し、長距離の経路計画を可能にした。
- 反射:反応が重要な操作のための高速で予測的な視覚言語行動モデルVLA2026/8/14
動的操作における反応速度を重視したベンチマークReflexBenchを新設し、低遅延で予測的なVLAモデルReflexVLAを提案した。
- RGB基盤モデルの階層的監督による熱画像深度推定への転用深度推定2026/8/1
熱画像からの深度推定において、RGB基盤モデルの階層的表現を活用するフレームワークRGB-HSを提案し、複数レベルでの特徴整合と品質検証により性能を向上させた。
- PLS-Calib: 地上運動制約下でのイベントカメラとオドメトリ校正のための部分最小二乗フレームワークセンサ校正2026/8/1
地上ロボットの限られた運動条件下で、イベントカメラとオドメトリ間の回転校正を部分最小二乗法を用いて安定かつ高精度に行う新しいフレームワークを提案した。
- ハーネスVLA:メモリ誘導エージェントによる凍結VLAの信頼性ある操作プリミティブへの変換VLA/操作2026/7/1
凍結したVLAモデルを再試行可能な接触豊富なプリミティブとして活用し、解析的プリミティブと組み合わせることで、微調整なしに分布外の操作タスクでの成功率を大幅に向上させるフレームワークを提案した。
- 長尺動画における改ざんセグメントの説明可能なフォレンジック解析動画フォレンジック2026/6/1
未編集の長尺動画に埋め込まれたAI生成セグメントを検出・位置特定し、その理由を説明する新しいタスクとベンチマーク、ベースライン手法を提案した論文。
- 身体性AIにおける安全性:リスク、攻撃、防御のサーベイ安全性2026/5/1
身体性AIの安全性に関する研究を、知覚から計画、行動、相互作用までのパイプライン全体にわたって体系的にレビューし、攻撃と防御の多層的な分類法を提案した論文。
- DSSP: 全履歴符号化を備えた拡散状態空間ポリシー模倣学習/拡散モデル2026/5/1
ロボット操作のための拡散模倣学習において、履歴全体を効率的に圧縮・活用する階層的コンディショニング手法を提案し、シミュレーションと実機で高い性能を達成した。
- 産業運搬タスクにおける人型ロボットの負荷対応歩行制御歩行制御2026/3/1
人型ロボットが荷物を運搬する際の安定歩行を実現するため、強化学習と運動学に基づく参照軌道を組み合わせた負荷対応フレームワークを提案し、シミュレーションと実機で有効性を検証した。
- 人間の手のマルチ剛体近似とデジタルツインへの応用デジタルツイン2025/12/1
人間の手の動作を光学式モーションキャプチャから取り込み、MANOモデルを関節軸が解剖学的に整合したURDFに変換することで、リアルタイム物理シミュレーション可能なマルチ剛体近似を構築するパイプラインを提案した。
- OMP: 方向性アライメントによる一段階Meanflowポリシーマニピュレーション2025/12/1
拡散モデルの推論遅延とフローモデルの複雑さを解決するため、方向性アライメントと微分導出方程式を導入し、単一ステップで高精度なロボットマニピュレーションを実現するOMPを提案。
- ポリシーを合成せよ!テスト時分布レベル合成による拡散・フローベースロボットポリシーの改善VLA2025/10/1
複数の事前学習済みロボットポリシーの分布スコアを凸結合しテスト時探索で合成する訓練不要手法GPCを提案し、単一ポリシーを超える性能を実現した。
- 言語整合3Dキーポイントによる汎化可能な粗から細へのロボットマニピュレーションマニピュレーション2025/9/1
言語指示と3Dキーポイントを組み合わせた粗から細への階層的マニピュレーションポリシーを提案し、少ないデモで新規指示や環境変化への汎化を実現した。
- RLRC: 強化学習による圧縮VLAモデルの性能回復VLA2025/6/1
VLAモデルを構造的プルーニング・強化学習による性能回復・量子化の3段階で圧縮し、メモリを最大8分の1、推論を2.3倍高速化しつつ成功率を維持した。
- ロボット運動制御における時変二次計画法のための厳密な事前定義時間収束・耐雑音分数階ゼロ化ニューラルネットワーク運動制御/ニューラルネットワーク2025/3/1
ロボットの運動制御で生じる時変二次計画問題を解くため、雑音に強く、あらかじめ定めた時間で厳密に収束する分数階ゼロ化ニューラルネットワークを提案し、シミュレーションと実機で有効性を示した。
- 知覚不確かさ下での安全な適応クルーズコントロール:深層アンサンブルとConformal Tubeモデル予測制御によるアプローチ適応クルーズコントロール2024/12/1
RGB画像から深層アンサンブルとConformal Predictionで不確かさを推定し、Conformal Tubeモデル予測制御で適応クルーズコントロールの確率的な安全性を確保する手法を提案した。
- FASTNav: マルチポイントロボットナビゲーション向けに微調整した適応型小型言語モデルナビゲーション2024/11/1
小型言語モデルを微調整と教師-生徒反復で強化し、エッジデバイス上で低コスト・高精度・低遅延に動作する言語誘導型マルチポイントロボットナビゲーション手法を提案した。
- NeuroVE: スパイキングニューラルネットワークによる脳に着想を得た線形・角速度推定VLA2024/8/1
イベントカメラとスパイキングニューラルネットワーク(SNN)を組み合わせ、脳の空間細胞の機能を模倣してロボットの自己速度を高精度に推定するフレームワークを提案。
- 知覚の不確かさを考慮した自動運転:ディープアンサンブルに基づく適応クルーズコントロール自動運転/知覚/MPC2024/3/1
ディープアンサンブルで車間距離の予測不確かさを推定し、確率的安全性を保証する適応クルーズコントロールを開発した。
- System-level Safety Guard: Safe Tracking Control through Uncertain Neural Network Dynamics Models2023/12/1
- Decision-Making for Autonomous Vehicles with Interaction-Aware Behavioral Prediction and Social-Attention Neural Network2023/10/1
- Interaction-Aware Decision-Making for Autonomous Vehicles in Forced Merging Scenario Leveraging Social Psychology Factors2023/9/1
- Spatio-Temporal Calibration for Omni-Directional Vehicle-Mounted Event Cameras2023/7/1
- Multi-Abstractive Neural Controller: An Efficient Hierarchical Control Architecture for Interactive Driving2023/5/1
- BarrierNet: A Safety-Guaranteed Layer for Neural Networks2021/11/1
- Set-theoretic Localization for Mobile Robots with Infrastructure-based Sensing2021/10/1
- SeanNet: Semantic Understanding Network for Localization Under Object Dynamics2021/10/1
- The Logical Options Framework2021/2/1
- Comfort-Centered Design of a Lightweight and Backdrivable Knee Exoskeleton2019/2/1
- Reinforcement Learning With Temporal Logic Rewards2016/12/1