Yuan Li
収録論文 8本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 潜在ブリッジ:デュアルシステム視覚言語行動モデルの効率的推論のための特徴デルタ予測VLA/推論高速化2026/5/1
高コストなVLMバックボーンの呼び出しを間引いても行動精度を保つため、時間ステップ間のVLM出力差分を予測する軽量モデルを提案し、複数のVLAアーキテクチャで有効性を示した。
- VehicleWorld: 車載エージェントのための統合マルチデバイス環境VLA2025/9/1
車載システム向けに30モジュール・250 APIを備えた実行可能な環境を構築し、状態を明示的に扱うState-based Function Callを提案して従来手法より高精度・低遅延を実現した。
- 建設・鉱業におけるコンピュータビジョン支援ロボットアームによる骨材の自律選別マニピュレーション2025/9/1
6自由度ロボットアームとステレオカメラを組み合わせ、注意機構付きYOLOv8で骨材を検出・3D位置推定し、自律的に把持・選別するシステムを構築した。4種類の骨材で平均97.5%の選別成功率を達成した。
- 高速道路合流部における異種車両の先制的時空間軌道調整合流制御2025/9/1
合流部での知覚遅れと時空間資源の利用効率を改善するため、車種・意図・安全時空間距離を統合した自動運転車の協調合流制御戦略を提案し、シミュレーションで平均遅延の大幅な改善を実証した。
- 7自由度ロボットマニピュレータに適用した身体性ニューロモーフィック制御マニピュレーション2025/4/1
スパイキングニューラルネットワークを用いて7自由度ロボットアームの逆動力学を学習し、手動パラメータ調整なしでトルク予測誤差を60%以上削減、目標位置追従を実現した。
- VLABench: 長期的推論を伴う言語条件付きロボット操作のための大規模ベンチマークVLA2024/12/1
視覚言語行動モデル(VLA)向けに、世界知識や意図理解、多段階推論を要する100カテゴリ・2000以上の物体からなる言語条件付き操作タスクのベンチマークを構築した。
- VLMimic: 視覚言語モデルによる細粒度動作の視覚的模倣学習模倣学習2024/10/1
少数の人間動画から、視覚言語モデルを用いて細かい動作レベルまで直接学習し、ロボットの模倣学習を効率化する手法を提案。
- FACT: ビジョンベースドローン群のための高速で能動的な座標初期化群制御2024/3/1
ステレオカメラとIMUのみを搭載したドローン群が、その場で回転しながら観測を行い、SDPとハンガリアン法で相対姿勢をリアルタイムに復元するシステムを提案した。