Yu Li
収録論文 22本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboFFT:順過程を用いたオンライン強化学習による生成ロボット方策のファインチューニングVLA2026/9/26
生成モデルベースの方策を、順過程ノイズ付加とスコアマッチング損失でPPO的にファインチューニングする手法を提案し、模倣学習の限界を強化学習で改善する。
- MIRA: 身体性を備えたコンパニオン向けリアルタイム全二重ヒューマンロボットインタラクションヒューマンロボットインタラクション2026/9/21
ストリーミング音声から応答と身体動作を同時生成し、割り込み可能な動作をリアルタイムで実行する全二重対話フレームワークを提案し、ヒューマノイドロボットに実装した。
- TryOnCrafter: レンダリング可能な4D試着プロキシによるカメラ軌道を活用した現実的なビデオ仮想試着仮想試着2026/6/24
従来のビデオ仮想試着はカメラ軌道に依存していたが、任意のカメラ移動に対応できる新しいタスクCaM-VVTを定義し、4D試着プロキシとDiTベースのフレームワークで解決する。
- 周波数認識フローマッチングによる連続かつ一貫したロボット動作生成動作生成2026/6/1
離散的な動作チャンクに依存せず、周波数領域でフローマッチングを行うことで、異なる制御周波数や時間的不整合に頑健な連続動作を生成する手法を提案した。
- データ効率的なロボット操作のためのマルチモーダル軌道ポリシー学習マニピュレーション2026/6/1
視覚と言語と軌道の異種モダリティをMoEで分離し、クロスモーダルコサインルーターで安定した専門家割り当てを実現する軌道予測フレームワークMATEを提案し、データ不足時の成功率を向上させた。
- 光の相互作用:インタラクティブビデオワールドモデルのための学習不要推論高速化推論高速化2026/5/29
インタラクティブなビデオワールドモデルの推論を高速化する、学習不要のフレームワークを提案。適応的なコンテキスト管理とキャッシュ、スパースアテンションにより最大2.59倍の高速化を実現。
- Afford-VLA: 内在化されたアフォーダンスによる行動整合的な視覚プランニングVLA2026/5/1
VLAモデルにタスク条件付きアフォーダンスを内部生成・利用する視覚プランニング機構を導入し、行動予測と密結合させることで操作性能を向上させた。
- 視覚障害者向けナビゲーション支援におけるVLMの活用可能性の探求視覚言語モデル/ナビゲーション支援2026/3/1
視覚障害者(pBLV)のナビゲーション支援における視覚言語モデル(VLM)の性能を、閉域・オープンソースモデルを比較評価し、空間推論やシーン理解の課題と可能性を明らかにした。
- 自己巻き付きを考慮したケーブル牽引平面物体操作の軌道最適化マニピュレーション2026/3/1
ケーブルが物体に自己巻き付きする状況を考慮し、張力の有無を暗黙的に扱う軌道最適化手法を提案。緩和階層を構築し、自己巻き付きを状態発展として誘導する手法が有効であることを示した。
- 長時間ロボット卓上ゲームにおける内部状態整合性を維持するシステム設計システム設計2026/3/1
ロボットによる長時間の卓上ゲーム(麻雀)で、知覚や実行の小さな誤りが状態を破壊する問題に対し、状態を明示的に分離・監視し、触覚トリガーによる回復機構を備えた統合アーキテクチャを提案・実証した。
- Prompt2Auto: 動作プロンプトから幾何不変ワンショットガウス過程学習による自動制御へ模倣学習2025/9/1
単一の人間の動作プロンプトから、並進・回転・スケーリングに不変なワンショットガウス過程学習(GeoGP)を用いてロボットの自動制御を実現するフレームワークを提案し、実機実験で有効性を示した。
- 手術ロボットにおけるRCM制約に整合した動的制御マニピュレーション2025/9/1
遠隔運動中心(RCM)制約をトルクレベルで厳密に扱う投影型逆動力学制御を提案し、トロカール移動や人間との相互作用下でもRCM誤差とトルクの滑らかさを改善した。
- 基盤モデルの推論とパーツグラウンディングによる適応的な関節物体操作マニピュレーション2025/7/1
基盤モデルを活用して関節物体をパーツ単位で認識し、そのアフォーダンスからプリミティブスキルを組み合わせて未知カテゴリの物体も操作できるフレームワークAdaRPGを提案した。
- 把持不能物体に対する外的手先による巧みな非把持マニピュレーションマニピュレーション2025/3/1
強化学習を用いて、把持できない大きな物体を机の端や壁へ移動させてから掴む戦略を学習するロボットハンドシステムExDexを提案し、実機へのゼロショット転移も実証した。
- RetrDex: 多指ハンドによる散らかった環境での効率的な物体取り出しマニピュレーション2025/2/1
散らかった環境で目標物体を取り出すため、大規模並列強化学習と遮蔽状況を考慮した空間表現を用い、押す・かき混ぜる・突くなどの多様な操作を学習する枠組みを提案し、実機へのゼロショット転移も示した。
- AdaManip: 適応的な関節物体操作環境と方策学習マニピュレーション2025/2/1
鍵やドアなど内部状態が見えない関節物体を試行錯誤で操作するための新しいシミュレーション環境と、3D視覚拡散を用いた模倣学習による適応方策を提案した。
- どこから取るか:大規模事前学習モデルによるロボット目標ナビゲーションのための視覚シーン表現抽出目標ナビゲーション2024/8/1
大規模視覚言語モデルで環境の特徴表現を構築し、言語モデルと組み合わせて指示を行動列に変換することで、ロボットが複雑な目標ナビゲーションを遂行できる手法を提案した。
- UniDoorManip:大規模多様ドア操作環境における汎用ドア操作ポリシーの学習マニピュレーション2024/3/1
多様なドアを操作するための大規模データセットとモバイルロボット・部分点群観測を含む新環境を構築し、操作過程を3段階に分解して推論と逆順に学習する汎用ポリシーを提案した。
- 粗から細へのアフォーダンス学習による点群ノイズに頑健な関節物体操作マニピュレーション2024/2/1
実世界の点群ノイズに対処するため、遠距離の粗い点群で操作箇所を推定し、近距離の精細な点群で最終動作を決定する2段階のアフォーダンス学習手法を提案した。
- FishDreamer: Towards Fisheye Semantic Completion via Unified Image Outpainting and Segmentation2023/3/1
- A Simulation Study of Passing Drivers' Responses to the Autonomous Truck-Mounted Attenuator System in Road Maintenance2022/8/1
- A Virtual Reality-based Training and Assessment System for Bridge Inspectors with an Assistant Drone2021/9/1