Pengteng Li
The Hong Kong University of Science and Technology (Guangzhou)
収録論文 8本 ・ フィジカルAI/ロボット学習
VLA模倣学習継続学習/VLAマニピュレーション時空間超解像
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚言語行動モデルは自己受容状態をどう使うべきかVLA2026/8/1
VLAモデルにおけるロボットの自己受容状態の入力方法(テキスト、プレフィックス、直接入力など)と履歴長が性能に与える影響を、制御実験で体系的に比較し、設計原則を導出した論文。
- 介入可能なマルチモーダル模倣のためのソースリフトフローマッチング模倣学習2026/7/1
フローマッチングポリシーに介入可能なハンドルを導入し、ユーザーが同じ状態から複数の有効な行動を選択できるようにする手法を提案した。
- PHASER: 位相認識と意味的経験再生による視覚言語行動モデルの継続学習継続学習/VLA2026/6/2
視覚言語行動モデルの継続学習における破滅的忘却を防ぐため、操作軌道の位相(サブスキル)に注目した経験再生手法PHASERを提案。位相ごとのメモリ割り当てと忘却リスクに基づく動的優先付けで、LIBEROベンチマークで最大31%の成功率向上を達成した。
- 視覚言語行動モデルにおける視野外操作のための空間記憶VLA2026/5/1
視覚言語行動モデルに、可動カメラの多視点観測から構築した空間記憶を組み込み、視野外の物体操作を可能にするフレームワークSOMAを提案した。
- 脳に着想を得た身体性知能による流動的で高速な反射的ロボティクス制御VLA2026/1/1
皮質・小脳・脊髄の構造を模したニューロモーフィックVLAを実機ロボットに初めて実装し、腕の振動抑制や20ms未満の安全反射、時間記憶を実現した。
- 回転同変なボリュメトリック把持モデルマニピュレーション2025/7/1
垂直軸周りの回転に同変なトリプレーン特徴表現を導入し、GIGAやIGDといった把持プランナを同変化することで、計算・メモリコストを抑えつつ把持性能を向上させた。
- HR-INR: イベントカメラによる連続時空間ビデオ超解像時空間超解像2024/5/1
イベントカメラを活用し、任意のスケールで動画の解像度とフレームレートを同時に向上させる連続時空間ビデオ超解像フレームワークを提案。
- Robot Trajectron: Trajectory Prediction-based Shared Control for Robot Manipulation2024/2/1