Kun Li
Tsinghua University
収録論文 24本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 適応的中间状態による効率的なWorld Action Model推論VLA2026/9/28
World Action Modelの推論を、軌道リマッピング・観測リバインディング・残差リスケーリングで高速化する学習不要フレームワークを提案。
- 離散VLAモデルによるヒューマノイドの移動操作VLA2026/9/28
ヒューマノイドの全身動作を部位ごとの離散トークンに分解し、言語モデルの語彙を拡張して学習・リアルタイム制御を可能にしたVLAモデルHolo-Mを提案。
- Zeva-Ego: 一人称視点動画の中間学習と文脈内因果学習によるロボットマニピュレーションVLA2026/9/21
一人称視点の人間動画から行動中心の監督信号を作りVLAモデルを中間学習させ、さらに展開時に行動と結果のフィードバックからパラメータ更新なしで適応する枠組みを提案。
- Zeva: 文脈内因果学習による汎用身体操作の実現マニピュレーション2026/8/31
ロボットが実環境での物理的相互作用からその場で学習し、その知識を次の行動に活かすフレームワークZevaを提案。ポリシーモデルを凍結したまま、因果相互作用抽出器と二重タイムスケールの因果メモリを用いて、実行した行動と状態変化を符号化し、後の行動の文脈として注入する。シミュレーションと実機操作で最先端のVLAやWAMを上回る性能を示し、勾配更新なしで自己進化を実現。
- Zetta ζ: 自己進化する物理知能のための効率的な閉ループ具現化ハーネス具現化エージェント/自己進化2026/8/17
ロボットの実行中にコードベースの批評家と回復スキルをオンラインで進化させる閉ループハーネスを提案し、LIBERO-ProとRoboCasaで高い成功率と高速化を達成した。
- EgoPriMo: 対話型ヒューマノイド制御のための自己中心視点動作生成ヒューマノイド制御2026/6/7
自己中心視点の人間デモから全身動作の事前分布を学習し、テキスト指示に基づいて動作の再構築・生成・予測を行う統一フレームワークを提案した。
- ActProbe: 生成ロボットポリシーの早期故障検出のためのアクション空間プローブ故障検出2026/6/1
生成ロボットポリシーの出力するアクション列自体に故障予兆が含まれることを利用し、軽量なアクション空間のみの検出器ActProbeを提案。故障を視覚的に認識される前に検出し、F1-即時性のトレードオフを改善する。
- MemCompiler: コンパイルする、注入しない -- 身体化エージェントのための状態条件付きメモリ身体化エージェント/メモリ管理2026/5/1
エージェントの現在の状態に応じて関連メモリのみを動的に選択・コンパイルするメモリシステムを提案し、静的メモリ注入を上回る性能と低遅延を実現した。
- Dexora: 高自由度両腕巧緻操作のためのオープンソースVLAVLA/操作2026/5/1
両腕・両手の高自由度操作を対象とした初のオープンソースVLAシステムDexoraを提案し、ハイブリッド遠隔操作とデータ品質を考慮した学習手法により、巧緻操作の成功率を大幅に向上させた。
- DiffAD: 自動運転のための統合拡散モデリング手法自動運転2025/3/1
自動運転の知覚・予測・計画を拡散確率モデルで統合し、BEV画像生成として扱うことでタスク調整を改善した手法。
- Realm: 未知障害物環境におけるマルチロボットナビゲーションのためのリアルタイム見通し維持群制御2025/2/1
未知環境で複数ロボットが互いの見通し(LoS)を保ちながら協調移動するため、リアルタイム点群からLoS制約を直接導出し、接続性を維持する制御フレームワークを提案した論文。
- スケーラブルな生成モデルによる動作計画タスクの解決自動運転2024/7/1
運転シーンのダイナミクスを学習する生成モデルを提案し、シミュレーション・計画・オンライン学習に活用できることを示した。
- FusionAD: Multi-modality Fusion for Prediction and Planning Tasks of Autonomous Driving2023/8/1
- Imitation with Spatial-Temporal Heatmap: 2nd Place Solution for NuPlan Challenge2023/6/1
- ClusterFusion: Real-time Relative Positioning and Dense Reconstruction for UAV Cluster2023/4/1
- HybridFusion: LiDAR and Vision Cross-Source Point Cloud Fusion2023/4/1
- Accurate 3D Localization for MAV Swarms by UWB and IMU Fusion2018/7/1
- A Function Approximation Method for Model-based High-Dimensional Inverse Reinforcement Learning2017/8/1
- Bellman Gradient Iteration for Inverse Reinforcement Learning2017/7/1
- Clinical Patient Tracking in the Presence of Transient and Permanent Occlusions via Geodesic Feature2017/7/1
- Online Inverse Reinforcement Learning via Bellman Gradient Iteration2017/7/1
- Inverse Reinforcement Learning in Large State Spaces via Function Approximation2017/7/1
- Object Structure from Manipulation via Particle Filter and Robot-based Active Learning2014/8/1
- Inverse Reinforcement Learning with Multi-Relational Chains for Robot-Centered Smart Home2014/8/1