Li Sun
Beijing University of Posts and Telecommunications
収録論文 27本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 見えなくなっても、そこにある:大規模視覚言語モデルにおける圧縮起因リスクの露呈VLA2026/9/28
視覚トークン圧縮が引き起こす敵対的失敗を「圧縮特異的失敗」として定義し、それを誘発する攻撃手法CIRAを提案した研究。
- DexHoldem: 巧みな身体システムによるテキサス・ホールデムのプレイ操作/ベンチマーク2026/5/1
実世界の巧みな操作システムを評価するためのベンチマークDexHoldemを提案。ShadowHandを用いたテキサス・ホールデムの操作プリミティブの実行と、エージェントがゲーム状態を認識する能力を評価する。
- PACT: 人間とロボットの協調作業における継続的タスク支援のためのプロアクティブな質問人間ロボット協調2026/5/1
ロボットが長期の人間との協調作業で、過去の対話履歴を活用しつつ、行動前に質問すべきか行動すべきかを判断する「ask-or-act」フレームワークを提案し、支援精度と質問頻度のトレードオフを評価した。
- VVLoc: 事前情報不要の3自由度車両ビジュアルローカリゼーション自動運転/位置推定2026/2/1
単一のニューラルネットワークとマルチカメラ映像から、車両のトポロジカル位置推定とメトリック位置推定を同時に行い、信頼度も算出する手法を提案。
- GenDexHand:多指ハンドのための生成的シミュレーションマニピュレーション2025/11/1
VLMのフィードバックで物体配置を調整する閉ループ生成により、多指ハンド操作用の多様なタスクと環境を自動生成し、サブタスク分解で強化学習の効率と成功率を高める手法を提案。
- HiMaCon: ラベルなしマルチモーダルデータからの階層的マニピュレーション概念の発見マニピュレーション2025/10/1
クロスモーダルな相関と複数時間スケールの予測を組み合わせ、人手アノテーションなしで階層的な操作概念を自己教師あり学習するフレームワークを提案。シミュレーションと実機で性能向上を示し、獲得概念が人間に解釈可能な操作プリミティブに似ることを明らかにした。
- HyperTASR: ハイパーネットワーク駆動のタスク認識型シーン表現によるロバストなマニピュレーションマニピュレーション2025/8/1
ハイパーネットワークを用いてタスク目標と実行段階に応じてシーン表現を動的に変換し、ロボットマニピュレーションの性能を向上させるフレームワークを提案。
- IRL-VLA:逆強化学習報酬ワールドモデルによる視覚言語行動ポリシーの訓練VLA2025/8/1
逆強化学習で軽量な報酬ワールドモデルを構築し、PPOによる閉ループ強化学習でVLAポリシーを訓練する手法を提案。NAVSIM v2ベンチマークで最先端性能を達成。
- 自動運転車のための運動予測:サーベイ運動予測2025/2/1
自動運転車の意思決定に不可欠な交通参加者の将来行動予測について、問題定式化・課題・データセット・評価指標を整理し、教師あり学習と自己教師あり学習の研究を分類して展望を論じたサーベイ論文。
- Angle Robustness Unmanned Aerial Vehicle Navigation in GNSS-Denied Scenarios2024/2/1
- NDT-Map-Code: A 3D global descriptor for real-time loop closure detection in lidar SLAM2023/7/1
- Towards Long-term Autonomy: A Perspective from Robot Learning2022/12/1
- 3D ToF LiDAR in Mobile Robotics: A Review2022/2/1
- EventPoint: Self-Supervised Interest Point Detection and Description for Event-based Camera2021/9/1
- NDT-Transformer: Large-Scale 3D Point Cloud Localisation using the Normal Distribution Transform Representation2021/3/1
- Introspective Visuomotor Control: Exploiting Uncertainty in Deep Visuomotor Control for Failure Recovery2021/3/1
- Localising Faster: Efficient and precise lidar-based robot localisation in large-scale environments2020/3/1
- EU Long-term Dataset with Multiple Sensors for Autonomous Driving2019/9/1
- EPANer Team Description Paper for World Robot Challenge 20202019/9/1
- Imagine That! Leveraging Emergent Affordances for 3D Tool Synthesis2019/9/1
- End-to-end Recurrent Multi-Object Tracking and Trajectory Prediction with Relational Reasoning2019/7/1
- Recurrent-OctoMap: Learning State-based Map Refinement for Long-Term Semantic Mapping with 3D-Lidar Data2018/7/1
- Learning monocular visual odometry with dense 3D mapping from dense 3D flow2018/3/1
- Multisensor Online Transfer Learning for 3D LiDAR-based Human Detection with a Mobile Robot2018/1/1
- 3DOF Pedestrian Trajectory Prediction Learned from Long-Term Autonomous Mobile Robot Deployment Data2017/10/1
- Single-Shot Clothing Category Recognition in Free-Configurations with Application to Autonomous Clothes Sorting2017/7/1
- Robot Vision Architecture for Autonomous Clothes Manipulation2016/10/1