Lijun Wang
Dalian University of Technology
収録論文 8本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CARE: 経験に基づく原子的修正実行によるVision-Language-Actionポリシーの回復VLA2026/9/21
VLAポリシーの失敗ロールアウトから段階別の失敗分布を学習し、推論時に3Dモニタリングで原子的な修正動作をトリガーすることで、ロボット操作の回復性能を向上させるフレームワーク。
- 明示的な軌道なしで先読みを学習する3D拡散ポリシーVLA2026/9/17
短い観察履歴から相互作用の進展を潜在表現で先読みし、拡散ポリシーの行動生成を導く手法を提案。パラメータを3.52%増やすだけで複数ベンチマークで性能を大幅改善。
- VA-Bench:視覚実演・能動的知覚・メートル制御による身体性空間知能の評価VLA2026/9/17
RGB実演から手順を学び、カメラ視点を能動的に選び、メートル単位の動作指令を出してフィードバックで修正する「観察-推論-行動-修正」ループを評価するベンチマークVA-Benchを提案。最良モデルでもタスク成功率は約54%にとどまることを示した。
- Attention-DP3: 幾何整合型注意条件付けによる空間的物体認識3D拡散ポリシーマニピュレーション2026/9/10
RGB画像から対象物体をセグメンテーションして3D点群に持ち上げ、物体レベルの幾何的手がかりを注意機構で拡散ポリシーに注入することで、 clutter の多い操作シーンでも安定して対象を操作できるようにした手法。
- MA-VLA: 協調と構成的汎化のためのマルチアーム視覚言語行動モデルVLA2026/8/26
複数アームの協調動作をアトミックな行動割り当てで分解し、訓練時にアームの役割をシャッフルすることで、未見の協調パターンへの汎化を実現するVLAモデルを提案した。
- 予測から計画へ:協調的な状態行動予測のためのポリシーワールドモデル自動運転/世界モデル2025/10/1
運転の世界モデルと軌道計画を単一アーキテクチャに統合し、行動に依存しない未来状態予測を通じて計画を改善するPWMを提案。フロントカメラのみでマルチビュー・マルチモーダル手法に匹敵する性能を達成。
- SR-SLAM: 多様な環境におけるシーン信頼性に基づくRGB-D SLAMSLAM2025/9/1
環境ごとの特徴量の質と量の変動に対応するため、シーン信頼性評価を導入し、動的特徴除去や姿勢推定を適応的に行うRGB-D SLAM手法を提案した。
- 高速安定性検証と安定再配置計画によるオンライン3Dビンパッキングマニピュレーション2025/7/1
オンラインビンパッキングにおいて、荷崩れしない安定配置を効率的に判定するLBCPと、既存アイテムを安全に再配置するSRPを組み合わせ、強化学習方策に安定性保証と再構成能力を付与したフレームワークを提案。