Zaibin Zhang
Dalian University of Technology
収録論文 7本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 双腕VLAモデルにおける腕ごとの組合せ的一般化VLA2026/10/5
双腕ロボットの協調を「腕ごとの基本スキルの再構成」として評価するベンチマークACG-Benchを提案し、スキル特化LoRAと腕別アテンションを組み合わせたAE-VLAで汎化性能を大幅に改善した。
- CARE: 経験に基づく原子的修正実行によるVision-Language-Actionポリシーの回復VLA2026/9/21
VLAポリシーの失敗ロールアウトから段階別の失敗分布を学習し、推論時に3Dモニタリングで原子的な修正動作をトリガーすることで、ロボット操作の回復性能を向上させるフレームワーク。
- 明示的な軌道なしで先読みを学習する3D拡散ポリシーVLA2026/9/17
短い観察履歴から相互作用の進展を潜在表現で先読みし、拡散ポリシーの行動生成を導く手法を提案。パラメータを3.52%増やすだけで複数ベンチマークで性能を大幅改善。
- VA-Bench:視覚実演・能動的知覚・メートル制御による身体性空間知能の評価VLA2026/9/17
RGB実演から手順を学び、カメラ視点を能動的に選び、メートル単位の動作指令を出してフィードバックで修正する「観察-推論-行動-修正」ループを評価するベンチマークVA-Benchを提案。最良モデルでもタスク成功率は約54%にとどまることを示した。
- Attention-DP3: 幾何整合型注意条件付けによる空間的物体認識3D拡散ポリシーマニピュレーション2026/9/10
RGB画像から対象物体をセグメンテーションして3D点群に持ち上げ、物体レベルの幾何的手がかりを注意機構で拡散ポリシーに注入することで、 clutter の多い操作シーンでも安定して対象を操作できるようにした手法。
- MA-VLA: 協調と構成的汎化のためのマルチアーム視覚言語行動モデルVLA2026/8/26
複数アームの協調動作をアトミックな行動割り当てで分解し、訓練時にアームの役割をシャッフルすることで、未見の協調パターンへの汎化を実現するVLAモデルを提案した。
- CoEnv: 構成環境による身体化マルチエージェント協調の推進マルチエージェント協調2026/4/1
実世界とシミュレーションを統合した構成環境を導入し、複数ロボットが協調して複雑な操作タスクを安全に実行するフレームワークCoEnvを提案した。