Chengjie Zhang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション模倣学習空間推論音響センシング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- テキスト・視覚相乗トークンキャッシュ:効率的なVLA推論のための学習不要フレームワークVLA2026/9/28
VLAモデルの推論を高速化するため、テキストと視覚の相乗効果を利用して注意ヘッドを選別し、キャッシュ再利用層を選択する学習不要のトークンキャッシュ手法を提案。
- GCNGrasp-VP: アフォーダンス誘導による視点計画を用いた効率的なタスク指向把持マニピュレーション2026/6/1
オクルージョンによるタスク指向把持の性能低下を解決するため、アフォーダンス場の予測と能動的な視点計画を統合したフレームワークを提案。シーン再構成を不要とし、1回の視点調整で高精度な把持を実現する。
- VLAConf: 視覚言語行動モデルのための校正されたタスク成功信頼度VLA2026/5/1
VLAモデルのタスク成功確率を、軽量な信頼度ヘッドで単一フォワードパス推定する手法を提案。既存手法より高速で、連続行動空間にも適用可能。
- Easy-IIL: アシスタント専門家による対話型模倣学習の人間の操作負担軽減模倣学習2026/3/1
対話型模倣学習において、モデルベースの模倣手法をアシスタント専門家として活用し、人間の介入を最小限に抑えつつ性能を維持するフレームワークを提案した。
- Meta-Memory: ロボットの空間推論のための意味・空間記憶の検索と統合空間推論2025/9/1
LLM駆動エージェントが環境の高密度記憶を構築し、自然言語の位置質問に対して意味と空間の記憶を統合して応答する手法を提案。SpaceLocQAデータセットを導入し、実機でも検証した。
- ハイブリッドTDOAを用いた複数非同期マイクロホンアレイのキャリブレーション音響センシング2025/2/1
複数の非同期マイクロホンアレイのキャリブレーション精度を向上させるため、アレイ間のTDOAと隣接音イベント間のTDOAを組み合わせた2段階手法を提案し、シミュレーションと実験で有効性を示した。