Zanjia Tong
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション3D再構成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- テキスト・視覚相乗トークンキャッシュ:効率的なVLA推論のための学習不要フレームワークVLA2026/9/28
VLAモデルの推論を高速化するため、テキストと視覚の相乗効果を利用して注意ヘッドを選別し、キャッシュ再利用層を選択する学習不要のトークンキャッシュ手法を提案。
- GCNGrasp-VP: アフォーダンス誘導による視点計画を用いた効率的なタスク指向把持マニピュレーション2026/6/1
オクルージョンによるタスク指向把持の性能低下を解決するため、アフォーダンス場の予測と能動的な視点計画を統合したフレームワークを提案。シーン再構成を不要とし、1回の視点調整で高精度な把持を実現する。
- 単一視点メッシュ再構成はロボットカメラの回転に汎化できるか?3D再構成2026/6/1
ロボット搭載カメラの回転が単一視点メッシュ再構成の性能に与える影響を評価し、回転による深度推定の歪みやレイアウトずれを明らかにした。重力情報を活用した改良によりレイアウト誤差を47.1%削減できることを示した。