Xuan Zhang
収録論文 10本 ・ フィジカルAI/ロボット学習
量子化ソフトロボティクス/グリッパーVLAナビゲーション世界モデルアフォーダンス
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Q-WAM: 行動サブスペース保護によるWorld Action Modelの4ビット量子化量子化2026/9/27
World Action Modelを4ビットに量子化する際、行動生成に重要なチャネルを低ランク16ビット枝で保護することで、精度をほぼ保ったまま計算・メモリコストを削減する手法を提案。
- 塑性変形による連続安定構造ソフトロボティクス/グリッパー2026/7/1
塑性変形を利用してエネルギー入力なしで連続的な形状を維持し、剛性を高めたソフトグリッパーを開発。静的・動的安定性を実現し、最大16Nの受動保持力や400m/s^2のパルス加速度下での安定性を実証した。
- Flash-WAM: モダリティ認識蒸留によるワールドアクションモデルの高速化VLA2026/6/3
ビデオとロボット動作を同時生成するワールドアクションモデルを、モダリティごとに適切な蒸留手法を適用して単一ステップ推論に圧縮し、リアルタイム制御を可能にした。
- IntentionNav: 暗黙的な人間の指示からの意図駆動型物体ナビゲーションのベンチマークナビゲーション2026/5/1
物体のカテゴリ名を直接与えず、人間の暗黙的な意図(例:「これを温めたい」)から目標物体を推論して探索する「意図駆動型物体ナビゲーション」のベンチマークを提案し、VLMを用いた評価を行った。
- 機械における人間の認知:世界モデルの統一的視点世界モデル2026/4/1
世界モデルの研究を認知機能の観点から分類し、人間のような認知能力を目指すための統一的枠組みを提案した論文。特に動機付けとメタ認知の研究不足を指摘し、今後の研究方向を示している。
- 3D-TAFS: 訓練不要の3Dアフォーダンスセグメンテーションフレームワークアフォーダンス2024/9/1
大規模マルチモーダルモデルと3D視覚ネットワークを組み合わせ、訓練なしで言語指示から3D物体のアフォーダンス領域を切り出す手法を提案し、屋内シーン向けベンチマークIndoorAfford-Benchも構築した。
- SATac: A Thermoluminescence Enabled Tactile Sensor for Concurrent Perception of Temperature, Pressure, and Shear2024/2/1
- Learning Neural Traffic Rules2023/12/1
- Attacking Vision-based Perception in End-to-End Autonomous Driving Models2019/10/1
- Simple Physical Adversarial Examples against End-to-End Autonomous Driving Models2019/3/1