Zixin Zhang
収録論文 9本 ・ フィジカルAI/ロボット学習
空間推論親和性予測アフォーダンス推論VLA制御/モデルベースRL状態推定歩行
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OmniCoT:グローバルかつ多段階のパノラマ推論のためのベンチマーク空間推論2026/6/29
パノラマ画像におけるマルチモーダル大規模言語モデルの空間推論能力を評価・向上させるため、グローバルな証拠と多段階推論に焦点を当てたベンチマークOmniCoTを提案し、訓練データと評価データを整備した。
- パノラマ親和性予測親和性予測2026/3/1
360度画像を用いた親和性予測の新タスクを提案し、大規模データセットPAP-12Kと訓練不要のパイプラインPAPを導入した。
- A4-Agent: ゼロショットアフォーダンス推論のためのエージェントフレームワークアフォーダンス推論2025/12/1
訓練不要のエージェント型フレームワークで、生成モデル・視覚言語モデル・視覚基盤モデルを組み合わせ、言語指示に基づく物体のアフォーダンス領域をゼロショットで推論する。
- PhysToolBench:マルチモーダル大規模言語モデルの物理ツール理解を評価するベンチマークVLA2025/10/1
MLLMが物理ツールをどれだけ理解しているかを評価する初のVQAベンチマークを構築し、32モデルを評価した結果、ツール理解に大きな欠陥があることを明らかにした。
- リアルタイム再帰的モデル更新によるサンプル効率の高いオンライン制御方策学習制御/モデルベースRL2025/9/1
クープマン理論に基づき、データセットサイズに依存しない軽量な再帰的モデル更新でオンライン制御方策を学習する手法を提案し、従来の10%以下のデータで同等性能を実現した。
- 脚式ロボットのためのマルチIMUセンサフュージョン状態推定2025/7/1
脚式ロボットの複数リンクに搭載した低コストIMUと関節エンコーダ、カメラを拡張カルマンフィルタと因子グラフで融合し、着地衝撃や足滑りがあっても低ドリフトな姿勢・速度推定を実現した。
- 姿勢を持つロボット:敏捷な脚式ロボットのための特異点のないクォータニオンベースのモデル予測制御歩行2024/9/1
脚式ロボットの姿勢表現にクォータニオンを用い、大角度回転時の特異点を回避するモデル予測制御フレームワークを提案。iLQRを拡張し、四足歩行ロボットとヒューマノイドで性能と計算効率を実証した。
- Cerberus: Low-Drift Visual-Inertial-Leg Odometry For Agile Locomotion2022/9/1
- Design of an Optoelectronically Innervated Gripper for Rigid-Soft Interactive Grasping2020/12/1