Miao Zhang
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション3D物体検出3D物体検出/ドメインシフト
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ATI-VLA: 行動中心の予測型視覚-言語-行動モデルVLA2026/10/1
予測観測と行動の表現を共有コードブックで揃え、予測潜在を行動生成に適応的に注入することで、操作タスクの性能と収束速度を向上させたVLAモデル。
- 皮質ポリシー:ロボット操作のための二重ストリームビュートランスフォーマーマニピュレーション2026/3/1
静的視点と動的視点の二つのストリームを統合するビュートランスフォーマーを提案し、3D空間理解と動的適応を向上させてロボット操作の性能を大幅に改善した。
- クラス対応PillarMix:混合サンプルデータ拡張はレーダーポイントクラウドによる3D物体検出を強化できるか?3D物体検出2025/3/1
レーダーポイントクラウドに混合サンプルデータ拡張を適用する際の課題を分析し、ピラー単位でクラスごとに混合比率を変える新手法CAPMixを提案した論文。
- 多様な環境条件下におけるレーダー3D物体検出のドメインシフト調査3D物体検出/ドメインシフト2024/8/1
4Dレーダーを用いた3D物体検出において、天候や道路種別の変化が性能に与えるドメインシフトを初めて体系的に分析し、データ収集戦略への示唆を示した。
- GAgent: 複雑な照明環境に対応する視覚言語モデル搭載の適応型剛軟把持エージェントマニピュレーション2024/3/1
VLMエージェントによる認知と可変剛性ソフトグリッパを組み合わせ、厳しい照明下でも物体や材質を認識して把持領域を推定する把持エージェントを提案した。