Jiaxin Huang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA遠隔操作マニピュレーション3D空間推論
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- KineVLA: 運動学を考慮した視覚言語行動モデルと二段階行動分解VLA2026/3/1
言語指示に運動学的属性(方向、軌道、姿勢、相対変位など)を細かく組み込んだ新しいVLAタスクを提案し、目標の不変性と運動学的可変性を分離する二段階行動表現と推論トークンを持つKineVLAフレームワークを導入した。シミュレーションと実機で精度・制御性・汎化性が向上することを示した。
- RoboMatch: 長期的タスクのための自動マッチングネットワークを備えた統合型移動マニピュレーション遠隔操作プラットフォーム遠隔操作2025/9/1
移動ベースと双腕を同期操作できるコックピット型遠隔操作インターフェースと、長期的タスクを分解して軽量モデルを動的に割り当てる自動マッチングネットワークを提案し、データ収集効率やタスク成功率を向上させた。
- FEWT: 周波数強調ウェーブレットベースTransformerによるマルチモーダル車輪型双腕マニピュレーションマニピュレーション2025/9/1
車輪型双腕ロボットの遠隔操作データを用いた模倣学習において、周波数強調とウェーブレット変換で視覚特徴と高周波物理ダイナミクスを整合させ、触覚センサも統合した軽量フレームワークFEWTを提案した。
- SURPRISE3D: 複雑な3Dシーンにおける空間理解と推論のためのデータセット3D空間推論2025/7/1
物体名に頼らず空間関係のみを問う20万件超の視覚言語ペアを構築し、3Dシーンでの空間推論を評価するベンチマークを提案した。
- 注意機構に基づくRGB-Dマルチモーダル融合を用いた効率的な双腕マニピュレーションマニピュレーション2024/4/1
RGB画像と深度画像を注意機構で融合するFocal CVAEを提案し、照明異常や遮蔽があっても双腕ロボットの操作精度と計算効率を向上させた。
- フラクタルグリッパー:モード切替可能な適応型マニピュレータマニピュレーション2024/2/1
フラクタル構造を応用し、受動的クランプ特性を保ちながら多関節劣駆動マニピュレータの把持能力を高める、モード切替可能なグリッパーを開発した。