Jiaxing Zhang
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAVLA/データ収集/空間汎化セマンティック通信/3D再構成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AtomEgo: 一人称視点ロボット統合による身体性基盤モデル事前学習の探求VLA2026/9/18
約2,659時間の一人称視点人間データとロボットデータを組み合わせ、身体性基盤モデルの事前学習における効果的な統合手法を体系的に検討した研究。
- 動く目:ハイブリッド動的データ収集によるVLAの空間汎化の強化VLA/データ収集/空間汎化2026/7/1
視覚言語行動モデルの空間汎化を改善するため、固定・多固定・移動視点を組み合わせたハイブリッドデータ収集戦略を提案し、疑似相関を減らして未見のカメラ位置や物体配置への汎化を実現した。
- PVI: 視覚言語行動モデルのためのプラグイン型視覚注入VLA2026/3/1
事前学習済みの視覚言語モデルと行動エキスパートを組み合わせたVLAアーキテクチャに対し、軽量でエンコーダ非依存のモジュールを追加し、時間的視覚特徴を注入することで性能を向上させる手法を提案した。
- 限られたリソースのモバイル端末によるリアルタイム3D再構成のためのセマンティック通信システムセマンティック通信/3D再構成2024/12/1
クラウド・エッジ協調とセマンティック通信を活用し、低リソースのモバイル端末でもリアルタイムに3Dセマンティックマッピングを実現する符号化・復号フレームワークと、チャネル状況に応じて安定伝送を可能にするアテンション機構を提案した。