Jiaqi Wang
Shanghai Innovation Institute
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FlexiWorld: 複数時間スケールにわたる柔軟なアクションチャンクによる学習と計画世界モデル/計画2026/9/28
可変長アクションチャンクと混合スパン目標監督を組み合わせたJEPAベースの世界モデルを提案し、長期的制御の成功率を向上させた。
- VLMエージェントによる文脈内ロボット学習VLA2026/9/16
商用VLMを活用し、デモやフィードバックから勾配更新なしでロボット行動を生成するGPT-Policyを提案。実機実験で人間のビデオデモがタスク完了率を向上させることを示した。
- 驚くほど単純なモダリティマスキングによる堅牢な両腕視覚言語行動モデルVLA/両腕操作2026/8/23
両腕ロボット操作のための視覚言語行動モデルの堅牢性を、トレーニング中にモダリティチャネルをランダムにマスクするだけのシンプルな手法で向上させた。
- BehaviorWorldGen: 行動モデルとワールドシミュレータのループを閉じる、制御可能な行動認識型構造化ワールド生成自動運転/シミュレーション2026/8/23
運転行動モデルの自己改善ループにおいて、周辺エージェントの行動的に妥当な応答を生成できるシミュレータの欠如がボトルネックであることを指摘し、解釈可能な行動制御を注入してマルチエージェントの軌跡を生成するBehaviorFlowを中核とするフレームワークを提案した。
- OrthoSkillVLA: 勾配情報に基づくスキル部分空間適応による継続的スキル学習VLA/継続学習2026/8/20
事前学習済みのVLAモデルを複数のスキルに順次適応させる際に生じる破滅的忘却を防ぐため、VLMとActionHeadに別々の部分空間制約を課し、出力層には軽量なMoEデコーダを導入するパラメータ効率的な継続学習フレームワークを提案した。
- 実世界のストリーミング動画の活用VLA2026/6/7
オフライン動画理解に優れる既存のVLMを、ストリーミング動画の対話・理解に適応させるためのデータセット、訓練手法、デプロイシステム、評価ベンチマークを提案した論文。
- Light-WAM: 状態融合アクション復号による効率的なワールドアクションモデルロボット操作2026/6/6
ロボット操作のための軽量なワールドアクションモデルを提案し、将来予測の学習コストを削減しつつ、高速なアクション予測を実現した。
- ProbeFlow: 学習不要の適応型フローマッチングによる視覚言語行動モデルの高速化VLA/行動生成/推論高速化2026/3/1
VLAモデルの行動生成に用いるフローマッチングの推論遅延を、軌道の複雑さに応じて積分ステップ数を動的に調整する学習不要のフレームワークで削減し、実機でも安定した高速動作を実現した。
- 実時間3次元形状復元のための高変形可能な固有感覚膜触覚2026/1/1
光導波路センシングを用いた柔軟で伸縮可能な固有感覚シリコーン膜を開発し、機械学習で変形に伴う光強度信号を解析することで、面外変形や大ひずみ下でも実時間で3次元形状を復元できることを示した。
- 全身固有感覚モーフィング:堅牢なクロススケール把持のためのモジュラーソフトグリッパソフトグリッパ2025/10/1
タコに着想を得て、自己感知型のモジュラー空気圧アクチュエータを分散配置し、グリッパ全体の形状を多角形などに再構成できるソフトグリッパを開発。ピンチから包み込み把持まで対応し、多様な形状・スケールの物体把持を実現した。
- Large Language Models for Robotics: Opportunities, Challenges, and Perspectives2024/1/1
- Intelligent machines work in unstructured environments by differential neuromorphic computing2023/9/1