Xinjiang Wang
Horizon Robotics
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAビデオ生成飛行制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Ego4WAM:ロボット学習のための自己中心的人間データのスケーリングで重要な要素は何か?VLA2026/9/30
自己中心的人間データをロボット学習に活用する際、人間とロボットのアライメント、タスク多様性、行動監督、利用戦略が下流性能に与える影響を体系的に分析し、データ設計の指針を示した。
- CogWAM: イベント駆動型インターフェースによる意味認知と世界行動モデリングの整合VLA2026/9/29
タスク推論と世界行動学習の間に持続的な意味状態を介した明示的なインターフェースを設け、進捗条件付きクエリで未来予測と行動生成を整合させる認知誘導型世界行動モデルを提案。
- 世界行動モデルの表現設計を見直すReWAMVLA2026/9/29
事前学習済みDINO特徴を基盤に、特徴校正と時間表現ボトルネックで世界状態を圧縮し、行動損失のみで表現を整形する世界行動モデルを提案。動画生成事前学習なしでRoboTwin 2.0で93.6%の成功率を達成。
- MeRoPE: カメラ制御ビデオ生成のためのメトリック回転位置埋め込みビデオ生成2026/9/1
カメラ制御ビデオ生成において、実世界のメトリックカメラ軌道でスケール依存の失敗を起こさない、ノルム保存型の相対カメラエンコーディングMeRoPEを提案した。
- AeroAct: 言語条件付きクワッドローター飛行のためのアクション中心のワールドアクションモデル飛行制御2026/7/1
言語指示によるクワッドローター飛行を実現するため、事前学習済みビデオ拡散トランスフォーマーを応用し、視覚・状態・言語から局所的な軌道アクションを予測するアクション中心のワールドアクションモデルを提案した。実機飛行で初めて実証された。