Xiaoyang Wu
収録論文 6本 ・ フィジカルAI/ロボット学習
VLAVLA/操作sim2realマニピュレーションLiDARセグメンテーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- データスケーリングを超えて:視覚言語行動モデルのための表現中心の継続事前学習VLA2026/8/27
ロボットデータの不足を補うため、多様なロボットデータでVLMバックボーンを継続事前学習し、下流タスクの性能を向上させるVLActを提案した。
- DreamAvoid: 臨界期テストタイムドリーミングによるVLAポリシーの失敗回避VLA/操作2026/5/1
VLAモデルが微細な操作中に失敗する問題に対し、実行が臨界期に入ったかを検出し、複数の候補行動を評価して最適な行動を選択する「テストタイムドリーミング」フレームワークを提案した。
- Any3D-VLA:多様な点群によるVLAのロバスト性向上VLA2026/2/1
シミュレータ・センサ・モデル推定の点群を統合して学習し、2D表現と融合することで、VLAモデルの性能とドメインギャップ耐性を高める手法を提案。
- 最適化経路整形によるコンベア上の動的物体操作のSim-to-Real転移sim2real2025/8/1
シミュレータで生成したデモを用いた模倣学習において、外観ノイズのアニーリングで形状情報を優先させるGEMを提案し、コンベア上の動的物体操作を実環境へ転移させた。
- VIP: 視覚指示によるロボットマニピュレーションの事前学習マニピュレーション2024/10/1
テキスト指示の代わりに将来画像とスパース点フローを視覚指示として用いる事前学習手法VIPを提案し、多様なタスクでの性能を大幅に向上させた。
- ユニバーサルLiDARセグメンテーションに向けたマルチスペースアラインメントLiDARセグメンテーション2024/5/1
異なるセンサやシーンで収集された大規模運転データセットを統合し、データ・特徴・ラベル空間でのアラインメントを行うことで、単一パラメータでマルチタスク・マルチデータセット・マルチモダリティのLiDARセグメンテーションを実現するM3Netを提案。