Xinshuai Song
Sun Yat-sen University
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション身体化エージェント/OSsim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LexiconVLA: 未知タスク向けの再利用可能な原子行動コードブックの学習VLA2026/9/29
視覚言語行動モデルが未知タスクで繰り返し現れる動作を再利用できるよう、原子行動をコードブック化して検索・適用する手法を提案し、未知タスクの成功率を向上させた。
- 視界を取り戻せ:ロボットマニピュレーションにおける遮蔽回復のための物理的アクティブビジョンベンチマークマニピュレーション2026/9/29
両腕ロボットの遮蔽回復を評価するベンチマークBAVO-Benchを提案し、未来予測を活用したアクティブビジョン方策A-FARで遮蔽への頑健性を向上させた。
- PhyAgentOS: 認知計画と物理実行を分離した自己進化型身体化エージェントOS身体化エージェント/OS2026/7/1
身体化エージェント向けに、セッション単位のスケジューリング、検証、記憶、安全をOSサービスとして提供する実行基盤を提案。状態をファイルとして扱うことで認知と物理実行を分離し、検証済み結果を知識として蓄積する自己進化ループを実現した。
- RoVLA: ロバストな視覚言語行動モデルのための多重整合性制約VLA2026/5/1
視覚言語行動モデルのロバスト性を高めるため、指示意味・軌道進化・観測摂動の3つの変換に対する整合性制約を導入したRoVLAを提案。
- InfiniteWorld: 汎用視覚言語ロボットインタラクションのための統合スケーラブルシミュレーションフレームワークsim2real2024/12/1
Nvidia Isaac Sim上に構築された、汎用視覚言語ロボットインタラクション向けの統合スケーラブルなシミュレータを提案し、3Dアセット構築やReal2Sim、自動注釈などの機能と4つの新しいベンチマークを提供する。