Sanping Zhou
Xi'an Jiaotong University
収録論文 8本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CogWAM: イベント駆動型インターフェースによる意味認知と世界行動モデリングの整合VLA2026/9/29
タスク推論と世界行動学習の間に持続的な意味状態を介した明示的なインターフェースを設け、進捗条件付きクエリで未来予測と行動生成を整合させる認知誘導型世界行動モデルを提案。
- GE-Act 2.0: ロボット操作のためのワールドアクションモデルの事前学習とスケーリングVLA2026/9/4
操作データのみで生成・行動コンポーネントをゼロから学習するワールドアクションモデルを提案し、大規模データでの事前学習とスケーリングの効果を検証した。
- ロボットポリシー学習における視点汎化のための効率的なカメラポーズ拡張VLA2026/3/1
3Dガウススプラッティングを用いて、少数の非校正画像から高品質な3Dシーンを再構成し、多様な合成視点を生成することで、視覚運動ポリシーの未知視点への汎化性能を向上させる手法を提案した。
- DynaRend: マスク付き未来レンダリングによるロボットマニピュレーションのための3Dダイナミクス学習マニピュレーション2025/10/1
多視点RGB-D動画からマスク再構成と未来予測を微分可能ボリュームレンダリングで行い、3D形状・意味・ダイナミクスを統合したトライプレーン表現を自己教師あり学習するフレームワーク。RLBenchやColosseum、実機実験でマニピュレーション性能と汎化性を向上。
- SAMPO: 運動プロンプトを用いたスケールワイズ自己回帰による生成的世界モデル世界モデル2025/9/1
フレーム内生成に視覚自己回帰、次フレーム生成に因果モデリングを組み合わせ、運動プロンプトで時空間的手がかりを注入する世界モデルを提案。
- FlowRAM: 領域認識Mambaフレームワークによるフローマッチング方策のロボットマニピュレーションへの基盤化マニピュレーション2025/6/1
拡散方策の推論効率と3D知覚の課題に対し、動的半径スケジュールと状態空間モデル、条件付きフローマッチングを組み合わせ、高精度マニピュレーションで成功率を12%向上させた。
- 行動識別を備えた時間統合拡散ポリシーによるロボットマニピュレーションマニピュレーション2025/6/1
拡散ポリシーのノイズ除去過程を時間方向に統合し、行動識別情報を加えることで、ロボットマニピュレーションの行動生成を高速化・高精度化した手法TUDPを提案。
- RSRNav: 画像ゴールナビゲーションのための空間関係推論ナビゲーション2025/4/1
ゴール画像と現在の観測間の空間的関係を推論し、ナビゲーションの指針とする手法を提案。視点の不一致に強く、ベンチマークで優れた性能を示す。