Jingyi Tian
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボットポリシー学習における視点汎化のための効率的なカメラポーズ拡張VLA2026/3/1
3Dガウススプラッティングを用いて、少数の非校正画像から高品質な3Dシーンを再構成し、多様な合成視点を生成することで、視覚運動ポリシーの未知視点への汎化性能を向上させる手法を提案した。
- DynaRend: マスク付き未来レンダリングによるロボットマニピュレーションのための3Dダイナミクス学習マニピュレーション2025/10/1
多視点RGB-D動画からマスク再構成と未来予測を微分可能ボリュームレンダリングで行い、3D形状・意味・ダイナミクスを統合したトライプレーン表現を自己教師あり学習するフレームワーク。RLBenchやColosseum、実機実験でマニピュレーション性能と汎化性を向上。
- SAMPO: 運動プロンプトを用いたスケールワイズ自己回帰による生成的世界モデル世界モデル2025/9/1
フレーム内生成に視覚自己回帰、次フレーム生成に因果モデリングを組み合わせ、運動プロンプトで時空間的手がかりを注入する世界モデルを提案。
- FlowRAM: 領域認識Mambaフレームワークによるフローマッチング方策のロボットマニピュレーションへの基盤化マニピュレーション2025/6/1
拡散方策の推論効率と3D知覚の課題に対し、動的半径スケジュールと状態空間モデル、条件付きフローマッチングを組み合わせ、高精度マニピュレーションで成功率を12%向上させた。