Bofang Jia
収録論文 5本 ・ フィジカルAI/ロボット学習
強化学習マニピュレーションデータ拡張VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WorldSample: ワールドモデリングを用いた実機ロボットの閉ループ強化学習強化学習2026/7/1
実機ロボットの強化学習において、実ロールアウトとワールドモデル生成を閉ループで結び、高品質な合成遷移を生成して学習を効率化する手法を提案。ポリシー成功率を28%向上させ、訓練ステップを59%削減した。
- 嗜好較正型ヒューマン・イン・ザ・ループ強化学習によるロボット操作マニピュレーション2026/6/1
人間介入を利用した強化学習で、介入が誘発する嗜好信号から劣った軌道区間を特定し、Q値の過大評価を防ぎつつ方策を人間の修正行動に合わせて較正するPACTフレームワークを提案した。
- RESample: 探索的サンプリングによるロボットマニピュレーションのための堅牢なデータ拡張フレームワークデータ拡張2025/10/1
VLAモデルの失敗復帰データ不足を補うため、保守的カバレッジ関数で不足領域を特定し、探索行動と復帰行動を能動的にサンプリングしてデータ拡張するフレームワークを提案。LIBEROと実機で最大12%の成功率向上を達成。
- OpenHelix: ロボットマニピュレーションのためのデュアルシステムVLAモデルの短いサーベイ、実証分析、オープンソース化VLA2025/5/1
既存のデュアルシステムVLAアーキテクチャを整理・比較し、設計要素を実証評価した上で、低コストなオープンソースモデルを提供するプロジェクト。
- スコア・分布マッチング方策:マッチング蒸留による高速視覚運動方策VLA2024/12/1
拡散方策をスコアマッチングと分布マッチングの二段階最適化で1ステップ生成器に変換し、6倍の推論高速化と高品質な行動生成を両立させた。