Pranav Atreya
収録論文 9本 ・ フィジカルAI/ロボット学習
RL/遅延対応LLM検証ロボット評価/ベンチマークマニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 待ち時間に学習する:推論遅延下での汎用ロボットポリシーのRLファインチューニングRL/遅延対応2026/8/24
推論遅延がRLのマルコフ性を壊す問題に対し、非同期推論と状態拡張で遅延を隠蔽しつつRL改善を可能にするフレームワークARLIを提案。シミュレーションと実機で有効性を実証した。
- LLMを検証器として使う:汎用検証フレームワークLLM検証2026/7/1
LLMの検証能力を新たなスケーリング軸として捉え、追加学習なしでエージェントタスクにきめ細かいフィードバックを与える汎用検証フレームワークを提案した。スコアの粒度拡大や繰り返し評価、基準分解により検証精度を向上させ、複数のベンチマークで最高性能を達成した。
- RoboArena:汎用ロボットポリシーの分散型実世界評価ロボット評価/ベンチマーク2025/6/1
評価者ネットワークが自由にタスクと環境を選び、ペア比較の二重盲検評価を集約することで、汎用ロボットポリシーをスケーラブルかつ公平にランキングする手法を提案し、7機関・600以上の実機評価で有効性を示した。
- AutoEval: 実世界における汎用ロボットマニピュレーションポリシーの自律評価マニピュレーション2025/3/1
ロボットポリシーの実世界評価を人手なしで24時間自律的に行うシステムAutoEvalを提案し、自動成功判定とシーンリセットにより人手による評価と近い結果が得られることを示した。
- 基盤モデルによる指示追従スキルの自律的改善VLA2024/7/1
視覚言語モデルを活用してロボットが自律的に多様なデータを収集・評価し、人間の注釈なしで指示追従ポリシーを改善する手法を提案。未知環境での性能を2倍に向上させた。
- Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models2023/10/1
- High-Speed Accurate Robot Control using Learned Forward Kinodynamics and Non-linear Least Squares Optimization2022/6/1
- State Supervised Steering Function for Sampling-based Kinodynamic Planning2022/6/1
- VI-IKD: High-Speed Accurate Off-Road Navigation using Learned Visual-Inertial Inverse Kinodynamics2022/3/1