Mara Levy
収録論文 7本 ・ フィジカルAI/ロボット学習
選好ベース強化学習マニピュレーションsim2realタスク計画模倣学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TREND: デモンストレーションを用いたノイズに頑健な選好ベース強化学習のための三者相互学習選好ベース強化学習2025/5/1
少数の専門家デモンストレーションと三者相互学習戦略を組み合わせ、ノイズの多い選好フィードバック下でもロボットマニピュレーションタスクで高い成功率を達成する選好ベース強化学習フレームワークを提案。
- P3-PO: ロボット方策の視覚空間汎化のための指示的点事前分布マニピュレーション2024/12/1
人間が1枚のデモ画像上で指定した意味的な点を既存の視覚モデルでデータセット全体に伝播させ、その点を状態表現として方策学習に用いることで、新しい物体や混雑環境への汎化性能を大幅に向上させた研究。
- NeRF-Aug: ニューラル放射輝度場によるロボティクス向けデータ拡張sim2real2024/11/1
NeRFを用いて学習データにない物体のフォトリアルな画像を生成し、ロボット政策の汎化性能を55.6%向上させたデータ拡張手法。
- VeriGraph: 実行検証可能なロボット計画のためのシーングラフタスク計画2024/11/1
シーングラフを中間表現として用い、VLMが生成した行動計画の実行可能性を検証・修正するフレームワークを提案。多様な操作タスクでベースラインを大幅に上回る成功率を達成した。
- WayEx: 単一デモンストレーションによるウェイポイント探索模倣学習2024/7/1
単一のデモンストレーションから複雑な目標条件付きロボットタスクを学習する手法を提案し、従来の強化学習より訓練時間を50%削減した。
- ARDuP: 汎用ポリシーのためのアクティブ領域動画拡散VLA2024/6/1
動画生成ベースのポリシー学習において、動きの手がかりから自動的に「アクティブ領域」を抽出し、その領域に注目して拡散モデルで計画・行動生成する手法を提案。シミュレータと実世界データで成功率を改善。
- No-frills Dynamic Planning using Static Planners2021/6/1