Rahaf Aljundi
収録論文 4本 ・ フィジカルAI/ロボット学習
デモンストレーション学習/軌道生成報酬学習/VLM3D再構築VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DemoBridge: 単一視点の人間デモンストレーション再ターゲティングのためのシミュレーション・イン・ザ・ループ・ツールキットデモンストレーション学習/軌道生成2026/7/1
単一視点のRGBステレオ映像から人間の手のデモンストレーションを取得し、物理検証済みのロボットアーム軌道に変換するツールキットを提案。衝突回避プランナーと物理シミュレータをループさせ、再プランニングにより実行可能な軌道を生成する。
- デモから報酬へ:VLM報酬モデルのテスト時プロンプト最適化報酬学習/VLM2026/6/1
ロボットのデモンストレーション数本を用いて、VLM報酬モデルの言語指示をテスト時に最適化し、誤検出を減らして報酬精度を向上させる手法を提案した。追加学習や計算資源を必要とせず、シミュレーションと実機で有効性を実証した。
- 生成による再構築:スパース観測からの3D複数物体シーン再構築3D再構築2026/4/1
RGB-D画像のスパースな観測から、物体や部品の形状と姿勢を確率的に推定する生成フレームワークRecGenを提案し、複雑な遮蔽や対称物体に対応して高精度な再構築を実現した。
- Memo: 強化学習による記憶効率の良い身体性エージェントの訓練VLA2025/10/1
Transformerベースの強化学習において、定期的な要約トークンを入力に挟み込むことで記憶の生成と検索を行い、長期的なタスクを効率的に学習する手法を提案。