Elie Aljalbout
収録論文 22本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DREAMSTEER: 潜在世界モデルによるVLAポリシーの展開時誘導(微調整不要)VLA/世界モデル2026/7/1
事前学習済みの視覚言語行動(VLA)ポリシーを、微調整なしで展開時に潜在世界モデルと価値モデルを用いて誘導し、分布シフト下での成功率と指示追従精度を大幅に向上させるフレームワークを提案した。
- イベントカメラを用いた混雑環境でのクアッドローター飛行のための近似模倣学習ドローン飛行2026/3/1
イベントカメラの高周波データをシミュレーションする計算コストを回避するため、表現学習と方策探索を分離し、オフラインデータで表現を学習後、軽量な状態情報のみで方策を微調整する近似模倣学習を提案。訓練時間を28倍短縮し、実機でも有効性を実証した。
- ロボティクスにおけるリアルギャップ:課題・解決策・ベストプラクティスsim2real2025/10/1
シミュレーションと実環境の差異(リアルギャップ)の原因・解決手法・評価指標を体系的に整理したサーベイ。sim-to-real転移の現状と課題を概観する。
- オンザフライ学習:微分可能シミュレーションによる迅速な方策適応sim2real2025/8/1
微分可能シミュレーション内で残差ダイナミクス学習と実時間方策適応を統合し、実世界データでモデルを逐次更新することで、未見の外乱に5秒以内で適応するオンライン学習フレームワークを提案した。
- 状態空間ワールドモデルによるモデルベース強化学習の高速化モデルベースRL2025/2/1
状態空間モデル(SSM)を用いてダイナミクスモデルの学習を並列化し、モデルベース強化学習の計算ボトルネックを解消。部分観測環境向けに特権情報を活用するアーキテクチャも提案し、実機のアジャイルなクアッドロータ飛行タスクで検証した。
- 夢見るドローン:視覚ベース飛行のためのモデルベース強化学習VLA2025/1/1
DreamerV3を用いて、カメラ画像のみを入力としてドローンレースコースを最大9m/sで飛行する視覚運動ポリシーを学習させた研究。
- クアッドロータのためのマルチタスク強化学習マルチタスク強化学習/クアッドロータ制御2024/12/1
クアッドロータ制御において、共有された物理ダイナミクスを活用し、単一のポリシーで複数の機動(高速安定化、速度追従、自律レースなど)を実行できるマルチタスク強化学習フレームワークを提案した。
- 生徒に合わせた教師の訓練:部分観測下での模倣学習の改善模倣学習2024/12/1
特権情報を持つ教師と限られた観測の生徒の非対称性を解消するため、教師と生徒を同時に訓練し、生徒が模倣可能な行動を教師に学習させる枠組みを提案。
- ロボット学習における力の運動由来推定の欠点マニピュレーション2024/7/1
ロボット学習が運動中心の行動空間に偏り、物理的相互作用を明示的に制御できていない問題を指摘し、相互作用を明示した行動空間の必要性を論じた論文。
- LIMT: 言語情報を活用したマルチタスク視覚ワールドモデルマルチタスク強化学習/ワールドモデル2024/7/1
事前学習済み言語モデルでタスクを意味的に表現し、視覚ワールドモデルと方策がタスク間の類似性を考慮できるようにするマルチタスク強化学習手法を提案。モデルベース手法がモデルフリー手法より優れることを示した。
- ロボットアームのオンライン動作生成と適応のためのガイド付きデコーディングマニピュレーション2024/3/1
模倣学習とTransformerベースの条件付きVAEでロボットアームの動作を学習し、ビーム探索によるガイド付きデコーディングで障害物回避や経由点変更にオンライン適応する手法を提案した。
- On the Role of the Action Space in Robot Manipulation Learning and Sim-to-Real Transfer2023/12/1
- Actor-Critic Model Predictive Control: Differentiable Optimization meets Reinforcement Learning for Agile Flight2023/6/1
- CLAS: Coordinating Multi-Robot Manipulation with Central Latent Action Spaces2022/11/1
- Learning to Centralize Dual-Arm Assembly2021/10/1
- Learning Robotic Manipulation Skills Using an Adaptive Force-Impedance Action Space2021/10/1
- Dual-Arm Adversarial Robot Learning2021/10/1
- Seeking Visual Discomfort: Curiosity-driven Representations for Reinforcement Learning2021/10/1
- Making Curiosity Explicit in Vision-based RL2021/9/1
- How to Make Deep RL Work in Practice2020/10/1
- Learning Vision-based Reactive Policies for Obstacle Avoidance2020/10/1
- Task-Independent Spiking Central Pattern Generator: A Learning-Based Approach2020/3/1