Nejib Ammar
収録論文 3本 ・ フィジカルAI/ロボット学習
ワールドモデル/ストリーミング模倣学習/強化学習強化学習検証
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ネットワーク効率的なワールドモデルトークンストリーミングワールドモデル/ストリーミング2026/5/1
運転用ワールドモデルの離散トークン状態を、帯域制約下で効率的にストリーミングする適応的キーフレーム・デルタ方式を提案し、歪みとパープレキシティの改善を示した。
- IN-RIL: 模倣学習と強化学習を交互に組み合わせた方策ファインチューニング模倣学習/強化学習2025/5/1
強化学習の更新の合間に模倣学習の更新を定期的に挿入し、勾配を直交部分空間に分離することで、ファインチューニングの安定性とサンプル効率を向上させる手法を提案した。
- サイバーフィジカルシステムにおける強化学習制御器の耐性検証強化学習検証2024/6/1
強化学習制御器がシステムのずれに対して要求を満たせるかを評価する新たな耐性指標を提案し、小さな違反を探索する手法を開発した。