Mohamed Chetouani
Sorbonne University
収録論文 25本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- チャンク型VLAマニピュレーションポリシーの学習と実機展開のためのSim-to-Real統合パイプラインsim2real2026/9/18
シミュレーションで生成した専門家軌道を実機Franka FR3でオープンループ再生して実世界データを収集し、同じ展開スタックで学習済みポリシーを評価するSim-to-Real実験プロトコルを提案・公開した。
- 必要なときに考える:RLポリシーを用いた社会的ナビゲーションのための条件付きVLM推論ナビゲーション2026/7/1
ロボットの社会的ナビゲーションにおいて、RLポリシーの高速性とVLMの意味理解を動的に切り替えるハイブリッドアーキテクチャHUMAを提案し、ベンチマークで性能向上を実証した。
- スタイル条件付き拡散ポリシーによる予測可能性と可読性のエンコードVLA2026/3/1
事前学習済み拡散ポリシーを凍結し、軽量なシーンエンコーダと条件予測器で軌道生成を可読性か効率性に制御するモジュール型フレームワークを提案。曖昧な状況では可読性を高め、不要な時は効率を保つ。
- 階層拡散ポリシーにおける共適応のためのオンライン自己学習階層型ポリシー/拡散モデル/自己学習2026/3/1
階層型拡散ポリシーにおいて、プランナーとコントローラのサブゴール分布を整合させる自己学習フレームワークORCHIDを提案し、オンラインでの安定した改善を実現した。
- CLUE: 注意機構を用いた言語視覚理解によるクロスモーダル曖昧性解消VLA2026/2/1
VLMのクロスモーダル注意を空間的に接地した信号に変換し、参照曖昧性を検出して質問すべきタイミングを判断する対話型視覚接地モデルを提案。
- HARMONI: LLMを用いたマルチユーザーヒューマンロボットインタラクションのマルチモーダル個別化HRI2026/1/1
大規模言語モデルを活用し、社会的支援ロボットが複数ユーザーとの長期的な対話を持続的に個別化・適応させるマルチモーダルフレームワークを提案。介護施設での実証実験を含む評価で、話者識別や記憶更新、倫理的に整合した個別化を実現した。
- 拡散モデルによるロボット動作の意図表現度の制御動作生成2025/10/1
拡散モデルを用いて、ロボットの動作の「意図のわかりやすさ」を連続的に制御できる動作生成フレームワークを提案した論文。
- I-FailSense: 視覚言語モデルによる汎用的なロボット失敗検出に向けてVLA2025/9/1
視覚言語モデルを微調整し、内部層に軽量な分類ヘッドを付けてアンサンブルすることで、指示と意味的にずれたロボットの失敗を検出するフレームワークを提案。
- ユーザー認識型マルチモーダル対話エージェントのための推論LLM対話エージェント2025/4/1
CoT推論とVLMを組み合わせ、初対面から動的にユーザープロファイルを推定・更新するパーソナライズ対話フレームワークを提案し、高齢者向けVQAベンチマークで性能向上を示した。
- VIPER: 逐次意思決定のための視覚知覚と説明可能な推論VLA2025/3/1
VLMで画像をテキスト化しLLMで行動を推論するモジュール型パイプラインを提案し、ALFWorldで視覚指示ベースの計画性能を向上させた。
- User-VLM 360°: 社会的ヒューマンロボットインタラクションのためのユーザー認識チューニングによる個人適応型視覚言語モデルVLA2025/2/1
ユーザーの視覚・言語信号に基づきリアルタイムで適応する個人化視覚言語モデルを提案し、バイアス軽減と社会的感情データセットを統合してPepperロボットで実証した。
- タスクモデルの相違を超えた暗黙の目標推論価値整合/目標推論2025/1/1
ユーザーとエージェントのタスクモデルが異なる状況で、明示されていない暗黙のサブゴールをボトルネック状態から推定し、最小限の質問でそれを達成する方策を導出する手法を提案した論文。
- 基盤モデルによる品質多様性解の評価を用いたタスク認識型ロボット把持マニピュレーション2024/11/1
LLMと品質多様性アルゴリズムを組み合わせ、物体を意味的に分割してタスクに応じた把持をゼロショットで生成するフレームワークを提案し、YCBデータセットで有効性を示した。
- Pepperロボットの社会的インタラクションを強化するハードウェアと知覚の改良HRI2024/9/1
PepperロボットにNVIDIA Jetson GPUとRealSense D435iカメラを追加し、人間の検出・位置推定・体の向き・視線方向をリアルタイムで認識する知覚スタックをROS上で構築した研究。
- Legibot: コストベース局所プランナによるサービスロボットの意図が読み取りやすい動作生成ナビゲーション2024/4/1
移動ロボットの局所動作計画に「意図の読み取りやすさ(legibility)」を組み込み、実時間・動的環境で周囲の人に目標や意図を素早く伝える動作を生成する手法と、知覚・自己位置推定を統合した社会ロボット向けシステムを提案した。
- SLOT-V: Supervised Learning of Observer Models for Legible Robot Motion Planning in Manipulation2022/10/1
- Automatic Context-Driven Inference of Engagement in HMI: A Survey2022/9/1
- Two ways to make your robot proactive: reasoning about human intentions, or reasoning about possible futures2022/5/1
- A new approach to evaluating legibility: Comparing legibility frameworks using framework-independent robot motion trajectories2022/1/1
- Does the Goal Matter? Emotion Recognition Tasks Can Change the Social Value of Facial Mimicry towards Artificial Agents2021/5/1
- MobiAxis: An Embodied Learning Task for Teaching Multiplication with a Social Robot2020/4/1
- Explainable Agents Through Social Cues: A Review2020/3/1
- Interactively shaping robot behaviour with unlabeled human instructions2019/2/1
- Trust as indicator of robot functional and social acceptance. An experimental study on user conformation to the iCub's answers2015/10/1
- Towards engagement models that consider individual factors in HRI: on the relation of extroversion and negative attitude towards robots to gaze and speech during a human-robot assembly task2015/8/1