Haozhe Ma
収録論文 4本 ・ フィジカルAI/ロボット学習
空間音声理解強化学習ナビゲーションモデルベース強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SAIL: 分離音響・空間エンコーディングとデュアルストリームQ-Formerによる大規模言語モデルを用いた空間音声知能空間音声理解2026/9/28
音響特徴と空間特徴を別々のストリームで扱い、音源ごとの対応を保ちながらLLMに接続する空間音声理解フレームワークSAILを提案し、複数音源のイベント検出・方向・距離推定・空間推論を改善した。
- JEDI: オンライン強化学習のための統合埋め込み拡散世界モデル強化学習2026/5/13
拡散世界モデルをオンライン強化学習に適用し、JEPAフレームワークを用いて潜在空間を拡散ノイズ除去損失から直接学習する新しい手法を提案。再構成や事前学習モデルに頼らず、将来の潜在表現を予測することで、効率性と性能を両立する。
- MacroNav: マルチタスク文脈表現学習による未知環境での効率的ナビゲーションナビゲーション2025/11/1
マルチタスク自己教師あり学習で多スケールの空間表現を獲得し、強化学習とグラフ推論を組み合わせて未知環境を効率的にナビゲートする手法を提案した。
- モデルベース強化学習における性能非対称性モデルベース強化学習2025/5/1
モデルベース強化学習が人間を超えるタスクと大きく劣るタスクがある性能非対称性を指摘し、バランスの取れた評価指標Sym-HNSと新たな世界モデルJEDIを提案した。