Moritz Reuss
University of Stuttgart
収録論文 15本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ReCAT: 記憶・計数・時間を考慮した構造化リカレントメモリによるロボットマニピュレーションマニピュレーション2026/9/28
言語条件付きポリシーにMamba-2と因果注意層による構造化リカレントメモリを組み込み、過去の視覚手がかりの想起やイベント計数、経過時間推定を必要とするロボット操作タスクを高精度で実現した。
- GeomVLA: 3D空間でシーン・運動・行動を統合するVLAモデルVLA2026/9/12
深度とカメラキャリブレーションでVLM特徴を3Dシーントークンに持ち上げ、シーン点の将来運動を潜在表現として予測し、それを条件に3Dフロー型行動生成を行うVLAモデルを提案。CALVINなどで高性能を示した。
- DUET-DINO: ロボットマニピュレーションの潜在計画のための同時クロスビュー世界モデリングマニピュレーション2026/9/9
側面カメラと手首カメラの観測をクロスビュー条件付けで統合し、7自由度エンドエフェクタ制御のための行動条件付き潜在世界モデルを学習する手法を提案。到達・角度付き到達・把持持ち上げタスクで単一視点や独立二視点のベースラインを上回る性能を達成した。
- SPARC: ロボットデモからの信頼性校正付き空間アノテーションの大規模生成データアノテーション2026/6/11
ロボットのデモンストレーションから、信頼度スコア付きの構造化空間アノテーション(バウンディングボックスや物体軌跡など)を自動生成するリスク認識フレームワークを提案し、ノイズの多いラベルを減らしつつ有用なサンプルを保持する。
- DAM-VLA: 非同期マルチモーダル視覚言語行動モデルVLA2026/6/10
各モダリティをセンサー固有のレートで処理する非同期VLAモデルを提案し、接触の多い実世界操作タスクで成功率を大幅に向上させた。
- PointMapPolicy:マルチモーダル模倣学習のための構造化点群処理マニピュレーション2025/10/1
点群をダウンサンプリングせず規則的なグリッド状に構造化し、RGB画像と効率的に融合する拡散ポリシーを提案。複数の操作タスクで最先端性能を達成した。
- NaviTrace:視覚言語モデルの身体性ナビゲーション評価ベンチマークナビゲーション2025/10/1
視覚言語モデルに指示と身体タイプを与え、画像空間での2Dナビゲーション軌跡を出力させるVQAベンチマークを提案し、8つの最先端モデルを評価した。
- FLOWER: 効率的な視覚-言語-行動フローポリシーによる汎用ロボットポリシーの民主化VLA2025/9/1
LLM層の削減とモジュラー適応でパラメータを抑えた9.5億パラメータのVLAモデルFLOWERを提案し、200GPU時間の事前学習で大規模モデルに匹敵する性能とCALVIN ABCベンチマークでのSoTAを達成した。
- BEAST: Bスプライン符号化による模倣学習向けアクション系列の効率的トークン化模倣学習2025/6/1
Bスプラインでアクション系列をコンパクトな離散・連続トークンに符号化するトークナイザを提案し、別途学習不要で滑らかな軌道生成と計算コスト削減を実現した。
- マルチタスク学習のための専門家混合デノイザーを用いた効率的拡散トランスフォーマーポリシー模倣学習/拡散ポリシー2024/12/1
模倣学習向けに、ノイズ条件付きルーティングとスパースな専門家を組み合わせたMixture-of-Denoising Experts (MoDE) を提案し、拡散トランスフォーマーポリシーの計算コストを大幅に削減しつつ、複数のベンチマークで最先端性能を達成した。
- 基盤モデルによるゼロショットラベリングでロボット方策学習をスケールさせるVLA2024/10/1
視覚言語基盤モデルを組み合わせ、未整理の長期ロボットデータに自然言語指示を自動でゼロショット付与するNILSを提案し、11.5万軌道以上をラベリングした。
- マルチモーダル拡散トランスフォーマ:マルチモーダル目標から多様な行動を学習マニピュレーション2024/7/1
言語注釈が少ないデータでも、画像と言語の目標指示を統合した潜在表現を自己教師あり学習で獲得し、長期マニピュレーションタスクを高精度に実行する拡散ポリシーを提案。
- Towards Diverse Behaviors: A Benchmark for Imitation Learning with Human Demonstrations2024/2/1
- Goal-Conditioned Imitation Learning using Score-based Diffusion Policies2023/4/1
- End-to-End Learning of Hybrid Inverse Dynamics Models for Precise and Compliant Impedance Control2022/5/1