Yutong Hu
KU Leuven
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 2AM: 長期ホライズン操作における操縦可能な行動モデルのためのエージェント側記憶の基盤化VLA2026/9/10
マルチモーダルエージェントにタスク記憶を集約し、単一のRGBベースVLAを実行者として、履歴を言語サブタスクと2Dヒントに変換して操縦する長期操作フレームワーク。LIBERO-Memで大幅な性能向上を達成。
- FOCIポリシー:関係的操作ポリシーのためのオブジェクト中心相互作用に焦点を当てるマニピュレーション2026/9/8
物体間の相対運動に基づく相互作用中心のフレームワークを提案し、デモから重要な相互作用区間を抽出してスキルを表現することで、少ないデータで高い性能を達成する操作ポリシーを開発した。
- Assistron: 既製の視覚言語行動モデルを用いたベイズ共有自律制御共有自律制御2026/6/1
視覚言語行動モデルを活用し、ユーザーの介入を重要な失敗点に限定することで、日常操作タスクの成功率を高めつつ人間の負担を軽減する共有自律制御手法を提案した。
- ELVIS: 長期的視覚MPCのためのアンサンブル校正潜在想像モデルベースRL/視覚制御2026/5/1
モデルベース強化学習による視覚制御の長期計画を実用的にするため、ガウス混合MPPIと不確実性を考慮したラムダリターンを用いた潜在モデル予測制御器ELVISを提案し、シミュレーションと実世界のタスクで性能を向上させた。
- AR-VLA: 視覚言語行動モデルのための真の自己回帰型アクションエキスパートVLA2026/3/1
観測ごとに時間的文脈をリセットする従来のVLAや拡散ポリシーと異なり、長期記憶で履歴を保持し連続的な因果系列として行動を生成する自己回帰型アクションエキスパートを提案。再アンカリング機構で非同期な視覚・言語・行動を同期させ、滑らかで文脈認識型の行動生成を実現した。
- TASC: 関係的遠隔操作のためのタスク認識型シェアードコントロール遠隔操作2025/9/1
視覚入力から物体間の機能的関係を表すオープン語彙のインタラクショングラフを構築し、ユーザのタスク意図を推定して把持・操作を支援するシェアードコントロール手法を提案。シミュレーションと実機で効率向上とゼロショット汎化を実証した。
- 回転同変なボリュメトリック把持モデルマニピュレーション2025/7/1
垂直軸周りの回転に同変なトリプレーン特徴表現を導入し、GIGAやIGDといった把持プランナを同変化することで、計算・メモリコストを抑えつつ把持性能を向上させた。
- Mini Diffuser: 二段階ミニバッチによる高速マルチタスク拡散ポリシー学習VLA2025/5/1
拡散ポリシー学習において、視覚言語条件ごとに複数のノイズ付き行動サンプルを組み合わせる二段階ミニバッチを導入し、情報漏洩を防ぐアーキテクチャ改良により、性能を保ちつつ学習時間とメモリを大幅に削減した。
- M³PC:事前学習済みマスク付き軌道モデルのためのテスト時モデル予測制御オフライン強化学習2024/12/1
マスク付き自己符号化で事前学習した軌道モデルを、推論時にモデル予測制御(MPC)で活用し、追加学習なしで意思決定性能を向上させる手法を提案。
- DexDribbler: 動的監督による器用なサッカーマニピュレーションの学習マニピュレーション2024/3/1
脚ロボットが移動するボールを操作しながら走行するサッカー動作を、フィードバック制御による動的監督と改良されたボールモデル・推定器を用いてシミュレーションから実機へ転移学習する手法を提案。
- Making Parameterization and Constrains of Object Landmark Globally Consistent via SPD(3) Manifold and Improved Cost Functions2022/4/1
- SO-SLAM: Semantic Object SLAM with Scale Proportional and Symmetrical Texture Constraints2021/9/1