Yusuke Iwasawa
The University of Tokyo
収録論文 23本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PHASE: コンプライアンス対応触覚位相検索による少数ショット挿入学習触覚2026/9/25
コンプライアント手首の触覚信号から挿入作業の位相を自動分割し、位相に整合した経験検索で少数デモからのペグ挿入学習を高精度化した。
- 行動類似性監督による潜在行動モデルの異機体間転移の改善VLA2026/9/17
潜在行動モデルにおいて、真の行動を予測する代わりに行動間の類似性を監督信号として用いることで、異なるロボット間での知識転移性能を向上させる手法を提案した。
- MINERVA: 操作ポリシーはどれだけ小さくできるか、LIBEROを解くために操作学習2026/9/3
LIBEROベンチマークを解くのに必要な最小のモデル容量を探るため、わずか0.54MパラメータのコンパクトなポリシーMINERVAを提案し、95.1%の成功率を達成。大規模VLAモデルと同等性能を桁違いに少ないパラメータで実現した。
- DREAM: 実世界からシミュレーションへの変換による展開時デモ生成でスケーラブルなポリシー適応を実現VLA2026/8/29
新しい作業環境でVLAモデルを微調整するためのデモデータを、人間の遠隔操作なしに自動生成するフレームワークDREAMを提案。実環境を再構築し、言語指示からタスク目標を自動翻訳して軌道を計画し、シミュレーションでデータを増強してVLAを微調整する。
- マルチモーダルロボットデモにおける指示と軌道の不一致の監査VLA2026/8/1
ロボットのデモデータセットに含まれる、正しい動作だが誤った指示が付与されたデータを検出・修正する監査手法を提案した。
- 複雑な動的システムにおけるフィードバックコントローラ設計のための大規模言語モデルのベンチマーキングと推論蒸留LLM/制御設計2026/8/1
複雑な動的システムのフィードバックコントローラ設計におけるLLMの性能を評価するベンチマークを構築し、エッジ展開向けに推論蒸留で小型モデルを開発した。
- 時間中心化SIGRegによるマルチタスク世界モデル学習の改善:分析から手法へ世界モデル2026/7/1
マルチタスク世界モデル学習で表現崩壊を防ぐSIGRegがタスク間の分離を圧縮する問題を発見し、潜在変数の周辺分布ではなく時間中心化残差に適用する手法を提案。LIBEROベンチマークで成功率を大幅に向上させた。
- NavWAM: 目標条件付き視覚ナビゲーションのためのナビゲーションワールドアクションモデルナビゲーション2026/6/11
将来の視覚予測と行動生成を統合した拡散トランスフォーマーポリシーを提案し、シミュレーション事前学習と実機適応により、計画ベースのワールドモデルより高い性能を実現した。
- E3VS-Bench: 3Dガウススプラッティングシーンにおける視点依存型能動知覚のベンチマーク視覚探索/ベンチマーク2026/4/20
5自由度の視点制御で視点依存の証拠を集める必要がある、3Dガウススプラッティングで再構築された高精細シーンを用いた視覚探索ベンチマークを提案し、複数のVLMと人間の性能差を評価した。
- SAIL: VLMを用いた文脈内模倣学習のためのテスト時スケーリング模倣学習2026/3/1
ロボットの模倣学習を反復的な軌道改善問題として捉え、モンテカルロ木探索と視覚言語モデルによる評価でテスト時の計算量を増やすほど成功率を高めるフレームワークSAILを提案。
- WorldPack: 長文脈動画世界モデリングのための動的フレーム圧縮動画世界モデル2025/12/2
3D視点の空間的関連性に基づいて過去フレームの圧縮率を動的に割り当てることで、長期的な動画世界モデルの生成品質を向上させる手法を提案。
- AIRoA MoMaデータセット:移動マニピュレーションのための大規模階層データセットマニピュレーション2025/9/1
移動マニピュレーション向けに、RGB画像・関節状態・6軸力覚センサ・ロボット内部状態を同期収録し、サブゴールとプリミティブ動作の2層注釈を付けた大規模実世界データセットを構築した。
- 観測を無駄にしない:VLAアクションチャンクのリアルタイム補正VLA2025/9/1
VLAモデルのアクションチャンクを制御ステップごとに軽量ヘッドで補正し、遅延や長期的タスクでも反応性を回復させる手法を提案。
- LLM誘導適応補償器:大規模言語モデルによる自動制御系への適応性の導入適応制御2025/7/1
未知システムと参照システムの応答差をLLMに提示し、補償器を設計させることで、モデル参照適応制御の枠組みで適応性を実現する手法を提案し、ソフトロボットとヒューマノイドで有効性を示した。
- 追加学習なしで拡散ポリシーを高速化する検索拡張生成拡散ポリシー2025/7/1
専門家の観測-行動ペアをベクトルDBに保存し、推論時に類似行動を検索して拡散ポリシーのノイズ除去ステップを短縮する手法を提案。追加学習なしで精度と速度のトレードオフを改善。
- SPARK: ロボットタスク計画のためのグラフベースオンライン意味統合システムタスク計画2025/6/1
環境中の手がかりから意味情報を抽出し、シーングラフをオンラインで更新してロボットのタスク計画に活用するフレームワークSPARKを提案。動的環境やジェスチャーなどの非典型的な空間的手がかりへの適応能力を向上させる。
- 基盤モデル時代のロボティクスにおける物理的リスク制御の包括的サーベイ安全性/リスク制御2025/5/1
基盤モデルを活用したロボティクス(FMR)の物理的リスクを、配備前・インシデント前・インシデント後の3段階に分けて制御手法を整理したサーベイ。
- TRAIL Team Description Paper for RoboCup@Home 20232023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- GenDOM: Generalizable One-shot Deformable Object Manipulation with Parameter-Aware Policy2023/9/1
- GenORM: Generalizable One-shot Rope Manipulation with Parameter-Aware Policy2023/6/1
- A System for Morphology-Task Generalization via Unified Representation and Behavior Distillation2022/11/1
- World Robot Challenge 2020 -- Partner Robot: A Data-Driven Approach for Room Tidying with Mobile Manipulator2022/7/1