Kei Ota
The University of Tokyo
収録論文 25本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CounterAlign: 視覚言語行動モデルのための反事実的監督VLA/強化学習2026/8/22
専門家のデモンストレーションのみから、指示を入れ替えることで反事実的なデータを合成し、オフライン強化学習の報酬モデルを学習する手法を提案。ロボット操作の堅牢性を向上させる。
- マルチモーダルロボットデモにおける指示と軌道の不一致の監査VLA2026/8/1
ロボットのデモデータセットに含まれる、正しい動作だが誤った指示が付与されたデータを検出・修正する監査手法を提案した。
- 少なく見て、多く指定する:汎用VLAのための視覚的証拠予算VLA2026/6/1
視覚言語行動(VLA)モデルの汎化を改善するため、指示を詳細な軌跡・サブタスク言語で再ラベルし、明示的な視覚的証拠予算を課して実行器を訓練するフレームワークS2を提案した。
- 視覚言語行動のための連続推論VLA2026/6/1
自然言語はタスクレベルの粒度であり連続制御には不向きなため、VLAポリシーに適した連続思考を導入し、共有ガウス潜在変数として自己検証目的で学習する手法を提案した。
- YUBI: 両手巧緻操作のための指追従型ユニバーサル双指インターフェースの大規模展開データ収集/両手操作2026/6/1
指の動きをそのままグリッパーに伝える新しい手持ち型データ収集デバイスYUBIを開発し、両手での細かい操作タスクの大規模データセット(8,434時間・120万エピソード)を収集。このデータで訓練した単一ポリシーが複数のロボットに直接転移可能であることを実証した。
- Touch2Insert: 触覚によるピンと穴の交差検出を用いたゼロショット挿入触覚/挿入2026/3/1
触覚センサでピンと穴の断面形状を再構成し、位置合わせにより未知形状のコネクタ挿入をゼロショットで実現する手法を提案。シミュレーションと実機で高い精度と成功率を確認した。
- 分散触覚センシングによる外部接触と把持内姿勢の同時推定触覚2025/12/1
触覚センサの局所観測と接触の物理制約をファクタグラフで統合し、物体の把持内姿勢と外部接触を同時推定する手法を提案。触覚のみでも既存手法を上回る精度を実現。
- AIRoA MoMaデータセット:移動マニピュレーションのための大規模階層データセットマニピュレーション2025/9/1
移動マニピュレーション向けに、RGB画像・関節状態・6軸力覚センサ・ロボット内部状態を同期収録し、サブゴールとプリミティブ動作の2層注釈を付けた大規模実世界データセットを構築した。
- 軌道最適化における微分可能な衝突検出のための解析的条件軌道最適化2025/9/1
物体間の非貫入制約を効率的に扱うため、解析的な微分可能条件を導入し、多面体を滑らかな半代数集合で近似することで衝突を考慮した軌道最適化を可能にした。
- 力覚と視覚フィードバックを用いた最適化ベースのデモンストレーションによるピボット操作の学習マニピュレーション2025/8/1
接触を考慮した軌道最適化でデモを生成し、それをガイドに強化学習を行うことで、視覚・力覚・固有感覚のみを用いたピボット操作を実機で実現した。
- クロスモダリティ注意によるモダリティ選択とスキル分割マニピュレーション2025/4/1
触覚や音声などの追加モダリティをロボット基盤モデルに組み込む際、各時点で最も有益なモダリティだけを選ぶクロスモダリティ注意機構を提案し、さらに熟練者のデモから基本スキルを分割して階層的政策を訓練することで、長期的で接触の多いマニピュレーション課題を解決できるようにした。
- ゼロショットペグ挿入:視覚言語モデルによる嵌合穴の特定とSE(2)姿勢推定マニピュレーション2025/3/1
視覚言語モデル(VLM)を用いて、未見の穴に対するペグ挿入をゼロショットで実現するフレームワークを提案し、嵌合穴の特定と姿勢推定を行い、PC背面パネルへのコネクタ挿入で88.3%の成功率を達成した。
- 自律ロボット組立:部品の分離から精密組立までマニピュレーション2024/6/1
ランダムに置かれた部品からギアボックスを自律的に組み立てるロボットシステムを提案し、視覚・触覚・力覚センサを用いた閉ループ制御で実現した。
- 外部接触を活用したロバストな把持内操作マニピュレーション2024/3/1
ロボットが物体を把持したまま環境との外部接触モードを維持しつつ把持内姿勢を同時に調整する操作を実現するため、把持内力学モデルとパラメータ誤差に頑健な計画法を提案した。
- Tactile Estimation of Extrinsic Contact Patch for Stable Placement2023/9/1
- Tactile-Filter: Interactive Tactile Perception for Part Mating2023/3/1
- H-SAUR: Hypothesize, Simulate, Act, Update, and Repeat for Understanding Object Articulations from Interactions2022/10/1
- Object Memory Transformer for Object Goal Navigation2022/3/1
- OPIRL: Sample Efficient Off-Policy Inverse Reinforcement Learning via Distribution Matching2021/9/1
- Training Larger Networks for Deep Reinforcement Learning2021/2/1
- Data-Efficient Learning for Complex and Real-Time Physical Problem Solving using Augmented Simulation2020/11/1
- Deep Reactive Planning in Dynamic Environments2020/11/1
- Efficient Exploration in Constrained Environments with Goal-Oriented Reference Path2020/3/1
- Can Increasing Input Dimensionality Improve Deep Reinforcement Learning?2020/3/1
- Trajectory Optimization for Unknown Constrained Systems using Reinforcement Learning2019/3/1