Haruki Nishimura
収録論文 17本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ガウスで十分:大規模行動モデルのファインチューニングにフローマッチング事前分布は効かない模倣学習2026/9/22
大規模行動モデルのファインチューニングでは、目標に近い非ガウス事前分布を使っても標準ガウスと性能が変わらないことを大規模実験で示し、その理由を分析した論文。
- VLA Foundry: 視覚言語行動モデル訓練のための統合フレームワークVLA2026/4/1
LLM、VLM、VLAの訓練を単一コードベースで統合するオープンソースフレームワークを提案し、スクラッチからの訓練と事前学習済みバックボーンを用いた訓練の両方をサポートし、シミュレータ上で評価した。
- 二値的成功を超えて:サンプル効率的で統計的に厳密なロボットポリシー比較評価・ベンチマーク2026/3/1
ロボット操作ポリシーの評価を少数の実機試行で行う際に、サンプル効率的で統計的に厳密な比較フレームワークを提案。逐次検定により早期停止を可能にし、離散的な部分成功から連続的な報酬まで幅広い指標に対応する。
- 異なる失敗がロボットの知覚信頼性に与える影響HRI/信頼性2026/3/1
ロボットの失敗の種類(滑り、停止、誤動作)が人間の信頼感に与える影響を調べ、失敗後の成功が信頼回復に有効であることを示した研究。
- ロボットマニピュレーションのための大規模行動モデルの共訓練におけるデータモダリティと戦略の系統的研究マニピュレーション2026/2/1
ロボット操作のための大規模行動モデルを共訓練する際に、5種類のデータモダリティと訓練戦略が性能に与える影響を大規模実験で調査し、視覚言語データと異なる身体のロボットデータの共訓練が汎化を大幅に改善することを示した。
- マルチタスク巧みな操作のための大規模行動モデルの慎重な検証マニピュレーション2025/7/1
大規模行動モデル(LBM)をシミュレーションと実世界で厳密に評価し、マルチタスク事前学習が単一タスクより成功率・堅牢性・データ効率を高めることを統計的に示した。
- SAFE: 視覚言語行動モデル向けマルチタスク故障検知VLA2025/6/1
VLAの内部特徴からタスク失敗の可能性を予測する汎用的な故障検知器SAFEを提案し、未見タスクでも高精度・早期検知を実現した。
- CUPID: 影響関数でロボットが好むデータを選別模倣学習2025/6/1
模倣学習において、各デモンストレーションが方策の性能に与える影響を影響関数で推定し、有害なデータを除去・有益なデータを選択するデータキュレーション手法を提案。
- STITCH-OPE: ガイド付き拡散による軌道スティッチングを用いたオフポリシー評価オフポリシー評価2025/5/1
行動データで事前学習した拡散モデルを目標方策のスコアでガイドし、部分軌道を繋ぎ合わせることで、高次元・長期間のオフポリシー評価を低分散で行う手法を提案した。
- 失敗データなしで失敗を検出できるか?模倣学習ポリシーの不確実性を考慮した実行時失敗検出マニピュレーション2025/3/1
模倣学習ポリシーの失敗を、成功データのみから逐次的な分布外検出として捉え、不確実性を定量化するスカラー信号とConformal Predictionで検出する手法FAIL-Detectを提案。
- 模倣学習ポリシーの比較:準最適停止を伴う統計的検定模倣学習2025/3/1
少数試行で2つの模倣学習ポリシーを厳密に比較するため、逐次的に試行数を適応させる準最適停止型の統計的検定手法を提案し、実機マニピュレーション実験で有効性を示した。
- 行動クローニング方策の汎化性能を統計的に評価する枠組みVLA2024/5/1
少数のロールアウトから、行動クローニング方策の性能分布の下限をユーザー指定の信頼度で保証する統計的評価フレームワークを提案し、シミュレーションと実機で検証した。
- In-Distribution Barrier Functions: Self-Supervised Policy Filters that Avoid Out-of-Distribution States2023/1/1
- RAP: Risk-Aware Prediction for Robust Planning2022/10/1
- RAT iLQR: A Risk Auto-Tuning Controller to Optimally Account for Stochastic Model Mismatch2020/10/1
- Risk-Sensitive Sequential Action Control with Multi-Modal Human Trajectory Forecasting for Safe Crowd-Robot Interaction2020/9/1
- SACBP: Belief Space Planning for Continuous-Time Dynamical Systems via Stochastic Sequential Action Control2020/2/1