Keisuke Shirai
National Institute of Advanced Industrial Science and Technology
収録論文 8本 ・ フィジカルAI/ロボット学習
VLA模倣学習基盤モデル模倣学習/操作両腕マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TOAST: 自己回帰型視覚-言語-行動モデルのための確率的ロボット行動トークン化VLA2026/10/1
同じ行動列を複数のトークン列で表現できる冗長性を活かし、学習時に確率的にサンプリングするトークン化手法を提案。データが少ないほど精度が向上し、実機タスクでも有効性を示した。
- ロボット模倣学習のための固有感覚と能動的行動に基づく指先センシングの自己教師ありアンカリング模倣学習2026/9/24
指先の触覚・近接センサを固有感覚と行動に自己教師ありで対応付け、接触前後の情報を活用して模倣学習の成功率を高める手法を提案。
- ロボット基盤モデルにおける身体性ギャップ基盤モデル2026/8/19
ロボット基盤モデル(RFM)の汎化性能と実ロボットへの適用に必要な作業の差を「身体性ギャップ」と定義し、既存手法を共有構造と適応段階の2軸で整理したサーベイ論文。
- GuidedAttention: OODロバストなロボット操作のための解釈可能かつ修正可能な視覚的注意機構模倣学習/操作2026/7/1
視覚運動ポリシーに解釈可能で修正可能な注意キーポイントを中間表現として導入し、ユーザーが初期化時に修正可能な模倣学習フレームワークを提案。シミュレーションと実世界でOOD条件下での操作性能を向上させた。
- RoboManipBaselines:実機とシミュレーションを横断するロボットマニピュレーション模倣学習の統合フレームワーク模倣学習2025/9/1
データ収集・方策学習・実行までを一貫して行える模倣学習用のオープンソース基盤を提案し、複数シミュレータと実機ロボットに対応したベンチマークと応用例を示した。
- 長期的な両腕タスク・動作計画のための接地された視覚言語インタプリタ両腕マニピュレーション2025/6/1
視覚言語モデルでPDDL仕様を生成し、タスク・動作計画と修正計画を組み合わせて、検証可能な両腕ロボットの調理タスクを実現する枠組みを提案。
- KeyMPs: 遮蔽の多いタスクに向けたDMPシーケンスによるワンショット視覚言語誘導動作生成VLA2025/4/1
視覚言語モデル(VLM)の高レベル推論と空間認識を活用し、キーワードラベル付きプリミティブ選択とキーポイントペア生成によってDMPを連結し、遮蔽が多いタスクでもワンショットで複雑なロボット動作を生成するフレームワークを提案。
- Vision-Language Interpreter for Robot Task Planning2023/11/1