Naoaki Kanazawa
収録論文 19本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- YUBI: 両手巧緻操作のための指追従型ユニバーサル双指インターフェースの大規模展開データ収集/両手操作2026/6/1
指の動きをそのままグリッパーに伝える新しい手持ち型データ収集デバイスYUBIを開発し、両手での細かい操作タスクの大規模データセット(8,434時間・120万エピソード)を収集。このデータで訓練した単一ポリシーが複数のロボットに直接転移可能であることを実証した。
- 大規模言語モデルと多目的ブラックボックス最適化による効率的なロボット設計設計最適化2025/11/1
ブラックボックス最適化に大規模言語モデルを組み合わせ、ロボットの身体設計をより少ない試行で効率的に探索する手法を提案した。
- 根元中心の毛束調整のための経路計画を用いた前髪スタイリングロボットシステムマニピュレーション2025/1/1
前髪の目標スタイルとの毛流れの違いを画像から解析し、毛束の根元を狙って経路計画と閉ループ制御でブラッシング・スタイリングを行うロボットシステムを提案した。
- 基盤モデルを用いたグローバルタスク計画とローカル行動拡張のための遠隔生活支援ロボットインターフェースシステムVLA2024/11/1
言語指示にテンプレート変数を用いて不確実な情報を伝え、基盤モデルでロボットの行動を計画・拡張する遠隔生活支援システムを提案し、実タスクで有効性を示した。
- 基盤モデルとPDDLによる食材状態認識に基づく実世界調理ロボットシステムマニピュレーション2024/10/1
LLMとPDDLで調理行動を計画し、VLMで食材の状態を少量データから認識することで、PR2が実環境で新しいレシピ通りに調理を行うシステムを実現した。
- 事前学習済み視覚言語モデルの画像-テキスト検索とブラックボックス最適化によるロボット状態認識VLA2024/10/1
事前学習済み視覚言語モデルの画像-テキスト検索を利用し、複数の言語プロンプトとその重みをブラックボックス最適化で調整することで、再学習なしに多様な環境状態を認識する手法を提案。
- 事前学習済み視覚言語モデルとブラックボックス最適化によるロボットの環境状態認識VLA2024/9/1
事前学習済み視覚言語モデルとブラックボックス最適化を用いて、扉の開閉や水道の流水などの環境状態を統一的な手法で認識する。
- 全方向カメラと複数の視覚言語モデルによる事前知識不要の反射型オープンボキャブラリナビゲーションナビゲーション2024/8/1
全方向カメラと事前学習済み視覚言語モデルを組み合わせ、地図構築や学習なしで反射的に目標物体へ移動するロボットナビゲーション手法を提案し、Fetchロボットで検証した。
- 低剛性ロボットの経時的変化を考慮した視覚サーボの自己教師あり学習視覚サーボ2024/5/1
低剛性ロボットが自身の身体変化に適応しながら物体把持のための視覚サーボを自己教師あり学習で獲得する手法を開発し、6軸アームで有効性を確認した。
- 低剛性ロボットによる多様な表面素材とタスク定義を考慮した学習ベースの拭き動作マニピュレーション2024/3/1
低剛性ロボットが接触力の予測学習に基づき、様々な表面素材とタスク定義に応じて適切に拭き動作を行う手法を開発した。
- 料理ロボットのための連続的な物体状態認識:事前学習済み視覚言語モデルとブラックボックス最適化の活用視覚言語モデル2024/3/1
料理中の食品の状態変化を、事前学習済み視覚言語モデルを用いて画像とテキストの類似度から連続的に認識し、シグモイド関数へのフィッティングとブラックボックス最適化で重みを調整する手法を提案した。
- Daily Assistive View Control Learning of Low-Cost Low-Rigidity Robot via Large-Scale Vision-Language Model2023/12/1
- Binary State Recognition by Robots using Visual Question Answering of Pre-Trained Vision-Language Model2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Semantic Scene Difference Detection in Daily Life Patroling by Mobile Robots using Pre-Trained Large-Scale Vision-Language Model2023/9/1
- Recognition of Heat-Induced Food State Changes by Time-Series Use of Vision-Language Model for Cooking Robot2023/9/1
- Foundation Model based Open Vocabulary Task Planning and Executive System for General Purpose Service Robots2023/8/1
- Robotic Applications of Pre-Trained Vision-Language Models to Various Recognition Behaviors2023/3/1
- VQA-based Robotic State Recognition Optimized with Genetic Algorithm2023/3/1