Suvir Mirchandani
収録論文 14本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboCade:ロボットデータ収集をゲーム化データ収集2025/12/1
一般ユーザーが遠隔操作でゲーム感覚でロボットのデモデータを収集できるプラットフォームを開発し、そのデータで訓練した方策が対象タスクの成功率を16〜56%向上させることを示した。
- ロボティクスにおけるバッチオンライン強化学習で重要な要素は何か?強化学習2025/5/1
自律収集データからのバッチオンライン強化学習において、アルゴリズムクラス・方策抽出法・方策表現力の3軸を体系的に検証し、Q関数の利用と暗黙的な方策抽出が性能向上に重要であることを示した。
- 効率的な身体性推論のための学習戦略VLA2025/5/1
ロボットのChain-of-Thought推論がなぜ有効かを分析し、軽量で高速な代替推論手法を提案した論文。
- 相互情報量推定によるロボットデモデータの品質選別模倣学習2025/2/1
ロボットの模倣学習データについて、状態と行動の相互情報量への各軌道の寄与をVAE埋め込みとk近傍推定で評価し、デモの品質を選別する手法を提案した。
- 行動ラベルなしデータからの推論による方策の汎化VLA2025/2/1
人間の動画から言語ベースの推論を学習し、ロボットの行動ラベルなしデータを活用して汎化性能の高いロボット方策を訓練する手法RADを提案した。
- 自律ロボットデータ収集のスケールアップは本当に可能か?自律データ収集2024/11/1
自律模倣学習によるデータ収集は、実世界でのスケールアップにおいて環境設計の課題など強化学習と同様の限界に直面することを実験的に示した研究。
- RoboCrowd: クラウドソーシングによるロボットデータ収集のスケーリングデータ収集2024/11/1
クラウドソーシングとインセンティブ設計でロボット模倣学習用の人間デモデータ収集を分散・拡張する枠組みを提案し、大学カフェでの2週間実験で200人以上から800エピソード超を収集した。
- ボーカルサンドボックス:状況に応じた人とロボットの協働のための継続学習と適応人ロボット協働2024/11/1
音声対話やキネステティック教示など多様な教示から、ロボットが低レベル技能と高レベル計画を継続的に学習・適応する枠組みを提案し、ギフト袋詰めとLEGOストップモーション制作で有効性を示した。
- DROID: 大規模実環境ロボットマニピュレーションデータセットマニピュレーション2024/3/1
北米・アジア・欧州の50名が12ヶ月かけて564シーン・84タスクで収集した76k軌道・350時間のロボット操作データセットを構築し、学習ポリシーの性能と汎化性能が向上することを示した。
- RoboVQA: Multimodal Long-Horizon Reasoning for Robotics2023/11/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Large Language Models as General Pattern Machines2023/7/1
- Assistive Teaching of Motor Control Tasks to Humans2022/11/1
- ELLA: Exploration through Learned Language Abstraction2021/3/1