Shankar Sastry
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CaP-X: ロボットマニピュレーションのためのコーディングエージェントのベンチマークと改善フレームワークマニピュレーション2026/3/1
コードを方策として使うエージェントを体系的に評価する環境CaP-GymとベンチマークCaP-Benchを構築し、テスト時計算の拡張で人間レベルの信頼性を達成する手法を提案した。
- ヒューマノイドのピクセル入力から行動へのポリシー転移におけるSim-to-Realの扉を開くsim2real2025/12/1
GPU加速のフォトリアルシミュレーションと教示者-生徒-ブートストラップ学習を用い、RGB画像のみからヒューマノイドが多様な扉を開けるロコマニピュレーションポリシーをシミュレーションだけで学習し、実機でゼロショット転移を実現した。
- VIRAL: ヒューマノイドの移動操作に向けた大規模視覚Sim-to-Realsim2real2025/11/1
シミュレーションのみでヒューマノイドの移動を伴う操作スキルを学習し、実機にゼロショット転移する視覚ベースのフレームワークを提案。大規模ドメインランダム化と実機整合により、Unitree G1上で連続的な移動操作を実現した。
- 部分観測環境における追跡者に依存しないチーム追跡戦略群制御2025/11/1
都市環境で2機のUAVが追跡者を追う問題に対し、深層強化学習で段階的に敵対的方策を訓練し、オンライン分類で最適応答を選ぶ二段階ニューロシンボリック手法を提案した。
- ランダムなおもちゃで遊んで何でも掴めるようになる学習マニピュレーション2025/10/1
球・直方体・円柱・リングの4つの基本形状をランダムに組み合わせた「おもちゃ」で訓練することで、実世界の多様な物体をゼロショットで掴める汎化可能な把持方策を実現した研究。
- 部分的に観測可能な都市環境における人間中心の火災避難を支援する協調自律ドローン群制御2025/10/1
火災避難時に人間のパニック行動を考慮し、2種類のUAVが協調して避難者を探索・誘導するPOMDPベースの強化学習フレームワークを提案。
- DreamControl: 拡散モデル誘導による人間模倣型全身ヒューマノイドのシーンインタラクション制御ヒューマノイド全身制御2025/9/1
人間の動作データで学習した拡散モデルを事前分布として強化学習を誘導し、ヒューマノイドが全身で物体操作やシーンインタラクションを行うスキルを獲得する手法を提案。Unitree G1で実機検証も行った。
- LeVERB: 潜在視覚言語指示によるヒューマノイド全身制御VLA2025/6/1
ヒューマノイドの全身制御向けに、視覚言語ポリシーが潜在的な行動語彙を学習し、強化学習ベースの全身制御ポリシーがそれを実行する階層型フレームワークを提案。150以上のタスクを含む初のsim-to-real対応ベンチマークで評価し、単純な階層型VLAより7.8倍高い成功率を達成。
- α-RACER: 近ポテンシャル関数を用いた自律レースのためのゲーム理論的運動計画と制御のリアルタイムアルゴリズムゲーム理論的運動計画2024/12/1
自律レースにおける複数車両の競争(追い越しやブロッキング)をゲーム理論でモデル化し、近ポテンシャル関数を学習して近似ナッシュ均衡をリアルタイムに計算する手法を提案。3台のヘッドツーヘッドレースで既存手法を上回る性能を示した。
- Hacking Predictors Means Hacking Cars: Using Sensitivity Analysis to Identify Trajectory Prediction Vulnerabilities for Autonomous Driving Security2024/1/1
- Lyapunov Design for Robust and Efficient Robotic Reinforcement Learning2022/8/1
- Geometric Models of Rolling-Shutter Cameras2005/3/1