Koushil Sreenath
University of California, Berkeley
収録論文 101本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ChronoGraph: 視覚言語モデルによる機能的な4Dシーングラフで相互作用理解と接地計画を実現VLA2026/9/30
行動によるシーンの変化を4Dシーングラフとして表現し、視覚言語モデルで理解と計画を統合する手法を提案。グラフを思考連鎖として学習させ、実世界の移動マニピュレーションにも応用した。
- HiRE: 後知恵報酬編集による方策ファインチューニング強化学習2026/9/22
成功・失敗軌跡を後知恵で対比し、基盤表現モデルの報酬を制御中心に校正する訓練不要の枠組みを提案。
- ResSafe: 残差強化学習によるヒューマノイドの安全フィルタリングヒューマノイド制御2026/9/14
ヒューマノイド制御において、タスク遂行ポリシーと安全補正ポリシーを分離し、残差強化学習で安全フィルタを学習する手法を提案。
- 学習された停止可能性値によるヒューマノイドの安全停止ヒューマノイド制御2026/9/2
ヒューマノイドの緊急停止を到達回避問題として捉え、学習した停止ポリシーと停止可能性推定器を組み合わせたタスク非依存のフレームワークを提案。安全に停止できる場合のみ停止し、不可能な場合はフォールバック動作に切り替える。
- ODEWorld: 物理時間の流れに基づく連続予測アーキテクチャ世界モデル2026/7/1
物理世界の連続的な時間を捉えるため、常微分方程式(ODE)を用いた連続時間の潜在世界モデルを提案し、離散時間モデルの限界を克服した。
- Action QFormer: 行動監視下での構造化表現形成による視覚言語行動モデルの性能向上VLA2026/7/1
視覚言語行動モデルにおいて、行動監視が継承したマルチモーダル表現を形成する役割を分析し、クエリベースのインターフェースを導入して行動に適した表現を再構成することで、ゼロショットsim-to-realナビゲーションの成功率を大幅に向上させた。
- LieIPM: 剛体の直接軌道最適化のためのリー群内点法軌道最適化2026/6/9
剛体の軌道最適化をリー群上で直接行う構造を考慮したフレームワークを提案し、特異点を回避しつつ高速に収束する内点法を開発した。
- LadderMan: 人型ロボットによる知覚的梯子登りの学習歩行2026/6/4
人型ロボットが様々な梯子を頑健に登り、梯子上での操作も行える統一システムを提案。シミュレーションで学習したポリシーを実機にゼロショット転送し、多様な梯子形状での登攀と操作タスクを実現した。
- VLK: 再構築シーンでの合成インタラクションによるヒューマノイドの移動操作学習ヒューマノイド/移動操作/sim2real2026/6/1
3Dガウススプラッティングで再構築した屋内シーンで、視覚・言語・運動のペアデータを合成生成し、ヒューマノイドの移動操作ポリシーを学習する手法を提案。実機Unitree G1でナビゲーションと物体運搬を実証した。
- 動的不確実性下でのロバストな敵対的方策最適化強化学習/ロバスト制御2026/4/1
強化学習の方策が訓練時と異なる動的環境で失敗する問題に対し、双対問題に基づく温度パラメータを敵対的ネットワークで近似し、軌道レベルとモデルレベルの両方で敵対的サンプリングを行うロバストな方策最適化手法を提案した。
- WOMBET: ワールドモデルに基づく経験転移によるロバストでサンプル効率的な強化学習強化学習2026/4/1
ソースタスクでワールドモデルを学習し、不確実性ペナルティ付き計画でオフラインデータを生成・フィルタリングしてから、ターゲットタスクでオンライン微調整する経験転移フレームワークを提案した。
- 凸集合間の成長距離を高速計算するためのレイ交差アルゴリズム幾何計算/最適化2026/4/1
凸集合間の成長距離を、ミンコフスキー差集合上のレイ交差問題に帰着させ、内外の多面体近似を反復構築して解く高速アルゴリズムを提案した。
- SPARK: ヒューマノイドロボットにおける骨格パラメータ整合リターゲティングと運動力学的軌道最適化ヒューマノイド/動作生成/軌道最適化2026/3/1
人間の動作データをヒューマノイドロボット用に変換する2段階パイプラインを提案。骨格構造をロボットに合わせて較正し、運動力学的軌道最適化で動的に実現可能な自然な動作参照を生成する。
- RPL: 複雑地形におけるロバストな人型知覚移動の学習歩行2026/2/1
2段階の学習フレームワークにより、複数の深度カメラを用いて複雑な地形を多方向に歩行し、荷物を積んでもロバストな人型ロボットの移動を実現した。
- mjlab:GPU加速ロボット学習のための軽量フレームワークロボット学習フレームワーク2026/1/1
GPU加速物理シミュレーションとモジュール式環境を組み合わせた、最小限のセットアップで使える軽量なロボット学習フレームワークを提案。
- 不完全なシミュレーションから器用な操作スキルを学習するsim2real2025/12/1
シミュレーションで学習した方策をテレオペレーションのスキルプリミティブとして使い実世界の触覚・固有感覚データを収集し、触覚入りの行動クローニングでナット締めやネジ回しを実現するsim-to-realフレームワークを提案。
- MomaGraph: 視覚言語モデルによる状態認識統合シーングラフと身体性タスクプランニングVLA2025/12/1
家庭内の移動マニピュレータ向けに、空間的・機能的関係と物体状態を統合したシーングラフ表現MomaGraphと、大規模データセット・評価ベンチマーク・強化学習で訓練した7B視覚言語モデルMomaGraph-R1を提案し、ゼロショットタスクプランニングで最先端性能を達成した。
- 選択ポリシーによる協調型ヒューマノイドマニピュレーションマニピュレーション2025/12/1
モジュール式遠隔操作で収集したデータを用い、複数の候補行動を生成・評価する模倣学習「Choice Policy」でヒューマノイドの全身協調マニピュレーションを実現した。
- CHyLL: ハイブリッドシステムの連続ニューラル表現学習ハイブリッドシステム/ニューラル表現学習2025/12/1
ハイブリッドシステムのダイナミクスを、軌道分割やモード切替なしに連続的なニューラル表現として学習する手法を提案し、流れの高精度予測やトポロジー不変量の同定、確率的最適制御への応用を示した。
- ヒューマノイドの接触計画のための自己視点ワールドモデル接触計画2025/10/1
自己視点の深度画像と固有感覚から、学習したワールドモデルとMPCを組み合わせてヒューマノイドの接触を伴う動作計画を実現した研究。
- RoVerFly: クアッドロータ・ペイロード系のロバストで汎用的な暗黙的ハイブリッド制御飛行制御/ハイブリッド制御2025/9/1
単一の強化学習ポリシーを暗黙的なハイブリッド制御器として用い、ペイロードの有無や質量・ケーブル長が変化しても再調整なしで適応するクアッドロータの軌道追従制御を実現した。
- BeyondMimic: 誘導拡散による運動追従から多様なヒューマノイド制御へヒューマノイド制御2025/8/1
単一の運動追従フレームワークでアクロバティックな動作を学習し、潜在拡散モデルと分類器誘導により未知のタスクへゼロショット転移する手法を提案。
- HITTER: 階層的計画と学習によるヒューマノイド卓球ロボットヒューマノイド2025/8/1
モデルベースの軌道予測・ラケット計画と強化学習による全身制御を組み合わせ、人間と106連続ラリーできるヒューマノイド卓球システムを実現した。
- 動的モーフィング翼飛行における空気力推定羽ばたき翼/空気力推定2025/8/1
ハミルトン力学に基づく物理オブザーバとニューラルネットワーク回帰の2手法で、羽ばたき翼ロボットAerobatの空気力を推定し、6軸ロードセルで評価した。
- IteraOptiRacing: 反復最適性能のためのリアルタイム自動運転レース向け統合計画・制御フレームワーク自動運転レース2025/7/1
自動運転レースにおいて、i2LQRを基にした統合計画・制御戦略を提案し、周囲の動的障害物を考慮しつつラップタイムを改善する。
- LeVERB: 潜在視覚言語指示によるヒューマノイド全身制御VLA2025/6/1
ヒューマノイドの全身制御向けに、視覚言語ポリシーが潜在的な行動語彙を学習し、強化学習ベースの全身制御ポリシーがそれを実行する階層型フレームワークを提案。150以上のタスクを含む初のsim-to-real対応ベンチマークで評価し、単純な階層型VLAより7.8倍高い成功率を達成。
- 四足歩行ロボットチームによる実世界での協調・競争サッカーに向けてマルチエージェント強化学習2025/5/1
階層型マルチエージェント強化学習により、四足歩行ロボットが自律的に協調・競争サッカーを行うフレームワークを提案し、実機でロボット同士や人間との試合を実現した。
- HuB: 極限ヒューマノイドバランスの学習ヒューマノイド制御2025/5/1
ヒューマノイドロボットが片足立ちや高蹴りなどの極限的なバランス課題を強化学習で獲得するための、参照動作修正・バランス認識方策学習・sim-to-realロバスト訓練を統合したフレームワークを提案。
- Berkeley Humanoid Lite:オープンソースで入手しやすくカスタマイズ可能な3Dプリントヒューマノイドロボットの実演ヒューマノイド/オープンソースハードウェア2025/4/1
市販部品とデスクトップ3Dプリンタで作れる低コスト(5000ドル以下)のオープンソースヒューマノイドロボットを開発し、強化学習による歩行制御でその能力を実証した。
- LangWBC: 言語指示によるヒューマノイド全身制御のエンドツーエンド学習VLA2025/4/1
言語コマンドを直接解釈してヒューマノイドの全身動作を生成するエンドツーエンド方策を、強化学習と方策蒸留およびCVAE構造で実現し、実機で検証した。
- RoboCopilot:ロボットマニピュレーションのための人間参加型インタラクティブ模倣学習マニピュレーション2025/3/1
人間と自律方策の間でシームレスに制御を切り替えられる双方向テレオペレーションシステムを提案し、双腕マニピュレーションタスクの効率的な学習を実現した。
- 速度障害物に基づく制御バリア関数を用いた動的衝突回避衝突回避2025/3/1
加速度制御ユニサイクルロボットに対し、速度空間で速度障害物ベースの制御バリア関数(VOCBF)を構築し、混合整数二次計画問題として安全臨界制御器を定式化することで、高速移動障害物を含む動的環境での衝突回避性能を向上させた研究。
- 四足歩行ロボットチームによるケーブル牽引荷物の分散ナビゲーション:MARLアプローチ群制御2025/3/1
複数の四足歩行ロボットがケーブルで繋がれた荷物を協調して牽引し、障害物を避けながら狭い環境をナビゲートするための分散型マルチエージェント強化学習プランナーを開発した。実機で1~4台、シミュレーションで最大12台のロボットでの有効性を実証した。
- Diffuse-CLoC: 物理ベースキャラクターの先読み制御のための誘導拡散拡散モデル/キャラクター制御2025/3/1
状態と行動の同時分布を単一の拡散モデルで学習し、予測状態に条件付けすることで、物理的に実現可能で操縦可能な先読み制御を実現した研究。
- MuJoCo Playground:ロボット学習のためのオープンソースフレームワークsim2real2025/2/1
MJX上に構築された完全オープンソースのロボット学習フレームワークで、単一GPUで数分以内に方策を訓練でき、四足歩行・ヒューマノイド・多指ハンド・ロボットアームなど多様なプラットフォームでゼロショットsim-to-real転移を実現する。
- DDAT: 動的に実行可能なロボット軌道を強制する拡散ポリシー拡散ポリシー2025/2/1
拡散モデルを用いてロボットの運動方程式に厳密に従う実行可能な軌道を生成するため、学習と推論の両方で予測を動的実行可能多様体に射影する手法を提案。
- 動画予測ポリシー:予測的視覚表現を持つ汎用ロボットポリシーVLA2024/12/1
動画拡散モデルが持つ未来予測的な視覚表現を活用し、ロボット操作のための汎用ポリシーを学習する手法を提案。Calvinベンチマークと実世界の巧緻操作で大幅な性能向上を達成した。
- 不整地における四足ロボットのオンライン全方向跳躍軌道計画跳躍/軌道計画2024/11/1
不整地で四足ロボットが全方向に跳躍するための、軌道生成・追従制御・着地制御を統合したオンライン最適化フレームワークを提案し、運動学的制約を考慮した高速進化アルゴリズムと着地後の高精度位置推定を実現した。
- 鳥に着想を得た羽ばたき翼ロボットの学習ベース軌道追従飛行制御2024/11/1
強化学習を用いて、鳥型羽ばたき翼ロボットが複雑な翼軌道を学習し、安定飛行・飛行モード切替・様々な空力条件下での軌道追従を実現する制御フレームワークを提案した。
- 実世界の視覚データから学習する走破性認識型脚式ナビゲーション歩行2024/10/1
脚式ロボットの制御器の価値関数に基づいて走破性コストをロボット中心に推定し、RGBDナビゲーション計画に統合して実世界で効率的に強化学習する手法を提案した。
- 適応的な非把持移動マニピュレーションによる対話型ナビゲーション移動マニピュレーション2024/10/1
未知の動特性を持つ屋内物体を押す操作のために、学習したSE(2)動特性表現をMPPI制御に統合し、物体を動かしながらナビゲーションする枠組みを提案した。
- Lipschitz制約付きポリシーによる滑らかなヒューマノイド歩行の学習歩行2024/10/1
方策にLipschitz制約を勾配ペナルティとして課すことで、低域通過フィルタや平滑化報酬を使わずに滑らかで頑健なヒューマノイド歩行制御を学習する手法を提案し、実機で検証した。
- CurricuLLM:大規模言語モデルを用いた複雑なロボットスキル学習のための自動タスクカリキュラム設計強化学習/カリキュラム学習/LLM2024/9/1
大規模言語モデルを活用して、ロボットの複雑なタスクを段階的なサブタスクに分解し、報酬コードや目標分布コードを自動生成することで、カリキュラム学習を効率的に設計する手法を提案した。
- 深層学習ベースの到達可能性による歩行ロボットの歩容切替と安定化強化:2リンク歩行器の事例研究歩行2024/9/1
深層学習でハイブリッド脚ロボットの到達可能領域を近似し、歩容ごとの安定領域を推定して外乱に応じた歩容切替と安定化制御を実現した。
- Berkeley Humanoid:学習ベース制御のための研究プラットフォーム歩行2024/7/1
低コストで信頼性の高い中型ヒューマノイドロボットを開発し、軽度のドメインランダム化を用いた強化学習制御により、屋外の様々な地形での俊敏な歩行や跳躍を実現した。
- HiLMa-Res: 残差強化学習による四脚ロボットの移動と操作を統合する汎用階層フレームワーク移動操作2024/7/1
四脚ロボットが歩行しながら脚で操作を行うための階層型強化学習フレームワークを提案し、実機で複数の移動操作タスクにおいて既存手法より優れた性能を示した。
- 大規模言語モデルを用いた四足歩行ロボットの長期的な移動と操作VLA2024/4/1
大規模言語モデルを活用し、四足歩行ロボットが長期的なタスクを計画・実行するシステムを構築した。強化学習による運動・操作スキルと組み合わせ、道具の作成や人間への助け要請などの複雑な行動を実現した。
- DiffuseLoco: オフラインデータセットからの拡散モデルによるリアルタイム脚式移動制御歩行2024/4/1
オフラインデータセットから拡散モデルを用いて多様な脚式移動スキルを学習し、実機の四足ロボットでリアルタイム制御とゼロショット転移を実現したフレームワーク。
- 適応的エネルギー正則化による四足歩行の自律的歩容遷移と省エネルギー化歩行2024/3/1
エネルギー消費を最小化する適応的な報酬設計により、四足ロボットが速度に応じて歩容を自律的に切り替え、省エネで安定した移動を実現する手法を提案した。
- 四足歩行ロボットの脚による実世界操作をデモンストレーションから学習マニピュレーション2024/3/1
四足歩行ロボットが脚のみを使って物体を操作できるよう、強化学習ベースの低レベル制御と模倣学習ベースの高レベル計画を組み合わせた手法を提案し、実機で籠の持ち上げやボタン押しなどを実現した。
- 脚式ロコモーション制御における対称性を活用した強化学習歩行2024/3/1
脚式ロボットの強化学習において、ネットワークの同変・不変性やデータ拡張で対称性を組み込み、サンプル効率と歩容品質を改善し実機へゼロショット転移できることを示した。
- 次トークン予測としてのヒューマノイド歩行歩行2024/2/1
センサ運動軌跡を自己回帰的に次トークン予測するTransformerで学習し、実機ヒューマノイドをサンフランシスコでゼロショット歩行させた研究。
- Reinforcement Learning for Versatile, Dynamic, and Robust Bipedal Locomotion Control2024/1/1
- Constraint-Guided Online Data Selection for Scalable Data-Driven Safety Filters in Uncertain Robotic Systems2023/11/1
- Prompt a Robot to Walk with Large Language Models2023/9/1
- Control Barrier Functions for Collision Avoidance Between Strongly Convex Regions2023/6/1
- Velocity Obstacle for Polytopic Collision Avoidance for Distributed Multi-robot Systems2023/4/1
- Real-World Humanoid Locomotion with Reinforcement Learning2023/3/1
- i2LQR: Iterative LQR for Iterative Tasks in Dynamic Environments2023/2/1
- Robust and Versatile Bipedal Jumping Control through Reinforcement Learning2023/2/1
- In-Distribution Barrier Functions: Self-Supervised Policy Filters that Avoid Out-of-Distribution States2023/1/1
- Walking in Narrow Spaces: Safety-critical Locomotion Control for Quadrupedal Robots with Duality-based Optimization2022/12/1
- Iterative Convex Optimization for Model Predictive Control with Discrete-Time High-Order Control Barrier Functions2022/10/1
- Creating a Dynamic Quadrupedal Robotic Goalkeeper with Reinforcement Learning2022/10/1
- GenLoco: Generalized Locomotion Controllers for Quadrupedal Robots2022/9/1
- Lyapunov Design for Robust and Efficient Robotic Reinforcement Learning2022/8/1
- Hierarchical Reinforcement Learning for Precise Soccer Shooting Skills using a Quadrupedal Robot2022/8/1
- Collaborative Navigation and Manipulation of a Cable-towed Load by Multiple Quadrupedal Robots2022/6/1
- Bridging Model-based Safety and Model-free Reinforcement Learning through System Identification of Low Dimensional Linear Models2022/5/1
- Adapting Rapid Motor Adaptation for Bipedal Robots2022/5/1
- Perception-aware receding horizon trajectory planning for multicopters with visual-inertial odometry2022/4/1
- Bayesian Optimization Meets Hybrid Zero Dynamics: Safe Parameter Learning for Bipedal Locomotion Control2022/3/1
- Learning Torque Control for Quadrupedal Locomotion2022/3/1
- Tethered Power for a Series of Quadcopters: Analysis and Applications2022/3/1
- Teaching Robots to Span the Space of Functional Expressive Motion2022/3/1
- Learning Differentiable Safety-Critical Control using Control Barrier Functions for Generalization to Novel Environments2022/1/1
- Computation of Regions of Attraction for Hybrid Limit Cycles Using Reachability: An Application to Walking Robots2022/1/1
- Autonomous Racing with Multiple Vehicles using a Parallelized Optimization with Safety Guarantee using Control Barrier Functions2021/12/1
- Vision-aided Dynamic Quadrupedal Locomotion on Discrete Terrain using Motion Libraries2021/10/1
- Safety-Critical Control and Planning for Obstacle Avoidance between Polytopes with Control Barrier Functions2021/9/1
- Autonomous Navigation of Underactuated Bipedal Robots in Height-Constrained Environments2021/9/1
- Real-time Geo-localization Using Satellite Imagery and Topography for Unmanned Aerial Vehicles2021/8/1
- Duality-based Convex Optimization for Real-time Obstacle Avoidance between Polytopes with Control Barrier Functions2021/7/1
- Autonomous Navigation for Quadrupedal Robots with Optimized Jumping through Constrained Obstacles2021/7/1
- Enhancing Feasibility and Safety of Nonlinear Model Predictive Control with Discrete-Time Control Barrier Functions2021/5/1
- Legged Robot State Estimation in Slippery Environments Using Invariant Extended Kalman Filter with Velocity Update2021/4/1
- Robotic Guide Dog: Leading a Human with Leash-Guided Hybrid Physical Interaction2021/3/1
- Reinforcement Learning for Robust Parameterized Locomotion Control of Bipedal Robots2021/3/1
- Scalable Learning of Safety Guarantees for Autonomous Systems using Hamilton-Jacobi Reachability2021/1/1
- Animated Cassie: A Dynamic Relatable Robotic Character2020/9/1
- Dynamic Legged Manipulation of a Ball Through Multi-Contact Optimization2020/8/1
- Safety-Critical Model Predictive Control with Discrete-Time Control Barrier Function2020/7/1
- Robust Safety-Critical Control for Dynamic Robotics2020/5/1
- Reinforcement Learning for Safety-Critical Control under Model Uncertainty, using Control Lyapunov Functions and Control Barrier Functions2020/4/1
- Improving Input-Output Linearizing Controllers for Bipedal Robots via Reinforcement Learning2020/4/1
- Staging energy sources to extend flight time of a multirotor UAV2020/3/1
- Multiple quadrotors carrying a flexible hose: dynamics, differential flatness and control2019/11/1
- Feedback Control for Autonomous Riding of Hovershoes by a Cassie Bipedal Robot2019/7/1
- Feedback Control of an Exoskeleton for Paraplegics: Toward Robustly Stable Hands-free Dynamic Walking2018/2/1
- Deep Visual Perception for Dynamic Walking on Discrete Terrain2017/12/1
- Torque Saturation in Bipedal Robotic Walking through Control Lyapunov Function Based Quadratic Programs2013/2/1