Stefan Lee
Oregon State University
収録論文 23本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 平面果樹園における視覚運動ロボット剪定のためのハイブリッド強化学習マニピュレーション2026/9/21
シミュレーションと合成データのみで学習した視覚運動制御器により、平面仕立てのリンゴとサクランボの木をロボットで剪定し、実環境へゼロショット転移を実現した。
- 3Dポイントワールドモデル:点群補完による高精度なダイナミクス学習ワールドモデル2026/7/1
部分点群を補完してから行動条件付きダイナミクスを学習する、3D空間で動作するタスク非依存のワールドモデルを提案し、長期的なロールアウトとモデルベース計画の精度を向上させた。
- 不確実性下での高精度接触操作のためのハイブリッド制御ポリシーの学習マニピュレーション2026/4/1
強化学習を用いて、位置制御と力制御を動的に切り替えるハイブリッド制御ポリシーを学習し、不確実性の高い環境下での繊細なコネクタ挿入などの接触操作を高精度で実現する手法を提案した。
- 3Dマスクへの視覚・言語の接地による長期的ボックス再配置VLA/計画2026/3/1
RGB-D観測と自然言語指示から、3Dセグメンテーションマスクを逐次的に予測して長期的なピックアンドプレース動作を生成するRAMP-3Dを提案し、倉庫環境でのボックス再配置タスクで高い成功率を達成した。
- ヒューマノイドによるハノイの塔:スキルベース箱並べ替えのための共有全身制御の検討マニピュレーション2026/2/1
ヒューマノイドが箱を並べ替える長期タスクを、再利用可能なスキルを組み合わせて実行する枠組みを検討し、共有全身コントローラとデータ集約で頑健性を高めた。
- 言語条件付き世界モデルによる環境記述の読解と方策汎化の向上モデルベースRL2025/11/28
DreamerV3を拡張し、環境の振る舞いを記述した言語を注意機構で観測内の実体に結びつける世界モデルLED-WMを提案。専門家デモや計画なしに、未知のゲームへの方策汎化を改善した。
- 強化学習によるロボット制御におけるタスク性能と衝突しないエネルギー最小化歩行2025/9/1
強化学習でタスク性能を損なわずにエネルギー消費を最小化する、ハイパーパラメータ不要の勾配最適化手法を提案し、歩行ベンチマークと四足歩行ロボットのSim2Realで有効性を示した。
- 果樹園における枝の剪定を学習するロボットマニピュレーション2025/7/1
混雑した果樹園で指定された切断点にカッターを導き、枝に垂直に切断する視覚運動コントローラを開発。シミュレーションで学習し、実世界にゼロショット転移して30%の成功率を達成。
- 視覚的想像は視覚と言語によるナビゲーションエージェントを改善するか?VLA2025/3/1
指示文に含まれるランドマークの視覚的想像を拡散モデルで生成し、VLNエージェントの追加モダリティとして与えることでナビゲーション性能が向上するかを検証した。
- 視覚と言語によるナビゲーションエージェントを環境攻撃で乗っ取るVLA2024/12/1
視覚と言語によるナビゲーション(VLN)エージェントに対し、環境中の3Dオブジェクトの見た目を最適化するホワイトボックス敵対的攻撃を開発し、指示を無視させたり経路を逸脱させたりできることを示した。
- 点群モデルはロボット学習者の視覚的ロバスト性を向上させる点群/ロバスト性/モデルベースRL2024/4/1
RGB-Dと点群ベースの視覚制御ポリシーを比較し、点群を明示的に扱うポリシーが視覚変化に対してよりロバストで、新しい点群ワールドモデルがサンプル効率も向上させることを示した。
- Behavioral Analysis of Vision-and-Language Navigation Agents2023/7/1
- Navigating to Objects Specified by Images2023/4/1
- Emergence of Maps in the Memories of Blind Navigation Agents2023/1/1
- Iterative Vision-and-Language Navigation2022/10/1
- Sim-2-Sim Transfer for Vision-and-Language Navigation in Continuous Environments2022/4/1
- Waypoint Models for Instruction-guided Navigation in Continuous Environments2021/10/1
- Sim-to-Real Transfer for Vision-and-Language Navigation2020/11/1
- Language-Conditioned Imitation Learning for Robot Manipulation Tasks2020/10/1
- Beyond the Nav-Graph: Vision-and-Language Navigation in Continuous Environments2020/4/1
- Sim2Real Predictivity: Does Evaluation in Simulation Predict Real-World Performance?2019/12/1
- Chasing Ghosts: Instruction Following as Bayesian State Tracking2019/7/1
- Visual Curiosity: Learning to Ask Questions to Learn Visual Recognition2018/10/1