Songhwai Oh
収録論文 20本 ・ フィジカルAI/ロボット学習
視覚ナビゲーションクロスエンボディメント操作マニピュレーションナビゲーション強化学習安全強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RVN-Bench: 衝突を考慮した屋内視覚ナビゲーションのベンチマーク視覚ナビゲーション2026/3/1
屋内移動ロボット向けに、衝突回避を重視した視覚ナビゲーションのベンチマークRVN-Benchを提案し、シミュレーションと実機での評価を行った。
- GR1とG1におけるクロスエンボディメント操作のための基盤ロボットポリシーのモダリティ拡張ファインチューニングクロスエンボディメント操作2025/12/1
接触信号や深度などのモダリティを追加して基盤ロボットポリシーをファインチューニングし、GR1とUnitree G1という異なるヒューマノイド機体への転移性能を向上させた研究。
- 整頓スコア誘導モンテカルロ木探索による視覚的卓上整理マニピュレーション2025/2/1
RGB-Dカメラのみを用い、整頓度を評価する識別器とモンテカルロ木探索を組み合わせて、目標配置を明示せずに卓上の物体を整理する枠組みを提案し、シミュレーションで収集したTTUデータセットを公開した。
- 物体目標ナビゲーションのための意味的環境アトラスナビゲーション2024/10/1
場所と物体の関係を表す意味グラフマップを画像から構築し、視覚的ローカリゼーションと物体目標ナビゲーションの精度を向上させる手法を提案した。
- アクロバティックロボットのための段階的報酬設計:制約付き多目的強化学習アプローチ強化学習2024/9/1
複雑なアクロバティック動作を段階に分割し、各段階で複数の報酬とコストを定義する制約付き多目的強化学習法を提案し、シミュレーションと実機で有効性を示した。
- Safe CoR: 制約報酬を用いた模倣学習と安全強化学習の二重エキスパート統合安全強化学習2024/7/1
性能重視と安全重視の2種類のエキスパート模倣を制約報酬で統合し、安全性と性能を両立させる枠組みを提案。実機Jackalで性能39%向上・制約違反88%削減を達成。
- TRC: Trust Region Conditional Value at Risk for Safe Reinforcement Learning2023/12/1
- Diffused Task-Agnostic Milestone Planner2023/12/1
- Meta-Explore: Exploratory Hierarchical Vision-and-Language Navigation Using Scene Object Spectrum Grounding2023/3/1
- Renderable Neural Radiance Map for Visual Navigation2023/3/1
- Topological Semantic Graph Memory for Image-Goal Navigation2022/9/1
- Semi-Supervised Imitation Learning with Mixed Qualities of Demonstrations for Autonomous Driving2021/9/1
- Towards Defensive Autonomous Driving: Collecting and Probing Driving Demonstrations of Mixed Qualities2021/9/1
- Visually Grounding Language Instruction for History-Dependent Manipulation2020/12/1
- Generative Autoregressive Networks for 3D Dancing Move Synthesis from Music2019/11/1
- Interactive Text2Pickup Network for Natural Language based Human-Robot Collaboration2018/5/1
- Text2Action: Generative Adversarial Synthesis from Language to Action2017/10/1
- Uncertainty-Aware Learning from Demonstration using Mixture Density Networks with Sampling-Free Variance Modeling2017/9/1
- A Nonparametric Motion Flow Model for Human Robot Cooperation2017/9/1
- Density Matching Reward Learning2016/8/1