Rui Yang
収録論文 27本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 安全性を競技力へ:安全フィルタ付き強化学習による搾取されにくいロボット方策安全強化学習2026/9/23
競技タスク向けに、安全フィルタを敵対的RLで学習してからタスク方策を訓練する2段階フレームワークS2Cを提案し、安全性と競技性能・非搾取性を両立させた。
- マルチモーダルメモリ圧縮による長期的身体化意思決定意思決定/ベンチマーク2026/8/2
長期的な身体化意思決定のためのベンチマークDunphyBenchを提案し、VLMエージェントの性能が人間に及ばないこと、メモリ管理がボトルネックであることを示した。さらに、ユーザー嗜好に基づいて情報を圧縮するMeMentoを設計し、精度向上とメモリ削減を実現した。
- 現場展開可能な無線式外骨格による潜水持久力の向上外骨格/水中移動2026/6/1
水中での移動効率を高める無線式外骨格DiveMateを開発し、実環境での潜水試験で呼吸ガス消費を減らし、移動距離と潜水時間を大幅に延長できることを実証した。
- LUNA-AD: 自動運転のための軽量不確実性認識言語モデルと生涯学習自動運転2026/6/1
自動運転向けに、不確実性を考慮した意思決定と生涯学習を備えた軽量な言語モデルを提案し、nuPlanベンチマークで高い成功率と低遅延を実現した。
- 自動運転のための軽量な信頼度認識言語モデルによる意思決定自動運転2026/5/1
大規模言語モデルの推論能力を軽量モデルに蒸留し、信頼度付きの意思決定を高速に行う自動運転フレームワークを提案した。
- DualShield: 到達可能性解析による安全なモデル予測拡散と対話型自動運転自動運転計画2026/1/1
拡散モデルによる自動運転計画に、ハミルトン・ヤコビ到達可能性値関数を「誘導」と「安全シールド」の二重の役割で組み込み、不確実な相互作用下でも安全性と効率を両立させる枠組みを提案。
- MobileVLA-R1: 四足歩行ロボットのための視覚-言語-行動モデルを強化学習で強化VLA2025/11/1
自然言語指示を四足歩行ロボットの連続制御に接地させるため、多粒度Chain-of-Thoughtデータセットと教師あり学習+GRPO強化学習の二段階学習を組み合わせた統合VLAフレームワークを提案し、実機で有効性を示した。
- VLMベースのマルチエージェント協調による自動運転ポリシー学習フレームワークOGR自動運転2025/9/1
視覚言語モデルを活用したマルチエージェント協調により、報酬関数と訓練カリキュラムの設計を自動化し、自動運転ポリシーをオンラインで進化させるフレームワークを提案した。
- CoPlanner: 不確実性を考慮した拡散モデルによる対話型自動運転モーションプランナー自動運転/モーションプランニング2025/9/1
自動運転向けに、マルチエージェントの対話的な軌道生成と不測の事態に備えたプランニングを統合した拡散ベースのフレームワークを提案。複数の将来シナリオを評価し、安全で現実的な軌道計画を実現する。
- オンライン学習ベースの可到達集合バリアによる自動運転車の安全かつ非保守的なコンティンジェンシープランニング自動運転計画2025/9/1
人間運転車両の不確実な挙動をオンライン学習でモデル化し、可到達集合に基づくバリア制約を組み込んだコンティンジェンシー軌道最適化により、安全性を保ちつつ過度に保守的でない自動運転計画を実現した。
- 模倣学習によるロボットマニピュレーション:分類、進化、ベンチマーク、課題マニピュレーション2025/8/1
模倣学習を用いたロボットマニピュレーション研究を体系的に分類し、技術的進化やベンチマーク結果を整理して今後の課題をまとめたサーベイ論文。
- ADPro: マニフォールド制約付きノイズ除去とタスク認識初期化によるテスト時適応拡散ポリシーマニピュレーション2025/8/1
拡散ポリシーに幾何学的マニフォールド制約とタスク認識初期化を導入し、再学習なしでテスト時に適応させることで、ロボットマニピュレーションの成功率・汎化・サンプリング効率を向上させた。
- 遮蔽環境に対応した自律走行のためのコンティンジェンシー安全臨界プランニングプランニング2025/2/1
遮蔽された動的環境で自律走行車の安全性と走行効率を両立するため、到達可能性解析と時空間バリア制約を用いたリアルタイム軌道生成手法を提案し、実機実験で有効性を示した。
- CALMM-Drive: 大規模マルチモーダルモデルによる信頼度を考慮した自動運転自動運転2024/12/1
大規模マルチモーダルモデルと拡散モデルを組み合わせ、信頼度に基づく候補選択で自動運転の意思決定と軌道計画を統合したフレームワークを提案。
- 並列合意最適化による部分観測環境下での自動運転の安全でリアルタイムな一貫計画自動運転計画2024/9/1
部分観測環境での自動運転の安全性と一貫性を確保するため、合意安全バリアと並列軌道最適化を組み合わせたCPTO手法を提案し、リアルタイムで安全な走行を実現した。
- 自動運転におけるフェイルオペレーショナル制御のための増分ベイズ学習自動運転/安全制御2024/3/1
周囲車両の急な挙動や環境外乱による不確実性に対応するため、増分ベイズ学習で外乱をオンライン推定し、確率的制御バリア関数に基づくQP制御で自動運転車を安全状態へ収束させる手法を提案した。
- 安全運転のためのバリア強化並列ホモトピック軌道最適化自動運転計画2024/2/1
自動運転車の安全性と効率性を両立するため、バリア関数と並列ホモトピック軌道最適化を組み合わせたリアルタイム意思決定・計画手法を提案。
- Real-Time Parallel Trajectory Optimization with Spatiotemporal Safety Constraints for Autonomous Driving in Congested Traffic2023/9/1
- Spatiotemporal Receding Horizon Control with Proactive Interaction Towards Autonomous Driving in Dense Traffic2023/8/1
- Learning-based Predictive Path Following Control for Nonlinear Systems Under Uncertain Disturbances2022/12/1
- Safe Learning-Based Feedback Linearization Tracking Control for Nonlinear System with Event-Triggered Model Update2022/3/1
- MHER: Model-based Hindsight Experience Replay2021/7/1
- Efficient Online Transfer Learning for 3D Object Classification in Autonomous Driving2021/4/1
- Bias-reduced Multi-step Hindsight Experience Replay for Efficient Multi-goal Reinforcement Learning2021/2/1
- Safe Learning-based Gradient-free Model Predictive Control Based on Cross-entropy Method2021/2/1
- Safe Learning-based Tracking Control for Quadrotors under Wind Disturbances2020/9/1
- Learning-Based Safety-Stability-Driven Control for Safety-Critical Systems under Model Uncertainties2020/8/1