Rui Song
Dalian University of Technology
収録論文 11本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RE-0: 局所オンポリシー蒸留による身体性コード・アズ・ポリシーエージェントの検証済み再帰的改善VLA2026/9/26
教師の失敗を考慮し、学生の失敗履歴に対する教師の局所修正を環境で検証してからオンポリシー蒸留の監督に使うことで、コード生成型身体性エージェントを再帰的に改善する手法を提案。
- PACE: 長期的身体操作のためのフェーズ進行認識クレジット操作2026/8/15
長期的な操作タスクにおいて、各ステップのフェーズと進行度を推定し、ステップ単位のクレジットを割り当てることで、VLAモデルのポストトレーニングを改善するフレームワークを提案した。
- What-If World: 身体性シナリオにおける汎用世界モデルのための因果ベンチマーク世界モデル2026/5/26
ビデオ生成モデルが物理的介入に正しく反応するかを評価するため、1つの物理変数だけが異なるプロンプトペアを用いたベンチマーク「What-If World」を提案し、9つの最先端モデルが低スコアであることを示した。
- MDrive: エンドツーエンドマルチエージェントシステムのための閉ループ協調運転ベンチマーク自動運転/協調運転/ベンチマーク2026/5/1
V2X通信を用いた協調運転の評価を閉ループで行うベンチマークMDriveを提案し、マルチエージェントシステムの利点と課題を明らかにした。
- TIC-VLA:動的環境におけるロボットナビゲーションのための制御内思考型視覚-言語-行動モデルVLA2026/2/1
遅延する意味推論を明示的にモデル化し、非同期推論に適応した視覚-言語-行動モデルを提案。動的環境での言語誘導ナビゲーションをリアルタイム制御で実現する。
- DRCP: 強化学習協調知覚への拡散モデルによる限界を超えた知覚協調知覚2025/9/1
V2X通信を活用した協調知覚において、拡散モデルによる軽量な特徴精錬とクロスモーダル融合を組み合わせ、動的環境での検出精度とロバスト性をリアルタイムで向上させるフレームワークを提案。
- 微分可能X線レンダリングと二重クロスビュー制約による堅牢で高精度なマルチビュー2D/3D画像位置合わせ2D/3D位置合わせ2025/6/1
術前モデルと術中X線画像をマルチビューで位置合わせする2段階手法を提案し、クロスビュー制約とテスト時最適化で高精度・高堅牢性を実現した。
- 自動運転のための生成AI:フロンティアと機会自動運転2025/5/1
生成AI(VAE・GAN・拡散モデル・LLM)を自動運転スタック全体にどう応用するかを体系的に整理したサーベイ。データ生成からEnd-to-End運転、デジタルツイン、評価・安全・規制まで課題と研究方向をまとめる。
- ROLO-SLAM: 不整地における回転最適化LiDARのみのSLAMSLAM2025/1/1
不整地を走行する地上車両向けに、スキャン間の位置予測とボクセル内の球面アライメントによる回転推定を組み合わせ、LiDARのみで高精度な姿勢推定を行うSLAM手法を提案した。
- 未知の不整地におけるリスクフリー自律ナビゲーションのための履歴考慮型プランニングナビゲーション2024/6/1
不整地を含む未知環境で地図なしに自律移動するため、探索履歴を保持する階層構造を用いて危険領域を明示的に特定し、安全かつ迅速に目標へ到達するナビゲーション手法を提案した。
- Flying Trot Control Method for Quadruped Robot Based on Trajectory Planning2022/10/1