Ruiyu Wang
KTH Royal Institute of Technology
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- フォーカスプーリングによる局所視覚特徴の集約と視覚運動ポリシーへの応用視覚運動ポリシー2026/9/8
CNNの中間特徴から制御に重要な局所情報を選択的に集約するFocusPoolを提案し、シミュレーションと実機で成功率を大幅に向上させた。
- 行動から注意を学ぶ:ポリシー学習のための創発的視覚ボトルネック視覚的注意/ロボット学習2026/8/1
行動教師信号のみから注目領域(ROI)を学習するSeekerを提案し、RGBクロップやマスク拡張、点群フィルタリングの空間インターフェースとして利用。実機で成功率を大幅に向上させた。
- 顕著性ガイドによる拡張を用いた行動クローニングの視覚領域ロバスト性向上行動クローニング/データ拡張2026/8/1
視覚ベースの行動クローニングにおいて、タスク重要領域を保持しつつ非重要領域に積極的なデータ拡張を適用する顕著性ガイド拡張法RoboSaGAを提案し、シミュレーションと実環境で視覚領域シフトに対するロバスト性を向上させた。
- MirrorDuo: 鏡像デモペアによる反射整合的な視覚運動学習模倣学習2026/6/1
鏡像関係にあるデモペアを自動生成し、データ数を実質2倍にする手法を提案。既存の模倣学習パイプラインに適用可能で、少ないデモで作業空間の鏡像側へのスキル転移を実現する。
- PALM: 知覚アライメントによる局所視覚運動ポリシーの汎化性向上模倣学習2026/1/1
操作ポリシーを大域的な粗い部分と局所的な細かい部分に分け、局所レベルで視覚的注目と固有受容感覚表現を揃えることで、追加の入力やデータ収集なしに分布外環境への汎化性能を高めた研究。
- R900: 900時間のロボットデータ収集から見るランダム探索の費用対効果の理解模倣学習2025/3/1
ロボットマニピュレーションにおけるデータ不足を解決するため、ランダム探索による行動と映像データの費用対効果を大規模に検証し、自動収集パイプラインを構築した。
- PACA: 視点を考慮したクロスアテンション表現によるゼロショットシーン再配置マニピュレーション2024/10/1
Stable Diffusionの生成・セグメンテーション・特徴符号化を1ステップに統合し、視点制御可能な物体表現で6-DoFのゼロショットシーン再配置を実現した。
- 特徴抽出器か意思決定者か:視覚運動ポリシーにおける視覚エンコーダの役割を再考するVLA2024/9/1
視覚運動ポリシーにおいて視覚エンコーダが単なる特徴抽出器ではなく意思決定にも寄与していることを実験的に示し、OOD事前学習モデルの性能低下を明らかにした研究。
- How Physics and Background Attributes Impact Video Transformers in Robotic Manipulation: A Case Study on Planar Pushing2023/10/1