Rui Zhang
収録論文 19本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VLA-Precision: 非対称共同ブートストラップによる視覚言語行動モデルの効率的な実世界オンライン強化学習VLA/強化学習2026/9/3
実世界のオンライン強化学習を用いて、精密な操作タスクにおける視覚言語行動モデルの性能を向上させるフレームワークを提案した。
- GigaBrain-0.7:三系統アーキテクチャによる創発的能力へのスケーリングVLA2026/8/16
視覚言語行動モデルのスケーリングとアーキテクチャ改善により、多様なロボットへの汎化を大幅に向上させた基盤モデルを提案。
- LAPF: UAVScenesデータセットを用いたLLMエージェントベースの経路探索ナビゲーション2026/8/15
UAVの自律ナビゲーションのため、LLMエージェントに知覚・記憶・計画・行動を統合した閉ループ認知アーキテクチャを提案し、市街地規模の環境で経路長を短縮することを実証した。
- AXIS:拡張可能なロボット操作のためのコミュニティ駆動型データエンジンデータエンジン/操作学習2026/7/1
ブラウザベースの遠隔操作で大規模なデモ収集を可能にし、タスクの自動生成・検証とデータ品質向上を組み合わせた、拡張可能なロボット操作学習用データエンジンとベンチマークを提案。
- VINE: 強化学習のための生成制御ポリシーの調整強化学習2026/7/1
フローマッチングポリシーを強化学習で安定して学習するための新しいサンプリング手法VINEを提案。各デノイズステップで補間状態を再構築し、価値勾配の伝播を安定化させる。
- UniDexTok: 実データからの統合器用手トークナイザ器用手/表現学習2026/6/9
人間とロボットの手の状態を共通の22自由度セマンティックインターフェースにマッピングし、再ターゲティング不要で異種の器用手を統一表現するトークナイザを提案。誤差をセンチメートルからサブミリメートルに大幅削減した。
- GPU並列マルチタスク強化学習とデモンストレーション誘導型方策最適化マルチタスクRL2026/6/1
GPU並列環境で複数の操作タスクを同時に学習するベンチマークMT-Liberoを構築し、デモンストレーションを活用したDGPOアルゴリズムを提案して性能を向上させた。
- Tabero: 視覚・触覚・言語からの閉ループ力フィードバックによる優しい操作の学習操作学習2026/5/1
触覚フィードバックを活用した優しいロボット操作を実現するため、データ効率的なパイプラインで視覚・触覚・言語データを生成し、力と位置を分離した指令インターフェースを持つモデルを提案。優しい指示下で把持力を70%以上削減しつつ高い成功率を維持した。
- ロボット巧手知能に向けて:サーベイ巧手操作2026/5/1
ロボット巧手の研究をハードウェア、制御・学習手法、データ・評価の観点から体系的にレビューし、今後の課題と方向性をまとめたサーベイ論文。
- Tele-Catch: 動的3D物体キャッチのための適応型遠隔操作遠隔操作2026/3/1
動く物体を器用なロボットハンドでキャッチするタスクにおいて、人間の遠隔操作信号と自律ポリシーを融合する共有自律フレームワークを提案し、キャッチ精度とロバスト性を向上させた。
- ポリシーを合成せよ!テスト時分布レベル合成による拡散・フローベースロボットポリシーの改善VLA2025/10/1
複数の事前学習済みロボットポリシーの分布スコアを凸結合しテスト時探索で合成する訓練不要手法GPCを提案し、単一ポリシーを超える性能を実現した。
- 軌道エントロピー:マルチモーダル軌道予測によるゲーム状態安定性のモデル化自動運転2025/6/1
エージェント間のゲーム理論的相互作用において、マルチモーダル軌道予測から不確実性を抽出し、その信号対雑音比でゲーム状態を定量化する「軌道エントロピー」を提案。これによりlevel-kゲームフレームワークを効率化し、予測・計画精度を向上させた。
- ロボットタスク計画におけるLLM活用の安全性向上フレームワークSAFERタスク計画2025/3/1
安全性を考慮したマルチLLMフレームワークSAFERを提案し、安全エージェントと制御バリア関数を統合してロボットタスク計画の安全性違反を低減する。
- RoboGSim: 実世界からシミュレーションを経て実世界へ戻るロボット用ガウシアンスプラッティングシミュレータsim2real2024/11/1
3Dガウシアンスプラッティングと物理エンジンを組み合わせ、実世界のロボット操作データを高忠実度でシミュレーションし、実機へのゼロショット転移を可能にするReal2Sim2Realシミュレータを提案。
- 3D-CDRGP: 3Dオープンワールドにおけるデバイス横断ロボット把持ポリシーマニピュレーション2024/11/1
異なるメーカーのカメラとロボットアームを使う2つの実環境で、カテゴリに依存せず3D点群から物体を検出し把持するクロスデバイス把持ポリシーを提案した論文。
- SegGrasp: セマンティック・幾何学誘導セグメンテーションによるゼロショットタスク指向把持マニピュレーション2024/10/1
視覚言語モデルと凸分解による幾何情報を組み合わせ、学習なしで対象物の機能部位を狙うゼロショット把持を実現したフレームワーク。
- 動作・力センサ不要の連続sEMG義手制御システム筋電義手2024/7/1
筋電位と指力のほぼ線形な関係に着目し、最大屈曲・伸展時のsEMGのみから指力とジェスチャを連続予測するResDDモデルを提案した。追加の運動・力センサなしで義手を制御できる。
- Semi-Aerodynamic Model Aided Invariant Kalman Filtering for UAV Full-State Estimation2023/10/1
- UAV Trajectory and Communication Co-design: Flexible Path Discretization and Path Compression2020/10/1