Le Wang
Huzhou Vocational and Technical College
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 音響駆動ミリメートル螺旋ロボット:閉鎖流体環境における超音波協調操作群制御2026/8/1
音響放射力と音響流の相乗効果を利用し、ミリメートルサイズの螺旋ロボットを制御・推進する手法を提案・実証した。
- ロボットポリシー学習における視点汎化のための効率的なカメラポーズ拡張VLA2026/3/1
3Dガウススプラッティングを用いて、少数の非校正画像から高品質な3Dシーンを再構成し、多様な合成視点を生成することで、視覚運動ポリシーの未知視点への汎化性能を向上させる手法を提案した。
- RoboSafe: 実行可能な安全ロジックによる身体性エージェントの保護安全/身体性エージェント2025/12/1
VLMベースの身体性エージェントに対し、短期・長期の安全メモリを用いた後方反省推論と前方予測推論を組み合わせ、実行可能な述語ロジックで危険行動を未然に防ぐランタイム安全ガードレールを提案。
- DynaRend: マスク付き未来レンダリングによるロボットマニピュレーションのための3Dダイナミクス学習マニピュレーション2025/10/1
多視点RGB-D動画からマスク再構成と未来予測を微分可能ボリュームレンダリングで行い、3D形状・意味・ダイナミクスを統合したトライプレーン表現を自己教師あり学習するフレームワーク。RLBenchやColosseum、実機実験でマニピュレーション性能と汎化性を向上。
- SAMPO: 運動プロンプトを用いたスケールワイズ自己回帰による生成的世界モデル世界モデル2025/9/1
フレーム内生成に視覚自己回帰、次フレーム生成に因果モデリングを組み合わせ、運動プロンプトで時空間的手がかりを注入する世界モデルを提案。
- 行動識別を備えた時間統合拡散ポリシーによるロボットマニピュレーションマニピュレーション2025/6/1
拡散ポリシーのノイズ除去過程を時間方向に統合し、行動識別情報を加えることで、ロボットマニピュレーションの行動生成を高速化・高精度化した手法TUDPを提案。
- AGENTSAFE:危険指示に対する身体性エージェントの安全性ベンチマーク安全性ベンチマーク2025/6/1
視覚言語モデルを用いた身体性エージェントが危険な指示を受けた際の安全性を、知覚・計画・実行の各段階で評価するベンチマークSAFEを提案し、9つの最先端モデルで体系的な失敗を明らかにした。
- FlowRAM: 領域認識Mambaフレームワークによるフローマッチング方策のロボットマニピュレーションへの基盤化マニピュレーション2025/6/1
拡散方策の推論効率と3D知覚の課題に対し、動的半径スケジュールと状態空間モデル、条件付きフローマッチングを組み合わせ、高精度マニピュレーションで成功率を12%向上させた。
- RSRNav: 画像ゴールナビゲーションのための空間関係推論ナビゲーション2025/4/1
ゴール画像と現在の観測間の空間的関係を推論し、ナビゲーションの指針とする手法を提案。視点の不一致に強く、ベンチマークで優れた性能を示す。
- BFA: マルチビュー細粒度マニピュレーションのための最良特徴量認識融合マニピュレーション2025/2/1
マルチビュー画像を用いた細粒度マニピュレーションにおいて、各視点の重要度を軽量ネットワークで予測し、再重み付けして融合するプラグアンドプレイ手法を提案。タスク成功率を22-46%向上させた。