Guangyu Chen
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MM-ABC: 見て、協調し、想像する汎用モバイルマニピュレーションモバイルマニピュレーション2026/9/28
移動とマニピュレーションを別々のストリームとして扱い、マスク付きジョイントアテンションと未来予測の追加監督で協調させる基盤モデルを提案。
- MoPA: サブシステム特化型知覚アラインメントによる協調的移動マニピュレーション移動マニピュレーション2026/9/10
移動とマニピュレーションで異なる知覚表現を二重ストリームで抽出し、行動レベルで協調させるフレームワークを提案。ManiSkill-HABで最高性能、実機でも成功率76.3%を達成。
- XPolicyLab: ロボットポリシー評価と展開のための統一標準・オープンエコシステムロボットポリシー評価2026/8/1
ロボットポリシーの評価と展開を統一する標準規格とオープンエコシステムを提案し、N個のポリシーとM個の環境の接続コストをO(NM)からO(N+M)に削減した。
- 信頼できる具現化知能に向けて:システムフレームワークと段階的信頼度レベル信頼性評価2026/7/1
具現化知能の信頼性を「持続的な安全な成功」と定義し、モデル・システム・エビデンス・展開の4層からなるフレームワークと段階的信頼度を提案する論文。
- 大規模な人間のデモから学習するロボット操作のための人間意図事前分布VLA/操作学習2026/4/1
人間のデモ動画から操作の事前知識を学び、ロボット操作に活用する階層型VLAフレームワークMoT-HRAを提案。大規模データセットHA-2.2Mを構築し、意図推定とロボット制御を統合することで、分布シフト下での堅牢な操作を実現。
- 適応触覚融合と力混合制御によるマスターマイクロ残差補正を用いた接触リッチ操作マニピュレーション2026/3/1
視覚模倣学習に触覚と力覚を組み合わせ、マスター・マイクロ残差制御アーキテクチャで高周波のリアルタイム補正を行い、接触を伴う精密操作の成功率を向上させた。
- 視覚ナビゲーションのための言語条件付きワールドモデリング視覚ナビゲーション2026/3/1
言語指示に基づく視覚ナビゲーションを、初期の一人称視点のみから将来の軌道を予測する問題として定式化し、大規模データセットと2つのモデル群を提案した。
- 記憶拡張型の計画と予見による視覚ナビゲーションのための統合世界モデルに向けてナビゲーション2025/10/1
視覚的予見と計画を単一のマルチモーダル自己回帰バックボーンに統合し、階層的記憶機構で長期推論を安定化させた世界モデルUniWMを提案。4つのベンチマークでナビゲーション成功率を最大30%改善し、未見環境へのゼロショット汎化も示した。
- VOTE: 軌道アンサンブル投票による視覚-言語-行動モデルの最適化VLA2025/7/1
VLAモデルの推論遅延と学習コストを削減するため、少ない行動トークンで並列生成する学習フレームワークと、過去と現在の予測を投票で統合する推論最適化を提案し、成功率と推論速度を大幅に向上させた。
- 空の安全保障:対UAV手法、ベンチマーク、今後の方向性に関する包括的サーベイ対UAV2025/4/1
UAVの脅威に対抗するための分類・検出・追跡技術を、拡散モデルやマルチモーダル融合などの新手法を含めて体系的に調査し、課題と将来展望をまとめたサーベイ論文。