Hongyu Yan
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA3Dシーン生成SLAM地図評価組立/マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Xiaomi-Robotics-U0: 世界基盤モデルによる統合的身体性合成VLA2026/7/1
ロボットの身体性を考慮した画像・動画生成を統合する380億パラメータのマルチモーダル自己回帰モデルを提案し、マルチビュー一貫性やロボットの身体制約を保ちながら、シーン生成や転移、動画生成を高品質で実現した。
- ProgressVLA: 進捗ガイド付き拡散ポリシーによる視覚言語ロボット操作VLA2026/3/1
ロボット操作のための視覚言語行動モデルに、タスク進捗の推定と微分可能な進捗ガイダンスを導入し、長期的なタスクでの成功率と汎化性能を向上させた。
- FlowSSC:単眼セマンティックシーン補完のためのワンステップ潜在拡散による汎用生成フレームワーク3Dシーン生成2026/1/1
単眼RGB画像からのセマンティックシーン補完を条件付き生成問題として扱い、トリプレーン潜在空間でのショートカットフローマッチングにより1ステップで高品質な3Dシーン生成を実現した。
- MapEval: 統合的で堅牢かつ効率的なSLAM地図評価フレームワークSLAM地図評価2024/11/1
SLAMで生成される大規模点群地図を評価するためのオープンソースフレームワーク。ボクセル空間でのガウス近似ワッサースタイン距離を提案し、従来手法より100〜500倍高速で頑健な評価を実現する。
- ニューラルアセンブラ:多視点画像から細粒度のロボット組立指示を生成する学習組立/マニピュレーション2024/4/1
多視点画像から3Dモデルを構成する部品を認識し、その姿勢推定と物理的に妥当な組立順序を推論して、ロボットアームが実行可能な組立指示列を生成するエンドツーエンドモデルを提案した。