Ran He
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAGUIワールドモデル安全性マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GaugeVLM: 計測された幾何学的介入による空間的監督の構造化VLA2026/9/29
3Dシーンで物体やカメラを操作し、空間関係の変化量を計測して視覚言語モデルを訓練する手法を提案。複数の空間推論ベンチマークで性能を大幅に改善した。
- GUIは状態ではない:GUIワールドモデルにおける状態エイリアシングの診断GUIワールドモデル2026/9/26
GUIワールドモデルが観測のみに依存すると状態の曖昧さが生じる問題を指摘し、その診断ベンチマークと履歴から状態を復元する手法を提案した。
- 身体性AIにおける安全性:リスク、攻撃、防御のサーベイ安全性2026/5/1
身体性AIの安全性に関する研究を、知覚から計画、行動、相互作用までのパイプライン全体にわたって体系的にレビューし、攻撃と防御の多層的な分類法を提案した論文。
- OmniUMI:人間に合わせたマルチモーダルインタラクションによる物理的基盤を持つロボット学習マニピュレーション2026/4/1
UMI型インターフェースに触覚・把持力・外力などの物理的接触信号を統合し、拡散ポリシーで学習するシステムを提案。力に敏感な操作タスクで有効性を示した。
- VITA-E:見る・聞く・話す・行動するを同時に実現する身体的インタラクションVLA2025/10/1
2つのVLAモデルを並列に動かす二重モデル構成と「モデル・アズ・コントローラ」により、ロボットが環境を見ながらユーザーの音声を聞き、発話し、行動を同時並行で実行し、割り込みにも即応できる身体的対話フレームワークを提案した。