Irving Fang
収録論文 7本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA触覚人間-ロボット協調
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 可動穴へのペグ挿入のための視覚・力アドミタンス学習マニピュレーション2026/9/12
視覚フィードバックと高頻度の力ベースモデルを融合し、動的な環境でもミリメートル精度でペグ挿入を実現する枠組みを提案。
- 意図から実行へ:Vision-Language-Actionモデルの汎化境界を探るVLA2025/6/1
VLAモデルの汎化能力を体系的に評価するため、言語・視覚・物体に関する50のシミュレーションタスクを用意し、最先端モデルが知覚や計画は得意でも、分布外の状況では動作実行が崩れることを示した。
- VLMが見て、ロボットが動く:人間のデモ動画からロボット行動計画を生成VLA2024/10/1
視覚言語モデル(VLM)を用いて人間のデモ動画を解釈し、ロボットのタスク計画を自動生成する手法SeeDoを提案。キーフレーム選択と視覚認識、VLM推論を統合し、シミュレーションと実機で有効性を検証した。
- FusionSense: 常識・視覚・触覚を融合したロバストな疎視点再構成触覚2024/10/1
基盤モデルの事前知識と視覚・触覚の疎な観測を統合し、透明・反射・暗色物体でも高精度に3D再構成するフレームワークを提案。
- EgoPAT3Dv2: 一人称視点の2D画像から3D行動ターゲットを予測し人間-ロボット協調を実現人間-ロボット協調2024/3/1
一人称視点のRGB画像のみから手の動作の3D目標座標を予測するデータセットとアルゴリズムを拡張し、実機ロボットでその有用性を示した研究。
- Metric-Free Exploration for Topological Mapping by Task and Motion Imitation in Feature Space2023/3/1
- Dynamic Placement of Rapidly Deployable Mobile Sensor Robots Using Machine Learning and Expected Value of Information2021/11/1