Xiaoyu Guo
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA触覚ニューロモルフィック視覚
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EWAM:統合身体モデルにおける創発的な深さ方向の専門化——意味理解から視覚的先読み、行動までVLA2026/9/30
行動中心の統合身体モデルEWAMを提案し、層ごとの監督なしに浅い層で意味、中間層で予測未来、深い層で行動に注意が向く創発的な深さ方向の専門化が生じることを示した。
- RePO-VLA: 回復駆動型ポリシー最適化による視覚言語行動モデルVLA2026/5/1
成功軌跡のみの模倣学習では実行時のずれに対処できないため、失敗軌跡を活用して回復行動を学習するフレームワークを提案。成功・回復・失敗の軌跡に役割を割り当て、価値関数で進捗を評価し、ポリシーを改善する。
- A1: 完全透過型オープンソースの適応的かつ効率的なトランケート型視覚言語行動モデルVLA2026/4/1
低コストで高スループットな推論を実現するため、事前学習済みVLMと適応的早期終了・層間トランケートフローマッチングを導入したVLAモデルA1を提案し、シミュレーションと実機でSOTA性能と推論コスト削減を達成した。
- 構造化光を用いたロボット支援手術における軟組織インタラクションの画像からの力推定触覚2025/1/1
内視鏡ステレオカメラと構造化光投影で軟組織の3D変形を再構成し、PointNetベースのニューラルネットワークで接触力を推定する手法を提案した論文。
- ニューロモルフィック時空間オプティカルフロー:人間を超える超高速視覚知覚の実現ニューロモルフィック視覚2024/9/1
2次元フローティングゲート型シナプストランジスタに時間情報を直接符号化し、1〜2msで関心領域を特定する時空間ニューロモルフィックオプティカルフローを提案した研究。