Jianyi Zhou
収録論文 5本 ・ フィジカルAI/ロボット学習
触覚/操作UAV/ベンチマーク触覚推定VLAセキュリティVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TouchWorld: 器用な操作のための予測・反応型触覚基盤モデル触覚/操作2026/7/1
触覚を予測と高速フィードバックの両方に活用する階層型ポリシーを提案し、視覚言語によるタスク計画と触覚による接触適応を分離することで、長期的な操作タスクの成功率を向上させた。
- ESARBench: エージェント型UAV身体化捜索救助のためのベンチマークUAV/ベンチマーク2026/5/1
マルチモーダル大規模言語モデル(MLLM)を搭載したUAVによる捜索救助(SAR)のための、新しいタスク「身体化捜索救助(ESAR)」と、その評価ベンチマーク「ESARBench」を提案した。Unreal Engine 5とAirSimを用いて現実のGISデータから高忠実度の環境を構築し、600タスクのデータセットと評価指標を提供する。
- TouchAnything: 自己中心視点映像からの両手触覚推定のためのデータセットとフレームワーク触覚推定2026/5/1
自己中心視点の映像から触覚情報を推定するための大規模データセットと、視覚から触覚を予測するベースラインフレームワークを提案した論文。
- 一度注入すれば生き残る:下流ファインチューニングを耐え抜くVLAモデルへのバックドア攻撃VLAセキュリティ2026/2/1
VLAモデルのファインチューニングで消えにくいモジュールにバックドアを注入し、ユーザー側の追加学習後も攻撃が持続する手法INFUSEを提案した。
- ConLA: 人間動画からの対照的潜在行動学習によるロボットマニピュレーションVLA2026/2/1
人間の動画からロボットの行動を教師なしで学習する際、対照学習で動きと見た目を分離し、実ロボット軌道での事前学習を上回る性能を実現した。