Ziyi Ye
Fudan University
収録論文 7本 ・ フィジカルAI/ロボット学習
マニピュレーションVLAVLA/汎化BCI/ロボット制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LIBERO-Agent:汎用エージェントによる実機マニピュレーションの評価ベンチマークマニピュレーション2026/9/30
汎用AIエージェントがロボット操作タスクを直接実行できるかを評価する200タスクの対話型ベンチマークLIBERO-Agentを提案し、知覚は得意だが長期的・難しい操作では信頼性が大きく低下することを示した。
- 長期的計画のための明示的言語メモリを備えた視覚言語行動モデルVLA2026/8/1
長期的なタスクにおけるVLAモデルの課題を解決するため、高レベルVLMと低レベルVLAを分離し、明示的な言語メモリモジュールを導入して時間的一貫性とエラー修正を実現する階層的アーキテクチャを提案した。
- ActiveMimic: 能動的知覚を備えた自己中心視点ビデオ事前学習VLA2026/6/4
自己中心視点の人間ビデオから能動的知覚(カメラ動作)を活用してロボット操作を事前学習するフレームワークを提案し、ロボットデータ事前学習と同等の性能を実現した。
- 動きから触覚を見る:触覚運動相関を用いた統一モダリティ認識視触覚ポリシーマニピュレーション2026/6/1
接触を伴う操作において、触覚センサの画像から過渡的運動と累積運動の相関を利用して細かい接触状態を識別する新しい触覚表現を提案し、視覚と触覚の効果的な融合を実現するポリシーを開発した。
- ThinkingVLA: ロボット操作のための視覚と言語の推論を交互に行う手法VLA2026/6/1
ロボット操作タスクにおいて、視覚と言語の推論を交互に行う統一アーキテクチャを提案し、長期的な操作タスクでの性能を向上させた。
- VLA-Pro: 視覚言語行動モデルのためのクロスタスク手続き記憶転送VLA/汎化2026/5/1
タスク固有のLoRAアダプタを手続き記憶として保存し、推論時に現在のマルチモーダル文脈に基づいて関連記憶を検索・融合することで、未見タスクへの汎化を向上させるプラグアンドプレイフレームワークを提案した。
- EEGベースの視覚・運動イメージハイブリッド制御によるロボット把持と配置BCI/ロボット制御2026/3/1
脳波(EEG)による視覚イメージと運動イメージを組み合わせ、ロボットの把持対象と配置位置を意図駆動で制御する枠組みを提案・実装した。