Mengde Li
収録論文 6本 ・ フィジカルAI/ロボット学習
マルチモーダルHRIVLAマニピュレーション触覚
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 音声・感情・動作を統合するVLMベースのヒューマノイドロボット向けエッジ展開可能なマルチモーダルフレームワークマルチモーダルHRI2026/2/1
VLMを基盤に、音声・表情・ジェスチャーを感情的に一貫させて生成するフレームワークSeM²を提案し、知識蒸留によりエッジ上でも95%の性能を維持するSeM²_eを実装した。
- 注意が裏切るとき:視覚トークン再構成によるロボットポリシーのバックドア攻撃消去VLA2026/2/1
VLAモデルのバックドアが深層注意を乗っ取る仕組みを解明し、テスト時に異常トークンを検出・マスクしてトリガー除去画像を再構成することで、再学習なしに攻撃を無効化する防御手法Beraを提案した。
- RGMP: 汎化可能なヒューマノイドロボット操作のための再帰的幾何事前マルチモーダルポリシーマニピュレーション2025/11/1
視覚言語モデルに幾何学的な事前知識を組み込み、ガウス過程でロボットと対象物の関係を再帰的に符号化することで、少ないデータで未知環境にも汎化するヒューマノイド操作を実現した。
- 触覚センシングと適応スキルによるロバスト把持戦略の学習触覚2024/11/1
人間のデモンストレーションと触覚フィードバックを用いて、外乱に耐えるロバストな把持を実現する適応的把持ポリシーを学習した研究。
- A novel tactile palm for robotic object manipulation2023/8/1
- Fast calibration for ultrasound imaging guidance based on depth camera2023/8/1