Miao Li
Carnegie Mellon University
収録論文 37本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚言語行動モデルへの普遍的敵対攻撃:ロボット操作における脆弱性の悪用VLA2026/9/30
ロボットの視界に置くだけでタスク成功率を大幅に下げる最適化された表面テクスチャを持つ球体を提案し、VLAモデルの軌道計画・実行・制御を同時に妨害する攻撃を実機とシミュレーションで検証した。
- 汎用ロボットポリシーのためのシンプルなエージェント記憶マニピュレーション2026/9/29
凍結した汎用ロボットポリシーに、訓練不要の記憶層を追加し、履歴に依存する操作タスクの成功率を大幅に向上させた。
- ICI-VLA: 時空間的に整列したデモによる文脈内模倣を用いた視覚言語行動モデルVLA2026/9/7
追加学習なしで、テスト時にデモを文脈として与えることで新しい操作タスクに適応できるVLAモデルの訓練・検索フレームワークを提案した。
- Co-policy: 人間とロボットによる応答的な音楽共創のためのフレームワーク共創/音楽ロボティクス2026/6/1
音楽セマンティクスを物理的な演奏動作に結びつける、人間とロボットの音楽共創フレームワークを提案。意味理解、音楽変奏、視覚運動実行を分離し、低遅延で応答的な演奏を実現する。
- 注意が裏切るとき:視覚トークン再構成によるロボットポリシーのバックドア攻撃消去VLA2026/2/1
VLAモデルのバックドアが深層注意を乗っ取る仕組みを解明し、テスト時に異常トークンを検出・マスクしてトリガー除去画像を再構成することで、再学習なしに攻撃を無効化する防御手法Beraを提案した。
- 音声・感情・動作を統合するVLMベースのヒューマノイドロボット向けエッジ展開可能なマルチモーダルフレームワークマルチモーダルHRI2026/2/1
VLMを基盤に、音声・表情・ジェスチャーを感情的に一貫させて生成するフレームワークSeM²を提案し、知識蒸留によりエッジ上でも95%の性能を維持するSeM²_eを実装した。
- 汎化可能な幾何学的事前知識と再帰スパイキング特徴学習によるヒューマノイドロボットマニピュレーションマニピュレーション2026/1/1
視覚言語モデルに軽量な2D幾何学的バイアスを組み込み、再帰スパイキングネットワークで時空間一貫性を学習することで、未見環境での汎化と少ない実演からのデータ効率的な動作生成を実現した。
- 合成デモンストレーションから汎化可能な手と物体のトラッキングを学習マニピュレーション2025/12/1
人間のデモなしに合成データのみから、多様な物体形状や手の形態に対応する器用な手と物体のトラッキング制御器を学習する手法を提案。
- RGMP: 汎化可能なヒューマノイドロボット操作のための再帰的幾何事前マルチモーダルポリシーマニピュレーション2025/11/1
視覚言語モデルに幾何学的な事前知識を組み込み、ガウス過程でロボットと対象物の関係を再帰的に符号化することで、少ないデータで未知環境にも汎化するヒューマノイド操作を実現した。
- ManiDP: 姿勢依存型両腕マニピュレーションのための可操作度を考慮した拡散ポリシーマニピュレーション2025/10/1
専門家のデモから両腕の可操作度を抽出し、リーマン幾何に基づく確率モデルで姿勢特徴を符号化して条件付き拡散過程に組み込むことで、姿勢依存の力・速度要件を満たす両腕動作を生成する模倣学習手法を提案。
- DexFlow: 巧みな手のポーズリターゲティングとインタラクションの統合手法マニピュレーション2025/5/1
人間の手と物体のデータを組み合わせ、微分損失制約と接触マップ生成により、ロボットハンドの高精度で自然な操作データを生成するパイプラインを提案した。
- CrashAgent: マルチモーダル推論によるクラッシュシナリオ生成自動運転シミュレーション2025/5/1
マルチモーダル大規模言語モデルを用いて実際の交通事故報告書から走行環境と車両挙動を構造化し、シミュレーションで実行可能な衝突シナリオを自動生成するマルチエージェントフレームワークを提案。
- 敵対的蒸留による言語条件付きロボットモデルへの攻撃:中間特徴の再考敵対的攻撃2024/11/1
言語条件付きロボットモデルに対し、任意のプロンプトに付加する普遍的な敵対的プレフィックスを生成し、意図しない動作を引き起こす攻撃手法を提案。連続行動表現と中間自己注意特徴の負勾配を活用して攻撃効果を高めた。
- 触覚センシングと適応スキルによるロバスト把持戦略の学習触覚2024/11/1
人間のデモンストレーションと触覚フィードバックを用いて、外乱に耐えるロバストな把持を実現する適応的把持ポリシーを学習した研究。
- 人間の実演に基づく動的異種グラフを用いた目標指向の両手生地伸ばし学習マニピュレーション2024/10/1
動的異種グラフで状態表現と方策学習を統一的に扱い、人間の実演を活用して両手ロボットによる生地伸ばしを学習する手法を提案し、シミュレータと実機で有効性を示した。
- 複合リンク機構を用いた二関節ロボット魚の設計ロボット魚/機構設計2024/8/1
1つのモータの回転を複合リンク機構で尾柄の並進と尾びれの回転の2自由度運動に変換し、カルンギフォーム型魚類の遊泳を再現するロボット魚を設計・実験した。
- A novel tactile palm for robotic object manipulation2023/8/1
- Fast calibration for ultrasound imaging guidance based on depth camera2023/8/1
- Learning Autonomous Ultrasound via Latent Task Representation and Robotic Skills Adaptation2023/7/1
- 3D-SeqMOS: A Novel Sequential 3D Moving Object Segmentation in Autonomous Driving2023/7/1
- Privacy Risks in Reinforcement Learning for Household Robots2023/6/1
- PoseFusion: Robust Object-in-Hand Pose Estimation with SelectLSTM2023/4/1
- Homography matrix based trajectory planning method for robot uncalibrated visual servoing2023/3/1
- 4D iRIOM: 4D Imaging Radar Inertial Odometry and Mapping2023/3/1
- Mixline: A Hybrid Reinforcement Learning Framework for Long-horizon Bimanual Coffee Stirring Task2022/11/1
- A Bioinspired Bidirectional Stiffening Soft Actuator for Multimodal, Compliant, and Robust Grasping2022/11/1
- Improving Robotic Grasping Ability Through Deep Shape Generation2022/6/1
- Robot Cooking with Stir-fry: Bimanual Non-prehensile Manipulation of Semi-fluid Objects2022/5/1
- Learning Ultrasound Scanning Skills from Human Demonstrations2021/11/1
- Learning Robotic Ultrasound Scanning Skills via Human Demonstrations and Guided Explorations2021/11/1
- Learning Friction Model for Magnet-actuated Tethered Capsule Robot2021/9/1
- Learning Based Adaptive Force Control of Robotic Manipulation Based on Real-Time Object Stiffness Detection2021/9/1
- Learning Friction Model for Tethered Capsule Robot2021/8/1
- Data Generation for Learning to Grasp in a Bin-picking Scenario2021/8/1
- Unknown Object Segmentation through Domain Adaptation2021/8/1
- Learning Dynamical System for Grasping Motion2021/8/1
- Motion Mappings for Continuous Bilateral Teleoperation2020/12/1