Zheng Li
The University of Hong Kong
収録論文 22本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SceneJail: 動画シナリオの文脈を悪用したマルチモーダルLLMのジェイルブレイクVLA2026/9/30
動画入力の周囲シナリオを適応的に構築・探索することで、有害クエリへの安全応答を回避するブラックボックス型ジェイルブレイク手法を提案し、8つのVideo-MLLMで最大91.5%の攻撃成功率を達成した。
- ゲームプレイから方策へ:ゲーム化されたロボット不要のインタラクションによるスケーラブルなロボットデータ収集VLA2026/9/16
VRゲームで人間の操作データを収集し、ロボットに転移する枠組みを提案。ゲームから実機へのギャップを埋めるGame2Policyにより、少数の実機デモで成功率が向上することを示した。
- 手術トリプレット認識の最適化:知識駆動型Mixture-of-Expertsソリューション手術認識2026/8/24
手術映像から器具・動作・対象のトリプレットを認識するタスクで、成分間・カテゴリ間の最適化競合を解消し、知識駆動のMoE機構で表現を強化するフレームワークを提案した。
- Tac4Loco: ヒューマノイド歩行のための時空間足底圧表現の学習歩行2026/8/16
ヒューマノイドロボットの歩行制御において、足底圧力の空間的トポロジーを保持した表現を学習し、シミュレーションと実機のセンサ信号を共通の観測空間にマッピングすることで、不整地での適応的な歩行を実現するフレームワークを提案した。
- TactileReflex: ノイズ統計駆動の視覚-触覚反射制御による力感応マニピュレーション触覚/マニピュレーション2026/5/1
視覚触覚センサのノイズ特性から制御閾値を自動導出し、力の微妙な調整が必要な壊れやすい容器の把持・注ぎ操作を実現する反射制御手法を提案した。
- UniLab: GPU中心パラダイムを超えたロボット強化学習のためのヘテロジニアスアーキテクチャ強化学習/システムアーキテクチャ2026/5/1
CPUシミュレーションとGPU学習を分離したヘテロジニアスな強化学習システムUniLabを提案し、GPUシミュレーションに依存せずに3〜10倍の学習効率向上を実証した。
- GS-Playground: 視覚に基づくロボット学習のための高スループット写実的シミュレータシミュレーション2026/4/1
3Dガウススプラッティングと並列物理エンジンを統合した高速写実シミュレータを開発し、視覚ベースの強化学習を大規模に加速する。
- VORL-EXPLORE: 動的環境におけるマルチロボット探索のためのハイブリッド学習計画アプローチ群制御2026/3/1
実行忠実度を共有し、フロンティア割り当てと局所ナビゲーションを結合することで、動的環境でのマルチロボット探索の堅牢性を向上させるハイブリッド学習・計画フレームワークを提案した。
- OmniDP: 全方位3D知覚による広視野・大作業空間でのヒューマノイド操作操作2026/3/1
RGB-Dカメラの狭い視野や自己遮蔽の問題を解決するため、LiDARによる全方位点群を時間的注意プーリングで処理するエンドツーエンドの3D視覚運動ポリシーを提案し、ロボットの再配置なしで広い作業空間での操作を可能にした。
- 適応的強化学習とモデル予測制御の切替による安全な人間-ロボット協調ナビゲーションナビゲーション2026/1/1
強化学習とモデル予測制御を状況に応じて切り替えるハイブリッド手法を提案し、混雑環境での移動ロボットの人間誘導ナビゲーションの安全性と成功率を向上させた。
- テスラの信号・一時停止制御のベンチマーク:実走行データセットと挙動分析自動運転ADAS2025/12/1
テスラの信号・標識認識ADASを実車で走行させ、軌跡データと映像を収集して停止・加速・追従の挙動を分類し、FVDMモデルで定量化した。
- UltraDP: 力覚対応拡散ポリシーによる汎化可能な頸動脈超音波スキャン医療ロボティクス2025/11/1
超音波画像・手首カメラ・接触力・プローブ姿勢を入力とする拡散ポリシーで頸動脈の自律スキャンを実現し、未見被験者でも95%の成功率を達成した。
- ManiVID-3D: 分離された3D表現による視点不変なロボットマニピュレーションのための汎化可能な強化学習マニピュレーション2025/9/1
カメラ視点が変わっても頑健に動作するロボットマニピュレーションのための3D強化学習手法を提案し、視点変化下で成功率を大幅に向上させた。
- EEG駆動ARロボットによる非接触把持操作システムBCI/ARロボティクス2025/9/1
運動想起EEGとARニューロフィードバックを統合し、ロボットアームの非接触把持を閉ループで実現した研究。ARフィードバックが操作安定性と情報伝達率を大幅に向上させ、把持成功率97.2%を達成した。
- FILIC: インピーダンストルク制御を用いた二重ループ力誘導模倣学習による接触の多いマニピュレーションマニピュレーション2025/9/1
力覚センサなしでも関節トルクから力を見積もり、インピーダンス制御とTransformer模倣学習を二重ループで組み合わせて、接触の多い作業を安全かつ柔軟に実行する手法を提案。
- RoboMemory: 物理エンボディドシステムにおける対話型環境学習のための脳に着想を得たマルチメモリエージェントフレームワークVLA2025/8/1
脳に着想を得て空間・時間・エピソード・意味記憶を統合したフレームワークを提案し、長期的な計画と対話型学習を実現してEmbodiedBenchで成功率を26.5%向上させた。
- 自動運転車と信号・標識のインタラクションデータセット自動運転データセット2025/1/1
Waymo Motionデータセットから自動運転車と信号機・一時停止標識のインタラクション軌跡を抽出し、ウェーブレットノイズ除去で品質を高めた大規模データセットを構築・公開した。
- ArtFormer: 多様な3D関節物体の制御可能な生成3D生成2024/12/1
関節物体をトークンの木として表現し、Transformerで形状コードと運動学関係を生成、SDFで各部位を高品質に合成する手法を提案。
- RoboNurse-VLA: 視覚-言語-行動モデルに基づく手術用器械出しロボットシステムVLA2024/9/1
SAM 2とLlama 2を統合したVLAモデルにより、術者の音声指示に基づいて手術器械を高精度に把持・受け渡しするロボット看護師システムを開発した。
- 模倣学習における力学系と機械学習の融合:包括的概観模倣学習2024/3/1
力学系に基づく模倣学習(DSIL)の古典的手法から深層学習・強化学習を組み合わせた最新手法までを、安定性理論と方策改善法の観点から体系的に整理したサーベイ論文。
- Towards Reproducible Evaluations for Flying Drone Controllers in Virtual Environments2022/7/1
- Design and Control of a Highly Redundant Rigid-Flexible Coupling Robot to Assist the COVID-19 Oropharyngeal-Swab Sampling2021/2/1