Zhen Lei
収録論文 7本 ・ フィジカルAI/ロボット学習
マニピュレーションマルチモーダル検出ヒューマンロボットインタラクション手術ナビゲーション3D物体検出医療ロボティクス
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 物体中心条件付けによる視覚運動フローマッチングマニピュレーション2026/9/21
シーンを物体ごとの意味特徴と空間手がかりに分離し、フローマッチング方策の条件付けに用いることで、視覚的妨害や位置ずれに頑健なマニピュレーションを実現した。
- 証拠に基づく法医学的推論によるマルチモーダルメディア改ざんの検出と位置特定マルチモーダル検出2026/8/8
画像とテキストのクロスモーダル改ざんを検出し、その根拠となる証拠の位置を特定する新しいフレームワークを提案。推論の透明性を高め、証拠と結論の整合性を強制する手法を導入した。
- 一目でわかる:顔から見た目の性格を推定するヒューマンロボットインタラクション2026/7/16
顔画像のみから初対面の印象に基づく性格(MBTI)を推定するフレームワークGlanceFaceを提案。視覚言語モデルによる意味的先行知識と不確実性を考慮した学習で、ノイズの多い主観的アノテーションに対処し、対話前の適応的初期戦略に活用できる。
- SurgTrack: CADモデル不要の実世界手術器具3Dトラッキング手術ナビゲーション2024/9/1
CADモデルなしで手術器具の3D形状をSDFでモデル化し、姿勢グラフ最適化で遮蔽に頑健な2段階3Dトラッキングを実現した研究。
- Voxel Mamba: 点群3D物体検出のためのグループフリー状態空間モデル3D物体検出2024/6/1
3Dボクセルを単一の系列にシリアライズするグループフリーな状態空間モデルを提案し、階層構造と位置エンコーディングで空間的近接性を保ちつつ、3D物体検出の精度と計算効率を向上させた。
- 超音波ロボティクスにおける身体性知能による手術介入の変革医療ロボティクス2024/6/1
超音波ロボットに大規模言語モデルと専門知識を組み合わせ、医師の音声指示を動作計画に変換し、患者の動きに応じてリアルタイム調整する身体性知能システムを提案した。
- 超音波ロボットに身体性知能を付与した自律スキャンシステム医療ロボティクス2024/5/1
LLMと超音波操作の知識データベースを組み合わせ、音声指示から自律的に超音波スキャンを行うシステムを提案した。