Zhedong Zheng
収録論文 8本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- REVEAL: 参照に基づく推論によるマルチモーダル操作検出マルチモーダル検出2026/5/27
画像とテキストのペアの偽造を検出し、改ざん領域を特定するために、検索した真正な証拠と比較する参照基盤の検証フレームワークを提案した。
- 指示からイベントへ:音トリガー型モバイルマニピュレーションモバイルマニピュレーション2026/1/1
音を発する物体を自律的に検知・操作する「音トリガー型モバイルマニピュレーション」を提案し、音響レンダリングと物理操作を統合したデータ基盤Habitat-Echoとベースライン手法を開発した。
- RoboSenseチャレンジ:あらゆる環境を認識し、どこへでも移動し、プラットフォームを超えて適応するロボット知覚ベンチマーク2026/1/1
ロボット知覚の堅牢性と適応性を競うRoboSense 2025チャレンジの報告で、5つのタスクのベンチマークと23の受賞解法から得られた知見をまとめた。
- WeatherPrompt: 全天候ドローン視覚的自己位置推定のためのマルチモーダル表現学習VLA2025/8/1
大規模マルチモーダルモデルで天候をテキスト化し、画像特徴と融合することで天候に不変なドローン位置推定を実現した研究。
- 第9回AIシティチャレンジコンピュータビジョン2025/8/1
交通・産業・公共安全分野におけるコンピュータビジョンとAIの実応用を推進する第9回AIシティチャレンジの概要。4つのトラックで245チームが参加し、3Dマルチカメラ追跡や交通安全のビデオQA、倉庫での空間推論、魚眼カメラの物体検出などが競われた。
- EQ-TAA: 拡散モデルによる事故動画合成を用いた同変交通事故予測事故予測2025/6/1
拡散モデルで通常映像から事故の因果部分を合成し、擬似的な事故・非事故映像ペアを用いた同変学習により、追加アノテーションなしで交通事故予測精度を向上させた研究。
- 自動運転のためのエコープランニング:現在の観測から未来の軌道へ、そして再び現在へ自動運転計画2025/5/1
現在のBEV表現から未来軌道を予測し、それを逆に現在のBEV状態へ再構成するサイクル整合性で軌道予測を自己修正する枠組みを提案し、nuScenesとBench2Driveで性能向上を示した。
- 3D-TAFS: 訓練不要の3Dアフォーダンスセグメンテーションフレームワークアフォーダンス2024/9/1
大規模マルチモーダルモデルと3D視覚ネットワークを組み合わせ、訓練なしで言語指示から3D物体のアフォーダンス領域を切り出す手法を提案し、屋内シーン向けベンチマークIndoorAfford-Benchも構築した。