Jun Zhang
収録論文 29本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 無線センサネットワークにおけるデータ収集のためのUAV経路計画を最適化する学習手法経路計画2026/9/15
無線センサネットワークでのデータ収集に向けたUAV経路計画を、二段階の学習ベース最適化と景観認識型データ拡張で高精度かつ適応的に解くフレームワークLAMDEを提案。
- 高さ制約付き2点最小解法:イベントカメラとアクティブLEDマーカーによる姿勢推定姿勢推定2026/8/1
IMUや高度計から得られる傾き角とカメラ高さを利用し、2つのLEDマーカーのみでカメラ姿勢を推定する最小解法を提案した。閉形式と線形最小二乗の両方で解を導出し、実データで精度を検証した。
- 何を無視し、何に反応するか:VLAモデルの視覚的に頑健なRLファインチューニングVLA/RLファインチューニング2026/5/1
VLAモデルのRLファインチューニングにおいて、視覚変化がタスクに無関係か挙動変更を要するかを区別する補助目的を追加し、視覚的頑健性を向上させるPAIR-VLAを提案した。
- LEAR: エッジ認識表現学習によるイベントカメラ-LiDAR位置推定位置推定2026/3/1
イベントカメラとLiDAR点群の位置合わせを、エッジ構造と深度フローを同時推定するデュアルタスク学習で解決する手法を提案。
- DreamDojo: 大規模人間動画から学ぶ汎用ロボット世界モデル世界モデル2026/2/1
44,000時間の一人称視点人間動画から汎用的なロボット世界モデルを学習し、連続潜在行動を代理ラベルとして活用することで、巧みな操作の物理理解と精密な行動制御を実現した研究。
- パズルを解くように:オフライン協調強化学習のための局所から大域への世界モデルマルチエージェント強化学習2026/1/12
マルチエージェント系の局所予測から大域状態を推定する世界モデルを構築し、不確実性を考慮した合成データでオフライン強化学習の汎化性能を高める手法を提案。
- UrbanV2X: 都市部における協調ナビゲーションのためのマルチセンサ車両インフラデータセット協調ナビゲーション2025/12/1
香港のC-V2Xテストベッドで車両と路側インフラから収集したマルチセンサデータセットを構築し、協調ナビゲーションアルゴリズムのベンチマークを実施した。
- 聴き・見・話し・行動する統合モデルELLSAVLA2025/10/1
視覚・テキスト・音声・行動を単一アーキテクチャで同時に知覚・生成する全二重エンドツーエンドモデルを提案し、対話と行動の割り込みや発話しながらの行動などを実現した。
- AdaWorld: 潜在行動で適応可能な世界モデルを学習する世界モデル2025/3/1
動画から自己教師ありで潜在行動を抽出し、それに条件づけた自己回帰的世界モデルを事前学習することで、新しい環境や行動への適応を効率化する手法を提案。
- EVLoc: イベントカメラとLiDAR地図を用いたイベント-深度レジストレーションによる視覚的自己位置推定自己位置推定2025/3/1
イベントカメラの画像とLiDAR地図から生成した深度マップを2D空間で位置合わせし、PnPソルバでカメラ姿勢を推定する自己位置推定手法を提案。
- 低遅延エッジSLAMのためのジョイントオフローディングとスケジューリングの統合エッジSLAM2025/2/1
移動ロボットのvSLAMをエッジサーバで支援する際に、入力変動と時間変化する要求に対応するため、領域特徴予測・圧縮/オフロード統合・制約付きスケジューリングを組み合わせた新アーキテクチャを提案し、姿勢推定精度の向上と通信コストの最大47%削減を実現した。
- EmbodiedCity:実世界都市環境における身体性エージェントのためのベンチマークプラットフォーム身体性AI/都市シミュレーション2024/10/1
実在都市の建物や道路を再現した高精細3Dシミュレータ上で、歩行者・車両の流れを再現し、身体性AIの評価タスクと入出力インターフェースを提供するベンチマークを構築した。
- ニューラルグラフマップ:ループ閉じ込みを効率的に統合する高密度マッピングSLAM/ニューラルマッピング2024/5/1
RGB-Dシーンを軽量なニューラルフィールドの集合として表現し、疎な視覚SLAMのポーズグラフに動的に接続することで、大規模なループ閉じ込みを最小限の再統合で扱えるマッピング手法を提案した。
- 古典手法と学習ベース手法によるマルチビーム点群位置合わせのベンチマーク点群位置合わせ2024/5/1
南極の自律型水中探査機から得たマルチビーム音響測深点群データセットを公開し、古典的手法と学習ベース手法の位置合わせ性能を比較評価した。
- NeuRSS: ニューラルレンダリングによるサイドスキャンSLAMのAUV位置推定と海底地形マッピングの強化SLAM2024/5/1
サイドスキャンソナーとニューラルレンダリングを組み合わせ、ループ閉じ込みを活用したSLAMによりAUVの位置推定と海底地形推定を反復的に改善するフレームワークを提案した。
- A Dense Subframe-based SLAM Framework with Side-scan Sonar2023/12/1
- NTU4DRadLM: 4D Radar-centric Multi-Modal Dataset for Localization and Mapping2023/9/1
- Evaluation of a Canonical Image Representation for Sidescan Sonar2023/4/1
- A Fully-automatic Side-scan Sonar SLAM Framework2023/4/1
- Overtwisting and Coiling Highly Enhances Strain Generation of Twisted String Actuators2022/9/1
- Anthropomorphic Twisted String-Actuated Soft Robotic Gripper with Tendon-Based Stiffening2022/7/1
- OverlapTransformer: An Efficient and Rotation-Invariant Transformer Network for LiDAR-Based Place Recognition2022/3/1
- A Critical Analysis of Image-based Camera Pose Estimation Techniques2022/1/1
- Semantic Reinforced Attention Learning for Visual Place Recognition2021/8/1
- Robust Ego and Object 6-DoF Motion Estimation and Tracking2020/7/1
- VDO-SLAM: A Visual Dynamic Object-aware SLAM System2020/5/1
- Efficient reinforcement learning control for continuum robots based on Inexplicit Prior Knowledge2020/2/1
- Dynamic SLAM: The Need For Speed2020/2/1
- Connectivity-Aware UAV Path Planning with Aerial Coverage Maps2019/5/1