Chen Feng
収録論文 47本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 可動穴へのペグ挿入のための視覚・力アドミタンス学習マニピュレーション2026/9/12
視覚フィードバックと高頻度の力ベースモデルを融合し、動的な環境でもミリメートル精度でペグ挿入を実現する枠組みを提案。
- Chain-SLAM:連鎖ループ閉じ込みによるマルチセッションLiDAR SLAMのグローバルに一貫したバックエンドSLAM2026/9/10
複数セッションで取得したLiDAR地図を、連鎖的なループ閉じ込みと因子グラフ最適化によりオンラインで統合し、大規模環境でもグローバルな幾何一貫性を保つSLAMバックエンドを提案。
- WildCity: 実世界の都市規模テストベッド - レンダリング、シミュレーション、空間知能のための空間知能/都市規模再構築2026/7/7
自律走行車両が収集した都市規模のマルチモーダルデータセットを構築し、都市全体の3D再構築とクローズドループシミュレーションのベースラインを確立した。
- 観測品質が重要: 失敗指向解析による頑健なマルチ魚眼カメラキャリブレーションカメラキャリブレーション2026/7/1
マルチ魚眼カメラのキャリブレーション失敗の主因が内部パラメータ初期化にあることを解析し、それを踏まえたデータ構築フレームワークCO-Calibを提案。成功率を68.1%から99.3%に向上させた。
- EgoPush: 移動ロボットのための自己中心視点によるエンドツーエンド多物体再配置学習マニピュレーション2026/2/1
単一の自己中心カメラ映像のみから、移動ロボットが散らかった環境で複数物体を押して再配置する方策を、特権RL教師から視覚生徒への蒸留で学習し、実機へゼロショット転移した研究。
- FC-Vision: 未知環境における遮蔽物のない航空目標構造物スキャンのためのリアルタイム可視性認識リプランニング飛行ロボティクス/再計画2026/2/1
飛行中に未知の障害物が現れても、目標構造物の遮蔽を能動的に回避しながらリアルタイムで経路を再計画し、スキャン品質を保つフレームワークを提案した。
- FlyCo: 基盤モデルを活用したドローンによるオープンワールド環境での自律的3D構造スキャン自律飛行2026/1/1
テキストや視覚的指示から、基盤モデルを活用した知覚・予測・計画ループにより、未知環境でドローンが対象構造物を自律的に3Dスキャンするシステムを提案。
- Wanderland:オープンワールド身体性AIのための幾何学的に接地したシミュレーションsim2real2025/11/1
実世界のマルチセンサーキャプチャから高精度な幾何学とフォトリアルな描画を両立する実→シミュレーション基盤を構築し、屋内・屋外都市シーンのデータセットを整備して、身体性ナビゲーションの再現可能な評価基盤を提供する。
- 意図から実行へ:Vision-Language-Actionモデルの汎化境界を探るVLA2025/6/1
VLAモデルの汎化能力を体系的に評価するため、言語・視覚・物体に関する50のシミュレーションタスクを用意し、最先端モデルが知覚や計画は得意でも、分布外の状況では動作実行が崩れることを示した。
- データ多様性の敵対的活用による視覚的ローカリゼーションの改善視覚的ローカリゼーション2024/12/1
外観多様性を持つ3Dガウススプラッティングで訓練データを合成し、敵対的判別器でsyn-to-realギャップを埋めることで、絶対姿勢回帰のロバスト性を大幅に向上させた。
- 外挿的な都市ビュー合成ベンチマークsim2real2024/12/1
自動運転向けの新規視点合成(NVS)において、訓練視点から大きく外れた視点での性能を評価する初のベンチマークEUVSを構築し、既存手法が訓練視点に過適合しやすいことを示した。
- CityWalker: Web規模の動画から身体性を伴う都市ナビゲーションを学習ナビゲーション2024/11/1
Web上の街歩き・運転動画から行動教師信号を抽出し、地図なし・路上外でも動ける都市ナビゲーション方策を大規模模倣学習で獲得した研究。
- VLMが見て、ロボットが動く:人間のデモ動画からロボット行動計画を生成VLA2024/10/1
視覚言語モデル(VLM)を用いて人間のデモ動画を解釈し、ロボットのタスク計画を自動生成する手法SeeDoを提案。キーフレーム選択と視覚認識、VLM推論を統合し、シミュレーションと実機で有効性を検証した。
- FusionSense: 常識・視覚・触覚を融合したロバストな疎視点再構成触覚2024/10/1
基盤モデルの事前知識と視覚・触覚の疎な観測を統合し、透明・反射・暗色物体でも高精度に3D再構成するフレームワークを提案。
- SOAR: 異種UAV群による探索と撮影の同時実行で高速自律再構成群制御2024/9/1
LiDAR搭載の探索機とカメラ搭載の撮影機からなる異種マルチUAVシステムを提案し、探索と撮影を並行して進めることで複雑環境の高速な3次元再構成を実現した。
- FALCON:カバレッジ経路誘導による高速自律飛行探索自律探索2024/7/1
未探索領域を効率的にカバーする経路を生成し、階層的な計画でドローンの自律探索を高速化するフレームワークを提案。
- どこにいるか教えて:マルチモーダルLLMによる場所認識VLA2024/6/1
視覚基盤モデルで候補地点を検索し、マルチモーダルLLMが各候補を言語推論で比較して最終決定する、追加学習不要の視覚的場所認識手法を提案。
- 外部測位・時刻同期デバイス不要のロバスト協調知覚協調知覚2024/5/1
各エージェントの検出物体から顕著物体グラフを構築し、グラフニューラルネットで共通部分グラフを同定することで、外部の測位・時計デバイスなしに相対姿勢と時刻を推定する協調知覚システムを提案。
- 重要なものだけを記憶する:多重走行からの創発的シーン分解3Dマッピング2024/5/1
同じ領域を複数回走行したRGB動画から、自己教師ありで環境と一時的物体を分離し、3Dガウシアンマップを構築する手法を提案。
- MASSTAR: 表面予測と補完のためのマルチモーダル大規模シーンデータセットと汎用ツールチェーン3Dシーン理解2024/3/1
複雑な3D環境から高品質なシーンモデルとマルチモーダル情報を効率的に抽出するツールチェーンを開発し、1000以上のシーンモデルを含む大規模データセットを構築した。
- OmniNxt:全方位視覚知覚を備えた完全オープンソースのコンパクト空中ロボット空中ロボット/全方位視覚2024/3/1
全方位カメラを搭載した空中ロボットのハードウェアとソフトウェアを完全オープンソースで提供し、限られた計算資源で高精度な自己位置推定とリアルタイム高密度マッピングを実現した。
- EgoPAT3Dv2: 一人称視点の2D画像から3D行動ターゲットを予測し人間-ロボット協調を実現人間-ロボット協調2024/3/1
一人称視点のRGB画像のみから手の動作の3D目標座標を予測するデータセットとアルゴリズムを拡張し、実機ロボットでその有用性を示した研究。
- Star-Searcher: A Complete and Efficient Aerial System for Autonomous Target Search in Complex Unknown Environments2024/2/1
- LiDAR-based 4D Occupancy Completion and Forecasting2023/10/1
- AutoTrans: A Complete Planning and Control Framework for Autonomous UAV Payload Transportation2023/10/1
- Collaborative Visual Place Recognition2023/10/1
- FC-Planner: A Skeleton-guided Planning Framework for Fast Aerial Coverage of Complex 3D Scenes2023/9/1
- MacFormer: Map-Agent Coupled Transformer for Real-time and Robust Trajectory Prediction2023/8/1
- Concavity-Induced Distance for Unoriented Point Cloud Decomposition2023/6/1
- Metric-Free Exploration for Topological Mapping by Task and Motion Imitation in Feature Space2023/3/1
- Among Us: Adversarially Robust Collaborative Perception by Consensus2023/3/1
- Toward Zero-Shot Sim-to-Real Transfer Learning for Pneumatic Soft Robot 3D Proprioceptive Sensing2023/3/1
- PredRecon: A Prediction-boosted Planning Framework for Fast and High-quality Autonomous Aerial Reconstruction2023/2/1
- VoxFormer: Sparse Voxel Transformer for Camera-based 3D Semantic Scene Completion2023/2/1
- Robust Collaborative 3D Object Detection in Presence of Pose Errors2022/11/1
- A Deep Reinforcement Learning Environment for Particle Robot Navigation and Object Manipulation2022/3/1
- Learning Distilled Collaboration Graph for Multi-Agent Perception2021/11/1
- Mobile 3D Printing Robot Simulation with Viscoelastic Fluids2021/10/1
- Projector-Guided Non-Holonomic Mobile 3D Printing2021/5/1
- Deep Weakly Supervised Positioning2021/4/1
- Simultaneous Navigation and Construction Benchmarking Environments2021/3/1
- DR^2Track: Towards Real-Time Visual Tracking for UAV via Distractor Repressed Dynamic Regression2020/8/1
- Automatic Failure Recovery and Re-Initialization for Online UAV Tracking with Joint Scale and Aspect Ratio Optimization2020/8/1
- Real-time Soft Body 3D Proprioception via Deep Vision-based Sensing2019/4/1
- DeepMapping: Unsupervised Map Estimation From Multiple Point Clouds2018/11/1
- Simultaneous Edge Alignment and Learning2018/8/1
- VLASE: Vehicle Localization by Aggregating Semantic Edges2018/7/1