Nanning Zheng
収録論文 30本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 差動増幅器に着想を得たAmpAttentionによる多視点ロボット操作マニピュレーション2026/7/1
多視点ロボット操作における注意機構のノイズを抑制するため、アナログ回路の差動増幅器に着想を得た新しい注意機構AmpAttentionを提案し、これを統合したRVAFモデルがRLBenchタスクで最高成功率を達成しつつ訓練時間を短縮することを示した。
- SpaAct: 空間活性化遷移学習とカリキュラム適応による視覚言語ナビゲーションVLA/ナビゲーション2026/4/30
視覚言語ナビゲーション(VLN)のためのVLM適応フレームワークSpaActを提案。後方行動推論と前方遷移予測の2つの空間活性化タスクと、TriPAカリキュラム学習により動的空間認識を獲得し、VLN-CEベンチマークでSOTAを達成。
- 考える前に進む:画像目標ナビゲーションのための階層的推論ナビゲーション2026/4/1
画像目標ナビゲーションを高レベル計画と低レベル実行に分解し、視覚言語モデルで短期的計画を生成して強化学習ポリシーを導く階層的フレームワークHRNavを提案。迷いを減らすペナルティも導入し、シミュレーションと実環境で有効性を実証した。
- ロボット操作のための双曲多視点事前学習マニピュレーション2026/3/1
ロボット操作タスクの性能向上のため、双曲空間で多視点表現を自己教師あり学習するHyperMVPを提案し、既存のユークリッド空間ベース手法より優れた性能を示した。
- 不均質な群衆中での最適予測ホライズンに基づくソーシャルロボットナビゲーションナビゲーション2026/3/1
群衆中のロボットナビゲーションにおいて、予測ホライズンを固定ではなく社会的文脈に応じて動的に最適化する枠組みを提案し、シミュレーションと実機実験で性能向上を実証した。
- VideoVLA:動画生成モデルを汎用ロボットマニピュレータに転換VLA2025/12/1
大規模動画生成モデルをロボットの視覚-言語-行動モデルに転換し、言語指示と画像から行動列と将来の視覚結果を同時予測することで、新規物体や他機体スキルへの汎化を実現した。
- PlaneHEC: 任意の点群平面検出による多視点ロボットアームの効率的ハンドアイキャリブレーションキャリブレーション2025/7/1
壁や机などの任意の平面を深度カメラで検出するだけで、複雑なモデルや人手を要さずに多視点ロボットアームのハンドアイキャリブレーションを高精度かつ高速に行う手法を提案。
- 森林におけるLiDAR位置認識:複数高さのBEV密度画像を用いた注意機構位置認識2025/3/1
森林環境でのLiDAR位置認識のため、異なる高さの水平スライスから得たBEV密度画像をViTで処理し、マルチBEV相互作用で統合する手法を提案。実世界データで既存手法より高い精度を達成。
- DexDiff: 制約のない環境で掴めない物体を外的手先で操作するマニピュレーション2024/9/1
VLMによる高レベル計画と目標条件付き拡散モデルを組み合わせ、壁や机の端を利用して本や鍋のような掴みにくい物体を掴む外的手先操作を実現した。
- Long-Term Dynamic Window Approach for Kinodynamic Local Planning in Static and Crowd Environments2023/10/1
- Adaptive Spatio-Temporal Voxels Based Trajectory Planning for Autonomous Driving in Highway Traffic Flow2023/10/1
- InteractionNet: Joint Planning and Prediction for Autonomous Driving with Transformers2023/9/1
- Milestones in Autonomous Driving and Intelligent Vehicles Part II: Perception and Planning2023/6/1
- Milestones in Autonomous Driving and Intelligent Vehicles Part I: Control, Computing System Design, Communication, HD Map, Testing, and Human Behaviors2023/5/1
- Prioritized Planning for Target-Oriented Manipulation via Hierarchical Stacking Relationship Prediction2023/3/1
- Milestones in Autonomous Driving and Intelligent Vehicles: Survey of Surveys2023/3/1
- CoBigICP: Robust and Precise Point Set Registration using Correntropy Metrics and Bidirectional Correspondence2023/1/1
- Model-based Decision Making with Imagination for Autonomous Parking2021/8/1
- INVIGORATE: Interactive Visual Grounding and Grasping in Clutter2021/8/1
- Probabilistic Human Motion Prediction via A Bayesian Neural Network2021/7/1
- REGRAD: A Large-Scale Relational Grasp Dataset for Safe and Object-Specific Robotic Grasping in Clutter2021/4/1
- A Driving Behavior Recognition Model with Bi-LSTM and Multi-Scale CNN2021/3/1
- REGNet: REgion-based Grasp Network for End-to-end Grasp Detection in Point Clouds2020/2/1
- Visual Semantic SLAM with Landmarks for Large-Scale Outdoor Environment2020/1/1
- A Real-time Robotic Grasp Approach with Oriented Anchor Box2018/9/1
- A Multi-task Convolutional Neural Network for Autonomous Robotic Grasping in Object Stacking Scenes2018/9/1
- ROI-based Robotic Grasp Detection for Object Overlapping Scenes2018/8/1
- Fully Convolutional Grasp Detection Network with Oriented Anchor Box2018/3/1
- Visual Manipulation Relationship Network2018/2/1
- Brain Inspired Cognitive Model with Attention for Self-Driving Cars2017/2/1