Jian Yang
Nanjing University of Science and Technology
収録論文 22本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BridgeMatch: マッチング行列空間における条件付きトランスポートブリッジによる3次元変形レジストレーション3Dレジストレーション2026/9/10
粗い解像度で拡散モデルにより大域的なマッチング行列を推定し、それを高解像度に持ち上げた後、条件付きトランスポートブリッジ(Flow Matching ODEまたはSchrödingerブリッジSDE)で洗練することで、非剛体点群対応を高精度化する手法を提案。
- 言語軌跡符号化による身体化エージェントの長期的空間記憶の効率化空間記憶2026/9/4
動的物体の動きの履歴を自然言語と空間・視覚アンカーで圧縮表現し、長時間にわたる物体の状態遷移を言語で検索可能にする手法を提案した。
- OpenArmベースの実験室モバイルマニピュレーションにおける表現ハンドオフモバイルマニピュレーション2026/8/1
OpenArmを用いた実験室タスク向けモバイルマニピュレーションシステムを構築し、言語指示から安全な動作までの表現の受け渡しを設計・評価した。
- HyperDCM: 双曲空間における動的クラスタメモリリプレイによる継続的ロボットナビゲーションナビゲーション2026/7/1
視覚ナビゲーションの継続学習における破滅的忘却を防ぐため、シーングラフと双曲空間のメモリリプレイを組み合わせた手法を提案した。
- 思考の蒸留と行動の予見:自動運転のための認知物理強化学習自動運転2026/5/20
自動運転のための認知物理強化学習フレームワークCoPhyを提案。VLM知識を蒸留して認知能力を保持しつつ、BEV世界モデルで将来予測を行い、安全と意図適合の二重報酬でポリシーを最適化する。
- 視覚的に現実的なシミュレーションを目指して:ロボット操作のシミュレーション評価のためのベンチマークシミュレーション評価2026/5/1
シミュレーションと実世界の視覚的ギャップを減らすため、照明とマテリアルが幾何学的推論と空間的接地に与える影響を分析し、高忠実度の3Dアセットと自動パイプラインを用いた視覚的に現実的なベンチマークVISERを提案した。
- 動的屋内環境における少数ショット増分3D物体検出3D物体検出2026/4/9
動的屋内環境での3D物体認識を効率的に行うため、視覚言語モデルを活用して未知カテゴリの知識を学習し、少数の新規サンプルで検出性能を向上させるFI3Detフレームワークを提案した。
- 実現可能性を高めた制御バリア関数によるマルチUAV衝突回避手法群制御2026/3/1
密集したマルチUAV環境でCBF-QPの実行可能性が損なわれる問題に対し、内部非両立性を緩和する符号整合制約を導入し、分散CBF-QPに組み込むことで衝突回避性能を向上させた。
- RoboSafe: 実行可能な安全ロジックによる身体性エージェントの保護安全/身体性エージェント2025/12/1
VLMベースの身体性エージェントに対し、短期・長期の安全メモリを用いた後方反省推論と前方予測推論を組み合わせ、実行可能な述語ロジックで危険行動を未然に防ぐランタイム安全ガードレールを提案。
- MonoSE(3)-Diffusion: 単眼カメラからのロボット姿勢推定のためのSE(3)拡散フレームワーク姿勢推定2025/10/1
単眼画像からのマーカーレスなロボット姿勢推定を条件付き拡散過程として定式化し、視認性制約付き拡散とタイムステップ対応逆過程で高精度かつ頑健な姿勢推定を実現した。
- RuN: 自然なヒューマノイド歩行のための残差ポリシー歩行2025/9/1
事前学習済みの動作生成器と残差強化学習を組み合わせ、歩行から走行まで滑らかに遷移する自然なヒューマノイド移動を実現した。
- GMOR: 幾何学的最大重複に基づく軽量な点群位置合わせフレームワーク点群位置合わせ2025/8/1
回転軸のみを分枝限定法で探索し、残りのパラメータを範囲最大クエリとして解くことで、外れ値が多い点群でも高精度かつ軽量に位置合わせする手法を提案した。
- KGN-Pro: 確率的2D-3D対応学習によるキーポイントベースの把持予測マニピュレーション2025/7/1
RGB-D画像から把持キーポイントを予測し、確率的PnP層で3D最適化をエンドツーエンドに組み込むことで、6自由度把持推定の精度と成功率を向上させた研究。
- NeuroLoc: 脳のナビゲーション細胞を模倣した6自由度カメラ自己位置推定自己位置推定2025/5/1
グリッド細胞・プレイス細胞・頭方向細胞に着想を得て、単一画像から6自由度のカメラ位置姿勢を推定する手法を提案し、屋内・屋外ベンチマークで複雑環境でのロバスト性を向上させた。
- KiteRunner: UAVマッピングを用いた言語駆動型協調的局所・大域ナビゲーション方策ナビゲーション2025/3/1
UAVのオルソフォトで大域的な確率マップを作り、拡散モデルで局所経路を生成し、CLIPやGPTで自然言語指示を解釈する屋外長距離ナビゲーション手法を提案した。
- GigaSLAM:階層的ガウススプラットによる大規模単眼SLAMSLAM2025/3/1
単眼RGB入力のみでキロメートル規模の屋外環境を扱える、階層的ボクセルマップと3Dガウススプラッティングを組み合わせた初のSLAMフレームワーク。
- Dual-BEV Nav:非構造屋外環境におけるロボットナビゲーションのための二層BEVベースヒューリスティック経路計画ナビゲーション2025/1/1
局所と大域のBird's Eye View(BEV)表現を組み合わせた二層ヒューリスティック計画により、非構造屋外環境での長距離ナビゲーションを実現する手法を提案した。
- QwenGrasp: A Usage of Large Vision-Language Model for Target-Oriented Grasping2023/9/1
- Semantics-Guided Moving Object Segmentation with 3D LiDAR2022/5/1
- Adaptive Coordinated Motion Control for Swarm Robotics Based on Brain Storm Optimization2021/5/1
- LiDAR Iris for Loop-Closure Detection2019/12/1
- Greedy Graph Searching for Vascular Tracking in Angiographic Image Sequences2018/5/1