Xiangyang Ji
Tsinghua University
収録論文 22本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DualManip:二重経路の意味推論と幾何適応によるエージェント型動的マニピュレーションマニピュレーション2026/9/25
VLMによる意味推論と形状適応ネットワークによる幾何適応を分離し、動的な物体変化に追従しながら把持を再構成するロボットマニピュレーション手法を提案。
- ビールを取ってきて:スムーズなピックアンドプレースのための合成から実への階層型ポリシーsim2real2026/9/16
液体入り容器をこぼさずに運ぶため、流体シミュレーションで検証した合成データと、言語・視覚からSE(3)目標を生成する高レベルモジュール+潜在拡散コントローラの階層型ポリシーを組み合わせた合成→実機フレームワークを提案。
- 3DWay: 3D一貫性ウェイポイントによるロボット操作の一般化マニピュレーション2026/9/8
多視点画像から3D一貫性のあるウェイポイントを予測し、ロボット操作の一般化を向上させる手法を提案した論文。
- Functional-SLAM: オンライン機能シーングラフによるインタラクション認識マッピングSLAM2026/9/7
ロボットの細かいインタラクションに必要な機能関係をモデル化したオンラインSLAMフレームワークを提案し、機能シーングラフをリアルタイムに構築・維持する。
- 均一照明視触覚センサと時空間トランスフォーマによる堅牢な滑り検出と物体分類触覚/滑り検出2026/8/25
均一RGB照明を備えた視触覚センサと、滑り方向を含む高精度な滑り検出・物体分類を行う時空間トランスフォーマネットワークを提案した。
- アクティブイベントベースステレオ視覚による超高速深度センシングに向けてイベントベースビジョン/深度センシング2026/7/1
イベントカメラと赤外線パターン投影機を統合したアクティブイベントベースステレオ視覚を提案し、高速シーンでの高密度深度推定を実現する軽量ニューラルネットワークActiveEventNet+を開発した。
- DynFly: 都市環境におけるUAV視覚言語ナビゲーションのための動的認識連続軌道生成UAVナビゲーション2026/6/1
UAVの視覚言語ナビゲーションにおいて、高レベルの推論と実行可能な連続軌道の間のギャップを埋めるため、Bスプラインとフローマッチングを用いた動的認識軌道生成フレームワークDynFlyを提案した。
- TapSampling: タスク進捗理解型検証器を用いた推論時サンプリングによるロボット操作マニピュレーション2026/5/1
ロボット操作の汎用ポリシーに対して、推論時に複数の行動候補をサンプリングし、タスク進捗を予測する検証器で最適な行動を選ぶプラグアンドプレイなフレームワークを提案した。
- 屋内空間のための階層的かつ全体的なオープンボキャブラリー機能3Dシーングラフ3Dシーン理解2026/5/1
機能的な3Dシーングラフの構築において、テーブルトップ上の密集した物体や多階層の機能関係を扱う新しいパイプラインを提案し、2D視覚グラウンディングと3Dグラフ最適化により頑健なグラフ構造を復元する。
- UniStateDLO: 遮蔽下の変形可能な線状物体に対する統合的な生成的状态推定と追従変形物体知覚2025/12/1
ケーブルやロープなどの変形線状物体(DLO)の知覚を、拡散モデルを用いた条件付き生成問題として定式化し、部分点群からの単一フレーム状態推定とフレーム間追従を統合的に実現。合成データのみで訓練し、遮蔽下でのゼロショットsim-to-realを達成した。
- タスク指向飛行への道:フレームワーク・基盤・原則飛行制御/sim2real2025/4/1
クアッドロータのエンドツーエンド深層強化学習のためのタスク指向フレームワークを提案し、シミュレーションから実機への転移を可能にするソフト・ハード・ファームウェアの統合基盤と設計原則を示した。
- GFreeDet: ガウシアンスプラッティングと基盤モデルによるモデルフリー未知物体検出物体検出2024/12/1
参照動画からガウシアンスプラッティングで物体を再構成し、CADモデルなしで未知物体を検出する手法を提案。BOP Challenge 2024のモデルフリー2D検出部門で最優秀賞を受賞した。
- オフライン強化学習のための二重緩和一般化オフライン強化学習2024/11/12
オフライン強化学習において、データセット外への過度な一般化を抑えつつ、適度な一般化を活用する二重緩和一般化(DMG)を提案し、Gym-MuJoCoやAntMazeで最高性能を達成した。
- UW-SDF: 水中多視点単眼画像からのニューラルSDF再構成のためのハイブリッド幾何事前分布の活用3D再構成/NeRF/SDF2024/10/1
水中の多視点画像からニューラルSDFを用いて物体を3D再構成するフレームワークを提案し、ハイブリッド幾何事前分布とSAMを活用した少数ショット多視点セグメンテーションで高精度・高効率を実現した。
- 競争を通じてロボットの潜在能力を引き出す群制御2024/3/1
競争環境での他者との比較を学習の補助信号として活用し、ロボットが競争から知識を得て潜在能力を最大限に発揮する競争学習フレームワークを提案。マルチエージェント競走環境での実験で、単一ロボット環境の最先端手法より優れた性能を示した。
- PAS-SLAM: A Visual SLAM System for Planar Ambiguous Scenes2024/2/1
- Supported Trust Region Optimization for Offline Reinforcement Learning2023/11/15
- LanPose: Language-Instructed 6D Object Pose Estimation for Robotic Assembly2023/10/1
- 6D Robotic Assembly Based on RGB-only Object Pose Estimation2022/8/1
- Occlusion-Aware Self-Supervised Monocular 6D Object Pose Estimation2022/3/1
- GDRNPP: A Geometry-guided and Fully Learning-based Object Pose Estimator2021/2/1
- DeepIM: Deep Iterative Matching for 6D Pose Estimation2018/4/1