Zeyu Jiang
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UniNav: 視覚ナビゲーションのための統合ワールド・アクション拡散モデルナビゲーション2026/8/4
画像ゴールの視覚ナビゲーションにおいて、将来の観測予測と軌道生成を単一の拡散プロセスで統合したモデルUniNavを提案。幾何認識カメラトークンとビデオのみのデータ学習により性能を向上させ、高速推論も可能にした。
- AdvNav: 行動誘導型ブラックボックス敵対的攻撃による視覚言語ナビゲーションの妨害ナビゲーション/敵対的攻撃2026/7/13
視覚言語ナビゲーションシステムに対する、勾配情報を使わずにエージェントの行動観測のみで敵対的摂動を生成するブラックボックス攻撃フレームワークを提案した。
- FreeOcc: 学習不要の身体化オープンボキャブラリ占有予測占有予測2026/4/1
3Dアノテーションやカメラ姿勢の真値を使わず、SLAMと視覚言語モデルを組み合わせて、単眼またはRGB-Dシーケンスからオープンボキャブラリの占有マップを構築する学習不要のフレームワークを提案した。
- SaferPath: 学習による誘導と安全制約付き制御を用いた階層的視覚ナビゲーションナビゲーション2026/3/1
既存のエンドツーエンドモデルから得た誘導を、安全制約付き最適化制御モジュールで洗練する階層的視覚ナビゲーションフレームワークを提案し、未見環境での衝突を減らし成功率を向上させる。
- REAL: 時空間ポリシー学習と物理誘導フィルタリングによる堅牢な極限アジリティ歩行2026/3/1
視覚ノイズや遅延に頑健な四足ロボットのパルクール学習フレームワークを提案。クロスモーダルな教師ポリシーを、視覚ノイズを能動的にフィルタリングするMambaベースの学生ポリシーに蒸留し、物理誘導ベイズ推定で剛体整合性を保つ。
- DexFormer: 履歴条件付きTransformerによるクロスエンボディメント器用マニピュレーションマニピュレーション2026/2/1
履歴観測を条件とするTransformerベースの単一ポリシーで、異なる多自由度ハンドの形態や動力学をオンラインで推定し、ゼロショットで多様なハンドに適応する器用マニピュレーションを実現した。
- LST-SLAM: キロメートル規模の動的環境に対応するステレオ熱画像SLAMシステムSLAM2026/2/1
熱画像カメラを用いた大規模動的環境向けステレオSLAMシステムを提案し、自己教師あり特徴学習と動的特徴抑制によりキロメートル規模のデータセットで高精度・高ロバスト性を実現した。
- VLA-OS:視覚言語行動モデルにおける計画表現とパラダイムの構造化と分析VLA2025/6/1
VLAモデルの計画パラダイムと表現を統一的に比較するVLA-OSを提案し、視覚接地表現が言語表現より優れ、階層型VLAが性能・汎化・拡張性で優位だが速度が遅いことを示した。
- DexSinGrasp: 密集した clutter 環境における巧みな物体分離と把持のための統合ポリシーの学習マニピュレーション2025/4/1
多自由度の巧みなハンドを用いて、密集した clutter 環境で物体を分離しながら把持する統合ポリシーを学習し、カリキュラム学習とポリシー蒸留により効率と成功率を向上させた。
- 効率的なキーポイント検出と系列情報によるシーン座標回帰の強化visual localization2024/12/1
シーン座標回帰において、キーポイント検出とシーンエンコーディングを統合し、系列情報を活用することで、繰り返しテクスチャ環境での精度と効率を向上させた。