Jiaxin Li
収録論文 14本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 人口規模にスケーラブルなマルチエージェント世界モデリング世界モデル2026/8/9
エージェント数に依存しない共有世界状態と統一レンダリングインターフェースを導入し、推論時にエージェント数を任意に拡張できるマルチエージェント世界モデルKhoraを提案した。
- SONG: ソーシャルナビゲーションのベンチマークのためのフォトリアリスティックな3Dガウスシミュレーションプラットフォームナビゲーション2026/7/1
3Dガウススプラッティングを用いた高忠実度のソーシャルナビゲーションシミュレーションプラットフォームSONGを提案し、ベンチマークと評価指標を提供する。
- DR-GS: 物理ベースの変形・再照明可能な2Dガウシアン3D再構成2026/6/28
変形物体のガウシアンスプラッティングにおいて、照明と材質を分離し、再照明や変形後の編集を可能にする統一フレームワークを提案した。
- HAT-4D: 人間とエージェントの協調による単眼ビデオからの4D複数物体インタラクション復元4D再構成2026/6/26
単眼ビデオから複数物体の3D形状・時間変化・物理的相互作用を復元するエージェントフレームワークを提案し、人間のフィードバックを統合して深度曖昧性や遮蔽問題を解決する。
- HumanScale: 身体中心の人間ビデオは実ロボットデータを凌駕する身体化事前学習の可能性身体化事前学習2026/6/18
身体化基盤モデルの事前学習データとして、遠隔操作の実ロボット軌跡と身体中心の人間ビデオを比較し、適切なフィルタリングとラベリング処理を施した人間ビデオが実ロボットデータよりも優れた性能を示すことを発見した。
- FloVerse: フロアプラン誘導によるマルチモーダルナビゲーションナビゲーション2026/6/1
フロアプランを用いた屋内ナビゲーションの新しいタスクを提案し、PointNav・ObjectNav・ImageNavを統合した大規模データセットと拡散モデルベースの模倣学習手法を開発した。
- OmniXtreme:高ダイナミックヒューマノイド制御における汎用性の壁を突破ヒューマノイド制御2026/2/1
多様なモーションの学習と実機向けの物理的調整を分離したフレームワークを提案し、ヒューマノイドが多様で高難度な動きを実機で高精度に追従できるようにした。
- グレートマーチ100:身体性AIエージェント評価のための100の詳細指向タスクVLA評価ベンチマーク2026/1/1
ロボット学習の評価に向けて、多様な相互作用とロングテール行動を網羅する100の詳細設計タスク「GM-100」を提案し、複数のVLAモデルの性能差を明確に評価できることを示した。
- 間取り図誘導による深度と方向手がかりを統合した視覚ナビゲーション視覚ナビゲーション2025/11/1
間取り図とRGB画像から拡散ポリシーで将来のウェイポイントを予測し、深度による局所的な安全性と間取り図による大局的な方向誘導を組み合わせて効率的にナビゲーションする手法を提案。
- MetaScenes: 実世界3Dスキャンからの自動レプリカ生成に向けてsim2real2025/5/1
実世界スキャンから構築した大規模シミュラブル3DシーンデータセットMetaScenesと、アセットを自動置換するマルチモーダル整合モデルScan2Simを提案し、ロボット操作とVLNのベンチマークで有効性を示した。
- FloNa: 間取り図を活用した身体性視覚ナビゲーションナビゲーション2024/12/1
間取り図を事前知識として視覚ナビゲーションに組み込む新タスクFloNaを提案し、拡散ポリシーFloDiffで観測と間取り図の位置合わせを実現した。
- DisGNet: グラフ距離学習によるGough-Stewartプラットフォームの順運動学順運動学/グラフニューラルネットワーク2024/2/1
Gough-Stewartプラットフォームの順運動学問題に対し、グラフ距離行列を学習するGNNとGPU並列ニュートン法を組み合わせ、高精度かつリアルタイムな姿勢推定を実現した。
- LiDAR Distillation: Bridging the Beam-Induced Domain Gap for 3D Object Detection2022/3/1
- Accurate 3D Localization for MAV Swarms by UWB and IMU Fusion2018/7/1