Jie Li
収録論文 32本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- NIDAR: 近赤外線誘導によるシーン非依存LiDAR強度再構成sim2real2026/9/29
RGB画像とシミュレータ幾何情報からLiDAR強度をフィードフォワードで合成するNIDARを提案。実強度ラベルやシーンごとの最適化を不要にし、Waymoで学習した固定モデルでnuScenesにも適用可能。
- GNNロバスト性の分離解析フレームワーク:相転移からシステム崩壊までGNNロバスト性2026/9/15
ラベルノイズと特徴分布シフトを別々に操作できる合成グラフ回帰ベンチマークを構築し、GNNが中程度のラベルノイズには耐えるが深刻な分布シフトで劇的に性能劣化することを示した。
- DreamQAS: 意思決定に有用な世界モデルによるVQE効率的な量子アーキテクチャ探索量子アーキテクチャ探索2026/7/31
量子回路の構築と動作の合法性が決定的であることを利用し、高コストなVQEフィードバックのみを学習するモデルベース強化学習フレームワークDreamQASを提案した。
- ロボット化学実験室における大規模言語モデルエージェントのストレステスト科学エージェント2026/7/1
ロボット化学実験室を物理世界のテストベッドとして使い、大規模言語モデルエージェントの科学的エージェンシーを測定可能にした研究。実験の実行可能性と証拠に基づく再計画の能力を評価した。
- RiskFlow: 高速かつ忠実な安全臨界交通シナリオ生成自動運転/シナリオ生成2026/6/1
自動運転システムの評価に必要な安全臨界シナリオを、反復的ノイズ除去を避け、単一の順伝播で生成する新しいフレームワークを提案した論文。
- FastDSAC: 制約付き探索によるポリシー可塑性の向上とスケーラブルな人型ロコモーション歩行2026/6/1
並列サンプリング環境での強化学習の安定性とポリシー可塑性を向上させるため、切断ガウス分布を用いた行動制約を導入したDistributional Actor-Criticの高速版FastDSACを提案した。
- HULK: 継続的かつ不確実な時間的タスク下での大規模階層的協調群制御2026/5/1
オンラインで発生し、サブタスク数が不確実なタスク群に対して、階層的な枠組みで効率的にマルチエージェントを協調させる手法を提案した論文。
- ViVa: ロボット強化学習のためのビデオ生成価値モデル強化学習2026/4/1
事前学習済みのビデオ生成モデルを価値関数として再利用し、将来の身体状態とスカラー価値を同時に予測することで、ロボット操作タスクにおける価値推定を改善する手法を提案した。
- HECTOR: 継続的時相タスク下でのロボット群に対する人間中心の階層的協調と監督群制御2026/4/1
大規模ロボット群を人間が効率的に監督・操作するための階層的な協調・監督スキームを提案し、動的環境でのタスク追加・変更に対応する。
- TeleGate: モーション事前分布とゲート付きエキスパート選択による全身ヒューマノイド遠隔操作遠隔操作2026/2/1
複数の専門家ポリシーを蒸留せずにゲートネットワークで動的に選択し、VAEベースの運動事前分布で将来の動きを予測することで、ヒューマノイドの全身遠隔操作を高精度に実現した。
- Xiaomi-Robotics-0:リアルタイム実行可能なオープンソース視覚言語行動モデルVLA2026/2/1
大規模なロボット軌道と視覚言語データで事前学習し、非同期実行のための学習技術と展開時のタイムステップ調整により、民生用GPUで高速かつ滑らかなリアルタイム動作を実現したVLAモデルを提案。
- BoRe-Depth:境界精緻化を備えた組込みシステム向け自己教師あり単眼深度推定深度推定2025/11/1
組込みシステム上で高精度かつ物体境界が鮮明な深度推定を実現するため、8.7Mパラメータの軽量モデルBoRe-Depthを提案し、Jetson Orinで50.7FPSで動作することを示した。
- GigaBrain-0: ワールドモデルを活用した視覚-言語-行動モデルVLA2025/10/1
ワールドモデルで生成した多様なデータを活用し、実機データへの依存を抑えつつ汎化性能を高めたVLA基盤モデルを提案。RGBD入力と身体性Chain-of-Thoughtで長期的・移動を伴う器用な操作タスクの実世界性能を向上させた。
- UAVによる風車ブレード自動検査:停止角度推定とブレード詳細優先露出調整UAV検査2025/7/1
風車ブレードのUAV自動検査のため、フェルマ点に基づく停止角度推定と、撮影時にブレード詳細を優先する露出調整手法を提案し、実証実験で有効性を示した。
- 障害物環境における見通し接続性を保証するマルチUAV配置群制御2025/7/1
障害物の多い環境で複数UAVの中継ネットワークを構築するため、最小辺RRT*に基づく探索とLOS接続性を考慮した分散モデル予測制御を提案し、衝突回避と接続維持を理論的に保証した。
- HS-SLAM:低速自動運転向けの高速ハイブリッド戦略ベースSLAM手法SLAM2025/5/1
IMUによる相対位置推定と多層直接法を組み合わせ、特徴点マッチングを効率化することで、ORB-SLAM3より高精度かつ15%高速な追跡を実現したSLAMフレームワーク。
- MemFusionMap: ワーキングメモリ融合によるオンライン・ベクター化HDマップ構築自動運転/HDマップ2024/9/1
複数フレームの履歴をワーキングメモリとして融合し、時間的重なりヒートマップも活用することで、オンラインでのベクター化HDマップ構築の精度を向上させた研究。
- 姿勢制御のためのモジュール衛星の形態と制御の同時最適化宇宙ロボティクス2024/9/1
モジュール衛星の姿勢制御性能を高めるため、衛星の形態と制御器を勾配ベースで同時最適化する手法を提案し、進化計算ベースの手法より優れた性能を示した。
- Lifelike Agility and Play in Quadrupedal Robots using Reinforcement Learning and Generative Pre-trained Models2023/8/1
- A novel integrated method of detection-grasping for specific object based on the box coordinate matching2023/7/1
- Tracking through Containers and Occluders in the Wild2023/5/1
- Viewpoint Equivariance for Multi-View 3D Object Detection2023/3/1
- Integrated Design of Cooperative Area Coverage and Target Tracking with Multi-UAV System2023/3/1
- Standing Between Past and Future: Spatio-Temporal Modeling for Multi-Camera 3D Multi-Object Tracking2023/2/1
- Probabilistic 3D Multi-Modal, Multi-Object Tracking for Autonomous Driving2020/12/1
- PillarFlow: End-to-end Birds-eye-view Flow Estimation for Autonomous Driving2020/8/1
- Probabilistic 3D Multi-Object Tracking for Autonomous Driving2020/1/1
- Mission Oriented Miniature Fixed-wing UAV Swarms: A Multi-layered and Distributed Architecture2019/12/1
- ViLiVO: Virtual LiDAR-Visual Odometry for an Autonomous Vehicle with a Multi-Camera System2019/9/1
- Boosting Real-Time Driving Scene Parsing with Shared Semantics2019/9/1
- Gaussian Processes Semantic Map Representation2017/7/1
- WaterGAN: Unsupervised Generative Network to Enable Real-time Color Correction of Monocular Underwater Images2017/2/1