Sheng Zhong
Chinese Academy of Sciences
収録論文 16本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FARM: 凍結ロボット世界モデルの内部予測状態から失敗信号を読み取る失敗検出/世界モデル2026/9/10
凍結した事前学習済みロボット世界モデルの内部予測状態から、小さな読み出し層のみを学習して失敗を検出する手法を提案し、実機ロボットでも転移可能で低遅延な監視を実現した。
- Embodied.cpp: 異種ロボット向け具現化AIモデルのポータブル推論ランタイムVLA/推論ランタイム2026/7/1
VLAモデルや世界行動モデルなどの具現化AIモデルを、異なるロボットやエッジデバイス上で効率的に実行するためのC++推論ランタイムを提案。モジュール化された5層構造により、多レート実行や低遅延推論を実現し、Pythonベースラインと比較して1.05〜2.70倍の高速化とVRAM削減を達成した。
- 高速機動のためのイベントベースSLAMベンチマークSLAM2026/4/1
イベントカメラを用いた高速機動下での状態推定手法の限界を分析し、多様なプラットフォームと照明条件を含む新しいベンチマークフレームワークEvSLAMを提案した。
- ニューラル暗黙アクションフィールド:視覚-言語-行動モデルのための離散ウェイポイントから連続関数へVLA2026/3/1
VLAモデルの行動表現を離散ウェイポイントから連続時間の行動関数へ再定式化し、任意の時間分解能で滑らかな制御を可能にした手法を提案。
- イベントカメラの法線フローを用いたリアルタイム動作セグメンテーションイベントカメラ/動作セグメンテーション2026/2/1
イベントカメラの法線フローを中間表現として用い、グラフカットによるエネルギー最小化で動作セグメンテーションをリアルタイムに実行するフレームワークを提案した。
- LOC: 言語誘導によるオープンセット3D占有予測の汎用フレームワーク3D占有予測2025/10/1
LiDAR点群とCLIP特徴空間を活用し、テキスト誘導で未知クラスも認識できる3D占有予測フレームワークLOCを提案。教師あり・自己教師あり両方に対応。
- ステレオイベントカメラのための深層視覚オドメトリ視覚オドメトリ2025/9/1
イベントカメラのステレオ視覚オドメトリにおいて、深層学習と静的ステレオ対応戦略を組み合わせ、リアルタイムで高精度な姿勢推定を実現した。
- LLMを活用した人間らしい交通シミュレーションによる自動運転テスト自動運転シミュレーション2025/8/1
認知理論とLLMを組み合わせ、多様な運転スタイルを持つ人間ドライバーを再現する交通生成フレームワークHDSimを提案し、自動運転システムの安全性評価を改善した。
- ESVO2: ステレオイベントカメラによる直接視覚慣性オドメトリ視覚慣性オドメトリ2024/10/1
イベントカメラとIMUを組み合わせ、直接法で高精度なステレオ視覚慣性オドメトリを実現した研究。
- 相互情報量を用いた物体探索マニピュレーションマニピュレーション2024/8/1
視覚的に隠れた環境で既知の可動物体の姿勢を推定するため、相互情報量に基づいてロボットの接触を伴う探索行動をオンライン生成する手法を提案。
- IMU支援によるイベントベースステレオ視覚オドメトリ視覚オドメトリ2024/5/1
イベントカメラとジャイロスコープを組み合わせ、エッジピクセルの動的サンプリングと時間的・静的ステレオの統合により、マッピングの効率と精度を向上させた視覚オドメトリ手法を提案。
- Event-based Visual Inertial Velometer2023/11/1
- CHSEL: Producing Diverse Plausible Pose Estimates from Contact and Free Space Data2023/5/1
- Robust and Efficient Trajectory Planning for Formation Flight in Dense Environments2022/10/1
- Soft Tracking Using Contacts for Cluttered Objects to Perform Blind Object Retrieval2022/1/1
- TAMPC: A Controller for Escaping Traps in Novel Environments2020/10/1