Siheng Chen
収録論文 22本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GLoRI: グローバル・ローカル参照相互作用によるヒューマノイド移動操作のための閉ループ全身追跡ヒューマノイド制御2026/9/5
ヒューマノイドの全身動作追跡を高精度化するため、グローバルな位置補正とローカルな動作構造を融合する閉ループ制御器GLoRIを提案し、シミュレーションから実機への転移でも高い精度と汎化を実証した。
- 基盤モデルを物理世界エージェントに組み込むことで長期的ナビゲーションの限界を押し広げるナビゲーション2026/8/31
VLMによる推論エージェントとナビゲーション基盤モデルを組み合わせたフレームワークNavMCPを提案し、長期的な探索タスクで高い性能を達成した。
- ツール整合型視覚言語行動モデルによる長期的身体エージェントの実現VLA/長期タスク2026/5/1
高レベルのVLMエージェントが計画を、専門化されたVLAツール群が局所操作を分担し、長期的タスクを効率的に実行する枠組みを提案した。
- デジタルからフィジカルへ:物理知能のための自律型コーチとしてのデジタルエージェントVLA2026/1/1
LLMエージェントが強化学習や模倣学習のタスク設計・デバッグ・最適化を自律的に行うベンチマークEmboCoach-Benchを提案し、人間設計を上回る性能を実証した。
- ヒューマノイドロボットの高レベル制御におけるデータとモデルのスケーリングの影響の解明ヒューマノイド制御2025/11/1
人間の動画から自動生成した260時間超のヒューマノイド動作データセットHumanoid-Unionと、スケーラブルな学習フレームワークSCHURを提案し、大規模データが高レベル制御に与える影響を検証した。
- EmboMatrix: 身体性意思決定のためのスケーラブルな訓練基盤VLA2025/10/1
大規模言語モデルに身体性意思決定能力を獲得させるため、タスク・シーン生成、分散シミュレーション、精密報酬を統合した訓練基盤EmboMatrixを構築し、7Bモデルが671Bモデルを上回る性能を達成した。
- 二人で成し遂げる:ヒューマノイドロボット間のインタラクティブ全身制御の学習全身制御2025/10/1
二人のヒューマノイドが相互作用する人間の動作を模倣するため、接触を考慮した動作リターゲティングと相互作用駆動型制御器を組み合わせたフレームワークHarmanoidを提案。
- PolySim: マルチシミュレータのダイナミクスランダム化によるヒューマノイド制御のsim-to-realギャップの橋渡しsim2real2025/10/1
複数の異なるシミュレータを同時に用いて全身制御ポリシーを訓練し、シミュレータ固有のバイアスを低減して実機へのゼロショット転移を実現した。
- BeliefMapNav: 3Dボクセルベースの信念マップによるゼロショット物体ナビゲーションナビゲーション2025/6/1
LLMの意味推論と3Dボクセル空間を組み合わせ、未知環境で対象物体を探すゼロショット物体ナビゲーション手法を提案し、ベンチマークで最高精度を達成した。
- 合成データがEnd-to-End自動運転に与える影響の解明自動運転/シミュレーション2025/3/1
3Dガウシアンスプラッティングを用いた高忠実・対話的・効率的な自動運転シミュレータSceneCrafterを提案し、合成データ生成と閉ループ評価を通じてEnd-to-Endモデルの汎化性能を向上させる。
- SafeAgentBench:身体性LLMエージェントの安全なタスク計画のためのベンチマーク安全性評価2024/12/1
対話型シミュレーション環境で身体性LLMエージェントの安全性を評価する初のベンチマークを提案し、750タスクと評価環境を構築した。実験では既存エージェントの安全意識が低いことを示した。
- 外部測位・時刻同期デバイス不要のロバスト協調知覚協調知覚2024/5/1
各エージェントの検出物体から顕著物体グラフを構築し、グラフニューラルネットで共通部分グラフを同定することで、外部の測位・時計デバイスなしに相対姿勢と時刻を推定する協調知覚システムを提案。
- 言語駆動によるインタラクティブ交通軌跡生成交通軌跡生成2024/5/1
自然言語の指示から複数車両が相互作用する交通軌跡を生成するInteractTrajを提案し、従来手法より現実的で制御性の高い生成を実現した。
- FastMAC: 対応グラフの確率的スペクトルサンプリング点群位置合わせ2024/3/1
3D対応グラフにグラフ信号処理を導入し、高周波成分を保つ確率的スペクトルサンプリングでMACを高速化した3D点群位置合わせ手法を提案。
- Asynchrony-Robust Collaborative Perception via Bird's Eye View Flow2023/9/1
- Interruption-Aware Cooperative Perception for V2X Communication-Aided Autonomous Driving2023/4/1
- Among Us: Adversarially Robust Collaborative Perception by Consensus2023/3/1
- Robust Collaborative 3D Object Detection in Presence of Pose Errors2022/11/1
- Collaborative Perception for Autonomous Driving: Current Status and Future Trend2022/8/1
- Latency-Aware Collaborative Perception2022/7/1
- Modular representation and control of floppy networks2022/2/1
- Learning Distilled Collaboration Graph for Multi-Agent Perception2021/11/1