Sha Zhang
収録論文 8本 ・ フィジカルAI/ロボット学習
オフライン強化学習マニピュレーション触覚/操作VLAsim2real自動運転計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoMAN-Flow: ロボット操作におけるオフライン強化学習のための自己回帰正規化フローの制御オフライン強化学習2026/8/20
自己回帰正規化フローを用いたオフライン強化学習フレームワークを提案し、サンプリング不要の尤度目的と一段階蒸留により推論遅延を削減しつつ、ロボット操作の性能を維持する。
- LabDex: 実験室における器用な操作のための階層的ベンチマークマニピュレーション2026/8/19
化学実験室での器用な操作を評価するための大規模な実世界データセットとベンチマークを導入し、原子スキル、合成タスク、長期実験の階層的タスク分類を提供する。
- ReTouch: オンライン更新型触覚予測による接触豊富な器用操作の実現触覚/操作2026/8/1
触覚予測を実行時のフィードバックでオンライン更新するVLAモデルReTouchを提案し、接触を伴う器用操作の成功率を大幅に向上させた。
- Trans2Occ: 透明物体のボクセル占有推定と把持 - シミュレーションから実世界へマニピュレーション2026/6/1
単一RGB画像から透明物体のボクセル占有を直接予測し、シミュレーションで大規模学習したモデルを実ロボットに微調整なしで適用して把持を実現する枠組みを提案した。
- VLMPlanner: 視覚言語モデルと運動計画の統合VLA2025/7/1
視覚言語モデル(VLM)を自動運転の運動計画に組み込み、生画像から得た文脈情報でリアルタイムプランナを誘導するハイブリッド手法を提案。シーン複雑度に応じて推論頻度を調整する機構も導入した。
- LabUtopia:科学実験エージェントのための高忠実度シミュレーションと階層的ベンチマークsim2real2025/5/1
実験室での科学作業を自動化する身体性エージェントの研究を進めるため、物理・化学反応を扱える高忠実度シミュレータ、多様な実験シーンの自動生成器、5段階の難易度を持つ階層的ベンチマークを統合したスイートを提案。
- 知覚が計画を助ける:二重エッジ構造による多段階レーンレベル統合自動運転計画2024/7/1
車線や交差点などの交通要素の知覚を計画に統合するフレームワークPHPを提案し、レーンの両エッジを活用して安全で効率的な自動運転計画を実現、Carlaベンチマークで運転スコアを27.20%改善した。
- TrajMatch: Towards Automatic Spatio-temporal Calibration for Roadside LiDARs through Trajectory Matching2023/2/1