Zhipeng Bao
収録論文 7本 ・ フィジカルAI/ロボット学習
自動運転VLMV2X/エッジクラウド協調自動運転自動運転/人間中心AI自動運転データセット拡散モデル3Dシーン理解
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AnchorReasoning: ロングテール自動運転シナリオにおける視覚的根拠付けと因果推論データセット自動運転VLM2026/9/23
自動運転のロングテール場面を対象に、視覚的根拠付きの思考連鎖(VG-CoT)で判断要素の特定・位置推定から行動計画までを結びつけた大規模データセットを構築し、段階的ファインチューニングで推論と軌道予測の精度を向上させた。
- CABLE: V2Xシステム向けクラウド支援・帯域効率的なLMMベース符号化V2X/エッジクラウド協調2026/6/1
エッジとクラウド間の通信量を削減するため、前フレームのセグメンテーション結果を利用して関心領域を絞り込み、その領域のみをクラウドに送信するフレームワークを提案した。
- 大規模言語モデルによる自動運転車のスタックからの自律復帰自動運転2025/10/1
LLMを活用し、自動運転車が立ち往生した際に自己推論や乗客の指示で復帰するプラグイン型フレームワークStuckSolverを提案し、ベンチマークで有効性を示した。
- あなたの乗車、あなたのルール:心理・認知対応の自動運転システム自動運転/人間中心AI2025/6/1
乗員の脳波や心拍、表情、音声指示といった心理・認知情報を基盤モデルエージェントで解釈し、外部環境認識と統合して自動運転車の乗車体験を個人化する枠組みPACE-ADSを提案・評価した論文。
- 自動運転車と信号・標識のインタラクションデータセット自動運転データセット2025/1/1
Waymo Motionデータセットから自動運転車と信号機・一時停止標識のインタラクション軌跡を抽出し、ウェーブレットノイズ除去で品質を高めた大規模データセットを構築・公開した。
- Diff-2-in-1:拡散モデルによる生成と高密度知覚の橋渡し拡散モデル2024/11/1
拡散モデルの脱ノイズ過程を活用し、マルチモーダルデータ生成と高密度視覚知覚を同時に扱う統合フレームワークを提案。生成データを自己改善学習に用いることで、様々な知覚バックボーンの性能を向上させる。
- Lexicon3D: 複雑な3Dシーン理解のための視覚基盤モデルを探る3Dシーン理解2024/9/1
画像・動画・3Dの視覚基盤モデル7種を4つの3Dシーン理解タスクで比較評価し、各モデルの強みと弱みを明らかにした研究。