Yunlong Wang
収録論文 15本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- デジタルヘルスキャンペーン成果の早期予測のための患者ワールドモデル:能力と限界ヘルスケア予測2026/9/20
患者ごとの潜在状態を保持し、曝露条件付き状態ダイナミクスと週次転換ハザードを学習して将来の転換曲線を予測するコンパクトな患者ワールドモデルを構築し、米国のキャンペーンデータで評価した。
- UniDexTok: 実データからの統合器用手トークナイザ器用手/表現学習2026/6/9
人間とロボットの手の状態を共通の22自由度セマンティックインターフェースにマッピングし、再ターゲティング不要で異種の器用手を統一表現するトークナイザを提案。誤差をセンチメートルからサブミリメートルに大幅削減した。
- HT-Bench: 器用な全手触覚表現のベンチマークと学習 - 自己中心視覚との統合触覚表現学習2026/6/1
触覚センサの多様性を超え、自己中心視覚と全手触覚データを組み合わせた大規模ベンチマークHT-Benchを構築し、触覚表現学習の評価手法とHandTouchエンコーダを提案した。
- XEmbodied: 大規模具現環境向けに幾何・物理的手がかりを強化した基盤モデルVLA/基盤モデル2026/4/1
クラウド側でVLMに3次元幾何認識と物理的手がかりを統合し、空間推論や具現化タスクの性能を向上させる基盤モデルを提案した。
- ALOE: 視覚言語行動モデルの事後学習のための行動レベルオフポリシー評価VLA2026/2/1
実世界の人間参加型強化学習でVLAモデルを改善するため、現在のポリシーを直接評価するオフポリシー評価フレームワークALOEを提案し、4つの実世界マニピュレーションタスクで検証した。
- MTRDrive: 記憶とツールの協調推論によるコーナーケースに頑健な自動運転自動運転/VLM2025/9/1
運転経験の記憶検索と動的ツールキットを組み合わせた閉ループ型フレームワークMTRDriveを提案し、OODシナリオでのゼロショット汎化と計画精度を向上させた。
- 自動運転のための視覚-言語-行動モデルに関するサーベイVLA2025/6/1
自動運転向けの視覚・言語・行動を統合したVLAモデルについて、アーキテクチャや20以上の代表モデル、データセット、課題を初めて体系的にまとめたサーベイ。
- RAVE: ラスタライズ・ベクター化HDマップを用いたエンドツーエンド階層型視覚自己位置推定自己位置推定2025/3/1
周囲画像とHDマップを統合し、ラスタマップによる粗推定とベクタマップによるTransformerベースの精緻化を組み合わせたエンドツーエンドの視覚自己位置推定システムを提案。
- 車はどう動くか:安全な都市交通のための運転ダイナミクス分析交通分析2024/12/1
都市交通の時空間パターンを分析するデータ統合フレームワークPriorMotionを提案し、交通パターン分析の精度向上と長期予測誤差の低減を実現した。
- 高精細地図のマッピングと更新:全体像と今後の展望自動運転/HDマップ2024/9/1
自動運転向け高精細地図の作成・更新技術について、データ処理からSLAM・深層学習手法、品質評価、更新アルゴリズムまでを体系的に概説したサーベイ論文。
- 受容野拡張と把持可能バランスサンプリングによる混雑環境での6自由度把持検出マニピュレーション2024/7/1
混雑環境での小さな物体の6自由度把持検出精度を高めるため、受容野を拡張するモジュールと把持可能領域に基づくバランスサンプリングを提案し、GraspNet-1Billionで約10%の精度向上を達成した。
- ToolEENet:道具のアフォーダンス6D姿勢推定マニピュレーション2024/4/1
道具の把持時の遮蔽に対応するため、道具のエンドエフェクタのアフォーダンス分割と6D姿勢推定を行うデータセットと拡散モデルベースのフレームワークを提案。
- A Survey on Monocular Re-Localization: From the Perspective of Scene Map Representation2023/11/1
- Poses as Queries: Image-to-LiDAR Map Localization with Transformers2023/5/1
- PandaSet: Advanced Sensor Suite Dataset for Autonomous Driving2021/12/1