Yang Xiao
収録論文 8本 ・ フィジカルAI/ロボット学習
VLA分散学習自動運転ヘルスケアロボティクスVLA/ジェスチャー理解マニピュレーション液体知覚/3D再構成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- M²Tok: 視覚言語行動モデルのためのマルチヘッド・マルチコードブック離散行動トークン化VLA2026/9/16
連続的な行動信号を複数のヘッドと独立したコードブックで離散トークン化し、再構成誤差を抑えつつVLAモデルの性能を向上させる手法を提案。
- モデル整合性を保証するビザンチン耐性を持つ分散型フェデレーテッドラーニング分散学習2026/8/23
分散型フェデレーテッドラーニングにおいて、全ノードが同じモデル更新を集約する非同期コンセンサスプロトコルと二重領域の信頼スコアリングを導入し、ビザンチン攻撃下でもグローバルなモデル整合性を維持する手法を提案した。
- LIDAR-AD: 行動残差連鎖を用いたデコーダーフリー潜在相互作用ドリーマーによる自動運転自動運転2026/7/12
自動運転のための潜在世界モデルを改良し、観測再構成をやめて冗長性を削減した潜在整列と、行動を残差更新としてモデル化する手法を提案し、長期的な閉ループ意思決定の性能を向上させた。
- ActiveVital: ホームヘルスケアロボットのための幾何学を考慮した身体装着型バイタルサイン計測ヘルスケアロボティクス2026/6/1
家庭用ロボットが非接触で呼吸数と心拍数を正確に計測できるよう、ミリ波レーダーの観測角度を視覚情報で能動的に調整するフレームワークを提案した。
- GIVE: 視覚言語行動モデルにおける人間のジェスチャーの接地VLA/ジェスチャー理解2026/6/1
人間のジェスチャーを視覚・意味の2経路でVLAモデルに統合し、曖昧な指示でも物体接地と操作意図の推定を改善する手法を提案。実世界実験で成功率を大幅に向上させた。
- カメレオン:視覚運動操作のための制御インデックス型予測記憶マニピュレーション2026/3/1
観察と行動の間に時間差があるタスクで、過去の観察を記憶し将来の行動に活用するための視覚運動ポリシー「Chameleon」を提案し、実ロボットベンチマークで高い成功率を達成した。
- Phys-Liquid: 透明変形液体の3D形状と体積を推定するための物理情報データセット液体知覚/3D再構成2025/11/1
容器の動きで変形する透明液体の3D形状・体積を推定するため、97,200枚の物理シミュレーション画像と3Dメッシュからなるデータセットを構築し、4段階の再構成パイプラインで有効性を検証した。
- Performance Evaluation of 3D Correspondence Grouping Algorithms2018/4/1