Xinyu Wang
収録論文 16本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LoDA: 物体レベルの変化検出のための検出レベル認識手法とマルチモーダルセンシングベンチマーク3D変化検出2026/8/1
都市の3D LiDARマップにおける物体レベルの変化を検出するパイプラインを提案し、検出限界を考慮した位置合わせと幾何・意味情報に基づく変化ラベル付けを行う。また、新しいベンチマークLoDAを構築し、既存手法を上回る精度を達成した。
- GeoEdit: 幾何認識オブジェクト編集のためのデュアルブランチ拡散画像編集2026/6/29
3D物理制約を守りながら写真内のオブジェクトを正確に操作するための、トレーニング不要のLift-Manipulate-Render-Denoiseパイプラインを提案。
- 超音波ロボティクスのための高速・低速知能階層システム医療ロボティクス2026/6/1
臨床環境での超音波ロボット走査を安全かつ解釈可能にするため、高次臨床推論を行う低速脳と、リアルタイム実行を担う高速脳を備えた階層型システムを提案し、安全性と成功率を向上させた。
- RARM: 操作学習における信頼度ゲート付き進捗報酬モデリング操作学習/報酬設計2026/6/1
単一の成功デモ動画を参照し、ロボット操作の強化学習向けに信頼できる進捗報酬を生成する軽量な視覚比較モデルを提案した。
- HoloQ-VLA: 視覚言語行動モデルの一様W4A4量子化VLA/量子化2026/5/27
視覚言語行動モデルを、拡散アクションヘッドを含む全体を一様に4ビット量子化する訓練不要のフレームワークを提案し、性能を維持しつつメモリを大幅削減した。
- 世界行動モデルはVLAより汎化するのか?ロバスト性の比較研究VLA2026/3/1
VLAと世界行動モデル(WAM)をLIBERO-PlusやRoboTwin 2.0-Plusで視覚・言語の摂動下に比較し、WAMの高いロバスト性を示した研究。
- 視覚フィードバックを用いた複数ケーブルの自律的な絡み解きマニピュレーション2025/12/1
視覚情報からケーブルのトポロジーと形状を推定し、把持位置と操作を計画することで、絡み合った複数のケーブルを自律的に分離する手法を提案した。
- 多段階一貫性統合ショートカットモデルに基づく模倣学習ポリシー模倣学習2025/10/1
フローマッチングの推論速度を改善するため、ショートカットモデルに多段階一貫性損失と適応的勾配配分を導入し、1ステップ推論で高性能を実現した模倣学習手法を提案。
- Nav-EE: 自動運転向け効率的な視覚言語モデルのためのナビゲーション誘導型早期終了VLA2025/10/1
ナビゲーション情報を活用して視覚言語モデルの推論を途中で打ち切ることで、精度を保ちつつ最大63.9%の遅延削減を実現した。
- 都市規模のLiDARを用いた3D変化検出3D変化検出2025/10/1
異なる時期のLiDAR点群を位置合わせし、不確かさを考慮した物体中心の手法で都市の3D変化を検出する。
- 動的時間伸縮法によるLiDAR・GNSS・IMUの高精度統合と3D都市地図構築SLAM/地図構築2025/7/1
LiDAR・GNSS・IMUを動的時間伸縮法と拡張カルマンフィルタで融合し、都市規模の3D地図を高精度に構築する手法を提案。パースで取得した大規模データセットも公開。
- 検索ベースの重み付き局所適応によるタスク非依存の生涯ロボット学習マニピュレーション2024/10/1
過去タスクのデータを一部保存し、経験再生と検索ベースの局所適応を組み合わせることで、タスクIDや境界が不明な環境でも破滅的忘却を抑えながら新しい操作タスクを継続学習する手法を提案した。
- Multi-level decision framework collision avoidance algorithm in emergency scenarios2023/4/1
- NeurIPS 2022 Competition: Driving SMARTS2022/11/1
- RITA: Boost Driving Simulators with Realistic Interactive Traffic Flow2022/11/1
- Design of a Biomimetic Tactile Sensor for Material Classification2022/3/1