Yu Zhou
収録論文 15本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RAO-Nav: 統合言語モデルによるゼロショット音声視覚ナビゲーションの探求ナビゲーション2026/9/26
音声と視覚を統合した大規模言語モデルをゼロショットの音声視覚ナビゲーションに適用し、学習データなしで既存手法を上回る性能を実現した。
- 接触アンカリング再ターゲティングと残差方策学習による人間実演からの器用なロボットマニピュレーションマニピュレーション2026/9/21
人間の動作キャプチャから接触構造を抽出し、物理的に整合する軌道へ変換してロボットハンドの器用な操作方策を学習する3段階パイプラインを提案した。
- スパース制約付き整流フローによるオープンセット視覚テキスト鑑識画像鑑識2026/8/3
生成AIによる視覚テキスト改ざんを検出するため、改ざんパターンに依存せず、画像を本物の統計に合わせるための局所復元コストを推定する生成型検出器を提案。スパース制約付き整流フローと自己教師ありアーティファクト注入により、未知の改ざんに対しても高い性能を示した。
- 検出を超えて:シーンテキスト追跡のための構造認識フレームワークテキスト追跡2026/5/17
ビデオ内のシーンテキストを追跡する新しいタスクを定義し、検出不要の二重分岐フレームワークSymTrackを提案。幾何学的歪みや視覚的曖昧さに対処し、3つのベンチマークで最高性能を達成した。
- ENACT: 自己中心的なインタラクションの世界モデリングによる身体性認知の評価身体性認知/ベンチマーク2025/11/1
ロボティクスシミュレーションから生成した自己中心視点の行動と観測の系列並べ替えタスクにより、視覚言語モデルが身体性認知の能力(アフォーダンス認識、行動効果推論など)をどの程度持つかを評価するベンチマークを提案。
- LLMの事前知識をフローモデルに蒸留し物体目標ナビゲーションの想像力を汎化物体目標ナビゲーション2025/8/1
LLMから得た空間事前知識を2次元ガウス場としてフローモデルに蒸留し、未観測領域の意味マップを生成的に補完することで、未知環境での物体目標ナビゲーションを高精度化した研究。
- 大規模シーングラフにおける汎用複数物体回収のためのLLMと動作計画の交互実行VLA2025/7/1
大規模シーングラフ環境で複数の物体を複数箇所に運ぶ長期タスクに対し、LLMと動作計画を交互に実行する手法を提案し、従来比30%の性能向上を達成した。
- 誘導ベクトル場の逆運動学によるロボットの経路追従経路追従2025/2/1
経路の陰的方程式から誤差信号を構成し、逆運動学を誘導ベクトル場に拡張することで、単一積分器ロボットや一定速度の単車型ロボット、固定翼ドローンが過渡応答を精密に制御しながら経路に追従できる手法を提案した。
- SimADFuzz: 自動運転システム向けシミュレーションフィードバック型ファズテスト自動運転テスト2024/12/1
自動運転システムの安全性検証のため、シミュレーションのフィードバックを活用して違反予測モデルと距離誘導型変異戦略により多様で効果的な走行シナリオを生成するファズテスト手法を提案した。
- 身体性エージェントインターフェース:身体的意思決定のためのLLMベンチマークVLA2024/10/1
LLMを用いた身体的意思決定を統一的に評価するための汎用インターフェースを提案し、多様なタスク・モジュール・細粒度エラー指標でLLMの能力を体系的に分析するベンチマークを構築した。
- Indoor Obstacle Discovery on Reflective Ground via Monocular Camera2024/1/1
- MARF: Multiscale Adaptive-switch Random Forest for Leg Detection with 2D Laser Scanners2022/4/1
- Tiny Obstacle Discovery by Occlusion-Aware Multilayer Regression2021/11/1
- A Novel Multi-layer Framework for Tiny Obstacle Discovery2019/4/1
- A Parallel Distributed Strategy for Arraying a Scattered Robot Swarm2015/5/1