Guoyang Zhao
収録論文 18本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SFVO:双方向PnPを用いた分離型信頼度誘導ステレオフロー視覚オドメトリ視覚オドメトリ2026/9/18
事前学習済みのステレオマッチングとオプティカルフローを活用し、対応点から幾何制約を構築して信頼度を推定するステレオ視覚オドメトリ手法を提案。
- GeoProp: ロボット状態を視覚に接地する汎用操作のための手法マニピュレーション2026/7/1
ロボットの状態と視覚特徴を幾何学的に整合させる軽量アダプタを提案し、操作ポリシーの性能を向上させた。
- 遅い推論器から速いプランナーへのトークン単位潜在ストリーミングによる動的視覚言語ナビゲーションナビゲーション2026/7/1
動的な人間中心環境での視覚言語ナビゲーションにおいて、遅いVLMの推論中に中間隠れ状態をストリーミングして高速なプランナーを逐次更新するSPARK-VLNを提案し、ナビゲーション成功率と社会的コンプライアンスを向上させた。
- GenHOI: タスク固有の訓練なしに生成ビデオを模倣する接触を考慮したヒューマノイドと物体のインタラクションヒューマノイド操作2026/6/1
生成ビデオを模倣することで、タスク固有の訓練や物理デモデータなしに、ヒューマノイドロボットが多様な物体操作タスクをゼロショットで実行できるフレームワークを提案した。
- 地形認識型全身体制御による脚式移動マニピュレーションの学習脚式移動マニピュレーション2026/5/1
脚式マニピュレータのための地形認識型全身体制御フレームワークTA-WBCを提案し、外部センサによる地形特徴抽出と新しいエンドエフェクタサンプリング法により、様々な地形での安定した移動操作を実現した。
- FLUX: 整流フローと静的から動的への学習によるクロス身体性生成ナビゲーションポリシーの高速化ナビゲーション2026/3/1
動的ナビゲーションベンチマークDynBenchを導入し、フローベースの統一ナビゲーションポリシーFLUXを提案。直線軌道で推論を高速化し、静的から動的へのカリキュラムで社会的ナビゲーションと静的タスクの堅牢性を向上、ゼロショットで多種ロボットに転移可能。
- ALORE: 脚式マニピュレータによる大型物体の自律再配置マニピュレーション2026/2/1
脚式マニピュレータが多様な大型物体を衝突回避しながら効率的に再配置するシステムを提案。階層強化学習とタスク・モーション計画を組み合わせ、実機実験で有効性を示した。
- 物理整合的な物体間推論による高密度クラッタ環境のReal-to-Simsim2real2026/2/1
単視点RGB-D画像から、接触グラフと微分可能剛体シミュレーションを用いて物理的に整合した3Dシーンを再構成し、接触の多いマニピュレーションを可能にする手法を提案。
- 自動運転のための視覚-言語-行動モデル:過去・現在・未来VLA2025/12/1
自動運転における視覚-言語-行動(VLA)フレームワークの進化を整理し、End-to-End型とDual-System型の2つのパラダイムに分類して、その特徴と課題を概観したサーベイ論文。
- GP3: マルチビュー画像を用いた3D幾何認識ロボットマニピュレーションポリシーマニピュレーション2025/9/1
マルチビューRGB画像から深度とカメラパラメータを推定し、3Dシーン表現を構築して言語指示に基づく操作を実現するポリシーGP3を提案。シミュレーションで高性能を示し、実機にも少ない微調整で転移可能。
- MonoGlass3D: 平面回帰と適応的特徴融合による単眼3Dガラス検出3D認識2025/9/1
実世界のガラスを3Dアノテーション付きで集めた新データセットを構築し、適応的特徴融合と平面回帰を組み合わせて単眼画像からガラスの領域と奥行きを推定する手法を提案した。
- SAMP: 空間アンカーに基づく衝突を考慮したロボットマニピュレータの動作方策マニピュレーション2025/9/1
ロボットと環境の形状を共有空間グリッド上の符号付き距離場で同時に表現し、衝突を考慮した滑らかな軌道を生成するニューラル動作方策を提案した。
- 脚式ロボットのための信頼度校正知覚とトポロジカルサブゴール選択による意思決定駆動型意味的物体探索歩行2025/9/1
脚式ロボットがノイズの多い意味的観測を信頼度校正で統合し、トポロジカル記憶とサブゴール選択により効率的に物体探索する手法を提案。
- 成功への階段:LLM駆動の粗から細への探索によるオンライン階層対応ゼロショット物体目標ナビゲーションフレームワークナビゲーション2025/5/1
事前地図や再学習なしで多階層建物内の物体を目指すゼロショットナビゲーションを実現するASCENTを提案。階層表現構築とLLMによる粗密探索でHM3D/MP3Dで最高性能を達成し、四足ロボットで実機検証した。
- 移動と連動したハイブリッド稲冠マッピングアルゴリズム農業ロボティクス2025/2/1
農業用無人地上車両(Agri-UGV)が複雑な水田を走行する際、RGB-Dセンサと運動・慣性計測を統合し、移動に伴う不確かさを考慮した確率的な稲冠の高さマップを生成する手法を提案した。
- FisheyeDepth:魚眼カメラ向け実スケール自己教師あり深度推定モデル深度推定2024/9/1
魚眼カメラの歪みを考慮した投影・再投影と実スケールの姿勢情報を組み合わせ、自己教師ありで実用的な深度推定を可能にしたモデルを提案。
- OmniColor: LiDARと360度カメラの融合による点群彩色のための大域的カメラ姿勢最適化点群彩色/センサ融合2024/4/1
LiDAR点群と360度パノラマ画像を組み合わせ、特徴抽出なしに測光一貫性を直接最大化してカメラ姿勢を最適化し、点群を高精度に彩色する手法を提案。
- CurbNet: LiDAR点群セグメンテーションに基づく縁石検出フレームワーク点群セグメンテーション2024/3/1
LiDAR点群のセグメンテーションを用いて道路上の縁石を検出するCurbNetを提案し、大規模な3D縁石データセット3D-Curbを構築した。