Qi Zhang
収録論文 29本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- アフォーダンス条件付き意思決定:ゼロショット階層横断Vision-and-Languageナビゲーションにおける意味空間ギャップの橋渡しVLA2026/9/26
ゼロショット意味プランナに、遷移可能なアフォーダンス姿勢を予測し行動生成を条件付ける局所実行モジュールPACEを追加し、失敗を考慮した選好学習で階層横断ナビゲーションの成功率を改善した。
- SciHorizon-eLab: 科学実験用身体性エージェントのスケーラブルなベンチマークのためのエージェント型プロトコル・タスクコンパイラベンチマーク/身体性エージェント2026/9/25
自然言語の実験プロトコルを意味接地・実行可能タスク合成・シミュレーション検証を通じて身体性タスクへ自動コンパイルし、300タスクのベンチマークを構築した研究。
- SafeStage: 視覚言語条件付きロボットマニピュレーションの実行前・実行中・実行後の安全性評価VLA2026/9/18
視覚言語条件付きロボット操作の安全性を、タスク実行の前・中・後の3段階で評価するベンチマークSafeStageを提案し、VLAポリシーがタスク成功と安全性違反を同時に起こしうることを示した。
- 単脚跳躍クアッドコプターの俊敏かつ省エネな移動のための動力学を考慮した強化学習強化学習/脚式移動2026/9/14
跳躍するクアッドコプターの制御に、目標比エネルギーを報酬に組み込む動力学情報付き強化学習を適用し、エネルギー効率の良い跳躍歩容を実現した。
- バネ脚付きクアッドコプターのエネルギー効率良いターゲットホッピングのための受動ダイナミクス活用学習跳躍/強化学習2026/9/14
バネ脚付き単脚クアッドコプターの跳躍制御において、状態からモーターへ直接指令するPPO方策を学習させ、PID制御と比べ消費電力を30.7%削減しつつ再現性の高い跳躍を実現した。
- A4A: 人間のデモからの行動指向4Dアフォーダンスのクロスエンボディ転移操作学習/クロスエンボディ転移2026/9/5
人間のデモから行動指向の4Dアフォーダンス(相互作用点の将来軌跡)を学習し、ロボットポリシーの事前学習に利用することで、多様なVLAポリシーの操作性能を向上させる手法を提案した。
- ビデオ表現正則化による複合誤差の軽減ビデオ生成2026/7/29
ビデオ拡散ベースの世界モデルにおける自己回帰生成の誤差蓄積が、隠れ表現の次元崩壊と関連することを発見し、表現を安定化させる軽量な正則化手法を提案した。
- HELP: ロールアウト分割による人間効率的な大規模ロボットポストトレーニングVLA/ポストトレーニング2026/7/1
VLAモデルのポストトレーニングにおいて、2人の専門オペレータが12台のロボットを同時監視し、ロールアウトを自動分割する手法を提案し、人間の労力あたりのポリシー改善とタスクスループットを最大化する。
- JEPAベース世界モデルの一般化理論世界モデル2026/6/25
JEPA事前学習を条件付きスペクトルグラフ学習として定式化し、計画誤差との関連から有限サンプル一般化境界を導出した理論論文。
- 次の一歩を超えて:長期的計画のための可変長潜在世界モデル世界モデル2026/6/19
可変長の行動系列に基づいて未来の潜在状態を予測する世界モデルを提案し、長期的計画における誤差蓄積を軽減した。
- AI支援ピアレビューへのゲーミング攻撃が科学コミュニティにもたらす新たなリスクAI査読2026/6/8
AIによる査読システムが、抄録の言い換えという低コストな操作で評価を不当に引き上げられる脆弱性を持つことを実証した論文。
- アフォーダンスから行動へ:タスク条件付きシーン全体のアフォーダンス接地によるリアルタイム操作操作2026/6/1
タスク条件付き操作のための、シーン全体でタスク関連の機能部位を接地するベンチマーク中心の学習フレームワークを提案。単一領域と複数領域の指示対応をカバーするベンチマークと、エージェント支援のアノテーションパイプラインを構築し、リアルタイムのアフォーダンス接地と操作ポリシーへの応用を示した。
- 中断しない支援:非干渉型人間ロボット支援のためのベンチマークとLLMベースフレームワークHRI/LLM2026/5/1
ロボットが人間の進行中の作業を中断せずに支援する「非干渉型支援」を定義し、その評価用ベンチマークとLLMとスコアリングモデルを組み合わせた支援手法を提案した論文。
- フローマッチングVLAにおける保守的SFTによる基盤能力の保持VLA/ロボット学習2026/5/1
フローマッチング型VLAモデルのファインチューニング時に生じる破壊的忘却を防ぐため、モデルの信頼度に応じて学習信号を動的にスケーリングする保守的教師あり学習(ConSFT)を提案し、LIBEROやRoboTwinベンチマークで既存手法を上回る性能を確認した。
- 身体性AIにおける安全性:リスク、攻撃、防御のサーベイ安全性2026/5/1
身体性AIの安全性に関する研究を、知覚から計画、行動、相互作用までのパイプライン全体にわたって体系的にレビューし、攻撃と防御の多層的な分類法を提案した論文。
- 正のみドリフト方策最適化強化学習2026/4/1
オンライン強化学習向けに、負例を使わず正のアドバンテージサンプルのみで方策を更新する生成モデル手法PODPOを提案した論文。
- FRoM-W1: 言語指示による汎用人型全身制御フレームワークVLA2026/1/1
自然言語から人型ロボットの全身動作を生成・実行する2段階フレームワークを提案し、Unitree H1/G1で動作追従精度の向上を実証した。
- VCoT-Grasp: 視覚的思考連鎖推論による言語駆動型把持生成のための把持基盤モデルマニピュレーション2025/10/1
視覚的思考連鎖推論を組み込んだエンドツーエンドの把持基盤モデルを提案し、大規模データセットを構築して、実環境での把持成功率と未知物体への汎化性能を向上させた。
- ロボット実世界強化学習のための視覚-言語-行動-批評家モデルVLA2025/9/1
大規模データで学習したVLAベースのプロセス報酬モデルVLACを提案し、報酬設計を不要にするとともに、実世界のマニピュレーション4タスクで成功率を約30%から約90%へ向上させた。
- 日和見LEO衛星を用いた証明可能な最適ドップラー測位測位2025/9/1
低軌道衛星のドップラーシフトを利用し、初期値不要で大域最適解を保証する凸緩和ベースの測位手法を提案した。
- CKANIO: チェビシェフ多項式を用いた学習可能な慣性オドメトリ慣性オドメトリ2025/7/1
IMU信号の非線形な運動パターンをモデル化するため、チェビシェフ多項式ベースのKolmogorov-Arnoldネットワークを組み込んだ慣性オドメトリフレームワークCKANIOを提案し、5つの公開データセットで有効性を示した。
- IONext:慣性オドメトリの次世代を切り拓く慣性オドメトリ2025/7/1
Transformerの弱点を補う新しいCNNモジュール(DADMとSTGU)を提案し、慣性オドメトリの精度と汎化性能を向上させたバックボーンIONextを開発した。
- TinyIO: 軽量再パラメータ化慣性オドメトリ慣性オドメトリ2025/7/1
訓練時にマルチブランチ構造を用い、推論時に等価な単一経路へ変換することで軽量化を実現した慣性オドメトリ手法を提案。公開データセットで精度とモデルサイズの良好なトレードオフを示した。
- FTIN: 周波数-時間統合ネットワークによる慣性オドメトリ慣性オドメトリ2025/7/1
IMU信号の冗長性による情報ボトルネックを解消するため、周波数領域と時間領域の情報を融合する慣性オドメトリのフレームワークを提案した。
- 軽量自動運転車の衝突回避のための強化型Visual SLAMVisual SLAM2024/8/1
単眼RGB-DカメラとCPUのみで動作する軽量自動運転車向けに、ORB-SLAM3とオプティカルフローを組み合わせた視覚認識と、CLF-CBF-QPおよび障害物形状再構成による経路計画を統合した衝突回避手法を提案し、シミュレーションで有効性を示した。
- ラウンドアバウトでの対話型運転に向けた衝突なし・速度損失なしのKANベース強化学習意思決定システム自動運転/強化学習2024/8/1
KANと深層Q学習を組み合わせ、ラウンドアバウトでの自動運転の安全性と効率を向上させる意思決定システムを提案し、衝突削減と走行時間短縮を実現した。
- ICRA@40パーティで記録されたEarth Roverデータセットナビゲーション2024/7/1
ICRA40周年記念パーティ会場前で、Earth Rover Challengeのロボットを用いて収集した実世界ナビゲーションデータセットを公開した。
- Intent-Aware Autonomous Driving: A Case Study on Highway Merging Scenarios2023/9/1
- Visual Perception System for Autonomous Driving2023/3/1