Qi Wang
Jilin University
収録論文 31本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- StreamRig: リグ内幾何を活用したストリーミング多カメラオドメトリオドメトリ/多カメラ2026/9/30
凍結した多視点3D基盤モデル上に、キャリブレーション済みカメラリグの幾何を活かした因果的ストリーミングオドメトリを構築するフレームワークを提案。
- AIネイティブ6Gロボット連携のためのセマンティックマップ共有と能力認識型カバレッジ計画群制御2026/9/29
航空機と地上ロボットの異種チームによる捜索救助を想定し、航空観測をコンパクトなセマンティックグリッドマップに変換して、各ロボットの走行能力に応じたカバレッジ経路を計画するエッジ中心のフレームワークを提案。セマンティック補正の共有により通信量を約82分の1に削減しつつ、カバレッジ91.5%を達成した。
- 幻覚を考慮した世界モデルベース方策最適化による汎用ロボット方策VLA2026/9/9
世界モデルが生成する長期ロールアウトの幻覚を検出して信頼度を推定し、そのスコアを強化学習に組み込むことで、VLA方策の事後学習を安定化・高性能化する手法を提案。
- RAPAC-DP: 遅延実行下での拡散ポリシーに対する応答整合型保留アクション補償模倣学習/遅延補償2026/8/16
クラウド推論の遅延による制御性能低下を補うため、実行予定のアクション列を条件入力として活用する補償機構を拡散・フローベースのポリシーに組み込んだ。遅延が無視できる場合は元のポリシーと完全に一致し、遅延デモなしで訓練可能。
- MITE-Net: 組み込みエッジSAR向けSWaP最適化4Kビデオ微小ターゲット認識物体検出2026/8/16
UAVなどのエッジデバイス向けに、SWaP制約下で4K映像から微小なターゲットをリアルタイムに認識するための軽量カスケードアーキテクチャMITE-Netを提案し、専用データセットとエッジデバイスでのベンチマークを提供した。
- BendTwin: 曲げを考慮した微分可能なばね-質量モデルによるロバストな密から疎への物理再構成物理シミュレーション/変形物体再構成2026/8/6
ビデオ観測から変形物体の物理的特性を再構成するため、曲げ剛性と減衰を導入した微分可能なばね-質量モデルを提案し、従来の軸方向ばねのみの手法より安定した再構成と将来予測を実現した。
- ProtoAct: ウェットラボのプロトコルを具現化ロボット動作へ変換するVLA2026/8/3
生物学のウェットラボ手順書を、状態を考慮したロボット実行可能な行動系列に変換するフレームワークを提案。手順の欠落や不整合を検出・修正し、JSON形式の関数系列にマッピングする。
- 具現化エージェントのハーネスに向けて具現化エージェント2026/8/1
コーディングエージェントの成功を支える「ハーネス」の考え方を物理世界の具現化エージェントに拡張し、シーングラフと評価機構を備えたシステムTheaを提案した。
- フラットな方策を超えて:ロボット操作における身体化エージェントのための階層的事後学習マニピュレーション2026/8/1
VLAモデルの事後学習を階層化し、高レベルのタスク計画と低レベルの行動実行を分離するフレームワークHiRoCを提案。強化学習と分布整合により長期的な操作性能を向上させる。
- Jetson-PI: 先読み整合非同期推論による搭載リアルタイムロボット制御の実現VLA/エッジ推論2026/7/1
低消費電力の搭載デバイス上でVLAモデルを高速に動作させるため、非同期推論の課題を解決する先読み整合補正と信頼度ベースのスケジューリングを提案した論文。
- BioVLN: 生物医学実験室における視覚言語ナビゲーションのためのシミュレーションプラットフォームナビゲーション2026/7/1
生物医学実験室のロボットが機器の操作可能な側面から安全に接近することを考慮した、視覚言語ナビゲーションのためのシミュレーションプラットフォームを提案した。
- 言語エージェントのための方策と世界モデルの同時学習言語エージェント2026/6/1
強化学習のロールアウトから得られる遷移データを利用し、方策学習と同時に世界モデルを補助的に学習するフレームワークPaWを提案。推論時の追加コストなしでエージェント性能を向上させる。
- Pipette: ウェットラボロボットのための具現化シミュレーションプラットフォーム、ベンチマーク、およびデータ効率的な拡張フレームワークシミュレーション/データ拡張2026/6/1
ウェットラボ(生物医学実験)ロボットの学習を効率化するため、カスタマイズ可能なシミュレータ、編集可能なアセット、限られたデモから訓練データを増強するパイプラインを備えたプラットフォーム「Pipette」を提案した。
- BioProVLA-Agent: 生物学的実験室操作のための手頃でプロトコル駆動・視覚強化・閉ループ推論可能なVLA搭載具身マルチエージェントシステムVLA/マルチエージェント/実験室自動化2026/5/1
生物実験室の自動化を目的に、プロトコルを入力として、LLMによるサブタスク分解、VLMによる状態検証、VLAによる実行を閉ループで行う低コストなマルチエージェントシステムを提案した。透明な実験器具や反射などの視覚的擾乱に強いオンライン拡張手法も導入している。
- 確率的分離ポリシー勾配による効率的なオンポリシー視覚強化学習強化学習/視覚2026/5/1
軌道ロールアウトのランダム摂動でポリシー勾配を推定し、単一GPUで数時間の学習を実現する軽量な視覚強化学習手法SDPGを提案。視覚MuJoCoベンチマークで既存手法より高速・低メモリ・高報酬を達成し、実機へのsim-to-real転送も実証した。
- OrbiSim: 具身知能のための微分可能物理エンジンとしてのワールドモデルシミュレーション2026/5/1
ワールドモデルを完全微分可能な物理エンジンとして再定義し、シミュレーション全体を微分可能にすることで、接触モデリングやスパース報酬下での勾配ベースのポリシー最適化を可能にした。
- 世界行動モデルはゼロショット方策であるVLA2026/2/1
動画拡散モデルを基盤に未来の世界状態と行動を予測するWorld Action Model「DreamZero」を提案し、実機でVLAを上回る汎化性能と7Hzのリアルタイム閉ループ制御を実現した。
- MimicDroid: 人間の遊び動画からの文脈内学習によるヒューマノイドロボット操作VLA2025/9/1
人間の遊び動画のみを訓練データとして、ヒューマノイドが新しい操作タスクを数例の動画から効率的に学習できる文脈内学習手法を提案し、実世界で成功率を約2倍に向上させた。
- VLAモデルのデュアルアクター微調整:対話と修正によるヒューマン・イン・ザ・ループ手法VLA2025/9/1
人間の修正を言語コマンドに変換する「talk-and-tweak」を取り入れた強化学習ベースの二重アクター微調整フレームワークを提案し、実世界の多タスク操作で高成功率と効率向上を実現した。
- TGRPO:軌道単位のグループ相対方策最適化によるVision-Language-ActionモデルのファインチューニングVLA2025/6/1
大規模言語モデルで密な報酬関数を自動生成し、軌道をグループ単位で比較・正規化するオンライン強化学習でVLAモデルをファインチューニングする手法を提案。LIBEROベンチマークで平均成功率80.7%を達成した。
- FLARE: 暗黙的世界モデリングによるロボット学習VLA2025/5/1
将来の観測の潜在表現を予測する世界モデリングを拡散トランスフォーマーポリシーに組み込み、模倣学習の性能と汎化を大幅に向上させた手法。
- DreamGen:動画世界モデルでロボット学習の汎化を解き放つVLA2025/5/1
画像から動画を生成するモデルでロボットの疑似行動データを作り、1つのテレオペデータから多様な行動・環境への汎化を実現する4段階パイプラインを提案。
- GR00T N1: 汎用人型ロボットのためのオープン基盤モデルVLA2025/3/1
視覚言語モジュールと拡散トランスフォーマを組み合わせた二重システム構成のVLA基盤モデルを提案し、実機・人間動画・合成データで学習して人型ロボットの両手マニピュレーションを実現した。
- CarPlanner: 自動運転の大規模強化学習のための一貫性のある自己回帰軌道計画自動運転計画2025/2/1
自己回帰構造と一貫性制約を組み合わせた強化学習プランナーを提案し、大規模実世界データセットnuPlanで従来のIL・ルールベース手法を上回る性能を達成した。
- GenComUI: 生成的視覚補助を用いたタスク指向の人間-ロボットコミュニケーション支援HRI2025/2/1
大規模言語モデルを活用し、地図注釈や経路指示などの視覚補助を動的に生成して、ロボットへの口頭でのタスク指示を支援するシステムを開発し、音声のみの場合と比較して有効性を示した。
- オフライン強化学習のための二重緩和一般化オフライン強化学習2024/11/12
オフライン強化学習において、データセット外への過度な一般化を抑えつつ、適度な一般化を活用する二重緩和一般化(DMG)を提案し、Gym-MuJoCoやAntMazeで最高性能を達成した。
- 締切を考慮したタスク・動作計画のための努力配分:メタ推論アプローチタスク・動作計画2024/10/1
不確実な計画・実行時間のもとで締切内に実行可能な計画を見つけるため、計算資源を各選択肢に配分する問題をMDPとして定式化し、MCTSやヒューリスティック手法DP_Rerunで解く。
- 非ホロノミック移動ロボットの経路計画のための空間適応探索経路計画2024/7/1
現在地周辺の状態をまとめて更新し近傍サイズを適応的に変える探索手法を提案し、局所解に陥りやすい非ホロノミック移動ロボットの経路計画をヒューリスティックなしでも高速・省メモリに解けるようにした。
- 深層学習による無人水上艇の外部パラメータ推定キャリブレーション2024/6/1
無人水上艇の動的なメタセンター変化を予測し、時系列GRNNを用いてセンサの外部パラメータをリアルタイムで補正する手法を提案した。
- TD3とDWAを融合した衝突回避型ロボットナビゲーションナビゲーション2024/5/1
深層強化学習TD3でDWAのサンプリング間隔を最適化し、静的・動的障害物を回避する経路計画手法を提案・検証した論文。
- Holistic Transformer: A Joint Neural Network for Trajectory Prediction and Decision-Making of Autonomous Vehicles2022/6/1