Jin Wang
University of Oxford
収録論文 28本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboAssist: 長期外科支援のための対話型ヒューマノイド計画ヒューマノイド計画2026/9/30
手術支援タスクにおいて、人間の作業状態を推定しながらロボットの行動計画をオンラインで更新し、安全性を保ちつつ長期タスクを遂行するエージェントフレームワークを提案。Unitree G1で実証。
- 階段ポリシー:大規模アクションチャンクを持つ世界行動モデルのストリーミング推論VLA2026/9/29
未来予測に基づく世界行動モデルをストリーミング推論で効率化し、大きなアクションチャンクを段階的に精錬しながら実行することで、長期的なタスクでも高精度・高スループットを実現した研究。
- Scope-WM: 効率的な視覚世界モデルのためのスコープ計算世界モデル2026/9/27
予測に関連する潜在領域と有望な行動系列に計算を絞ることで、視覚世界モデルの推論遅延とメモリ使用量を大幅に削減する手法を提案。
- 視覚-言語-行動モデルにおけるトークン圧縮のための最小知覚差モデリングVLA2026/8/21
本論文は、視覚-言語-行動(VLA)モデルのトークン圧縮において、下流の行動応答に基づく最小知覚差(JND)を導入し、許容範囲内の行動変化を保証する軽量なJND推定器を提案する。
- UMI-Bench 1.0: UMIデータを用いた卓上ロボット操作のためのオープンで再現可能な実世界ベンチマークマニピュレーション2026/6/1
UMIスタイルの操作ポリシーを実世界で標準評価する初のベンチマークを提案し、データ収集から評価までの統一プロトコルを提供する。
- ARP: 視覚的整合と反復的洗練による量子化スキル抽象化の強化でロボット操作を実現操作学習2026/6/1
長期的な操作タスク向けに、視覚と行動を整合させ、離散スキル表現の精度を反復的に洗練する新しいポリシーを提案し、ベンチマークと実機で効果を実証した。
- GUIDE: 目標初期化による方向理解を用いたエンドツーエンド視覚ナビゲーションナビゲーション2026/6/1
脚式ロボットのナビゲーションにおいて、目標をエピソード開始時に一度だけ与え、外部からの目標更新なしに内部の空間記憶と方向認識だけで動作するエンドツーエンドの強化学習フレームワークGUIDEを提案した。
- 悪天候・制約環境下での自律海上航行の検証・妥当性確認のための堅牢なシミュレーションフレームワークシミュレーション2026/3/1
自律航行船(MASS)の安全性検証のため、悪天候や水深などの環境要因を高忠実度に模擬できるシミュレーションフレームワークを提案した。
- 自律船舶航海中のCOLREGs準拠衝突回避と座礁防止自律船舶/運動計画2026/3/1
自律船舶のための統一的な運動計画手法を提案し、速度障害物法に基づく衝突回避、COLREGs準拠の方向制約、水深データに基づく座礁防止を凸最適化で統合した。
- 動的ロボットタスク計画のための視覚-言語-方策モデルVLA2025/12/1
実世界データで微調整した視覚言語モデルを基に、自然言語指示を解釈し、タスクシーンを推論してロボットの行動方策を生成するVLPモデルを提案。タスク変更に応じて方策を動的に更新でき、異なるロボットや新規タスクへの適応性を示した。
- PerchMobi^3:空・陸・壁移動のための動力再利用型クアッドファン機構を備えたマルチモーダルロボット空陸壁マルチモーダル移動2025/9/1
4つのダクトファンを推力と負圧吸着の両方に再利用することで、専用ポンプなしに飛行・走行・壁登りを実現した空陸壁ロボットを開発し、各モードと遷移動作を実験で検証した。
- 情報理論的グラフ融合と視覚言語行動モデルによる方策推論と双腕ロボット制御VLA2025/8/1
人間のRGB-D動画から手と物体の重要度を情報理論的に抽出し、時系列シーングラフと言語条件付きTransformerで双腕ロボットのタスク方策を生成・実行するGF-VLAを提案。
- INTENTION:対話的直感と接地されたVLMによるヒューマノイドロボット動作の傾向推論VLA2025/8/1
視覚言語モデルによるシーン推論と対話駆動型メモリを統合し、新しい環境でも人間のように直感的に操作行動を推論できるロボットフレームワークを提案。
- 転倒からの復帰を学習する:車輪脚協調による動的報酬整形脚ロボット2025/6/1
車輪付き脚ロボットが転倒後に自律復帰できるよう、エピソード単位の動的報酬整形とカリキュラム学習を組み合わせた学習フレームワークを提案し、車輪と脚の協調で関節トルクを削減しつつ高い復帰成功率を達成した。
- HiBerNAC:複雑なマニピュレーションを解きほぐす階層型脳模倣ロボット神経エージェント集団マニピュレーション2025/6/1
脳の神経回路と階層的意思決定に着想を得て、VLA計画とマルチエージェント協調を組み合わせた階層型フレームワークを提案し、複雑な長期的マニピュレーションタスクの実行性能を向上させた。
- VLMとKMPを橋渡し:意味的キーポイント表現による細やかなロボットマニピュレーションマニピュレーション2025/3/1
VLMの意思決定能力とKMPの精密な軌道生成を意味的キーポイントで連携させ、曖昧な状況下でも細やかなマニピュレーションを実現するVL-MPを提案した。
- 弾性受動脚を備えた尾なし羽ばたきロボットによるマルチモーダル移動羽ばたきロボット2025/3/1
幼生のアメンボの脚形態に着想を得た弾性受動脚を備えた尾なし羽ばたきロボットを開発し、羽ばたき振動を方向性のある地上移動に変換することで、追加アクチュエータなしで飛行と地上移動のマルチモーダル移動を実現した。
- レンジ画像で駆動する拡散モデルによるミリ波レーダー点群の高密度化点群生成/拡散モデル2025/3/1
ミリ波レーダーの点群をレンジ画像に変換し、事前学習済み画像拡散モデルを活用してLiDAR並みの高密度で正確な3D点群を生成する手法を提案した。
- VLM-C4L: 視覚言語モデルによるコーナーケース最適化を伴う自動運転向け継続的コアデータセット学習自動運転/継続学習/VLM2025/3/1
視覚言語モデルを活用して自動運転のコーナーケース(悪天候や逆光など稀な危険状況)データを動的に抽出・最適化し、コアデータのリプレイ戦略と組み合わせることで、過去の能力を損なわずに新たな希少シナリオを継続的に学習するフレームワークを提案した論文。
- RoboNurse-VLA: 視覚-言語-行動モデルに基づく手術用器械出しロボットシステムVLA2024/9/1
SAM 2とLlama 2を統合したVLAモデルにより、術者の音声指示に基づいて手術器械を高精度に把持・受け渡しするロボット看護師システムを開発した。
- 自律型移動マニピュレーションタスクにおける言語モデルの接地VLA2024/9/1
強化学習と全身最適化で動作ライブラリを構築し、LLMの計画・推論能力で階層的タスクグラフを生成することで、自由文の指示からヒューマノイドロボットの移動と操作を統合的に実行するフレームワークを提案した。
- 接地言語モデルによるヒューマノイドの移動操作のための自律行動計画VLA2024/8/1
大規模言語モデルを活用し、テキスト指示からヒューマノイドロボットの移動操作行動を自律的に計画・実行し、失敗を検知して修正するフレームワークを提案した。
- 機械学習を用いた倉庫ロボットの自動ピッキングシステム最適化マニピュレーション2024/8/1
深層学習と強化学習を組み合わせて倉庫ロボットのピッキング効率・精度を高め、ピーク時の処理や複雑環境への適応を改善する手法を実証的に示した研究。
- HYPERmotion: 自律移動マニピュレーションのためのハイブリッド行動計画の学習移動マニピュレーション2024/6/1
強化学習と全身最適化で38関節の運動スキルを学習し、LLMとVLMによる階層的計画で自由文指示から移動と操作を組み合わせた長期タスクを自律実行するフレームワーク。
- CapsuleBot: A Novel Hybrid Aerial-Ground Bi-Copter Robot With Two Actuated-Wheel-Rotors2023/9/1
- Roller-Quadrotor: A Novel Hybrid Terrestrial/Aerial Quadrotor with Unicycle-Driven and Rotor-Assisted Turning2023/3/1
- Catch Planner: Catching High-Speed Targets in the Flight2023/2/1
- Incrementally Stochastic and Accelerated Gradient Information mixed Optimization for Manipulator Motion Planning2021/8/1