Xueqian Wang
Tsinghua University
収録論文 57本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CALM: 電流整合型リンクマニピュレーションによる単腕での大型物体持ち上げマニピュレーション2026/9/24
モータ電流を関節負荷フィードバックとして活用し、前腕や肘を含む腕全体で大型物体を持ち上げる長期的接触操作をシミュレーションで学習し、実機へ転移するフレームワークを提案した。
- ASTRIL-MPC:言語誘導型ニューラル運動学MPCによる関節式クローラロボットの自律走行フレームワーク移動制御/MPC2026/9/11
関節式クローラロボットの階段や瓦礫環境での自律走行のため、学習した運動学モデルとMPC、LLMによるパラメータ調整を組み合わせた制御フレームワークを提案し、衝突を抑えつつ走行品質を大幅に改善した。
- ロボットのための視覚ベース触覚知能:センシング、学習、身体化された操作触覚2026/8/16
視覚ベース触覚センサ(VBTS)のハードウェア、学習手法、シミュレーション、データセットを統合したレビュー論文。接触による変形を画像化するVBTSのパイプライン全体を俯瞰し、今後の課題と方向性を示す。
- 視覚言語行動モデルをオンザフライツール使用エージェントへ進化させるVLA/ツール使用2026/8/14
VLAモデルにツール注入フレームワークを統合し、低次視覚・高次アフォーダンス・身体性を強化するエージェントARTを提案。ツール使用により行動解空間を縮小し、汎用性向上とデータ依存低減を実現。
- 時間で検索し、周波数で補正するVLA2026/8/1
凍結された視覚言語行動ポリシーの性能を、訓練なしのテスト時補正フレームワークで向上させる。成功軌道からの低周波残差を転送し、長期的な操作タスクの成功率を改善する。
- ActSWM: オープンワールドゲームにおける長期的計画のための行動感応型世界モデル世界モデル/計画2026/7/1
潜在世界モデルが長期的な行動計画で失敗する「コンテキスト崩壊」問題を特定し、行動感応性を制約として課す新しい世界モデルActSWMを提案した。Minecraftでの長期的計画やクロスゲームでの行動復元で性能を向上させた。
- FlowPRO: フローマッチングVLAの報酬なし強化学習による微調整 - 近接化選好最適化を用いてVLA/強化学習2026/6/1
フローマッチング型VLAモデルを実ロボットに展開可能なポリシーへと微調整する、報酬なしのオフライン強化学習フレームワークFlowPROを提案。選好最適化に近接正則化を導入し、介入・ロールバックデータから高品質なポリシーを学習する。
- RPG: 人間型格闘における複数スキル遷移のためのロバストなポリシーゲーティング歩行/格闘/スキル遷移2026/4/1
人間型ロボットの格闘動作において、複数のスキルを切り替える際の不安定さを解決するため、遷移ランダム化と時間ランダム化を用いたハイブリッド専門家ポリシーフレームワークを提案し、シミュレーションと実機で検証した。
- OVAL: 生涯物体ゴールナビゲーションのためのオープンボキャブラリ拡張メモリモデルナビゲーション2026/4/1
生涯にわたって複数の物体を連続的に探索する物体ゴールナビゲーションの課題に対し、オープンボキャブラリのメモリフレームワークと確率ベースの探索戦略を提案し、長期的なナビゲーション効率を向上させた。
- 腱駆動アームにおける時分割多重駆動:軽量設計と耐故障性マニピュレーション2026/4/1
腱駆動ロボットアームのアクチュエータ数を大幅に削減しつつ、高トルクと耐故障性を両立する時分割多重駆動(TDMA)方式を提案し、試作アームMuxArmでその有効性を実証した。
- 無重力状態を学ぶ:人型ロボットにおける非自己安定動作の模倣模倣学習/全身制御2026/4/1
人型ロボットが環境に依存する動作(椅子に座る、横になる、壁に寄りかかるなど)を実行する際、人間が行う「無重力状態」を模倣し、関節を選択的に弛緩させる手法を提案した。
- CDF-Glove: ケーブル駆動の力覚フィードバック手袋による巧みな遠隔操作遠隔操作/力覚フィードバック/模倣学習2026/3/1
軽量・低コストなケーブル駆動の力覚フィードバック手袋を開発し、遠隔操作による模倣学習のデモ品質を向上させた。
- MANSION: 長期的タスクのための多階層言語から3Dシーン生成環境生成2026/3/1
建物全体の多階層3D環境を言語指示から生成するフレームワークを提案し、長期的なロボットタスクの評価基盤を提供する。
- PhotoAgent: 空間的・美的理解を備えたロボット写真家ロボット写真2026/3/1
ロボット写真家のためのエージェントで、大規模マルチモーダルモデルと3Dガウススプラッティングによる内部世界モデルを統合し、言語指示から美的に優れた視点を自動生成・反復改善する。
- 何を操作するかを見極める:意味的操作のためのバウンディングボックス誘導方策におけるデータスケーリング則の解明マニピュレーション2026/2/1
バウンディングボックス指示で対象物体を直接指定する拡散方策を提案し、手持ち型セグメンテーションデバイスLabel-UMIで収集した6,400件の実世界デモにより、汎化性能が飽和型のデータスケーリング則に従うことを示した。
- AirHunt: VLMの意味理解と連続計画を橋渡しする効率的な空中物体ナビゲーション空中ナビゲーション2026/1/1
VLMの意味推論と連続経路計画を非同期に融合し、屋外で未知物体をゼロショットで探索するドローン航法システムを提案。
- CausalNav: 動的屋外環境における自律移動ロボットのための長期 embodied ナビゲーションシステムナビゲーション2026/1/1
LLMを用いた多層意味シーングラフ(Embodied Graph)を構築し、RAGによるオープン語彙クエリでの長距離計画と動的屋外環境でのロバストなナビゲーションを実現した。
- 進化するエージェントのための身体知能コデザイン:分類・フロンティア・課題身体知能コデザイン2025/12/1
身体と制御を同時に最適化する「身体知能コデザイン(ECD)」の研究を体系的に整理し、階層的分類やベンチマーク、応用、今後の課題をまとめたサーベイ。
- すべての回転を数え、すべての回転が重要:プロペラセンシングによるドローン動態の探求ドローンセンシング2025/11/1
イベントカメラでプロペラの回転数を高精度に計測し、ドローンの飛行コマンドや動態を推測する手法を提案。
- グラフアテンションネットワークを用いた変形可能線状物体の形状制御のための力・位置ハイブリッド戦略マニピュレーション2025/8/1
ワイヤやケーブルなどの変形可能線状物体(DLO)の形状制御のため、力空間での軌道計画と位置空間でのモデル予測制御を組み合わせたハイブリッド戦略を提案し、グラフアテンションネットワークに基づく動力学モデルで予測精度を高めた。
- ニューラルキネマティクスとオンライン残差学習による汎用車両-トレーラーナビゲーションシステムナビゲーション2025/7/1
車両とトレーラーの運動学をニューラルネットで学習し、オンライン残差学習で補正する汎用ナビゲーションシステムを提案。様々なトレーラーや積載条件で実世界実験を行い、手動調整なしで頑健に動作することを示した。
- 残差報酬モデルによる選好ベース強化学習強化学習2025/7/1
選好ベース強化学習において、事前知識の報酬と学習した報酬を足し合わせる残差報酬モデルを提案し、収束速度と性能を改善した。
- データ選択を用いたデータ駆動型MPCによる柔軟ケーブル駆動ロボットアームの制御マニピュレーション2025/7/1
物理モデルを使わず入出力データのみからケーブル駆動柔軟アームをモデル予測制御し、データ選択で計算時間を約80%短縮して高精度な位置決めと軌道追従を実現した。
- VTire:高解像度センシングを実現する視触覚バイモーダルタイヤ触覚2025/4/1
視覚と触覚を同時に取得できるバイモーダルスマートタイヤを開発し、地形認識やひび割れ検出、荷重センシング、損傷検出を実現した。
- 長いデモンストレーションから汎化可能な言語条件付き布操作を学習するマニピュレーション2025/3/1
LLMの常識知識で長いデモから基本スキルを発見・学習し、LLMベースのタスクプランナで組み合わせることで、未見の布操作タスクへ汎化する手法を提案した。
- D3-ARM:高ダイナミック・高器用・完全分離型ケーブル駆動ロボットアームマニピュレーション2025/2/1
低摩擦の運動分離機構を関節に配置し、全電気部品をベースに集約した軽量ケーブル駆動アームを開発。776mm・6自由度・1.6kgで平均位置決め誤差1.29mm、可搬2.0kgを実現した。
- 新規性に基づくサンプル再利用による連続ロボティクス制御強化学習2024/10/1
強化学習において、頻繁に観測される状態は更新を減らし、稀な新規状態には追加更新を行うことで、サンプルを効率的に再利用し、収束速度と成功率を向上させる手法NSRを提案した。
- GSON: 大規模マルチモーダルモデルを活用したグループベース社会ナビゲーションフレームワーク社会ナビゲーション2024/9/1
大規模マルチモーダルモデルを用いて歩行者の社会的関係をゼロショットで抽出し、群集を乱さない社会ナビゲーションを実現するフレームワークを提案。
- 姿勢制御のためのモジュール衛星の形態と制御の同時最適化宇宙ロボティクス2024/9/1
モジュール衛星の姿勢制御性能を高めるため、衛星の形態と制御器を勾配ベースで同時最適化する手法を提案し、進化計算ベースの手法より優れた性能を示した。
- MuxHand:時分割多重モータ駆動によるケーブル駆動型巧みなロボットハンドマニピュレーション2024/9/1
4つのモータを時分割多重制御して9本のケーブルを独立に動かすことで、低コストかつ高巧緻性を実現したロボットハンドを開発し、把持・操作性能を実験で示した。
- Range-SLAM: 超広帯域信号による煙環境対応のリアルタイム自己位置推定と地図構築SLAM2024/9/1
LiDARやカメラが使えない煙などの劣悪環境で、UWB信号の距離とRSSIのみを用いて2次元占有格子地図をリアルタイム構築し、重み付き最小二乗法で高精度に自己位置推定する軽量SLAMシステムを提案。
- 深層強化学習を用いた遠隔操作宇宙マニピュレータの軌道計画マニピュレーション2024/8/1
遠隔操作宇宙マニピュレータの軌道計画において、深層強化学習(SAC)と遅延対策(Mapping・Prediction・State Augmentation)を組み合わせ、非ホロノミック拘束や通信遅延に対応する枠組みを提案し、MuJoCo上で有効性を検証した。
- ViIK: 衝突判定を融合したフローベースの視覚逆運動学ソルバマニピュレーション2024/8/1
RGB画像から多様なロボット関節角度を高速生成し、衝突判定も同時に考慮するフローベースの逆運動学ソルバを提案。
- FOSP: ワールドモデルによるオフライン安全方策のファインチューニング安全RL2024/7/1
オフラインで学習した安全方策を、到達可能性ガイダンス付きのモデルベースRLでオンライン微調整し、未知の安全制約シナリオへの汎化を改善する手法を提案。
- LVCP: LiDARと視覚の緊密結合による協調的リアルタイム相対位置推定位置推定2024/7/1
GPSや事前地図がない環境で、ドローンとUGVの相対位置をLiDAR点群と単眼カメラの情報を緊密に統合してリアルタイム推定する手法を提案。
- GAgent: 複雑な照明環境に対応する視覚言語モデル搭載の適応型剛軟把持エージェントマニピュレーション2024/3/1
VLMエージェントによる認知と可変剛性ソフトグリッパを組み合わせ、厳しい照明下でも物体や材質を認識して把持領域を推定する把持エージェントを提案した。
- 安全性が重要なタスクのための復帰方策を用いたオフライン目標条件付き強化学習オフライン強化学習2024/3/1
オフライン目標条件付き強化学習において、安全制約を守りつつ目標到達を達成するRecovery-based Supervised Learning (RbSL)を提案し、ロボット把持環境のベンチマークと実機Pandaで有効性を示した。
- PPNet: A Two-Stage Neural Network for End-to-end Path Planning2024/1/1
- Learning visual-based deformable object rearrangement with local graph neural networks2023/10/1
- Path Generation for Wheeled Robots Autonomous Navigation on Vegetated Terrain2023/6/1
- Hybrid Trajectory Optimization for Autonomous Terrain Traversal of Articulated Tracked Robots2023/6/1
- Visuotactile Sensor Enabled Pneumatic Device Towards Compliant Oropharyngeal Swab Sampling2023/5/1
- Learning Language-Conditioned Deformable Object Manipulation with Graph Dynamics2023/3/1
- Deep Reinforcement Learning Based on Local GNN for Goal-conditioned Deformable Object Rearranging2023/2/1
- Graph-Transporter: A Graph-based Learning Method for Goal-Conditioned Deformable Object Rearranging Task2023/2/1
- Foldsformer: Learning Sequential Multi-Step Cloth Manipulation With Space-Time Attention2023/1/1
- Evaluating Model-free Reinforcement Learning toward Safety-critical Tasks2022/12/1
- Safety Correction from Baseline: Towards the Risk-aware Policy in Robotics via Dual-agent Reinforcement Learning2022/12/1
- Visual-tactile Fusion for Transparent Object Grasping in Complex Backgrounds2022/11/1
- The Simplest Balance Controller for Dynamic Walking2022/11/1
- USEEK: Unsupervised SE(3)-Equivariant 3D Keypoints for Generalizable Manipulation2022/9/1
- Dynamic Control Barrier Function-based Model Predictive Control to Safety-Critical Obstacle-Avoidance of Mobile Robot2022/9/1
- SafeRL-Kit: Evaluating Efficient Reinforcement Learning Methods for Safe Autonomous Driving2022/6/1
- Quadruped Guidance Robot for the Visually Impaired: A Comfort-Based Approach2022/3/1
- PUTN: A Plane-fitting based Uneven Terrain Navigation Framework2022/3/1
- Orientation to Pose: Continuum Robots Shape Sensing Based on Piecewise Polynomial Curvature Model2021/3/1
- Approximate Piecewise Constant Curvature Equivalent Model and Their Application to Continuum Robot Configuration Estimation2020/9/1