Tao Zhang
Renmin University of China
収録論文 37本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Magic-W0:物理知能のための構造化ワールド・アクション基盤モデルVLA2026/9/30
ロボットの行動生成と環境の物理的状態変化を、現在状態・遷移・未来状態からなる構造化表現で同時にモデル化する基盤モデルを提案。大規模データで事前学習し、行動仮説と世界予測を層レベルで相互に作用させる。
- リアルタイムVLAに向けて:段階認識型2ステップフローデノイジングとシステムレベル評価VLA2026/9/30
VLAモデルの推論とロボット実行の速度ギャップを分析し、フローデノイジングを2段階に削減する手法と分散リアルタイム実行フレームワークを提案、衣類折り畳みタスクで評価した。
- Ego2Robot: 自己中心視点の人間データからのスケーラブルなロボットデータ合成VLA2026/8/1
自己中心視点の人間の操作動画を、行動リターゲティングとロボットアームの視覚合成、品質キュレーションを経てロボット訓練データに変換するスケーラブルなパイプラインを提案し、大規模データセットでVLAモデルの汎化性能を向上させた。
- 拡散モデルのアンカリングとステアリング:推論時のテキストから画像生成の忠実度向上テキストから画像生成2026/7/29
テキストから画像への拡散モデルにおいて、複雑なプロンプトとの整合性を高めるため、初期ノイズとノイズ除去軌道の両方を制御するトレーニング不要のフレームワークAnchorSteerを提案。
- HRIBench:相互作用中心の人間ロボット協調のベンチマークHRI/ベンチマーク2026/7/1
人間とロボットの協調作業を評価するための新しいベンチマークを提案し、役割や時間的依存関係を明示したシナリオに基づいて、指示者・協力者・割り込み者の3つの役割を定義し、既存のVLAモデルが協調タスクで苦戦することを示した。
- 因子認識Mixture-of-Expertsと事前学習エンコーダによる組合せ汎化ロボット操作2026/6/1
視覚ロボット操作において、照明や表面テクスチャなどの環境変化に対する汎化を向上させるため、因子認識MoEと事前学習エンコーダを統合したFAMEフレームワークを提案。3段階の訓練で複数因子の組合せ汎化を実現し、Meta-Worldで34%、実世界ピックアンドプレースで35%の改善。
- FUSE: 車両・ロボットSLAMシステムにおける統合状態推定のためのフレームワークSLAM2026/5/1
SLAMの状態推定プロセスを観測取り込み・伝播・更新・状態問い合わせのインターフェースに分離し、設計選択を独立に変更可能にするフレームワークFUSEを提案。LiDAR-IMU実装で評価し、Faster-LIOと比較して誤差を低減した。
- 大規模言語モデルを用いた具現化プランニングには系統的な安全リスクが存在する安全性評価2026/4/1
大規模言語モデルをロボットのプランナーとして使う際の安全性を評価するベンチマークDESPITEを導入し、計画能力が高くても危険な計画を生成するリスクが高いことを示した。
- MetaTune: ロボットの微分可能ダイナミクスを用いた随伴法によるメタチューニング制御・メタ学習2026/3/1
微分可能な閉ループメタ学習により、フィードバック制御器と外乱オブザーバのゲインを同時自動調整する枠組みを提案し、随伴法で勾配計算を効率化してドローンの追従性能を向上させた。
- 曖昧な指示に対するアフォーダンス認識型インタラクティブ意思決定と実行VLA2026/2/1
曖昧な人間の指示に対し、対話的な探索と視覚言語推論を統合した二重ストリーム枠組みAIDEを提案し、ゼロショットでアフォーダンス解析と指示解釈を実現した。
- EasyMimic:人間の動画からロボット模倣学習を低コストで実現するフレームワーク模倣学習2026/2/1
家庭用低コストロボットが、RGBカメラで撮影した人間の動画から3D手軌跡を抽出し、把持制御空間にマッピングして模倣学習する手法を提案。少量のロボットデータとの共同学習で新タスクに迅速適応し、高コストなデータ収集を削減する。
- UAV捜索における統計幾何学的縮退:物理情報を考慮した非対称フィルタリング手法UAV捜索2026/2/1
災害後のUAVによる生存者捜索で問題となる非対称な測距バイアスに対し、非対称Huber拡張カルマンフィルタと能動センシングを組み合わせて対処する手法を提案した。
- 力推定に基づくアドミタンス制御による車輪型二足ロボットの頭部安定化歩行2025/11/1
不整地での頭部振動を抑えるため、6自由度車輪型二足ロボットの接地力をモデルベースで推定し、アドミタンス制御で地形適応性と頭部安定性を高めた。
- 地形推定を伴う6自由度車輪型二足ロボットの全身制御車輪型二足ロボット2025/11/1
6自由度車輪型二足ロボットの完全な動力学モデルを構築し、LiDAR慣性オドメトリと改良PCAによる地形推定を組み込んだ全身制御フレームワークを提案。不整地走破性能をシミュレーションと実機で検証した。
- 自己進化型プライアで強化学習をジャンプスタートさせた極限単脚ロコモーション歩行2025/7/1
強化学習の訓練を段階的に複雑化し、自己進化するプライアを生成することで、四脚ロボットが不整地で片脚跳躍を実現する手法を提案。
- 未知外乱下での安定飛行のための微分可能物理情報適応Koopman制御制御/適応制御2025/6/1
名目物理モデルとKoopman演算子の学習を組み合わせ、外乱の時間発展を予測して先回り補償する適応制御フレームワークを提案し、未知外乱下での安定飛行を実現した。
- JPDS-NN: 強化学習による農業車両ルーティング最適化のための動的タスク割り当てルーティング最適化2025/3/1
不規則形状の農地における入口依存型車両ルーティング問題(EDVRP)に対し、グラフトランスフォーマーとアテンションを用いた強化学習ベースのJPDS-NNを提案し、走行距離・燃料消費を大幅に削減しつつ高速な動的計画を実現した。
- 多様な脚式ロボットの効率的かつ汎用的な運動制御のための転移可能な潜在空間間移動ポリシー歩行2025/3/1
潜在空間で動作する移動ポリシーを事前学習し、タスク固有の軽量エンコーダ・デコーダのみを微調整することで、多様な脚式ロボットの運動制御を効率的に適応させる手法を提案した。
- 農場における入口依存型車両ルーティング問題に対する順序付き遺伝的アルゴリズム車両ルーティング/最適化2025/2/1
農場での車両ルーティングにおいて、各地点の入口位置が経路最適化に影響する問題(EDVRP)を定式化し、順序付き遺伝的アルゴリズム(OGA)を提案した。実験により、ランダム戦略や順序なし遺伝的アルゴリズムよりも優れた性能を示した。
- 二重ベータカルマンフィルタによる脚式ロボットのロバスト状態推定状態推定2024/11/1
脚式ロボットの状態推定において、足の滑りと脚の長さ変化を考慮した測定モデルを提案し、脚長を推定するパラメータフィルタと状態フィルタを反復的に用いる二重推定フレームワークと、外れ値に頑健なベータカルマンフィルタを導入した。
- デュアルステレオビジョンによるミリメートルスケールソフト連続ロボットの三次元形態再構成ソフトロボティクス/3D再構成2024/8/1
2台の対向するステレオカメラで撮影した点群を、既知の形状を参照にKD木で位置補正し、直径3.5mmのノッチ付き管状連続ロボットの3D形態を再構成する手法を提案した。
- Navi2Gaze: 基盤モデルを活用したナビゲーションと対象物注視ナビゲーション2024/7/1
視覚言語モデル(VLM)を使い、タスク記述に基づいてロボットが対象物に対して適切な位置と向きを自動で選び、効率的に移動・注視する手法を提案した論文。
- 動的シーン理解のための移動ロボット向け大規模屋内データセットデータセット2024/6/1
移動ロボットの動的環境での性能評価用に、実機とシミュレーションで収集した大規模屋内データセットTHUDを構築し、物体検出・セマンティックセグメンテーション・自己位置推定の課題を評価した。
- SpaceOctopus: タコに着想を得た多腕宇宙ロボットの運動計画フレームワーク宇宙ロボット/運動計画2024/3/1
タコの腕の分散制御に着想を得て、多腕宇宙ロボットのための多階層分散型運動計画フレームワークを開発し、マルチエージェント強化学習と統合することで、ベース姿勢調整や外乱・腕の故障に対する堅牢性を実現した。
- DexCatch: Learning to Catch Arbitrary Objects with Dexterous Hands2023/10/1
- i-Octree: A Fast, Lightweight, and Dynamic Octree for Proximity Search2023/9/1
- A Learning-based Adaptive Compliance Method for Symmetric Bi-manual Manipulation2023/3/1
- Efficient Exploration Using Extra Safety Budget in Constrained Policy Optimization2023/2/1
- A Policy Optimization Method Towards Optimal-time Stability2023/1/1
- A Complementary Framework for Human-Robot Collaboration with a Mixed AR-Haptic Interface2022/10/1
- A Miniature 3-DoF Flexible Parallel Robotic Wrist Using NiTi Wires for Gastrointestinal Endoscopic Surgery2022/7/1
- A Learning System for Motion Planning of Free-Float Dual-Arm Space Manipulator towards Non-Cooperative Object2022/7/1
- Multi-layer VI-GNSS Global Positioning Framework with Numerical Solution aided MAP Initialization2022/1/1
- An Efficient Calibration Method for Triaxial Gyroscope2021/3/1
- Generative Partial Visual-Tactile Fused Object Clustering2020/12/1
- Adaptive Trajectory Estimation with Power Limited Steering Model under Perturbation Compensation2019/12/1
- Visual Tactile Fusion Object Clustering2019/11/1