Dacheng Tao
Nanyang Technological University
収録論文 28本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 三モーダル整合性誘導フロートランスフォーマーによる効率的な視覚-言語-行動ポリシー学習VLA2026/9/28
視覚・言語・行動の三モーダル整合性を明示的に強制する損失を導入し、フローマッチング目的で推論を高速化したVLAモデルAGFTを提案。ベンチマークで成功率向上と低遅延を実現。
- 身体性知能のための世界モデル:もっともらしさから制御可能性、そして行動可能性へ世界モデル2026/9/15
身体性知能における世界モデルを、もっともらしさ・制御可能性・行動可能性の3段階の能力レベルで整理し、操作・ナビゲーション・歩行・自動運転などの研究を横断的に調査したサーベイ。
- TrojanWorld: 想像力の誘導によるワールドモデルエージェントへのバックドア攻撃セキュリティ/強化学習2026/9/7
物理的な物体をトリガーとして、ワールドモデルエージェントの内部想像を操作し、攻撃者が指定した行動を誘発するバックドア攻撃フレームワークを提案した。
- 基盤モデル時代における人間中心知能:サーベイサーベイ2026/8/18
基盤モデル時代の人間中心知能について、人間を観察対象・動的アクター・状況エージェントとして捉える6層のタクソノミーを導入し、方法論、代表的手法、データセット、課題を体系的にレビューしたサーベイ論文。
- Combodied Agents:人間中心のエージェントAIの新パラダイムエージェントAI2026/8/11
デジタルエージェントと身体化エージェントの限界を超え、個人の状態変化をモデル化・予測・支援する人間中心のエージェントAIパラダイム「Combodied Agents」を提案する。
- 経済エージェントからエージェント経済へ:経済世界モデルのためのシステム設計図経済シミュレーション2026/8/6
経済世界モデル(EWM)を構築するための実装ロードマップを提案し、エージェントの行動と市場・制度の相互作用から経済動学を生成するシステムを6段階の能力ラダーで整理した。既存研究のサーベイとリソース公開も行う。
- ACE-Data-0: 人間中心の環境キャプチャによる具現化データエンジンデータセット2026/7/30
家庭環境を校正済みの録音スタジオに変えるデータ収集エンジンACEを提案し、多感覚データセットACE-Data-0を構築した。
- MobileSAM2: 空間知能のための軽量セグメント・エニシングセグメンテーション/知識蒸留2026/7/14
SAM2をモバイル端末で動作するよう軽量化したモデルを提案。ハイパーグラフを用いた知識蒸留法HyperKDを導入し、画像・動画のセグメンテーション性能を保ちつつ効率化を実現した。
- ExToken: 効率的なVision-Language-Action強化学習のための構造化探索VLA/強化学習2026/7/1
VLAモデルの強化学習における探索停滞問題を分析し、軌跡の多様性がサンプル効率に重要であることを示した上で、オフラインのデモから得た離散的な行動プリミティブに基づいて探索を構造化するExTokenフレームワークを提案した。
- ACE-Brain-0.5:物理的エージェントAIのための統合具現化基盤モデルVLA2026/7/1
ロボット知能を空間知覚、意思決定、身体的行動、自己監視、自己改善の5機能に統合した、単一の8Bバックボーンによる閉ループ基盤モデルを提案する。
- 万能解を超えて:オフライン事前知識を用いた診断駆動型オンライン強化学習強化学習2026/6/24
オフライン事前知識の活用が強化学習に不可欠となる一方、その有効性は環境や学習過程で変化するため、単一の管理手法は最適でないと主張し、展開固有の証拠に基づく診断駆動型の緊張管理への転換を提案する論文。
- Kairos: 後悔を考慮した物理AI向けネイティブ世界行動モデルスタック世界モデル2026/6/15
物理AIのための世界モデルスタックを提案し、制御に重要な情報のみを学習・維持・展開する手法を導入した。
- MetaWorld: 単一視点ビデオデータからのマルチエージェントビデオワールドモデルのスケーリングビデオ生成2026/6/1
単一視点のビデオから、複数エージェントが共有する3D空間で一貫したビデオを生成するマルチエージェントビデオワールドモデルを提案した。カメラ軌跡分解とクロスアテンションによる世界状態整合で、データ不足と視点間の整合性問題を解決する。
- WMAttack: ワールドモデルエージェントの敵対的評価のための自動攻撃探索ロバスト性評価2026/5/22
ワールドモデルエージェントの敵対的ロバスト性を評価する自動攻撃探索フレームワークWMAttackを提案し、自己修正攻撃探索と表現誘導攻撃検索により、既存手法より強い攻撃を発見する。
- SAMe: ロボット超音波のための意味的解剖マッピングエンジン医用ロボティクス2026/4/1
ロボット超音波の走査開始を支援するため、臨床症状から標的臓器を特定し、患者の外観画像から解剖学的表現を構築して、6自由度のプローブ初期化状態を生成する意味的解剖マッピングエンジンSAMeを提案した。
- ACE-Brain-0: 空間知能を共通の足場とする普遍的身体性知能基盤モデル2026/3/1
多様な身体(自動運転、ロボット、ドローン)を統合する基盤モデルを提案し、空間知能を共通の足場として、専門化と融合を経て高い性能を達成した。
- 世界モデルが誤って夢を見るとき:物理条件付き敵対的攻撃敵対的攻撃2026/2/21
生成的世界モデルの物理条件チャネルを摂動させ、知覚品質を保ちつつ意味・論理・意思決定レベルの歪みを引き起こす初のホワイトボックス攻撃手法を提案し、下流タスクへの危険性を定量化した。
- 自動運転のための視覚-言語-行動モデル:過去・現在・未来VLA2025/12/1
自動運転における視覚-言語-行動(VLA)フレームワークの進化を整理し、End-to-End型とDual-System型の2つのパラダイムに分類して、その特徴と課題を概観したサーベイ論文。
- MetAdv: 自動運転のための統合対話型敵対的テストプラットフォーム自動運転テスト2025/8/1
仮想シミュレーションと実車フィードバックを統合し、動的な敵対的テストを可能にする自動運転向けの対話型評価プラットフォームを提案。
- Event-based Simultaneous Localization and Mapping: A Comprehensive Survey2023/4/1
- Evaluating Model-free Reinforcement Learning toward Safety-critical Tasks2022/12/1
- Safety Correction from Baseline: Towards the Risk-aware Policy in Robotics via Dual-agent Reinforcement Learning2022/12/1
- Localizing Scan Targets from Human Pose for Autonomous Lung Ultrasound Imaging2022/12/1
- 1st Workshop on Maritime Computer Vision (MaCVi) 2023: Challenge Results2022/11/1
- A Relational Intervention Approach for Unsupervised Dynamics Generalization in Model-Based Reinforcement Learning2022/6/1
- Discovering Human-Object Interaction Concepts via Self-Compositional Learning2022/3/1
- Affordance Transfer Learning for Human-Object Interaction Detection2021/4/1
- On the Guaranteed Almost Equivalence between Imitation Learning from Observation and Demonstration2020/10/1