Tao Sun
Stanford University
収録論文 20本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 幾何変動下におけるロボット挿入の視覚的sim-to-real学習:鉄筋設置への応用sim2real2026/9/17
鉄筋挿入タスクを対象に、手続き的生成とドメインランダム化を用いた視覚ベースのsim-to-real学習システムを構築し、実機で91.3%の成功率を達成した。
- FAMOS: 疎な観測からのフィードフォワード3D関節物体モデリング3D関節物体モデリング2026/9/17
複数の部分点群から可動部のセグメンテーションと関節パラメータを一度に予測するフィードフォワードモデルを提案し、手続き的データ生成により既存手法を上回る性能を実現した。
- MuJoCable: 腱駆動ロボットのための低次元表面配線ケーブル伝達モデルsim2real2026/9/9
MuJoCoに、移動する非円形接触・片側張力・摩擦を考慮した低次元のケーブル伝達モデルを追加し、腱駆動ロボットの配線設計とシミュレーション精度を向上させた。
- 知識誘導型階層ポリシー学習による高精度円筒組立組立/強化学習2026/9/6
0.1mmの厳しい公差を持つ円筒部品の高精度組立を実現するため、階層型強化学習フレームワークを提案。下層は行動クローニングとTD3を統合し、上層はヒューリスティックルールで調整する。シミュレーションで学習後、実世界に転移し、高い成功率と安定性を示した。
- UniFS: 視覚言語行動モデルのための統合高速-低速階層アーキテクチャVLA2026/6/1
人間の脳の多時間スケール処理に着想を得て、VLM層を更新頻度の異なるグループに階層化し、潜在ベクトル反転機構と多レベル監視戦略を導入することで、高速-低速の周波数ジレンマを解決する新しいVLAアーキテクチャを提案した。
- エネルギーに基づく合成的拡散プランニングプランニング2026/6/1
長期的なロボットタスクを解決するための合成的拡散プランナーを提案し、局所的な橋ポテンシャルの和を最小化するエネルギー的視点から、従来のヒューリスティックなステッチングが欠落していた境界反応項を導入し、効率的な推論を実現した。
- 3D大規模言語モデルは本当に3D空間関係を理解しているのか?3D視覚言語理解2026/3/1
既存の3D-LLMがテキストの手がかりに頼っており、3D空間理解を正しく評価できていない問題を指摘し、より厳密なベンチマークReal-3DQAと3D視覚情報を活用する学習手法を提案した。
- 任意の点を位置合わせ:フローマッチングによる3D点群レジストレーションのスケーリング点群レジストレーション2025/12/1
点群レジストレーションを条件付き生成問題として捉え、学習した連続的な点ごとの速度場でノイズ点を位置合わせ済みシーンへ輸送することで、多視点点群を直接統合する手法を提案。ペアワイズ・多視点ベンチマークで最先端性能を達成。
- 身体と制御の共設計は強力だが無償ではない身体性設計2025/10/1
形態と制御を単一のニューラルネットワークで同時最適化する枠組みを提案し、障害物回避タスクにおいて、形態がタスクに不適合な場合に共設計が有効であることを示した。
- WoMAP: 実世界モデルによる身体性を伴うオープン語彙物体位置推定VLA2025/6/1
ガウススプラッティングによる実→シミュ→実パイプラインと潜在世界モデルを組み合わせ、実演データなしでオープン語彙物体位置推定ポリシーを学習する手法を提案。
- 整流点フロー:汎用的な点群姿勢推定点群姿勢推定2025/6/1
点群のペア位置合わせとマルチパーツ形状組み立てを単一の条件付き生成問題として定式化し、点ごとの速度場を学習して部品姿勢を復元する手法を提案。
- 関節付きシミュレーション用アセットの手続き的生成sim2real2025/5/1
ロボティクスシミュレーション向けに、18種類の関節付き物体を手続き的に生成し、物理特性付きでシミュレータにエクスポートするツールキットを提案。
- SHIFTプランナ: IKD-treeを用いた高速ハイブリッド反復場・分割軌道最適化による均一軽量カバレッジカバレッジ計画2024/12/1
単眼カメラ・IMU・GPSと地形情報を統合し、拡散場モデルで環境の汚れや乾燥度に応じて速度と軌道を適応させる、均一カバレッジの計画・ナビゲーション手法を提案した。
- Underwater Motions Analysis and Control of a Coupling-Tiltable Unmanned Aerial-Aquatic Vehicle2023/12/1
- Nothing Stands Still: A Spatiotemporal Benchmark on 3D Point Cloud Registration Under Large Geometric and Temporal Change2023/11/1
- Scale jump-aware pose graph relaxation for monocular SLAM with re-initializations2023/7/1
- S3E-GNN: Sparse Spatial Scene Embedding with Graph Neural Networks for Camera Relocalization2022/5/1
- REPAINT: Knowledge Transfer in Deep Reinforcement Learning2020/11/1
- Zero-Shot Reinforcement Learning with Deep Attention Convolutional Neural Networks2020/1/1
- DeepRacer: Educational Autonomous Racing Platform for Experimentation with Sim2Real Reinforcement Learning2019/11/1