Yu Sun
収録論文 49本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- XPolicyLab: ロボットポリシー評価と展開のための統一標準・オープンエコシステムロボットポリシー評価2026/8/1
ロボットポリシーの評価と展開を統一する標準規格とオープンエコシステムを提案し、N個のポリシーとM個の環境の接続コストをO(NM)からO(N+M)に削減した。
- TableVerse: 実世界の接地レイアウトを備えた大規模テーブルトップデータセットによる汎用操作の実現データセット/操作2026/7/1
インターネット上の未整理画像から物理的に妥当なテーブルトップ環境を自動再構成し、100,000件の操作デモを含む大規模データセットを構築した論文。
- 成果指向蒸留:自動運転におけるVLM推論を進化させる教師-学生フレームワーク自動運転/VLM2026/7/1
自動運転のためのVLM推論を改善する教師-学生フレームワークを提案。教師モデルが反射的推論でラベルなしのゼロショット汎化を実現し、学生モデルが蒸留で推論能力を獲得、推論を軌道生成に活用する。
- WALL-WM: イベント接合部での世界行動モデリングの彫刻VLA2026/6/1
WALL-WMは、ビデオ行動学習をチャンク中心の最適化からイベント基盤の視覚言語行動事前学習へと移行させ、意味的に一貫した行動イベントを学習の原子単位として使用する世界行動モデルです。
- ω-EVA: 潜在的な対話型世界モデルによる想像・検証・行動VLA2026/6/1
ロボットの行動生成に、行動の結果を潜在空間で想像・検証してから最終行動を決定する3段階フレームワークを導入した論文。
- スムーズなリアルタイムチャンキングのためのアクション事前分布デノイジングロボット学習/動作生成2026/5/1
リアルタイムチャンキングの訓練時シミュレーションを拡張し、前のチャンクとの整合性を保つソフトな制約を導入。Kinetixベンチマークで高遅延時の動作の滑らかさを改善した。
- 大規模な人間のデモから学習するロボット操作のための人間意図事前分布VLA/操作学習2026/4/1
人間のデモ動画から操作の事前知識を学び、ロボット操作に活用する階層型VLAフレームワークMoT-HRAを提案。大規模データセットHA-2.2Mを構築し、意図推定とロボット制御を統合することで、分布シフト下での堅牢な操作を実現。
- A1: 完全透過型オープンソースの適応的かつ効率的なトランケート型視覚言語行動モデルVLA2026/4/1
低コストで高スループットな推論を実現するため、事前学習済みVLMと適応的早期終了・層間トランケートフローマッチングを導入したVLAモデルA1を提案し、シミュレーションと実機でSOTA性能と推論コスト削減を達成した。
- ManipArena:推論指向の汎用ロボットマニピュレーションの実世界包括評価マニピュレーション2026/3/1
実機ロボットでのマニピュレーション汎化を公平に評価するため、20タスク・1万超の専門家軌道・約188時間分のデータを備えた標準化ベンチマークを構築し、VLAやワールドアクションモデルなど7構成を比較した。
- DECO: 触覚アダプタを備えた双腕巧み操作のための分離型マルチモーダル拡散トランスフォーママニピュレーション2026/2/1
視覚・固有感覚・触覚を分離した条件付け経路で統合する拡散トランスフォーマDECOを提案し、双腕巧み操作の触覚データセットDECO-50を公開。実機実験で成功率72.25%を達成し、触覚アダプタが複雑な接触タスクで20%向上。
- MOSAIC: 高速残差適応による汎用人型モーション追従と遠隔操作のsim-to-realギャップの橋渡しsim2real2026/2/1
多様な入力インターフェースに対応する人型ロボットの全身遠隔操作システムを構築し、インターフェース固有の残差モジュールを高速適応・蒸留することで、実機での長期的な遠隔操作を安定化させた。
- ソフトロボティクスにおける汎用制御への道ソフトロボティクス/制御2025/11/1
人間の運動制御に着想を得て、制御コンプライアンスを積極的に活用する汎用ソフトロボット制御フレームワークを提案し、多様な形態・駆動方式のロボットで検証した。
- EchoVLA: 宣言的記憶を統合した移動マニピュレーション向け視覚-言語-行動モデルVLA2025/11/1
人間の脳に着想を得たシーン記憶とエピソード記憶を組み合わせ、移動と操作を協調させるメモリ対応VLAモデルを提案し、大規模学習用ベンチマークMoManiも構築した。
- 性能ベンチマークを効率化するモジュール式把持・操作パイプライン基盤の開発マニピュレーション2025/4/1
ロボット操作のオープンソース部品統合と再現性の問題に対処するため、モジュール式の把持・操作パイプライン基盤を開発し、そのアーキテクチャと実験、今後の拡張について概説した。
- 多物体把持のベンチマークマニピュレーション2025/3/1
ロボットの多物体把持能力を評価するための3つのプロトコルからなるベンチマークを提案し、複数のハンドでベースラインを確立した。
- STAR: 基盤モデル駆動によるロボットの堅牢なタスク計画と失敗復旧フレームワークタスク計画2025/3/1
基盤モデルと動的に拡張される知識グラフを組み合わせ、ロボットのタスク計画と人手を介さない自律的な失敗復旧を実現するフレームワークSTARを提案した。
- ゼロショットLLMを用いた実環境におけるエンドツーエンド自動運転の汎化自動運転/LLM2024/11/1
マルチモーダルLLMを定期的に走らせて高レベルな運転指示を生成し、それをエンドツーエンド運転モデルに与えることで、実環境のクローズドループでも汎化性能を高める手法を提案した。
- 心臓コパイロット:ワールドモデルによる心エコー検査の自動プローブガイダンス医療ロボティクス2024/6/1
心エコー検査において、経験の浅い検査技師を支援するため、データ駆動型ワールドモデル「Cardiac Dreamer」を用いてリアルタイムのプローブ移動ガイダンスを提供するシステムを提案した。
- ロボットハンド内の物体数を数えるマニピュレーション2024/4/1
把持後に指や物体による遮蔽があっても、対照学習ベースの分類器でハンド内の物体数を高精度に推定する手法を提案した。
- Consolidating Trees of Robotic Plans Generated Using Large Language Models to Improve Reliability2024/1/1
- From Cooking Recipes to Robot Task Trees -- Improving Planning Correctness and Task Efficiency by Leveraging LLMs with a Knowledge Network2023/9/1
- Only Pick Once -- Multi-Object Picking Algorithms for Picking Exact Number of Objects Efficiently2023/7/1
- Approximate Task Tree Retrieval in a Knowledge Network for Robotic Cooking2022/7/1
- Multi-Object Grasping -- Types and Taxonomy2022/5/1
- Multi-Object Grasping -- Generating Efficient Robotic Picking and Transferring Policy2021/12/1
- Functional Task Tree Generation from a Knowledge Graph to Solve Unseen Problems2021/12/1
- Multi-Object Grasping -- Estimating the Number of Objects in a Robotic Grasp2021/12/1
- Research Challenges and Progress in Robotic Grasping and Manipulation Competitions2021/8/1
- Evaluating Recipes Generated from Functional Object-Oriented Network2021/6/1
- A Road-map to Robot Task Execution with the Functional Object-Oriented Network2021/6/1
- OCRTOC: A Cloud-Based Competition and Benchmark for Robotic Grasping and Manipulation2021/4/1
- Developing Motion Code Embedding for Action Recognition in Videos2020/12/1
- Robot Gaining Accurate Pouring Skills through Self-Supervised Learning and Generalization2020/11/1
- Estimating Motion Codes from Demonstration Videos2020/7/1
- Self-Supervised Policy Adaptation during Deployment2020/7/1
- A Motion Taxonomy for Manipulation Embedding2020/7/1
- Model-Based Compensation of Moving Tissue for State Recognition in Robotic-Assisted Pedicle Drilling2020/6/1
- Manipulation Motion Taxonomy and Coding for Robots2019/10/1
- Accurate Robotic Pouring for Serving Drinks2019/6/1
- Task Planning with a Weighted Functional Object-Oriented Network2019/5/1
- Functional Object-Oriented Network for Manipulation Learning2019/2/1
- A Survey of Knowledge Representation in Service Robotics2018/7/1
- Functional Object-Oriented Network: Construction & Expansion2018/7/1
- A Novel Method for Extrinsic Calibration of Multiple RGB-D Cameras Using Descriptor-Based Patterns2018/7/1
- A Dataset of Daily Interactive Manipulation2018/7/1
- AI Meets Physical World -- Exploring Robot Cooking2018/4/1
- Learning to Pour2017/5/1
- Latest Datasets and Technologies Presented in the Workshop on Grasping and Manipulation Datasets2016/9/1
- Datasets on object manipulation and interaction: a survey2016/7/1