Yang You
収録論文 24本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 観測・行動の正準化による姿勢非依存のロボット機能的把持マニピュレーション2026/6/1
マグカップの取っ手を掴む機能的把持タスクにおいて、観測と行動を物体中心座標系に正準化する強化学習フレームワークAnyMugを提案し、シミュレーションのみで訓練した単一ポリシーを実機にゼロショット転移して高い成功率を達成した。
- 表現力豊かな教師からの敵対的二重オン方策蒸留模倣学習/蒸留2026/5/26
デモのみから学習する強化学習において、フローマッチング教師とMLP生徒を敵対的に共訓練し、報酬と行動の二つの蒸留信号でオンライン探索と局所学習を両立させる手法FA-OPDを提案。
- DOT-Sim: 精密な実機-シミュレーション物理較正を備えた微分可能な光学触覚シミュレーション触覚シミュレーション2026/4/1
光学触覚センサの物理的・視覚的リアリズムを高精度に再現するため、Material Point Methodを用いた弾性体モデルと実機のアイドル状態に対する残差画像学習を組み合わせた微分可能なシミュレータを提案し、少数のデモで高速較正を実現した。
- SceneTeract: 3Dシーンにおけるエージェント機能アフォーダンスとVLMの接地3Dシーン理解2026/3/31
3Dシーンの機能性をエージェントの制約下で検証するフレームワークを提案し、複雑な活動を原子アクションに分解して幾何学的シミュレーションで検証する。また、VLMの機能推論能力の評価と、報酬エンジンとしての活用も行う。
- HBVLA: 視覚-言語-行動モデルへの1ビット訓練後量子化の限界突破VLA量子化2026/2/14
VLAモデルを1ビットに二値化する際、行動生成に重要な重みをヘッセ行列で特定し、ハール領域でのグループ単位量子化を行うことで、精度劣化を抑えつつ省メモリ化を実現した。
- PhysMem: 身体性物理推論のためのテスト時メモリのスケーリングVLA2026/2/1
VLMロボットプランナがテスト時に経験から物理法則を学び、仮説を検証してから適用するメモリフレームワークを提案。実世界の操作タスクで成功率が大幅に向上。
- 事前分布マッピング共進化による拡散ポリシーの学習強化学習/生成ポリシー2025/12/2
強化学習において、最適化しやすい潜在空間で方策を訓練しつつ、条件付き生成デコーダで行動を合成するフレームワークGoRLを提案。複雑な連続制御タスクで既存手法を大幅に上回る性能を達成した。
- 物理世界モデルからのロボット学習マニピュレーション2025/11/1
動画生成モデルと物理世界再構成を組み合わせ、実機データなしでゼロショットのロボットマニピュレーションを実現するフレームワークPhysWorldを提案。
- あらゆる画像からのロボット学習sim2real2025/9/1
1枚の画像から物理シミュレーション可能なロボット環境を生成し、大規模な視覚運動デモンストレーションデータを自動収集するフレームワークRoLAを提案。
- ViReSkill: 視覚に基づく再計画とスキル記憶によるLLMベースの生涯ロボット学習VLA2025/9/1
LLM/VLMの計画を視覚情報で接地し、失敗時に再計画、成功した計画をスキルとして蓄積・再利用する枠組みを提案。LIBEROやRLBench、実機で成功率を向上させた。
- メモリ転送計画:LLM駆動の文脈適応型コード適応によるロボットマニピュレーションマニピュレーション2025/9/1
異なる環境での成功した制御コード例を手続き的知識として活用し、LLMによるロボットマニピュレーションの計画を文脈に応じて適応させるフレームワークを提案。シミュレーションと実機で成功率と適応性を向上させた。
- ArtGS: 3Dガウシアンスプラッティングによる関節物体の視覚・物理モデリングと操作マニピュレーション2025/7/1
3Dガウシアンスプラッティングに視覚言語モデルと微分可能レンダリングを組み合わせ、関節物体の構造を推定して操作方策を最適化するフレームワークを提案。
- 部分観測モンテカルログラフ探索POMDP2025/7/1
大規模POMDPをオフラインで解くため、探索木をオンラインで折りたたんでポリシーグラフを構築するサンプリングベースの新アルゴリズムPOMCGSを提案した。
- ロドリゲスネットワーク:ロボット動作学習のためのキネマティクス誘導バイアス模倣学習2025/6/1
関節系の運動学構造を反映した帰納バイアスを持つニューラル演算子「Neural Rodrigues Operator」を提案し、それを用いた動作処理特化型ネットワークRodriNetを構築。模倣学習や単眼3Dハンド再構成で有効性を示した。
- 決定論的POMDPのための有限状態コントローラに基づくオフライン解法計画・POMDP2025/5/1
決定論的POMDPに対して、有限状態コントローラの形で方策を構築するMonte Carlo Value Iterationの適応手法DetMCVIを提案し、大規模問題や実世界の森林マッピングで有効性を示した。
- EnvBridge: 環境間知識転移による具現化AIの多様環境適応マニピュレーション2024/10/1
ロボット制御コードを環境間で転移させるEnvBridgeを提案し、多様な環境でのマニピュレーション適応性を向上させた。
- ARCH: 長期的な接触を伴うロボット組立のための階層型ハイブリッド学習マニピュレーション2024/9/1
パラメータ化されたスキルの低レベルライブラリと模倣学習で訓練した高レベル方策を組み合わせ、接触の多い長期的な組立作業を高精度かつデータ効率的に実現する階層型手法を提案。
- AutoInspect: 長期的な自律産業点検に向けて自律ナビゲーション2024/4/1
ROSベースのミッション自律システムAutoInspectを開発し、鉱山や核融合炉などで数週間から数ヶ月の長期自律点検を実現した。
- ManiPose: 姿勢を考慮した物体操作のための包括的ベンチマークマニピュレーション2024/3/1
物体の6D姿勢に応じて把持や操作を適応させる「姿勢考慮型物体操作」の研究を進めるため、シミュレーション環境・大規模データセット・LLM活用ベースラインを提供するベンチマークを構築した。
- RPMArt: 関節物体のためのロバストな知覚とマニピュレーションマニピュレーション2024/3/1
ノイズの多い点群から関節パラメータと把持可能点を推定し、シミュレーションのみの学習で実世界の関節物体をゼロショットで操作できるフレームワークを提案。
- Make a Donut: Hierarchical EMD-Space Planning for Zero-Shot Deformable Manipulation with Tools2023/11/1
- SparseDFF: Sparse-View Feature Distillation for One-Shot Dexterous Manipulation2023/10/1
- Robust Robot Planning for Human-Robot Collaboration2023/2/1
- CPPF: Towards Robust Category-Level 9D Pose Estimation in the Wild2022/3/1