Heng Yang
収録論文 41本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 記憶の置き場所:記憶拡張VLAのためのオブジェクト台帳VLA2026/9/28
短期知覚記憶はポリシー内に、長期物体記憶は外部の読み取り可能な台帳に置くという分割を実現し、単一のファインチューニング済みポリシーでRoboMMEの4スイート平均最高精度を達成した。
- OCC4M: 長期的操作のための物体中心4Dメモリによる時空間推論マニピュレーション2026/9/23
物体中心の4Dメモリを構築し、視点が変わっても物体の位置や時間的同一性、収納関係を保持して、長期的な操作タスクの推論を可能にした研究。
- RoboMP-DINOv2: フィルタではなくプロンプトでロバストなロボットマニピュレーションマニピュレーション2026/9/22
マスクを視覚フィルタではなく空間プロンプトとして扱うDINOv2ベースの全シーン視覚エンコーダを提案し、外観変化や clutter 下での操作成功率を向上させた。
- SPARSER: ロボティクス知覚における分離可能構造を活用したスパース変数射影SLAM2026/9/21
ロボット知覚の非線形最小二乗問題において、変数射影とスパース性を組み合わせ、ゲージ対称性に対応した高速解法フレームワークを提案。SLAMやSfMで平均5〜7倍の高速化を実現。
- X4Val: 分散低減型ポリシー評価のためのニューラルサロゲート学習評価手法2026/6/1
実世界データが乏しい中で、シミュレーションや過去のログなどの多様な補助データを活用し、実世界の性能指標を高信頼に推定するための分散低減フレームワークX4Valを提案した。
- BEACON: ベストエフォート適応による生成ロボットポリシーのクロスドメイン共学習ロボットポリシー学習2026/5/1
豊富なソースドメインのデモと限られたターゲットドメインのデモを用いて、生成ロボットポリシーを効果的に訓練するための理論駆動型フレームワークを提案した。
- 微分可能ダイナミクスを用いた軌道・方策最適化のための焼きなまし逐次モンテカルロ法最適制御2026/4/1
制御器設計を推論問題として捉え、KL正則化付き期待軌道コストを最小化する分布から効率的にサンプリングするため、焼きなまし逐次モンテカルロ法(TSMC)を提案した。
- 自動運転における構造化Chain-of-Thoughtの高速化VLA2026/2/1
自動運転のVLAモデル向けに、Chain-of-Thought推論を依存グラフに分解し並列デコードすることで、精度を保ちつつ3〜4倍高速化する手法を提案。
- 3Dビジョンのための大域ソルバーの進展3Dビジョン最適化2026/2/1
3Dビジョンにおける非凸幾何最適化を証明可能な解で解く大域ソルバー(BnB・凸緩和・GNC)を初めて体系的にサーベイし、10の視覚タスクを通じて最適性・頑健性・スケーラビリティのトレードオフと今後の方向性を示した。
- ロボティクス知覚におけるスパース変数射影:効率的な非線形最適化のための分離可能構造の活用最適化2025/12/1
ゲージ対称性を持つロボティクス知覚問題に対し、分離可能性とスパース性を同時に活用する変数射影法を提案し、SLAMやSfMで効率化を実現した。
- 拡散モデル予測制御による柔軟な歩行学習歩行2025/10/1
生成拡散モデルをダイナミクスの事前分布として使うMPCで、報酬と制約を考慮した歩行制御を実現し、テスト時の適応性を高めた。
- MoTVLA: 高速・低速推論を統合した視覚-言語-行動モデルVLA2025/10/1
事前学習済みVLMとドメイン専門家トランスフォーマーを組み合わせ、高速・低速の推論を統合してロボットの行動方策を学習するVLAモデルを提案。
- フォーカスによる構成:シーングラフに基づくアトミックスキルマニピュレーション2025/9/1
タスクに関連する物体と関係に注目するシーングラフ表現を用いて、拡散ベース模倣学習によるスキルを学習し、VLMプランナーと組み合わせることで、長期的な操作タスクの構成的一般化とロバスト性を向上させた。
- Sim2Val: テストプラットフォーム間の相関を活用した分散低減メトリクス推定sim2real2025/6/1
シミュレーションと実世界のペアデータを制御変数として用い、実世界評価の分散を抑えて少ないサンプルで高信頼な性能推定を可能にする枠組みを提案。
- スパース性を活かした半正定値緩和による接触の多い大域運動計画マニピュレーション2025/2/1
接触の多い運動計画を多項式最適化として捉え、ロボット構造や接触モードの分離性に由来するスパース性を利用した半正定値計画緩和により、数秒で大域的にほぼ最適な計画を計算する手法を提案。
- 軌道予測器のオンライン統合軌道予測2025/2/1
複数の軌道予測モデルを「専門家」として扱い、オンラインで確率ベクトルを更新して最適に混合する軽量な手法を提案し、異なる都市やデータセットでも単一モデルと同等以上の性能を示した。
- 凸最適化による大規模3次元復元3次元復元2025/2/1
学習した深度を用いて2D特徴点を3Dに持ち上げるバンドル調整を凸緩和で大域最適に解き、CUDAベースの高速ソルバで大規模SfMを初期値不要で実現した。
- 接触暗黙的動作計画における逐次凸最適化の驚くべきロバスト性動作計画2025/2/1
接触を暗黙的な相補性制約として扱う動作計画問題に対し、主問題のみを解く逐次凸計画法CRISPを提案し、その収束条件を示すとともに、ゼロ初期化でも解ける高いロバスト性を実証した。
- 予測的世界モデルによる生成ロボットポリシーの推論時強化マニピュレーション2025/2/1
学習済み拡散ポリシーを再学習せずに、行動条件付き世界モデルで推論時にオンライン計画を行い、操作タスクの性能を向上させる手法GPCを提案。
- LoRA3D: 3D幾何学基盤モデルの低ランク自己校正3D再構成2024/12/1
スパースなRGB画像から3D幾何学基盤モデルを自己校正し、低ランク適応でシーンに特化させる手法を提案。単一GPUで5分以内に完了し、3D再構成と多視点姿勢推定で最大88%の性能向上を達成。
- 最適化問題に対する複数の初期解の学習最適化2024/11/1
問題パラメータから多様な初期解を複数予測し、単一または複数の最適化器で利用することで、ロボット制御などの最適化問題の収束を改善する手法を提案。
- 制御指向の視覚潜在表現クラスタリングVLA2024/10/1
模倣学習における視覚表現空間が制御に有用なクラスタ構造を持つことを示し、それを正則化に用いることで性能を向上させた研究。
- 高速で証明可能な軌道最適化軌道最適化2024/6/1
多項式制約付き非凸軌道最適化を半正定値計画緩和で解き、GPU実装のADMMソルバで高速かつ最適性保証付きで解くフレームワークを提案。
- CLOSURE: 姿勢不確かさ集合の高速定量化姿勢推定2024/3/1
学習したノイズを含む計測から6D姿勢推定の不確かさを定量化するため、姿勢不確かさ集合(PURSE)の最小包含測地線球を高速に内側近似するアルゴリズムCLOSUREを提案。
- Uncertainty Quantification of Set-Membership Estimation in Control and Perception: Revisiting the Minimum Enclosing Ellipsoid2023/11/1
- SIM-Sync: From Certifiably Optimal Synchronization over the 3D Similarity Group to Scene Reconstruction with Learned Depth2023/9/1
- Verification and Synthesis of Robust Control Barrier Functions: Multilevel Polynomial Optimization and Semidefinite Relaxation2023/3/1
- Object Pose Estimation with Statistical Guarantees: Conformal Keypoint Detection and Geometric Uncertainty Propagation2023/3/1
- Optimal and Robust Category-level Perception: Object Pose and Shape Estimation from 2D and 3D Semantic Keypoints2022/6/1
- Certifiably Optimal Outlier-Robust Geometric Perception: Semidefinite Relaxations and Scalable Global Optimization2021/9/1
- Optimal Pose and Shape Estimation for Category-level 3D Object Perception2021/4/1
- Self-supervised Geometric Perception2021/3/1
- Dynamical Pose Estimation2021/3/1
- ROBIN: a Graph-Theoretic Approach to Reject Outliers in Robust Estimation using Invariants2020/11/1
- Outlier-Robust Estimation: Hardness, Minimally Tuned Algorithms, and Applications2020/7/1
- One Ring to Rule Them All: Certifiably Robust Geometric Perception with Outliers2020/6/1
- TEASER: Fast and Certifiable Point Cloud Registration2020/1/1
- In Perfect Shape: Certifiably Optimal 3D Shape Reconstruction from 2D Landmarks2019/11/1
- Graduated Non-Convexity for Robust Spatial Perception: From Non-Minimal Solvers to Global Outlier Rejection2019/9/1
- A Quaternion-based Certifiably Optimal Solution to the Wahba Problem with Outliers2019/5/1
- A Polynomial-time Solution for Robust Registration with Extreme Outlier Rates2019/3/1