Yuhao Chen
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- iVISION-2DCD: 大規模屋外建設監視のための長期的変化検出データセットデータセット2026/7/1
建設現場の進捗監視を目的に、任意のカメラ視点からロバストに動作する2D変化検出アルゴリズムの開発・評価を可能にする、大規模な合成データセットiVISION-2DCDを導入した。
- 食品破壊シミュレーションにおける逆材料推定のための潜在空間強化学習シミュレーション/強化学習2026/6/15
食品の破壊挙動から材料パラメータを推定する逆問題を、強化学習を用いて解く手法を提案。オレンジの皮むきを例に、目標条件付きポリシーが単一の順伝播で材料推定を行い、CMA-ESによる改良と組み合わせることで高精度な推定を実現した。
- 事前学習済みビデオモデルから物理を学ぶ:ロボット操作のためのマルチモーダル連続・逐次世界相互作用モデル操作2026/3/1
ロボットデータ不足を補うため、事前学習済みビデオ生成モデルを物理シミュレータとして活用し、ビデオと行動を共通の物理トークンで表現することで、操作タスクを解く枠組みPhysGenを提案した。
- RADAR: 実世界ダイナミクス・空間物理知能・自律評価による視覚言語行動モデルの汎化ベンチマークVLA2026/2/1
VLAモデルの実世界汎化を評価するため、物理ダイナミクス・空間推論タスク・3D指標による完全自律評価を統合したベンチマークRADARを提案し、既存モデルを監査した。
- 視覚言語行動モデルのための安定した言語ガイダンスVLA2026/1/1
VLAモデルが言語の言い回しの変化に弱い「モダリティ崩壊」を解決するため、意味意図と視覚的アフォーダンスを分離する確率的フレームワークRSSを提案し、敵対的な言語摂動下でも頑健な操作性能を実現した。
- RGBSQGrasp: 単眼RGB画像からの局所スーパークアドリック推定による把持可能領域を考慮したビンピッキングマニピュレーション2025/3/1
単眼RGB画像から基礎モデルで物体の点群を推定し、スーパークアドリック形状を当てはめて把持姿勢を生成する、深度センサー不要のビンピッキング手法を提案。
- MGSO: 効率的な3Dガウシアンスプラッティングを用いた単眼リアルタイムフォトメトリックSLAMSLAM2024/9/1
フォトメトリックSLAMと3Dガウシアンスプラッティングを統合し、RGB入力のみで高品質・省メモリ・高速なリアルタイム単眼SLAMを実現した。
- リアルタイムGaussian Splattingに向けて:フォトメトリックSLAMによる3DGSの高速化SLAM2024/8/1
単眼フォトメトリックSLAM(Direct Sparse Odometry)の点群を3D Gaussian Splattingの入力に使うことで、高品質レンダリングに必要な学習時間を大幅に短縮できることを示した研究。
- オプティカルフローと擬似深度マップによる高密度単眼動きセグメンテーション:ゼロショットアプローチ動きセグメンテーション2024/6/1
学習不要で、基盤モデルによる物体提案とオプティカルフロー・単眼深度推定による相対深度マップを組み合わせ、単一カメラ映像から高密度な動きセグメンテーションを実現する手法を提案。
- ShapeShift: Superquadric-based Object Pose Estimation for Robotic Grasping2023/4/1
- MMRNet: Improving Reliability for Multimodal Object Detection and Segmentation for Bin Picking via Multimodal Redundancy2022/10/1
- MetaGraspNet: A Large-Scale Benchmark Dataset for Scene-Aware Ambidextrous Bin Picking via Physics-based Metaverse Synthesis2022/8/1
- MetaGraspNet_v0: A Large-Scale Benchmark Dataset for Vision-driven Robotic Grasping via Physics-based Metaverse Synthesis2021/12/1