Qifeng Chen
収録論文 40本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LeapBot-WA: 予測的潜在アライメントによるワールドアンカー行動モデルVLA2026/7/1
ピクセルレベルの動画生成に依存せず、潜在空間での予測的意味アライメントを用いて物理ダイナミクスを抽出する新しいワールドアクションモデルを提案し、LIBEROやRoboTwinで高い性能を達成した。
- 身体化操作のためのデータピラミッド:サーベイデータ収集/身体化AI2026/7/1
実ロボットデータからシミュレーションデータまで、身体化エージェントの学習に使われる5つのデータ源をピラミッド構造で整理し、各データの特性と組み合わせ方を分析したサーベイ論文。
- OmniContact: 接触フローによるメタスキルの連鎖で汎用ヒューマノイド移動操作を実現移動操作2026/6/1
ヒューマノイドの長期的な移動操作タスクを、接触フローという表現を介してメタスキルを階層的に連鎖させるフレームワークを提案し、高い成功率と自律的な失敗回復を実現した。
- Robo-Cortex: 二重粒度認知記憶と自律知識誘導による自己進化型具現化エージェントナビゲーション2026/5/1
ロボットが過去の経験からナビゲーションのヒューリスティックを自律的に抽出し、戦略を進化させる自己進化型フレームワークを提案した。
- スイッチ:ヒューマノイドロボットの俊敏なスキル切り替えの実現歩行2026/4/1
ヒューマノイドロボットが複数の移動スキルをシームレスに切り替えられるようにする階層型マルチスキルシステムを提案した論文。
- HumanX: 人間の動画からヒューマノイドの俊敏で汎用的なインタラクションスキルを獲得模倣学習2026/2/1
人間の動画から物理的に妥当なロボット動作データを生成し、模倣学習でUnitree G1にゼロショット転移するフレームワーク。バスケやサッカーなど5領域10スキルを獲得。
- FlyAware: 視覚推定と把持後適応による慣性を考慮した空中マニピュレーション空中マニピュレーション2026/1/1
視覚による把持前の慣性推定と把持後の適応機構を組み合わせ、慣性を考慮した適応制御で空中マニピュレータのロバストな操作を実現した。
- 合成デモンストレーションから汎化可能な手と物体のトラッキングを学習マニピュレーション2025/12/1
人間のデモなしに合成データのみから、多様な物体形状や手の形態に対応する器用な手と物体のトラッキング制御器を学習する手法を提案。
- RGB-Dカメラを用いた人間が投げる飛翔体に対する脅威認識型UAV回避UAV回避2025/11/1
RGB-Dカメラで人間の姿勢と奥行きを推定し、投げられる飛翔体の軌道を予測して、不確実性を考慮した回避戦略でUAVが瞬時に避けるシステムを提案した。
- PhysHSI:実世界で汎化可能な自然なヒューマノイド・シーンインタラクションシステムヒューマノイド2025/10/1
シミュレーションでの敵対的動作事前分布に基づく方策学習と、LiDARとカメラを組み合わせた粗から細への物体位置推定により、ヒューマノイドが実世界で物体運搬や着座などの多様なインタラクションを自然に自律実行できるシステムを構築した。
- VLMベースのマルチエージェント協調による自動運転ポリシー学習フレームワークOGR自動運転2025/9/1
視覚言語モデルを活用したマルチエージェント協調により、報酬関数と訓練カリキュラムの設計を自動化し、自動運転ポリシーをオンラインで進化させるフレームワークを提案した。
- 混沌から規則を学ぶ:タングラム組立のための推論・計画・操作の学習マニピュレーション2025/5/1
シミュレーションでの自己探索により、未知のタングラム形状を組み立てる汎用的なロボット組立ポリシーを学習する手法を提案。
- ロボットマニピュレーションにおける生成AI:サーベイマニピュレーション2025/3/1
GAN・VAE・拡散モデルなどの生成モデルをロボットマニピュレーションに応用する研究を、データ生成から方策学習まで階層的に整理したサーベイ。
- ガウシアンスプラッティングによる産業グレードのセンサシミュレーション:スケーラブルな編集とフルスタック検証のためのモジュラーフレームワークsim2real2025/3/1
自動運転のセンサシミュレーションをNeRFからガウシアンスプラッティングに置き換え、シーン編集や拡張を可能にするモジュラーフレームワークを提案し、カメラとLiDARで実証した。
- 多感覚統合ソフトハンドによる薄い変形物体の操作学習マニピュレーション2024/11/1
柔らかく受動的なコンプライアンスを持つソフトハンドに触覚・力覚・固有感覚と深度カメラを統合し、モデルフリー強化学習で薄い変形物体の分離・把持を自己教師あり学習する手法を提案。
- SkillMimic: デモンストレーションからバスケットボールのインタラクションスキルを学習模倣学習2024/8/1
人間と物体のインタラクションを模倣する統一的な報酬設計で、バスケットボールのドリブル・レイアップ・シュートなど多様なスキルを単一の方策で学習し、スキル遷移や長期タスクも可能にした研究。
- マルチカメラ画像から高解像度ベクトル表現を学習する3D物体検出3D物体検出2024/7/1
マルチカメラ画像から高解像度のベクトル表現と低解像度BEV表現を組み合わせ、効率的に3D物体検出を行うVectorFormerを提案。nuScenesで最高精度と高速推論を達成。
- GIC: ガウス情報付き連続体による物性推定とシミュレーションsim2real2024/6/1
3Dガウシアン表現と連続体シミュレーションを組み合わせ、視覚観測から物体の物理特性を推定するハイブリッド手法を提案。
- PLUTO:自動運転のための模倣学習ベース計画の限界を押し広げる自動運転計画2024/4/1
縦横を考慮したモデル構造と対照学習を活用した新しい訓練枠組みにより、自動運転の模倣学習ベース計画を大幅に改善し、初めてルールベース計画を上回る性能を達成した。
- OV9D: オープンボキャブラリなカテゴリレベル9D物体姿勢・サイズ推定6D姿勢推定2024/3/1
任意の新規カテゴリのテキスト記述から、観測画像中の物体の位置・向き・サイズを推定するオープンセット問題に取り組み、大規模合成データセットOO3D-9DとDinoV2・拡散モデルを活用したNOCS推定フレームワークを提案した。
- クロスクラスタシフトによる自動運転向け高効率・高精度3D物体検出3D物体検出2024/3/1
点ベース3D検出器の受容野を広げるCross-Cluster Shifting演算を提案し、KITTI・Waymo・nuScenesで高精度かつ高速な検出を実現した。
- PPAD: Iterative Interactions of Prediction and Planning for End-to-end Autonomous Driving2023/11/1
- Flipbot: Learning Continuous Paper Flipping via Coarse-to-Fine Exteroceptive-Proprioceptive Exploration2023/4/1
- Learn to Grasp via Intention Discovery and its Application to Challenging Clutter2023/4/1
- ERRA: An Embodied Representation and Reasoning Architecture for Long-horizon Language-conditioned Manipulation Tasks2023/4/1
- Rotating without Seeing: Towards In-hand Dexterity through Touch2023/3/1
- Planning for Sample Efficient Imitation Learning2022/10/18
- Volumetric-based Contact Point Detection for 7-DoF Grasping2022/9/1
- Bootstrap Motion Forecasting With Self-Consistent Constraints2022/4/1
- Towards Self-Supervised Category-Level Object Pose and Size Estimation2022/3/1
- FS6D: Few-Shot 6D Pose Estimation of Novel Objects2022/3/1
- DRINet++: Efficient Voxel-as-point Point Cloud Segmentation2021/11/1
- DRINet: A Dual-Representation Iterative Learning Network for Point Cloud Segmentation2021/8/1
- Joint Depth and Normal Estimation from Real-world Time-of-flight Raw Data2021/8/1
- MFuseNet: Robust Depth Estimation with Learned Multiscopic Fusion2021/8/1
- Stereo Waterdrop Removal with Row-wise Dilated Attention2021/8/1
- TPCN: Temporal Point Cloud Networks for Motion Forecasting2021/3/1
- Learning to Predict Vehicle Trajectories with Model-based Planning2021/3/1
- FFB6D: A Full Flow Bidirectional Fusion Network for 6D Pose Estimation2021/3/1
- PiP: Planning-informed Trajectory Prediction for Autonomous Driving2020/3/1