Ning Guo
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Triplet2Track: オブジェクト中心表現を用いた信頼性の高い長期的操作のための階層システム操作学習2026/8/24
長期的なロボット操作の信頼性を高めるため、人間の動画を活用し、高レベルのサブゴールをインスタンスに基づくトリプレットとして表現し、実行とオンライン再計画を行う閉ループ模倣学習システムを提案した。
- ABot-World-0: 単一デスクトップGPU上での無限インタラクティブワールドロールアウトワールドモデル2026/7/21
単一のデスクトップGPUでリアルタイムに長時間のインタラクティブなビデオ生成を実現するアクション条件付きワールドモデルを提案し、データ収集から推論最適化までを統合したシステムを構築した。
- ABot-Earth 0.5: 生成型3D地球モデル3D生成2026/6/8
衛星画像から広大な3D環境を生成する生成モデルを提案し、3Dガウススプラッティングを用いてリアルな都市景観を高速に合成する。
- FAWAM: 力覚を考慮した世界行動モデルによる閉ループ接触リッチ操作マニピュレーション2026/6/1
接触を伴う操作タスクにおいて、力覚情報を認識・予測・実行時補正の3段階で活用するモデルを提案し、成功率を大幅に向上させた。
- CLASH: 拡張Sim-to-realハイブリダイゼーションによる衝突学習でリアリティギャップを埋めるsim2real2026/2/1
不完全なシミュレータから衝突モデルを蒸留し、少数の実衝突データで微調整することで、衝突を含むタスクのsim-to-real転移精度を高めるフレームワークを提案。
- 見て、ズームして、理解する:身体性知覚のためのロボット眼球VLA2025/11/1
言語指示に基づきPTZカメラのパン・チルト・ズームを調整して最適な視野を得るVLAモデルEyeVLAを提案し、500サンプルで実世界適応を実現した。
- SocialNav: 社会規範を考慮した具身ナビゲーションのための人間模倣基盤モデルナビゲーション2025/11/1
社会規範を理解し遵守するナビゲーションを実現するため、700万サンプルのデータセットと階層型「脳-行動」アーキテクチャ、強化学習手法SAFE-GRPOを組み合わせた基盤モデルを提案し、成功率と社会規範遵守率を大幅に向上させた。
- JanusVLN: 二重暗黙メモリで意味と空間を分離する視覚言語ナビゲーションVLA2025/9/1
人間の左右脳のように意味理解と空間認知を別々の固定サイズの暗黙的ニューラルメモリで表現し、冗長な計算を抑えつつ効率的に視覚言語ナビゲーションを行うフレームワークを提案した。
- ロボットによる布の展開把持選択のためのデータセットとベンチマーク:ICRA 2024布コンペティションマニピュレーション2025/8/1
空中でのロボット布展開における把持姿勢選択を評価するベンチマークとICRA 2024コンペティションを開催し、679回の実世界デモンストレーションを含むデータセットを公開した。
- ソフト触覚溶接のためのフランジベース3Dハンドアイキャリブレーションキャリブレーション2024/7/1
ロボットのフランジ形状を3Dスキャナで直接計測する反復的なハンドアイキャリブレーション手法を提案し、ソフト触覚センシングと組み合わせた溶接シーム追従システムを実現した。
- Proprioceptive State Estimation for Amphibious Tactile Sensing2023/12/1
- Autoencoding a Soft Touch to Learn Grasping from On-land to Underwater2023/8/1