Liu Liu
Horizon Robotics
収録論文 39本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Ego4WAM:ロボット学習のための自己中心的人間データのスケーリングで重要な要素は何か?VLA2026/9/30
自己中心的人間データをロボット学習に活用する際、人間とロボットのアライメント、タスク多様性、行動監督、利用戦略が下流性能に与える影響を体系的に分析し、データ設計の指針を示した。
- 世界行動モデルの表現設計を見直すReWAMVLA2026/9/29
事前学習済みDINO特徴を基盤に、特徴校正と時間表現ボトルネックで世界状態を圧縮し、行動損失のみで表現を整形する世界行動モデルを提案。動画生成事前学習なしでRoboTwin 2.0で93.6%の成功率を達成。
- CogWAM: イベント駆動型インターフェースによる意味認知と世界行動モデリングの整合VLA2026/9/29
タスク推論と世界行動学習の間に持続的な意味状態を介した明示的なインターフェースを設け、進捗条件付きクエリで未来予測と行動生成を整合させる認知誘導型世界行動モデルを提案。
- SV-WAM: 効率的な全方位ビュー世界行動モデルによるエンドツーエンド自動運転自動運転2026/9/3
全方位カメラ入力を用いた世界行動モデルを提案し、将来ビデオ予測を訓練時の補助信号として活用することで、推論時の計算負荷を抑えつつ安全な運転計画を実現した。
- InstructMove: 指示追従操作のためのテキスト必須ベンチマークVLA/ベンチマーク2026/8/24
視覚的に顕著な物体や唯一の動作候補に頼らず、言語指示にのみ従って正解が決まる「テキスト必須」な操作ベンチマークInstructMoveを提案し、VLAモデルの指示追従能力を診断・改善する。
- Faster-WAM: ロバストな世界行動モデルのための効率的な推論時未来条件付けロボット操作2026/8/5
世界行動モデル(WAM)の推論時における未来条件付けの重要性を示し、計算コストを抑えつつ未来表現を活用する効率的なフレームワークFaster-WAMを提案した。
- DreamWAM: RGBを超えた未来予測による世界行動モデルVLA2026/8/1
世界行動モデル(WAM)の未来予測をRGBだけでなく、外観・動き・幾何・意味の構造化表現で行うことで、ロバストな行動学習を実現した。
- EmbodiedGen V2: 具身知能のためのエージェント型・シミュレーション対応3Dワールドエンジンシミュレーション環境生成2026/7/1
シミュレーション対応の3Dアセットを自動で組み立て、操作・ナビゲーションなどのタスク環境を生成できる世界エンジンを提案。生成環境での強化学習により、シミュレーション成功率と実ロボット成功率を大幅に向上させた。
- 四足ロボットのための行動基盤:ABot-C0 テクニカルレポート四足歩行2026/7/1
四足ロボット向けの汎用動作制御システムABot-C0を提案し、大規模データパイプラインとフローマッチングポリシーにより、動作追跡のスケーリング則を初めて実証した。
- ManiSplat: 単眼ビデオからの操作軌道合成 - 分離型3Dガウシアンスプラッティングによるアプローチ3D再構成/操作軌道合成2026/6/9
ロボットの単眼ビデオから、ロボット・物体・背景を分離した3Dガウシアン表現を構築し、操作タスクの軌道を合成するフレームワークを提案した。
- 無限の動きを解き放つ:生成ビデオ事前学習による表現豊かな四足歩行のスケーリング四足歩行2026/6/1
動物を介さずに、LLMとビデオ拡散モデルで四足ロボットの多様な動きを生成し、実機で追従させるパイプラインUni-Moを提案した。
- HoloAgent-0: 3D空間メモリを備えた統合具現化エージェントフレームワークVLA2026/6/1
言語指示を実行可能なスキルグラフに変換し、3D空間メモリとロボットスキルを統合して実ロボットで閉ループ実行を実現する統一エージェントフレームワークを提案した。
- 歩道ロボットのためのハイブリッド2D-3D学習による単眼3D占有知覚3D占有予測2026/6/1
歩道を走行するロボット向けに、LiDAR-RGBペアデータと大規模な非ペア単眼画像を組み合わせたハイブリッド学習で3D占有予測を行うフレームワークWalkOCCを提案し、新たな歩道データセットSidewalk3Dも導入した。
- SimWeaver: 変形物操作のためのゼロショットRGBシミュレーションから実世界への転移変形物操作/sim2real2026/6/1
変形物操作のためのRGBシミュレーションから実世界への転移を、実世界での微調整なしで実現する手法を提案。シミュレーション上のデモンストレーションのみで訓練したVLAポリシーが、5つの多様な変形物タスクで高い成功率を達成した。
- GeoFlow-SLAM++: 再位置推定を備えた堅牢なマルチカメラ視覚慣性SLAMシステムSLAM2026/6/1
複数カメラを統合した視覚慣性SLAMシステムを提案し、単眼やRGB-Dセンサの限界を克服して、外観変化に強いニューラル特徴量と再位置推定を組み合わせることで、様々な環境で高精度な位置推定を実現した。
- 制約を考慮した拡散事前分布による高忠実かつ多用途な四足歩行歩行2026/5/1
四足歩行の模倣学習において、GANの代わりに拡散モデルを運動事前分布として用い、多様な動作生成とハードウェア安全を両立する枠組みDiff-CASTを提案した。
- 対称性アノテーション不要の学習戦略による汎用・実動部品姿勢推定姿勢推定2026/5/1
対称性アノテーションを必要とせず、自己教師あり学習で部品の姿勢推定を行うフレームワークを提案した。
- MotionAnymesh: 物理に基づく関節構造生成によるシミュレーション対応デジタルツインシミュレーション/デジタルツイン2026/3/1
静的な3Dメッシュを、物理シミュレーションで動作可能な関節付きアセットへ自動変換するフレームワークを提案。VLMの推論に物理的知識を組み込み、関節推定と衝突回避を最適化する。
- QuadFM: テキスト駆動の四足歩行モーション生成と制御のための基盤データセットデータセット/モーション生成/制御2026/3/1
四足歩行ロボット向けに、多様な動作と感情表現を含む大規模なモーションデータセットを構築し、テキストからモーションを生成・制御する統一フレームワークを提案した。
- IRIS-SLAM: 幾何・インスタンス統合表現による堅牢な意味論的定位とマッピングSLAM2026/2/1
幾何基盤モデルを拡張して密な幾何と視点間で一貫したインスタンス埋め込みを同時予測し、意味論的に対応付けられたループ閉じ込み検出を可能にしたRGB意味論SLAMシステムを提案。
- ABot-N0:多様な身体性ナビゲーションのためのVLA基盤モデルに関する技術報告VLA2026/2/1
5種類のナビゲーションタスクを統一的に扱うVLA基盤モデルABot-N0を提案し、大規模データセット構築と7ベンチマークでのSOTA達成、実環境での長期ミッションを可能にした。
- SynHLMA:離散的な人-物体インタラクション表現による関節物体の手言語操作の合成マニピュレーション2025/10/1
関節物体に対する言語指示付きの手の把持・操作系列を生成するフレームワークSynHLMAを提案し、生成・予測・補間タスクで高性能を示した。
- FSR-VLN: 階層的マルチモーダルシーングラフによる視覚言語ナビゲーションの高速・低速推論VLA2025/9/1
階層的マルチモーダルシーングラフと高速・低速推論を組み合わせ、長距離視覚言語ナビゲーションの成功率を向上させつつ応答時間を82%削減し、ヒューマノイドロボットに実装した。
- ArtGS: 3Dガウシアンスプラッティングによる関節物体の視覚・物理モデリングと操作マニピュレーション2025/7/1
3Dガウシアンスプラッティングに視覚言語モデルと微分可能レンダリングを組み合わせ、関節物体の構造を推定して操作方策を最適化するフレームワークを提案。
- EmbodiedGen: 身体性知能のための生成的3D世界エンジンsim2real2025/6/1
物理的リアリティと正確なスケールを持つ3Dアセットを低コストで生成し、物理シミュレーションに直接インポート可能な基盤プラットフォームを提案。
- GeoFlow-SLAM:動的脚式ロボティクスのための堅牢な密結合RGBD慣性・脚式オドメトリ融合SLAMSLAM2025/3/1
高速・高頻度動作する脚式ロボット向けに、幾何学的整合性・脚式オドメトリ・デュアルストリームオプティカルフローを統合し、特徴マッチングや姿勢初期化の失敗、テクスチャレス環境での視覚特徴不足を解決する密結合RGBD慣性SLAMを提案。
- ガウシアン物体彫刻: 表面補完を伴う物体合成的ガウシアンスプラッティング3D再構成2024/12/1
3Dガウシアンスプラッティングと単眼幾何事前分布を組み合わせ、遮蔽領域の表面をゼロショットで補完しながら物体単位で編集可能な3Dシーン再構成を実現した研究。
- UniAff:視覚言語モデルによる道具使用と関節物体操作のためのアフォーダンス統合表現マニピュレーション2024/9/1
道具と関節物体の操作を統一的に扱うため、アフォーダンス認識と3D運動制約の推論を視覚言語モデルで行う手法UniAffを提案し、シミュレーションと実世界で汎化性能を向上させた。
- Thermal-NeRF: 赤外線カメラによるニューラル放射輝度場NeRF/赤外線2024/3/1
赤外線画像のみからNeRFを構築する初の手法を提案し、暗所や遮蔽物がある劣悪環境でも高品質な3D再構成を実現した。
- RPMArt: 関節物体のためのロバストな知覚とマニピュレーションマニピュレーション2024/3/1
ノイズの多い点群から関節パラメータと把持可能点を推定し、シミュレーションのみの学習で実世界の関節物体をゼロショットで操作できるフレームワークを提案。
- ManiPose: 姿勢を考慮した物体操作のための包括的ベンチマークマニピュレーション2024/3/1
物体の6D姿勢に応じて把持や操作を適応させる「姿勢考慮型物体操作」の研究を進めるため、シミュレーション環境・大規模データセット・LLM活用ベースラインを提供するベンチマークを構築した。
- GAMMA: Generalizable Articulation Modeling and Manipulation for Articulated Objects2023/9/1
- Image-based Geolocalization by Ground-to-2.5D Map Matching2023/8/1
- Deploying Offline Reinforcement Learning with Human Feedback2023/3/13
- Towards Real-World Category-level Articulation Pose Estimation2021/5/1
- SPINS: Structure Priors aided Inertial Navigation System2020/12/1
- On the Guaranteed Almost Equivalence between Imitation Learning from Observation and Demonstration2020/10/1
- PIRT: A Runtime Framework to Enable Energy-Efficient Real-Time Robotic Applications on Heterogeneous Architectures2018/2/1
- Robust and Efficient Relative Pose with a Multi-camera System for Autonomous Vehicle in Highly Dynamic Environments2016/5/1