Weiyu Liu
収録論文 21本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Retriever: 閉ループ非同期ロボットプログラムの合成システム/プログラミング2026/7/1
ロボットの長時間タスクを実現するため、異なるクロックと遅延を持つコンポーネントを組み合わせた閉ループパイプラインを、非同期意思決定モデルとプログラミングモデル、ランタイム、パイプライン例として提供する。
- APIVOT: 視覚と言語の思考を適応的に交互配置する長期的計画手法計画2026/7/1
長期的なロボット計画において、言語による意味推論と視覚による幾何学的検証を適応的に交互に行うVLMベースのプランナーを提案し、キッチンタスクで性能を向上させた。
- ENACT: 自己中心的なインタラクションの世界モデリングによる身体性認知の評価身体性認知/ベンチマーク2025/11/1
ロボティクスシミュレーションから生成した自己中心視点の行動と観測の系列並べ替えタスクにより、視覚言語モデルが身体性認知の能力(アフォーダンス認識、行動効果推論など)をどの程度持つかを評価するベンチマークを提案。
- MoMaGen: ソフト・ハード制約下で多段階両腕移動マニピュレーションのデモを生成sim2real2025/10/1
移動ベースと両腕の多段階タスク向けに、到達可能性などのハード制約と視認性などのソフト制約を満たすデータ生成を制約付き最適化として定式化し、多様なデモを自動生成する手法を提案。
- 言語と実演から構成可能な行動を学習するフレームワークBLADEマニピュレーション2025/5/1
言語注釈付き実演とLLMを活用し、長期ロボットマニピュレーションのための構造化された高レベル行動表現を自動構築する手法を提案。新規状況への一般化性能をシミュレーションと実機で検証した。
- IKEAマニュアルの実践:インターネット動画における組立指示の4Dグラウンディング4Dグラウンディング2024/11/1
家具の3Dモデル・組立説明書・インターネット動画を密に対応付けたデータセットを構築し、組立計画生成や動画内の部品位置推定など5つのタスクの評価基盤を提供した。
- 身体性エージェントインターフェース:身体的意思決定のためのLLMベンチマークVLA2024/10/1
LLMを用いた身体的意思決定を統一的に評価するための汎用インターフェースを提案し、多様なタスク・モジュール・細粒度エラー指標でLLMの能力を体系的に分析するベンチマークを構築した。
- 意味理解に基づく対話的曖昧性解消:モデル非依存な人間-ロボットインタラクション手法人間-ロボットインタラクション2024/9/1
曖昧な指示で対象物を探す際、意味埋め込みモデルと反復的な確認質問を組み合わせ、少ない試行で目的物を特定するモデル非依存の手法を提案した。
- 言語から計画抽象を学習するVLA2024/5/1
言語注釈付きデモンストレーションを用いて、記号的な抽象行動空間と潜在状態抽象を自動獲得し、長期的な計画を可能にするフレームワークPARLを提案。
- 部品ベースの組み合わせ可能なマニピュレーションマニピュレーション2024/5/1
物体を部品に分解し、部品間の機能的対応関係を拡散モデルで学習することで、新しい物体やカテゴリにも汎化するロボット操作手法を提案した。
- Foundation Models in Robotics: Applications, Challenges, and the Future2023/12/1
- GraspGPT: Leveraging Semantic Knowledge from a Large Language Model for Task-Oriented Grasping2023/7/1
- Latent Space Planning for Multi-Object Manipulation with Environment-Aware Relational Classifiers2023/5/1
- Task-Oriented Grasp Prediction with Visual-Language Inputs2023/2/1
- StructDiffusion: Language-Guided Creation of Physically-Valid Structures using Unseen Objects2022/11/1
- StructFormer: Learning Spatial Structure for Language-Guided Semantic Rearrangement of Novel Objects2021/10/1
- Towards Robust One-shot Task Execution using Knowledge Graph Embeddings2021/5/1
- Same Object, Different Grasps: Data and Semantic Knowledge for Task-Oriented Grasping2020/11/1
- Taking Recoveries to Task: Recovery-Driven Development for Recipe-based Robot Tasks2020/1/1
- CAGE: Context-Aware Grasping Engine2019/9/1
- RoboCSE: Robot Common Sense Embedding2019/3/1