Junyan Li
収録論文 6本 ・ フィジカルAI/ロボット学習
生成モデルマニピュレーション世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GS-Agent: 生成シミュレーションによる4D物理世界の構築生成モデル2026/7/1
自然言語の記述から、物理的に妥当で動的な4D世界を自動生成するマルチエージェントフレームワークを提案した論文。
- 視点が重要:マスク付きオートエンコーダによる視覚マニピュレーションのための動的視点最適化マニピュレーション2026/2/1
単一カメラロボットにおいて、事前学習済みマルチビューマスク付きオートエンコーダを活用し、ラベルなしで最も情報量の多い視点を動的に選択するフレームワークMAE-Selectを提案。
- FSAG: 拡散モデルによる人間から多指ハンドへの指先ごとのアフォーダンス接地の強化マニピュレーション2026/1/1
人間の動画から拡散モデルを用いて物体のアフォーダンスを抽出し、多指ハンドの把持生成に活用することで、ハードウェア固有のデータ収集なしに汎用性の高い把持を実現した。
- TesserAct: 4D身体化世界モデルの学習世界モデル2025/4/1
RGB-DN動画を生成するビデオモデルを微調整し、身体化エージェントの行動に応じた4Dシーン予測を可能にする世界モデルを提案。
- FoAM: 先読み拡張によるマルチタスク模倣方策マニピュレーション2024/9/1
多様なタスクを単一方策でこなす模倣学習において、行動の視覚的結果を予測する先読み拡張を導入し、未見タスクへの汎化と行動信頼性を高めた手法を提案。
- MultiPLY: A Multisensory Object-Centric Embodied Large Language Model in 3D World2024/1/1