Fabio Pizzati
収録論文 8本 ・ フィジカルAI/ロボット学習
世界モデル/マルチエージェント3Dシーン再構成ヒューマノイド動作生成マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ActionParty: 生成ビデオゲームにおけるマルチサブジェクト行動バインド世界モデル/マルチエージェント2026/4/2
ビデオ拡散モデルで複数のエージェントを同時に制御するための世界モデルを提案し、各被写体の状態トークンを導入して行動と被写体の対応を明確化した。Melting Potベンチマークで最大7プレイヤーを同時制御できる初のビデオ世界モデルを実証した。
- MessyKitchens: 接触リッチなオブジェクトレベルの3Dシーン再構成3Dシーン再構成2026/3/1
散らかった実世界のキッチンシーンを対象に、物体の形状・姿勢・接触を高精度に再構成する新しいデータセットと、複数物体を同時に再構成する手法を提案した論文。
- PhysMoDPO: 選好最適化による物理的に妥当なヒューマノイド動作生成ヒューマノイド動作生成2026/3/1
全身制御器(WBC)を訓練に組み込み、拡散モデルが生成する動作を物理法則とテキスト指示の両方に適合させる選好最適化フレームワークを提案し、シミュレーションと実機G1ヒューマノイドで有効性を示した。
- BLAZER: ゼロショットデータ生成によるLLMベース操作エージェントのブートストラップマニピュレーション2025/10/1
LLMプランナーでシミュレーション内の操作デモを自動生成し、成功例でLLMを微調整することで、人手なしに操作スキルを獲得・転移させるフレームワークを提案。
- ManiFest: Manifold Deformation for Few-shot Image Translation2021/11/1
- Leveraging Local Domains for Image-to-Image Translation2021/9/1
- Physics-informed Guided Disentanglement in Generative Networks2021/7/1
- Enhanced free space detection in multiple lanes based on single CNN with scene identification2019/5/1