Jianing Yang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA3次元再構成3D-LLM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboMME:ロボット汎用ポリシーの記憶能力を評価・理解するベンチマークVLA2026/3/1
長期的・履歴依存的な操作タスクにおけるVLAモデルの記憶機構を評価するため、16タスクからなる標準ベンチマークと14種の記憶拡張VLAを構築し、記憶表現の有効性がタスク依存であることを示した。
- Fast3R: 1000枚以上の画像を1回の順伝播で3次元再構成3次元再構成2025/1/1
多数の視点画像をTransformerで並列処理し、反復的な位置合わせなしに高精度な多視点3次元再構成を実現する手法を提案。
- 身体性強化学習エージェントへの教示:言語使用の情報量と多様性VLA2024/10/1
強化学習エージェントへの言語入力について、フィードバックの情報量と表現の多様性が学習・推論に与える影響を4つのベンチマークで検証し、多様で情報豊富な言語教示が汎化と新タスクへの適応を促進することを示した。
- 3D-GRAND: 接地精度が高く幻覚の少ない3D-LLM向け100万規模データセット3D-LLM2024/6/1
家庭内3Dシーン4万件と言語指示620万件を対応付けた大規模データセットを構築し、3D-LLMの指示チューニングで接地能力向上と幻覚低減を実現、幻覚評価ベンチマーク3D-POPEも提案した。
- LLM-Grounder: Open-Vocabulary 3D Visual Grounding with Large Language Model as an Agent2023/9/1
- DANLI: Deliberative Agent for Following Natural Language Instructions2022/10/1