Jinhan Li
収録論文 7本 ・ フィジカルAI/ロボット学習
メモリ/長期エージェントデータ生成sim2real全身運動生成模倣学習/ヒューマノイドVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MemPrism: 長期的エージェントのためのタスク条件付き関係メモリビューメモリ/長期エージェント2026/8/7
長期タスクのエージェント向けに、経験を永続的に保存しつつ、現在のタスクに応じて動的に関係性を構築するメモリフレームワークを提案。固定表現による表現ミスマッチを解消し、長い軌跡での性能向上とメモリ消費削減を実証。
- FlyMirage:生成的世界モデルによる多様でスケーラブルなUAV飛行データの完全自動生成パイプラインデータ生成2026/5/1
大規模言語モデルと生成的世界モデルを組み合わせ、高忠実度の3DGSシーンを自動生成し、UAVの飛行軌道を計画することで、多様で現実的な空中VLNデータセットを自動構築するパイプラインを提案した。
- 3D放射輝度場での学習とドメイン適応による単眼RGB画像での混雑環境飛行sim2real2025/12/1
3Dガウシアンスプラッティングによるフォトリアルなシミュレーションと敵対的ドメイン適応を組み合わせ、単眼RGB画像のみで混雑環境を飛行する方策を学習し、実世界へのゼロショット転移を実現した。
- Harmon: 言語記述からヒューマノイドの全身運動を生成全身運動生成2024/10/1
人間の運動データを事前知識として活用し、視覚言語モデルの常識推論で編集・洗練することで、言語指示に沿った自然で多様なヒューマノイド全身運動を生成する手法を提案した。
- OKAMI: 単一動画の模倣によるヒューマノイドロボットの操作スキル学習模倣学習/ヒューマノイド2024/10/1
1本のRGB-D動画から物体を認識して人間の動きをヒューマノイドに再ターゲティングし、操作計画と実行ポリシーを生成する手法を提案。閉ループ視覚運動ポリシーは79.2%の成功率を達成した。
- 大規模言語モデルを用いた四足歩行ロボットの長期的な移動と操作VLA2024/4/1
大規模言語モデルを活用し、四足歩行ロボットが長期的なタスクを計画・実行するシステムを構築した。強化学習による運動・操作スキルと組み合わせ、道具の作成や人間への助け要請などの複雑な行動を実現した。
- Learning Agile Bipedal Motions on a Quadrupedal Robot2023/11/1