Ziang Li
収録論文 8本 ・ フィジカルAI/ロボット学習
VLA/ベンチマークVLA/両腕操作シミュレーション環境生成3D再構成/操作軌道合成ロボット操作VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- InstructMove: 指示追従操作のためのテキスト必須ベンチマークVLA/ベンチマーク2026/8/24
視覚的に顕著な物体や唯一の動作候補に頼らず、言語指示にのみ従って正解が決まる「テキスト必須」な操作ベンチマークInstructMoveを提案し、VLAモデルの指示追従能力を診断・改善する。
- 驚くほど単純なモダリティマスキングによる堅牢な両腕視覚言語行動モデルVLA/両腕操作2026/8/23
両腕ロボット操作のための視覚言語行動モデルの堅牢性を、トレーニング中にモダリティチャネルをランダムにマスクするだけのシンプルな手法で向上させた。
- EmbodiedGen V2: 具身知能のためのエージェント型・シミュレーション対応3Dワールドエンジンシミュレーション環境生成2026/7/1
シミュレーション対応の3Dアセットを自動で組み立て、操作・ナビゲーションなどのタスク環境を生成できる世界エンジンを提案。生成環境での強化学習により、シミュレーション成功率と実ロボット成功率を大幅に向上させた。
- ManiSplat: 単眼ビデオからの操作軌道合成 - 分離型3Dガウシアンスプラッティングによるアプローチ3D再構成/操作軌道合成2026/6/9
ロボットの単眼ビデオから、ロボット・物体・背景を分離した3Dガウシアン表現を構築し、操作タスクの軌道を合成するフレームワークを提案した。
- Light-WAM: 状態融合アクション復号による効率的なワールドアクションモデルロボット操作2026/6/6
ロボット操作のための軽量なワールドアクションモデルを提案し、将来予測の学習コストを削減しつつ、高速なアクション予測を実現した。
- HoloBrain-0 技術報告VLA2026/2/1
ロボットの身体情報(カメラ配置やURDF)を組み込んだVLAフレームワークを提案し、事前学習と事後学習でシミュレーションと実機のマニピュレーションタスクを高精度に達成、エコシステム全体をオープンソース化した。
- "I am the follower, also the boss": Exploring Different Levels of Autonomy and Machine Forms of Guiding Robots for the Visually Impaired2023/2/1
- Can Quadruped Navigation Robots be Used as Guide Dogs?2022/10/1