Siqi Song
University of Illinois Urbana-Champaign
収録論文 3本 ・ フィジカルAI/ロボット学習
マニピュレーションマルチロボット協調VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MotorMind: 汎用視覚言語モデルをゼロショットロボットマニピュレーションに活用するフレームワークマニピュレーション2026/9/29
汎用VLMが直接観察から行動を生成しフィードバックで適応するだけでロボット操作を実現するハーネスを提案し、専用学習や外部ツールなしでLIBERO-PROや実機xArm6で高い成功率を達成した。
- 適応的グループ交渉による異種マルチロボット協調と大規模言語モデルの活用マルチロボット協調2026/2/1
各ロボットにLLMエージェントを割り当て、提案プランナーで動的にサブグループを形成し、サブグループ内で知覚駆動型のマルチLLM議論を行って行動指令を生成する枠組みCLiMRSを提案。異種マルチロボット組立ベンチマークCLiMBenchで評価し、複雑タスクの効率を40%以上向上させた。
- 大規模人間動画から学ぶ汎用人型ポーズ制御VLA2024/12/1
2000万件超の人間動画から人型ロボットのポーズとテキスト指示のデータセットHumanoid-Xを構築し、テキスト入力で人型ロボットを制御する大規模モデルUH-1を学習した。