Weijie Zhou
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAマニピュレーションタスク計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RxBrain:言語と視覚の推論・想像を統合した身体化認知基盤モデルVLA2026/7/1
身体化認知のための基盤モデルRxBrainを提案。言語による計画構造と視覚による世界状態予測を統合し、単一の計画シーケンスで表現する。
- ProAct: 構造認識型能動応答のためのベンチマークとマルチモーダルフレームワークVLA2026/2/1
75タスク・91,581アノテーションからなる能動エージェント用ベンチマークProAct-75を構築し、タスクグラフとMLLMを活用したベースラインProAct-Helperを提案した。
- UniBYD: 人間の模倣を超えた多様なロボットハンドの操作学習のための統合フレームワークマニピュレーション2025/12/1
ロボットと人間の身体差を超え、多様なロボットハンド形態に適応する操作方策を強化学習で獲得する統合フレームワークUniBYDを提案。動的PPOと影エンジンにより人間模倣を超えた適応的探索を実現。
- PhysVLM: 視覚言語モデルにロボットの物理的可到達性を理解させるVLA2025/3/1
ロボットの可到達性を汎用的に表現するS-Pマップを導入し、それを視覚言語モデルに組み込むことで、実環境での embodied 推論精度を向上させた研究。
- LightPlanner:軽量LLMの推論能力を引き出すタスクプランナータスク計画2025/3/1
軽量な大規模言語モデルでも複雑なタスク計画をこなせるよう、パラメータ化された関数呼び出しと階層的深層推論、記憶モジュールを組み合わせたプランナーを提案し、専用データセットで1.5Bモデルを訓練した。