Ling Chen
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAマルチモーダルエージェント家庭内ロボット
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RxBrain:言語と視覚の推論・想像を統合した身体化認知基盤モデルVLA2026/7/1
身体化認知のための基盤モデルRxBrainを提案。言語による計画構造と視覚による世界状態予測を統合し、単一の計画シーケンスで表現する。
- Hy-Embodied-0.5-VLA:視覚言語行動モデルから実世界ロボット学習スタックへVLA2026/6/1
データ収集からモデル設計、事前学習、微調整、強化学習、実機展開までを含むロボット学習の全スタックを備えたエンドツーエンドシステムを提案した論文。
- Automotive-ENV:車載インターフェースシステムにおけるマルチモーダルエージェントのベンチマークマルチモーダルエージェント2025/9/1
車載GUI向けの初の高忠実度ベンチマークと対話環境を構築し、GPS情報を活用する位置認識型マルチモーダルエージェントASURADAを提案した。
- 家庭内の危険を先回りして検知・対処するロボット家庭内ロボット2024/11/1
基盤モデルとマルチエージェント議論で家庭内の危険シナリオを自動生成し、ロボットが異常を能動的に発見・対処するスキルを学習する手法を提案した。