Huiwon Jang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA/操作VLA/触覚/マニピュレーションVLA表現学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RLDX-1 技術報告書VLA/操作2026/5/1
多機能な汎用ロボットポリシーRLDX-1を提案し、マルチストリームアクショントランスフォーマーにより多様なモダリティを統合して、器用な操作タスクで既存のVLAモデルを上回る性能を示した。
- 視覚言語行動モデルへの物理フィードバック統合のためのモジュール型感覚ストリームVLA/触覚/マニピュレーション2026/4/1
視覚言語行動モデル(VLA)に触覚やトルクなどの複数の物理センサ信号を統合するモジュール型フレームワークを提案し、実世界実験で性能向上を実証した。
- ContextVLA:マルチフレーム文脈を効率的に活用する視覚-言語-行動モデルVLA2025/10/1
過去の観測を1つの文脈トークンに圧縮することで、計算コストを抑えつつマルチフレームの時間的文脈を活用してロボットタスクの成功率を高めるVLAモデルを提案。
- 世界モデル拡張VLAのためのデュアルストリーム拡散VLA2025/10/1
視覚・言語・行動モデルに世界モデルを組み合わせ、状態と行動を別ストリームで拡散生成するDUSTを提案し、シミュレーションと実機で性能向上を実証した。
- Robot-R1: ロボティクスにおける身体性推論を強化する強化学習VLA2025/6/1
強化学習を用いてロボット制御のための身体性推論を改善するフレームワークを提案し、SFTを上回る性能を達成した。
- 確率的フレーム予測による視覚表現学習表現学習2024/6/1
将来フレーム予測の不確実性を確率的にモデル化し、マスク画像モデリングと組み合わせて動画やロボット学習に有効な視覚表現を学習する手法を提案した。