Jinwoo Shin
収録論文 19本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 器用なポイントポリシー:人間のデモから学習するポイントベースの器用な手のポリシー模倣学習/操作2026/6/9
人間のビデオから直接、器用な操作ポリシーを学習するフレームワークを提案。3Dキーポイント表現で人間とロボットの身体性のギャップを埋め、ロボットデモなしで実ロボットタスクを高い成功率で達成。
- Pose6DAug: 物理的に妥当な多視点物体交換によるロボットデータ拡張データ拡張2026/6/1
ロボットの失敗事例に対して、成功エピソードの物体だけを3Dで交換してデータ拡張する手法を提案し、新規物体での成功率を向上させた。
- 信頼領域Q-随伴マッチング強化学習2026/5/1
事前学習済みフローポリシーのオフポリシー強化学習を安定化するため、経路空間KLを信頼領域パラメータで制御するTRQAMを提案し、50のOGBenchタスクで既存手法を上回る性能を達成した。
- RLDX-1 技術報告書VLA/操作2026/5/1
多機能な汎用ロボットポリシーRLDX-1を提案し、マルチストリームアクショントランスフォーマーにより多様なモダリティを統合して、器用な操作タスクで既存のVLAモデルを上回る性能を示した。
- 視覚言語行動モデルへの物理フィードバック統合のためのモジュール型感覚ストリームVLA/触覚/マニピュレーション2026/4/1
視覚言語行動モデル(VLA)に触覚やトルクなどの複数の物理センサ信号を統合するモジュール型フレームワークを提案し、実世界実験で性能向上を実証した。
- RoboCurate: 行動検証済みニューラル軌道による多様性を活かしたロボット学習sim2real2026/2/1
生成ビデオから得たロボット行動をシミュレータで再生し、映像との動きの一致度で品質を評価・選別する合成データ生成フレームワークを提案。実データのみの場合と比べ成功率を大幅に改善した。
- 成功・失敗デモンストレーションを活用した階層型視覚言語行動モデルVLA2025/12/1
失敗デモも学習信号として活用し、高レベル推論と低レベル制御を分離した階層型VLAモデルVINEを提案。計画時に失敗を考慮した探索を行うことでマニピュレーションの成功率とロバスト性を向上させた。
- 視覚言語行動モデルのための対照表現正則化VLA2025/10/1
VLAモデルの表現をロボットの固有感覚状態と対照学習で整合させ、実機マニピュレーションの成功率を向上させた研究。
- 検証器不要のテスト時サンプリングによる視覚-言語-行動モデルVLA2025/10/1
VLAモデルが追加学習や外部検証器なしに、内部のマスキング分布を利用してテスト時に複数候補から最適な行動を選択する手法を提案。
- ContextVLA:マルチフレーム文脈を効率的に活用する視覚-言語-行動モデルVLA2025/10/1
過去の観測を1つの文脈トークンに圧縮することで、計算コストを抑えつつマルチフレームの時間的文脈を活用してロボットタスクの成功率を高めるVLAモデルを提案。
- HAMLET: 視覚言語行動モデルを履歴認識ポリシーに切り替えるVLA2025/10/1
各時刻の知覚情報を圧縮したモーメントトークンと軽量メモリモジュールで過去の文脈を統合し、VLAモデルを履歴依存タスクに適応させるフレームワークを提案。
- 世界モデル拡張VLAのためのデュアルストリーム拡散VLA2025/10/1
視覚・言語・行動モデルに世界モデルを組み合わせ、状態と行動を別ストリームで拡散生成するDUSTを提案し、シミュレーションと実機で性能向上を実証した。
- Robot-R1: ロボティクスにおける身体性推論を強化する強化学習VLA2025/6/1
強化学習を用いてロボット制御のための身体性推論を改善するフレームワークを提案し、SFTを上回る性能を達成した。
- セグメント化されたデモンストレーションからのサブタスク認識型視覚報酬学習報酬学習2025/2/1
アクションなしの動画デモをサブタスクに分割し、その区間を正解報酬として密な報酬関数を学習するREDSを提案。複雑な操作タスクでベースラインを大きく上回り、未知タスクや異なるロボットへの汎化も示した。
- 確率的フレーム予測による視覚表現学習表現学習2024/6/1
将来フレーム予測の不確実性を確率的にモデル化し、マスク画像モデリングと組み合わせて動画やロボット学習に有効な視覚表現を学習する手法を提案した。
- Guide Your Agent with Adaptive Multimodal Rewards2023/9/1
- Preference Transformer: Modeling Human Preferences using Transformers for RL2023/3/1
- Multi-View Masked World Models for Visual Robotic Manipulation2023/2/1
- Offline-to-Online Reinforcement Learning via Balanced Replay and Pessimistic Q-Ensemble2021/7/1