Tsung-Wei Ke
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TaRL: 触覚デモンストレーションから汎用的で物理的な報酬を学習する触覚2026/9/29
触覚の変形マップ列からタスク進捗を回帰し、成功・失敗デモを活用して強化学習の報酬を学習する手法を提案。接触を伴う操作のサンプル効率と成功率を大幅に改善。
- COT-FM: クラスタ単位の最適輸送フローマッチング生成モデル2026/3/1
フローマッチングの確率経路をクラスタリングと最適輸送で再形成し、より速く高品質な生成を実現する汎用フレームワークを提案。画像生成やロボット操作タスクで有効性を実証。
- 不確実な環境下での意思決定のための情報探索フレームワークInfoSeekerVLA/LLMプランニング2025/10/1
LLMを用いた意思決定において、内部モデルと実環境のずれを解消するため、行動前に情報を能動的に集める計画手法を提案し、部分観測環境の新ベンチマークで大幅な性能向上を示した。
- DexMan: 人間と生成動画から両手巧みな操作を学習マニピュレーション2025/10/1
第三者視点の人間動画から、ヒューマノイドロボットの両手巧みな操作スキルを自動生成するフレームワーク。接触ベース報酬でノイズの多い手・物体姿勢からも方策学習を改善する。
- RobotArena ∞: 実機からシミュレーションへの変換によるスケーラブルなロボットベンチマークVLA2025/10/1
実機の動画デモを生成モデルでシミュレーション環境に自動変換し、VLAポリシーを大規模かつ再現可能に評価するベンチマークフレームワークを提案。
- 見て、指して、飛ぶ:汎用無人航空ナビゲーションのための学習不要VLMフレームワークVLA2025/9/1
VLMを活用し、自由な言語指示を画像上の2Dウェイポイントに変換してドローンを閉ループ制御する、学習不要の航空視覚言語ナビゲーション手法を提案。
- 3D FlowMatch Actor:単腕・双腕マニピュレーションのための統合3Dポリシーマニピュレーション2025/8/1
流れマッチングと3D事前学習済み視覚表現を組み合わせ、単腕・双腕ロボット操作を高速かつ高精度に行う3Dポリシーを提案。
- Diffusion-ES: 拡散モデルと勾配不要最適化による自動運転とゼロショット指示追従自動運転/計画2024/2/1
拡散モデルから軌道をサンプリングし、進化的探索と黒箱報酬で評価・改良することで、微分不可能な目的関数でもデータ多様体上で最適化できる手法を提案し、自動運転ベンチマークnuPlanで最高性能を達成した。
- 3D Diffuser Actor:3Dシーン表現を用いた拡散ポリシーVLA2024/2/1
3Dシーン特徴と言語指示・固有感覚を融合する新しい3DデノイジングTransformerにより、ロボットの3D姿勢軌道を拡散モデルで生成するポリシーを提案し、RLBenchやCALVINでSOTAを達成した。
- Diffusion-TTA: Test-time Adaptation of Discriminative Models via Generative Feedback2023/11/1