Yiwen Hou
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AdaClearGrasp: 密集環境でのロバストなゼロショット器用把持のための適応的クリアリング学習マニピュレーション2026/3/1
密集環境での器用な把持を実現するため、視覚言語モデルを用いて直接把持するか周囲をクリアするかを適応的に決定する閉ループ意思決定・実行フレームワークを提案した。
- RoTri-Diff: 空間的なロボット-物体三者間相互作用に基づく両腕操作のための拡散モデル両腕操作/拡散モデル/模倣学習2026/3/1
両腕と操作対象物の間の相対的な6D姿勢を符号化した三者間相互作用表現を導入し、階層的拡散過程で軌道生成する模倣学習フレームワークを提案。シミュレーションと実機で高い性能を実証した。
- Bi-Adapt: 意味的対応による新規カテゴリ3D物体への少数ショット両手操作適応マニピュレーション2026/2/1
視覚基盤モデルを活用してカテゴリをまたぐアフォーダンス対応を学習し、新規カテゴリの物体に対する両手操作を少数データで効率的に汎化させるフレームワークを提案した。
- Goal-VLA: 画像生成VLMを物体中心の世界モデルとして活用するゼロショットロボットマニピュレーションVLA2025/6/1
画像生成型VLMを世界モデルとして使い、目標状態の画像を生成して物体姿勢を導出することで、追加学習なしに多様な操作タスクを実現するフレームワークを提案。
- VLA-OS:視覚言語行動モデルにおける計画表現とパラダイムの構造化と分析VLA2025/6/1
VLAモデルの計画パラダイムと表現を統一的に比較するVLA-OSを提案し、視覚接地表現が言語表現より優れ、階層型VLAが性能・汎化・拡張性で優位だが速度が遅いことを示した。
- DeCo: 長期的3Dマニピュレーションにおけるゼロショット汎化のためのタスク分解とスキル合成マニピュレーション2025/5/1
模倣学習のデモを把持物体の相互作用に基づいて原子タスクに分解し、VLMで指示を解析してスキルを動的に組み合わせることで、未見の長期的3D操作タスクへのゼロショット汎化を実現するフレームワーク。
- MetaFold: 軌道生成と基盤モデルによる言語誘導型多カテゴリ衣類折り畳みフレームワークマニピュレーション2025/3/1
衣類折り畳みタスクにおいて、タスク計画と言語誘導の点群軌道生成、低レベル基盤モデルによる行動予測を分離して学習し、多カテゴリの衣類や多様な指示に適応できるフレームワークを提案した。
- TelePreview: 仮想アーム支援による使いやすい遠隔操作システム遠隔操作2024/12/1
人間の入力を基にロボット動作をリアルタイムで仮想表示し、安全かつ直感的に教示データを収集できる低コスト遠隔操作システムを提案。
- D(R,O) Grasp:ロボットと物体の相互作用を統一的に表現するクロスエンボディメント巧みな把持マニピュレーション2024/10/1
ロボットハンドの記述と物体の点群を入力とし、様々なハンドと物体形状に対応する安定した把持を高速に予測するフレームワークを提案。シミュレーションと実機で高い成功率を示した。
- 不正確なシミュレータを活用したオフライン強化学習の改善オフライン強化学習2024/5/1
不正確なシミュレータから得たデータをGANで重み付けし、限られたオフラインデータと組み合わせて強化学習の性能を向上させる手法を提案した。