Yu She
収録論文 39本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PHR-VLA: 視覚言語行動モデルのための計画地平推論VLA2026/8/27
将来の観測から得た潜在ダイナミクスをVLAの内部表現に整列させる補助ヘッドを導入し、接触を伴う細かい操作タスクの成功率を向上させた。
- VTAPグリッパー:指先センシングと視覚触覚アクティブパームの融合による器用な手内操作マニピュレーション2026/7/1
指先の触覚アレイセンサと可動式の視覚触覚パームを備えたグリッパーを開発し、指とパームの協調と多感覚フィードバックにより、把持から微細な操作までを実現した。また、人間の手の動きを3本指構造にマッピングする段階的リターゲティング手法を提案し、複数の難易度の高い操作タスクで性能を実証した。
- TAC-LOCO: 触覚情報を活用した四足ロボットの全身ロコ操作の統合制御ロコ操作/触覚/強化学習2026/7/1
四足ロボットの動的ロコ操作において、触覚センサからの情報を潜空間表現に圧縮し、脚・腕・グリッパの統合制御に組み込む強化学習フレームワークを提案。実機でゼロショット展開し、把持力の低減と物体落下率の抑制を実証した。
- MVP-Tac: ロボット支援低侵襲手術のための小型化された視覚・光弾性触覚センサ触覚センサ2026/7/1
視覚と触覚を共存させる小型触覚センサを開発し、腫瘍触診や内視鏡検査での硬さ分類を高精度で実証した。
- 触覚を想像する:想像された触覚表現による触覚情報を活用した操作マニピュレーション2026/7/1
触覚センサーを使わずに、視覚と自己受容感覚から触覚観測を予測し、その予測信号で操作ポリシーを導くフレームワークTacImagを提案。シミュレーションと実世界のタスクで性能向上を確認した。
- シミュレーションから実世界へ:ロボットイチゴ収穫のための実地6Dポーズデータセットとベースライン6Dポーズ推定/農業ロボティクス2026/6/9
実際の農場で収集した初のイチゴ6Dポーズ実データセットを提供し、シミュレーションとのギャップを定量化してベースライン性能を示した論文。
- 接触豊富な操作における視覚-触覚世界モデルの重要要素:ContactWorld操作2026/6/1
接触を伴う操作タスクにおける視覚-触覚世界モデルの性能を、12種類のタスクで体系的に比較し、空間構造と時間連続性を持つ表現(特に点群と触覚力場)が計画性能を向上させることを示した。
- DREAM-Chunk: 潜在世界モデルによるリアクティブなアクションチャンキングVLA2026/6/1
アクションチャンキング方式のポリシーに軽量な潜在世界モデルを追加し、テスト時に複数の候補チャンクの未来を予測して最適なものを選択することで、確率的な環境下でのロバスト性を向上させる手法を提案した。
- 残差潜在アクションによる視覚特徴ベース世界モデルの学習世界モデル2026/5/1
視覚特徴ベースの世界モデルにおいて、DINO残差から学習可能な新しい潜在アクション表現(RLA)を導入し、フローマッチングで予測することで、既存手法より高速かつ高精度な未来予測を実現した。さらに、ロボット学習への応用として、アクションなし動画からの行動学習や、オフライン動画のみで学習する視覚RLフレームワークを開発した。
- 触覚を活用した四脚ロボットの移動操作ポリシー学習移動操作/触覚/強化学習2026/4/1
四脚ロボットの移動操作において、視覚と自己受容感覚に加えて触覚情報を活用する階層的ポリシー学習手法を提案。実世界の人間デモから触覚条件付き高レベルポリシーを学習し、シミュレーションでの大規模強化学習により全身制御ポリシーを獲得し、実世界へゼロショット転送する。接触を伴うタスクで平均28.54%の性能向上を達成。
- いつ見て、いつ感じるかを学ぶ:接触を考慮した操作のための適応的視覚・トルク融合マニピュレーション2026/4/1
接触を伴う操作タスクで、非接触時は視覚のみを使い、接触時のみ力覚情報を適応的に活用する融合戦略を提案し、拡散ベースの操作ポリシーで既存手法より成功率を14%向上させた。
- 接触認識型タクタイル学習によるロボット分解作業触覚/分解作業2026/3/1
ロボット分解作業における触覚センシングの役割を、シミュレーションと実世界の両方で体系的に調査し、力場表現の触覚情報が視覚のみやRGB触覚画像よりも高い成功率を示すことを明らかにした。
- EquiBim: 両腕操作のための対称性等変ポリシー学習両腕操作2026/3/1
両腕ロボットの対称性を活用し、観測と行動の間に両側等変性を課すポリシー学習フレームワークを提案。シミュレーションと実機で性能を検証した。
- TacVLA: 接触認識型触覚融合による堅牢な視覚言語行動操作VLA/触覚/操作2026/3/1
視覚と言語に依存するVLAモデルに触覚を統合し、接触検出時のみ触覚トークンを活性化するゲーティング機構を導入して、細かい操作や視覚遮蔽下での性能を向上させた。
- MuxGel:空間多重化と深層再構成による視覚・触覚の同時デュアルモーダルセンシング触覚2026/3/1
チェッカーボード状の被膜で触覚領域と透明窓を交互に配置し、単一カメラで外部視覚と接触触覚を同時取得するGelSight型センサを提案。U-Net再構成で密な視覚・触覚信号を復元する。
- イモムシに着想を得たバネ式圧縮連続体ロボットによるブラシ触覚探索連続体ロボット/触覚2026/3/1
イモムシの動きと感覚にヒントを得て、バネと腱で駆動する小型連続体ロボットを開発し、人工ブラシ触覚センサで狭所の表面知覚と探索を実現した。
- 二足歩行ロボットのための柔らかい表面を持つ視覚ベース触覚センサ触覚2026/2/1
柔らかい変形層と視覚センサを組み合わせた足裏触覚センサを開発し、接触位置・姿勢、せん断、圧力中心、地形分類を推定して、二足歩行ロボットのバランス制御と地形認識を向上させた。
- PLanAR: 計画言語に基づくエージェント推論によるロボットマニピュレーションマニピュレーション2026/2/1
VLMの推論空間を計画言語で定義し、各行動後にシンボリックな効果を検証して失敗検出と再計画を行う、長期的なオープンボキャブラリ操作のためのロボットエージェントフレームワーク。
- CompliantVLA-adaptor:VLM誘導可変インピーダンスによる安全な接触リッチマニピュレーションマニピュレーション2026/1/1
VLAモデルにVLMが解釈したタスク文脈で可変インピーダンス制御を適応させ、力覚フィードバックで安全性を確保することで、接触を伴うマニピュレーションの成功率と安全性を向上させた。
- EquiForm: 3D点群からのノイズに頑健なSE(3)同変方策学習マニピュレーション2026/1/1
点群ノイズによる同変性の崩れを幾何デノイジングと同変コントラスト整合で補正し、ノイズに頑健なSE(3)同変マニピュレーション方策を学習する手法を提案。
- 接触を伴うロボットタスクの安全な学習:古典的手法から安全な基盤モデルまでのサーベイ安全学習2025/12/1
接触を伴うロボットタスクにおける安全な学習手法を、安全な探索と安全な実行の二軸で整理し、制約付き強化学習やCBFなどの古典的手法からVLM/VLA基盤モデルへの拡張までを概観したサーベイ。
- ChicGrasp: 繊細で不規則な生体物を操作するための模倣学習に基づくカスタム双顎グリッパ制御マニピュレーション2025/5/1
鶏の脚を把持して吊り下げコンベアに載せる作業を自動化するため、双顎空気圧グリッパと条件付き拡散ポリシーを組み合わせたシステムを開発し、50回の遠隔操作デモから学習して40.6%の成功率を達成した。
- 正準ポリシー:SE(3)同変ポリシーのための正準3D表現学習模倣学習2025/5/1
3D点群を正準表現にまとめることで、物体・配置・視点の変化に強いSE(3)同変な模倣学習ポリシーを実現した研究。
- ManiFeel: 視触覚マニピュレーション方策学習のベンチマークと理解視触覚マニピュレーション2025/5/1
接触が多い・視覚的に難しい操作タスク向けに、視触覚方策学習を体系的に評価できる再現可能なシミュレーションベンチマークManiFeelを提案し、触覚が方策性能をどう高めるかを実験的に示した。
- DiffOG: 汎化可能な微分可能ポリシー軌道最適化マニピュレーション2025/4/1
模倣学習による視覚運動ポリシーの出力軌道を、Transformerを用いた微分可能な最適化層で滑らかかつ制約遵守的に改善する手法を提案し、シミュレーション11タスクと実機2タスクで有効性を示した。
- 接触知覚と把持のための磁気駆動型ビジョンベースひげアレイ触覚2025/3/1
8本のひげを円形に配置し、電磁石と永久磁石で駆動、カメラで動きを追跡する触覚センサを開発し、物体分類と把持実験で有効性を示した。
- VILP: 潜在動画プランニングによる模倣学習模倣学習2025/2/1
潜在動画拡散モデルで時間的に整合した予測動画を生成し、それを用いた模倣学習によりロボット方策を効率的に学習する手法を提案した論文。
- UniT: 未知物体にも汎化するデータ効率の良い触覚表現学習触覚2024/8/1
単一の簡単な物体から得た触覚画像のみでVQGANベースの触覚表現を学習し、未知物体へのゼロショット転移や操作方策学習で高い性能を示した手法。
- SeeBelow: 手術ロボットの触診と触覚探索による皮下腫瘍の3次元再構成触覚2024/8/1
手術支援ロボットに触覚フィードバックを組み込み、視覚誘導とベイズ最適化で触診位置を選び、100回未満の触診で多層組織内の硬い皮下腫瘍の3次元形状を再構成した。
- 5自由度触覚グリッパによる把持内分離とすくい操作触覚2024/8/1
GelSight触覚センサを統合した2本指5自由度グリッパを設計し、粒状媒体中の物体の分離・分類と狭所でのカードのすくい挿入を実現した。
- Feelit: 柔軟形状ディスプレイと視覚触覚センサを組み合わせたリアルタイム遠隔触覚提示触覚2024/8/1
視覚ベース触覚センサの高解像度3D情報をリアルタイムで再現する低コストな遠隔触覚デバイスFeelitを開発した。ピンベース形状ディスプレイと柔軟機構を組み合わせ、せん断変位と回転も提示できる。
- LeTac-MPC:触覚反応型把持のためのモデル予測制御の学習触覚2024/3/1
視覚ベース触覚センサGelSightと微分可能なMPC層を組み合わせ、物体の物性に応じて把持を適応制御する学習型モデル予測制御を提案。標準ブロックのみで学習しながら多様な日用品に汎化し、動的・力相互作用タスクで高い性能を示した。
- LeTO: Learning Constrained Visuomotor Policy with Differentiable Trajectory Optimization2024/1/1
- Robot Tape Manipulation for 3D Printing2024/1/1
- Visuotactile Affordances for Cloth Manipulation with Local Control2022/12/1
- Learning Generalizable Vision-Tactile Robotic Grasping Strategy for Deformable Objects via Transformer2021/12/1
- GelSight Wedge: Measuring High-Resolution 3D Contact Geometry with a Compact Robot Finger2021/6/1
- Exoskeleton-covered soft finger with vision-based proprioception and tactile sensing2019/10/1
- Cable Manipulation with a Tactile-Reactive Gripper2019/10/1