Zhouping Yin
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CableVLA: ケーブル配線のためのシミュレーション特権的グローバル・ローカル表現学習VLA2026/9/22
シミュレーションの特権情報を活用し、ケーブルのトポロジーと触覚を表現する視覚言語行動フレームワークを提案。ケーブル配線タスクの成功率を62.6%から84.9%に向上させた。
- SimpleMemVLA: 視覚言語行動モデルのためのシンプルかつ効果的なネイティブビデオメモリVLA2026/9/2
専用メモリモジュールを使わず、過去の観察をタイムスタンプ付きビデオとしてそのままバックボーンに渡すことで、長時間の操作タスクで高い性能を達成するVLAを提案した。
- FasTac: 高速・高精度な3次元形状と力覚知覚のための湾曲マルチスペクトル視覚触覚センサ触覚2026/7/1
湾曲した視覚ベース触覚センサFasTacを提案し、マルチスペクトル測光ステレオとFPGAハードウェア加速により、高速かつ高精度な3次元形状再構成と3軸力推定を実現した。
- S2M-Trek: 車輪付き脚ロボット上の単一球から複数球への輸送をフレーム毎のDeep Setsで実現移動操作2026/6/1
車輪付き四脚ロボットの背上で、フェンスやグリッパーなしに複数の自由転がり球を同時に運ぶ動的移動操作を、フレーム毎の置換不変なエンコーダ(PFDS)を用いてスケーリングする手法を提案した。
- Chronos: 非マルコフ的長期間操作のための物理情報を活用した全履歴フレームワーク操作2026/6/1
ロボットポリシーを力学系として捉え、観察履歴を状態として扱うことで、記憶依存の長期間操作を可能にするフレームワークを提案した。
- ヒューマノイドロボットの自然な視線移動を実現するフレームワークHRI2026/2/1
VLMで文脈に合った注視対象を推論し、VQ-VAEで人間らしい眼球・頭部協調の視線移動を生成するRGSフレームワークを提案。
- DeepThinkVLA:視覚言語行動モデルの推論能力を高めるVLA2025/11/1
CoTがVLAモデルに有効となる2つの条件(デコーディング整合性と因果整合性)を特定し、それに基づくハイブリッドアテンションとSFT→RLパイプラインでLIBEROやRoboTwinでの成功率を大幅に向上させた論文。
- 接触を考慮した動的最適化による全方向車輪脚型移動マニピュレータの全身運動制御移動マニピュレーション2025/9/1
全方向移動可能な車輪脚型四脚ロボットにマニピュレータを搭載し、操作と車輪-地面接触を統合した接触考慮型全身動的最適化でリアルタイム制御を実現した。
- MTIL: Mambaで全履歴を符号化する時間的模倣学習模倣学習2025/5/1
状態空間モデルMambaを使い、軌跡の全履歴を圧縮した状態に符号化することで、長期的な時間的文脈を考慮した模倣学習を実現した研究。
- GelSplitter: Tactile Reconstruction from Near Infrared and Visible Images2023/9/1