Cheston Tan
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA触覚
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SphMind: 360度カメラを用いた学習不要のVLMベース全方位空間推論フレームワークVLA2026/9/27
360度カメラの歪みや不連続性に対応するため、意味理解と幾何推論を分離し、球面調和空間グラフと推論時幾何接地でMLLMを再学習なしに全方位空間推論へ適応させる手法を提案。
- 視覚-言語-行動モデルの未来を導く10の未解決課題VLA2025/11/1
VLAモデルの発展における10の主要マイルストーンと新たな研究動向を議論し、今後の研究方向に注目を促す論文。
- FailSafe: VLAモデルの失敗推論と回復VLA2025/10/1
VLAモデルが実行中に遭遇する失敗を検出し、回復動作を生成できるようにする失敗生成・回復システムFailSafeを提案し、LLaVA-OV-7Bを微調整してロボットアームの失敗検出・回復性能を向上させた。
- RoboPack: 触覚情報を活用した動力学モデルによる高密度パッキング触覚2024/7/1
視覚と触覚を組み合わせたリカレントグラフニューラルネットワークで物体状態を推定し、モデル予測制御により非把持操作や高密度パッキングを実現する手法を提案。
- Robustness of Utilizing Feedback in Embodied Visual Navigation2023/3/1
- Efficient Robotic Task Generalization Using Deep Model Fusion Reinforcement Learning2019/12/1
- 6D Pose Estimation with Correlation Fusion2019/9/1