Shahram Najam Syed
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- すべての層を微調整する必要はない:視覚言語行動モデルにおける適応の診断と誘導VLA2026/9/16
VLAモデルの領域ごとの適応コストを診断し、可変ランクLoRAを配分して効率的に微調整する手法を提案。
- 階層的スキル検索による視覚言語行動モデルのデータ効率的適応VLA2026/8/25
長期的な操作タスクを階層的に分解し、サブタスクの言語検索と行動特徴の再ランキングを組み合わせて関連デモを検索することで、少数のデモでもVLAモデルを効率的に適応させる手法を提案した。
- 失敗を活かす再試行:テスト時回復と継続的ポリシー改善のためのFARフレームワークロボット学習2026/7/1
ロボットがテスト時に失敗から学習し、再試行で行動を適応させて自律的にタスクを完了するフレームワークFARを提案。失敗データを用いた選好学習と軽量な行動摂動により成功率を向上させる。
- 未来を先取りする:動的VLA操作のための潜在空間予測世界モデルVLA/動的操作2026/6/1
物体が動く環境での操作を可能にするため、凍結したVLAモデルに動きを考慮した潜在世界モデルを追加し、将来の特徴を予測してから行動する手法を提案した。
- ウィグル&ゴー!ゼロショット動的ロープ操作のためのシステム同定操作2026/4/1
ロープの動きを観察して物理パラメータを推定し、そのパラメータを用いて最適化によりロボットの動作を予測することで、実世界でゼロショットの動的ロープ操作を可能にする2段階フレームワークを提案した。
- 大規模単眼3D再構成のための深度・姿勢・局所放射輝度場の統合学習3D再構成2025/12/1
単眼動画から深度・カメラ姿勢・局所的なNeRF表現を同時に学習し、大規模シーンでも高精度な3D再構成と新規視点合成を実現する手法を提案。
- ExpReS-VLA: 経験再生と検索による視覚言語行動モデルの特化VLA2025/11/1
事前学習済みVLAモデルを、圧縮した経験再生バッファと検索拡張生成で破滅的忘却を防ぎつつ展開環境に高速適応させる手法。
- 視覚音響融合による手姿勢と接触推定触覚2025/8/1
骨伝導スピーカーと圧電マイクを手に装着し、音響信号とRGB-D画像をグラフ注意ネットワークで統合することで、遮蔽や静的な接触時でも高精度に手の姿勢と接触を推定するウェアラブルシステムを提案。
- SuperPoint-SLAM3: 深層特徴・適応的NMS・学習ベースループ閉じ込みによるORB-SLAM3の強化SLAM2025/6/1
ORB-SLAM3のORB特徴点を自己教師ありSuperPointに置き換え、適応的NMSとNetVLADによるループ閉じ込みを統合することで、KITTIやEuRoCで精度を大幅に向上させた。