Ramesh Karri
収録論文 6本 ・ フィジカルAI/ロボット学習
デジタルツインVLA把持
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- サイバーフィジカルシステム向けサンドボックス対応デジタルツインデジタルツイン2026/6/15
制御器の未変更バイナリをLinuxサンドボックスで実行し、外部プラントシミュレータと接続する閉ループデジタルツインを構築。内部実行とプラント状態を同期記録し、脆弱性検出やテストの基盤を提供する。
- BOP-ASK:視覚言語モデルのための物体インタラクション推論VLA2025/11/1
6D物体姿勢データを活用し、把持姿勢や経路計画などの細かい空間推論を問う15万枚・3300万QAペアの大規模データセットBOP-ASKを構築し、VLMの物体インタラクション理解を評価・訓練する。
- MapleGrasp: マスク誘導特徴プーリングによる言語駆動型効率的ロボット把持把持2025/6/1
言語指示とRGB-D画像から把持姿勢を予測する際、CLIP特徴からセグメンテーションマスクを予測しその内部で特徴をプーリングすることで計算効率と精度を向上させ、大規模データセットRefGraspNetも提案した研究。
- 3D CAVLA: 奥行きと3Dコンテキストを活用した未見タスクへの汎化を実現する視覚言語行動モデルVLA2025/5/1
VLAモデルにChain-of-Thought推論、深度認識、関心領域検出を組み込み、未見タスクへの汎化性能を向上させたフレームワークを提案。
- HiFi-CS: 視覚言語モデルを用いたロボット把持のためのオープン語彙視覚的グラウンディングVLA2024/9/1
画像とテキストの埋め込みを階層的に融合する軽量デコーダで、複雑な指示文から把持対象を高精度に特定し、7自由度アームでの実機実験で90.33%の精度を達成した。
- Grounding LLMs For Robot Task Planning Using Closed-loop State Feedback2024/2/1