Raktim Gautam Goswami
収録論文 7本 ・ フィジカルAI/ロボット学習
探索マニピュレーション模倣学習姿勢推定ナビゲーション位置認識
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VANDERER: 未来予測と視覚的好奇心に基づく拡散ポリシーによる地図不要の探索探索2026/6/12
単眼カメラのみを用いて、視覚的好奇心モジュールで拡散ポリシーを誘導し、地図なしで環境を効率的に探索するフレームワークを提案した。
- オブジェクト中心の世界モデルと拡散ポリシーの統合:多段階ロボットタスクのための階層的フレームワークマニピュレーション2026/6/1
多段階のロボット操作タスクを解決するため、高レベル世界モデルで実行時に実現可能なサブゴールを計画し、低レベル拡散ポリシーで実行する階層的フレームワークWorldDPを提案した。
- 人間の動画から巧みな手と物体の相互作用を学習する世界モデルマニピュレーション2025/12/1
一人称視点の人間動画から指のキーポイントを抽出し、巧みな手の動作を予測する世界モデルDexWMを提案。補助的な手の一貫性損失により、Franka PandaとAllegroグリッパーでのゼロショット転移でDiffusion Policyを50%以上上回る。
- OSVI-WM: ワールドモデル誘導軌道生成による未見タスクのワンショット視覚模倣模倣学習2025/5/1
世界モデルを用いて専門家動画から潜在軌道を予測し、物理ウェイポイントに変換することで、未見タスクでもワンショット視覚模倣を可能にするフレームワークを提案。
- RoboPEPP: 埋め込み予測事前学習による視覚ベースのロボット姿勢・関節角度推定姿勢推定2024/11/1
ロボットの物理モデル情報をマスキング自己教師あり学習でエンコーダに組み込み、遮蔽や切断に強い姿勢・関節角度推定を実現した手法。
- 実世界自律ロボットナビゲーションのためのオープンアーキテクチャなエンドツーエンドシステムナビゲーション2024/10/1
四足歩行ロボットにROS2ベースのシステムを実装し、オンボードセンサとオープン語彙の意味情報を統合した階層的シーングラフを構築、LLMプランナで自然言語指示に基づく実世界ゼロショット自律ナビゲーションを88%以上の成功率で実現した。
- SALSA: LiDAR位置認識のための高速適応型軽量自己注意機構位置認識2024/7/1
LiDAR点群の位置認識を高速・軽量に行うSALSAを提案。球面窓注意と適応型自己注意で局所記述子を集約し、リアルタイムで既存手法を上回る。