Hamidreza Kasaei
収録論文 38本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 多障害物環境での安全な物体投擲の学習投擲/強化学習2026/7/1
ロボットが障害物を避けながら目標のかごに物体を投げ入れる問題を扱い、ポテンシャル場表現を用いた強化学習で成功率90%を達成した。
- 単一の人間動画から汎化可能な両手視覚運動方策を学習するParse-Augment-Distill模倣学習2025/9/1
1本の人間動画をキーポイント動作軌道に変換し、シミュレータなしで両手タスク・動作計画により大規模拡張し、キーポイント条件付き方策へ蒸留することで、汎化可能な両手ロボット方策を学習する手法を提案。
- 強化学習ベース制御器を組み合わせたマニピュレータ向け高速軌道計画マニピュレーション2025/9/1
タスク空間での視覚ベース経路計画と関節空間での強化学習による障害物回避を組み合わせ、マニピュレータの高速な無衝突軌道計画を実現した研究。
- LM-MCVT: 軽量マルチモーダル・マルチビュー畳み込みVision Transformerによる3D物体認識3D物体認識2025/4/1
複数視点の画像をエントロピー基準で統合する軽量な畳み込みVision Transformerを提案し、合成・実世界の3D物体認識で高精度を達成した。
- 大型扁平物体把持のための双腕協調学習マニピュレーション2025/4/1
強化学習を用いて双腕ロボットの協調動作を学習し、本やキーボードのような大型扁平物体を追加動作なしで把持できるようにした。
- 模倣学習による収穫ロボットの視点計画強化:遮蔽への対処模倣学習/視点計画2025/3/1
Transformerを用いた行動チャンキング(ACT)で専門家の実演からカメラ視点の6自由度運動方策を学習し、作物の遮蔽を避けて撮影できる視点計画手法を提案。シミュレーションと実機で有効性を検証した。
- 密集クラッタ環境における双腕プッシュ・把持シナジーの学習マニピュレーション2024/12/1
密集した clutter 環境で対象物を把持するため、視覚入力から双腕のプッシュと把持の協調動作を階層型深層強化学習で学習するフレームワークを提案。
- VLN-Game: 視覚言語均衡探索によるゼロショット意味的ナビゲーションナビゲーション2024/11/1
事前学習済み視覚言語特徴と3D再構成を統合した物体中心の空間マップを構築し、ゲーム理論的視覚言語モデルで言語記述に最も合致する対象を選定することで、未知環境でのゼロショット物体・言語ナビゲーションを実現した。
- ManiSkill-ViTac 2025:視覚と触覚を用いたマニピュレーション技能学習チャレンジ触覚2024/11/1
触覚と視覚を融合させた接触の多いマニピュレーション技能学習を競うチャレンジを開催し、触覚操作・視触覚融合・触覚センサ設計の3部門で評価する。
- ロボットいちご収穫のための単発6DoF姿勢・3Dサイズ推定マニピュレーション2024/10/1
合成データで学習した深層学習モデルにより、いちごの6DoF姿勢と3Dサイズを単一ショットで推定し、実世界の収穫タスクへの有効性を示した。
- HMT-Grasp: 混雑環境におけるロボット把持のためのハイブリッドMamba-Transformer手法マニピュレーション2024/10/1
Vision Mambaと並列畳み込み-Transformerブロックを統合し、局所・大域特徴を同時に捉えることで、混雑環境でのロボット把持精度を向上させる手法を提案した。
- PANav: 視覚言語モデルによるプライバシー配慮型ロボットナビゲーションナビゲーション2024/10/1
視覚言語モデルを活用し、人間が活動する環境でロボットがプライバシーに配慮して経路計画を行うフレームワークを提案。A*で候補経路を生成し、VLMが最適経路を推論する。
- VITAL: 視覚的ヒューマン・イン・ザ・ループ修正による対話的少数ショット模倣学習模倣学習2024/7/1
少数の実演をシミュレーションで大規模にデータ拡張し、人間による視覚的修正を組み込むことで、ロボットの模倣学習ポリシーを頑健かつ汎用的に学習させる手法を提案した。
- 物体中心事前分布を用いた3D特徴蒸留3Dビジョン言語2024/6/1
単視点RGB-Dから物体中心の事前分布を活用して3D CLIP特徴を蒸留し、言語による3Dグラウンディングとセグメンテーション精度を向上させる手法を提案。
- 大規模視覚言語モデルによるオープンワールド把持マニピュレーション2024/6/1
大規模視覚言語モデルとセグメンテーション・把持生成モデルを組み合わせ、オープンな言語指示からゼロショットで物体を把持するパイプラインOWGを提案した論文。
- 生涯ロボットライブラリ学習:言語モデルによる身体性制御のための組み合わせ可能で汎化可能なスキルのブートストラップマニピュレーション2024/6/1
LLMを用いたロボット制御において、スキルライブラリを生涯にわたり自律的に拡張し、複雑化する操作タスクに対応するエージェントLRLLを提案。記憶モジュールや自己探索、スキル抽象化、人間によるブートストラップを組み合わせ、シミュレーションで有効性を示した。
- Harnessing the Synergy between Pushing, Grasping, and Throwing to Enhance Object Manipulation in Cluttered Scenarios2024/2/1
- Language-guided Robot Grasping: CLIP-based Referring Grasp Synthesis in Clutter2023/11/1
- Co-NavGPT: Multi-Robot Cooperative Visual Semantic Navigation Using Vision Language Models2023/10/1
- Learning Perceptive Bipedal Locomotion over Irregular Terrain2023/4/1
- L3MVN: Leveraging Large Language Models for Visual Target Navigation2023/4/1
- Frontier Semantic Exploration for Visual Target Navigation2023/4/1
- Instance-wise Grasp Synthesis for Robotic Grasping2023/2/1
- Enhancing Interpretability and Interactivity in Robot Manipulation: A Neurosymbolic Approach2022/10/1
- GraspCaps: A Capsule Network Approach for Familiar 6DoF Object Grasping2022/10/1
- Early or Late Fusion Matters: Efficient RGB-D Fusion in Vision Transformers for 3D Object Recognition2022/10/1
- IPPO: Obstacle Avoidance for Robotic Manipulators in Joint Space via Improved Proximal Policy Optimization2022/10/1
- Throwing Objects into A Moving Basket While Avoiding Obstacles2022/10/1
- Lifelong Ensemble Learning based on Multiple Representations for Few-Shot Object Recognition2022/5/1
- Self-Supervised Learning for Joint Pushing and Grasping Policies in Highly Cluttered Environments2022/3/1
- Lifelong 3D Object Recognition and Grasp Synthesis Using Dual Memory Recurrent Self-Organization Networks2021/9/1
- Simultaneous Multi-View Object Recognition and Grasping in Open-Ended Domains2021/6/1
- Self-Imitation Learning by Planning2021/3/1
- MVGrasp: Real-Time Multi-View 3D Object Grasping in Highly Cluttered Environments2021/3/1
- MORE: Simultaneous Multi-View 3D Object Recognition and Pose Estimation2021/3/1
- 3D_DEN: Open-ended 3D Object Recognition using Dynamically Expandable Networks2020/9/1
- Accelerating Reinforcement Learning for Reaching using Continuous Curriculum Learning2020/2/1
- OrthographicNet: A Deep Transfer Learning Approach for 3D Object Recognition in Open-Ended Domains2019/2/1