Miguel Altamirano Cabrera
収録論文 51本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Kintsugi-VLA: 失敗ロールアウトを介入的回復可能性で回復データに変換VLA2026/9/25
シミュレーションで失敗したロールアウトを、状態復元と分岐を利用して回復用の合成データに変換する枠組みを提案し、Frankaマニピュレーションで回復成功率を向上させた。
- CognitiveReality: LLMエージェントによるロボット非依存の意味的ガウスマッピングと没入型協調VRテレオペレーションVLA2026/9/25
ロボットのRGB-D映像から意味的に索引付けされたガウス-TSDFマップを生成し、VR上の操作者とツール利用型言語エージェントが共有して、音声やポインティングをロボット行動に変換するシステムを提案。2台の四足歩行ロボットで実証した。
- FlockDiffusion: 割当条件付き拡散モデルによるマルチドローンタスク割当と完了群制御2026/9/20
シーングラフエンコーダと拡散トランスフォーマを組み合わせ、複数ドローンのタスク割当と経路生成を高速かつ低コストで行う学習フレームワークを提案。
- AcousticDiffusion: 意味条件付き音響誘導拡散ポリシーによる救助支援音響ナビゲーション2026/9/18
音声認識とマイクアレイの到来方向推定を統合し、拡散モデルで経路を生成する音響誘導ナビゲーション手法を提案。四足歩行ロボットに実装し、救助者への接近性能を向上させた。
- ZeroTouch: 触覚教師あり視覚接触推定による接触リッチマニピュレーション触覚2026/9/18
訓練時のみ触覚を教師信号として使い、展開時は手首カメラ映像から接触変形・6軸力・把持圧縮目標を推定する枠組みを提案し、物体把持タスクで高い成功率を達成した。
- OmniAI: 人間とドローンの対話のための表面適応型空中投影インターフェースヒューマンロボットインタラクション2026/8/1
ドローンに搭載したレーザープロジェクタで、機体画面と周囲の環境表面に適応的に投影し、LLMによるテキストや画像応答を表示する空中エージェントを提案。RGB-DセンサとRANSAC平面推定で投影面をオンライン検出し、音声とジェスチャーで操作できる。
- GeminiPainter: 知覚・認知・計画・行動の各段階からなるシーケンス型パイプラインロボットアート2026/8/1
リアルタイム顔検出、AIによるスケッチ生成、ロボット描画を統合した自律的な肖像画生成システムを提案し、ユーザー評価で高い満足度を得た。
- ORCESTRA: 複合現実におけるVLM駆動の視覚的ロボットプログラミングHRI/プログラミング2026/8/1
複合現実環境で、ユーザーがロボットのデジタルツインを配置し、軌道を教示したり、言語で指示を与えることで、視覚言語モデルが構造化された計画に変換し、ロボットをプログラミングするシステムを提案した論文。
- AgenticFocus: 人間の一人称視点ビデオからの物体保持型MR合成による器用なヒューマノイド学習模倣学習2026/7/1
人間の一人称視点ビデオから、隠れた物体の形状復元と手の動きの再構築を行い、ヒューマノイドロボットの学習用デモを生成するMR合成パイプラインを提案した。
- AnyGoal: 視覚言語ガイドによるマルチエージェント探索を用いた訓練不要の生涯ナビゲーションナビゲーション2026/6/1
VLMを探索の中心に据え、共有ベイズ価値マップでエージェントを協調させる訓練不要のマルチロボットナビゲーション手法を提案。GOAT-BenchでSOTAを達成した。
- アクションエージェント:エージェント型ビデオ生成とフロー制約拡散の融合ナビゲーション2026/5/1
LLMによるビデオ生成とフロー制約拡散モデルを組み合わせ、複数のロボット形態でナビゲーションを実現する2段階フレームワークを提案した。
- GenerativeMPC: VLM-RAGガイドによる仮想インピーダンスを用いた全身MPCによる双腕移動マニピュレーションマニピュレーション2026/4/1
視覚言語モデルと検索拡張生成を用いて、双腕移動マニピュレータの全身MPCの制御パラメータ(速度制限や安全マージン、仮想インピーダンス)を文脈に応じて調整する階層的フレームワークを提案した。
- GraspSense: 言語誘導知覚と力マップによる器用なロボットハンドの物理的根拠に基づく把持・握力計画マニピュレーション2026/4/1
物体表面の機械的特性の不均一性を考慮し、局所的な許容接触力マップを用いて把持候補を再ランク付けし、指の剛性を調整することで安全な把持を実現するパイプラインを提案した。
- VersualRL: 視覚的実行フィードバックによる閉ループ言語強化学習を用いたタスクレベルロボット計画タスク計画2026/3/1
視覚言語モデルが実行結果を批評し、言語モデルが行動木を更新する閉ループ枠組みを提案し、実機ロボットの多段階タスクで有効性を示した。
- DiffusionAnything: 統一ナビゲーションと把持前動作のためのエンドツーエンド・インコンテキスト拡散学習VLA/ナビゲーション/マニピュレーション2026/3/1
RGB画像のみから、メートル規模のナビゲーションとセンチメートル規模のマニピュレーションを単一モデルで計画する拡散ポリシーを提案。タスクごとに5分の自己教師ありデータで学習し、未知シーンへのゼロショット汎化を実現する。
- 視覚ベース自律飛行のためのF'とROS2ハイブリッドアーキテクチャ:設計と実験的検証自律飛行2026/2/1
NASAのF'フライトソフトウェアとROS2をProtocol Buffersで連携させ、屋内クアッドコプターの視覚ナビゲーション飛行実験でリアルタイム性能と統合の堅牢性を検証した。
- DroneVLA:視覚言語行動モデルによる空中マニピュレーションVLA2026/1/1
自然言語の指示を理解するVLAモデルとGrounding DINOを組み合わせ、1自由度グリッパ付きドローンが対象物を把持し人へ受け渡すシステムを構築した。実機実験で位置推定・ナビゲーションの精度を検証した。
- Glove2UAV: 直感的なUAV操作のためのウェアラブルIMUグローブウェアラブル操作インターフェース2026/1/1
手と指のジェスチャーでUAVを直感的に操作するIMUグローブを開発し、速度閾値超過時に振動触覚警告を提示する。シミュレーションと実機飛行でリアルタイム性とコマンド実行の安定性を検証した。
- HumanoidVLM: 視覚言語ガイドによるインピーダンス制御で接触の多いヒューマノイドマニピュレーションマニピュレーション2026/1/1
視覚言語モデルとRAGを用いて、一人称視覚画像からタスクに適したインピーダンスパラメータと把持設定を選択し、Unitree G1ヒューマノイドの柔軟な操作を実現した。
- GuideTouch: 視覚障害者向け触覚フィードバック搭載の障害物回避ウェアラブルデバイス触覚2026/1/1
視覚障害者向けに、2つのToFセンサと4つの振動アクチュエータを備えた小型ウェアラブルデバイスを開発し、頭上の障害物を含む回避支援と方向提示の有効性を検証した。
- ニューロモーフィックプロセッサAltAiを用いたEMGと視線追跡による義手操作システム義手/ニューロモーフィック/EMG2026/1/1
筋電位と視線誘導の視覚情報を組み合わせ、ニューロモーフィックプロセッサ上でスパイキングニューラルネットワークを動かすことで、低消費電力かつ高精度な義手制御を実現した研究。
- HoverAI:自然な人とドローンのインタラクションを実現する身体性を備えた空中エージェント空中ロボット/対話AI2026/1/1
ドローンにレーザープロジェクタや会話AIを搭載し、音声・視覚で人を認識してリップシンク付きアバターで応答する、空間認識型の対話エージェントを開発した。
- SafeHumanoid: VLMとRAGによる人型ロボット上半身インピーダンス制御ヒューマンロボットインタラクション2025/11/1
視覚言語モデルと検索拡張生成を組み合わせ、周囲の状況や人間との距離に応じて人型ロボットのインピーダンスと速度を調整する制御パイプラインを提案し、安全性の向上を実証した。
- FlightDiffusion:拡散モデルによるFPV動画生成で自律ドローン訓練を革新VLA2025/9/1
単一フレームからFPV動画と行動空間を生成する拡散モデルを提案し、大規模な訓練データを合成してドローンのナビゲーション性能とsim-to-real転移を向上させた。
- PhysicalAgent:基盤世界モデルによる汎用認知ロボティクスの実現VLA2025/9/1
テキスト指示から拡散モデルで動画デモを生成し、ロボットで実行・失敗時に再計画する反復ループで、多様なロボットのマニピュレーション成功率を最大80%まで高めた。
- VLH:視覚・言語・触覚基盤モデル触覚2025/8/1
視覚と言語の理解から空中での力覚・振動フィードバックを生成する基盤モデルVLHを提案し、ドローンとVRで人間とのインタラクション性能を評価した。
- HapticVLM:視覚言語モデルによる触覚テクスチャ認識と知的ハプティックインタラクション触覚2025/5/1
物体の素材を画像から認識し、環境温度も推定して、振動と熱で触感を再現するマルチモーダル触覚フィードバックシステムを提案した論文。
- LLMグラス:視覚障害者ナビゲーションのための触覚フィードバック付き生成AI駆動メガネ触覚2025/3/1
YOLO-WorldとGPT-4oを組み合わせ、視覚情報を触覚パターンに変換して視覚障害者をリアルタイムに誘導するウェアラブルナビゲーションシステムを開発し、その有効性を3つの実験で検証した。
- Evolution 6.0:生成AIによるロボット進化VLA2025/2/1
VLM・VLA・テキストto3D生成モデルを組み合わせ、人間の指示に必要な道具をロボットが自律的に設計・製作し、その使い方を学習してタスクを遂行するシステムを提案。
- UAV-VLA:大規模航空ミッション生成のための視覚言語行動システムVLA2025/1/1
衛星画像とVLM・GPTを組み合わせ、テキスト指示から飛行経路と行動計画を生成するUAV向けシステムを提案。
- GazeGrasp: ウェアラブル視線インターフェースによるDNN駆動ロボット把持マニピュレーション2025/1/1
ESP32カメラとMediaPipe・YOLOv8を組み合わせ、視線で協働ロボットを操作して物体を把持する支援システムを開発し、磁気スナップ効果で作業効率を31%改善した。
- Shake-VLA: 視覚言語行動モデルによる双腕ロボットのカクテル調製システムVLA2025/1/1
視覚・音声・言語モデルを統合したVLAシステムで、双腕ロボットが材料の検出・計量・混合作業を行い、カクテルを自動調製する。
- Industry 6.0:生成AIと異種ロボット群が駆動する次世代産業群制御2024/9/1
自然言語の指示だけで製品設計から製造・組立までを自律的に行う完全自動生産システムを提案し、熟練開発者チームの4.4倍の速さで生産を完了できることを示した。
- TiltXter: ピペット遠隔操作のためのCNNによる傾斜角電気触覚レンダリング触覚2024/9/1
ロボットグリッパで把持した変形可能なピペットの傾きをCNNで推定し、その情報を電気触覚刺激として提示することで、遠隔操作の精度と成功率を向上させるシステムを提案した。
- GazeRace: 視線制御による遠隔ドローン操縦の革新遠隔操縦/視線制御2024/7/1
アイトラッキング技術とMediaPipeを用いて目の動きをドローン操作コマンドに変換し、遠隔操縦を可能にするシステムを開発した。従来の操作と比べて飛行経路長を18%短縮しつつ同等の速度を維持し、操作精度の向上とユーザーのストレス軽減を示した。
- MoveTouch: ウェアラブル触覚ディスプレイを備えたロボット動作計測システムによる安全なHRIの実現触覚2024/5/1
手首に装着するウェアラブルロボットでマーカーを保持し動作計測と振動触覚フィードバックを行い、協働作業の安全性を高めるシステムを提案し、振動パターンの認識率と応答時間を評価した。
- Bi-VLA: 視覚-言語-行動モデルによる双腕ロボットの巧みな操作システムVLA2024/5/1
視覚・言語・行動を統合したBi-VLAモデルを提案し、人間の指示からサラダ調理などの双腕家庭タスクを実行、83.4%の成功率を達成した。
- ロボットは感じられる:LLMベースのロボット倫理推論フレームワーク倫理推論2024/5/1
感情重み係数を用いて人間らしい感情をシミュレートし、ロボットに倫理的判断を行わせるLLMベースのフレームワークを開発し、8つのLLMで評価した。
- DogSurf: Quadruped Robot Capable of GRU-based Surface Recognition for Blind Person Navigation2024/2/1
- CognitiveOS: Large Multimodal Model based System to Endow Any Type of Robot with Generative AI2024/1/1
- HaptiCharger: Robotic Charging of Electric Vehicles Based on Human Haptic Patterns2023/10/1
- TeslaCharge: Smart Robotic Charger Driven by Impedance Control and Human Haptic Patterns2023/10/1
- ArUcoGlide: a Novel Wearable Robot for Position Tracking and Haptic Feedback to Increase Safety During Human-Robot Interaction2023/7/1
- MorphoArms: Morphogenetic Teleoperation of Multimanual Robot2023/7/1
- DroneARchery: Human-Drone Interaction through Augmented Reality with Haptic Feedback and Multi-UAV Collision Avoidance Driven by Deep Reinforcement Learning2022/10/1
- Exploring the Role of Electro-Tactile and Kinesthetic Feedback in Telemanipulation Task2022/8/1
- DogTouch: CNN-based Recognition of Surface Textures by Quadruped Robot with High Density Tactile Sensors2022/6/1
- CoboGuider: Haptic Potential Fields for Safe Human-Robot Interaction2021/10/1
- CoHaptics: Development of Human-Robot Collaborative System with Forearm-worn Haptic Display to Increase Safety in Future Factories2021/9/1
- DroneTrap: Drone Catching in Midair by Soft Robotic Hand with Color-Based Force Detection and Hand Gesture Recognition2021/2/1
- CobotGear: Interaction with Collaborative Robots using Wearable Optical Motion Capturing Systems2020/7/1