Oleg Sautenkov
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DIFF-IPPO: 拡散モデルに基づくオープンボキャブラリ信念マップを用いた情報経路計画経路計画2026/6/1
拡散モデルを用いて、非ガウス型の信念マップ上で情報利得を最大化する大域軌道を生成する経路計画手法を提案。シミュレーションの捜索救助シナリオで有効性を検証した。
- UAV-CodeAgents: マルチエージェントReActと視覚言語推論によるスケーラブルなUAVミッション計画VLA2025/5/1
LLM/VLMを活用したマルチエージェントフレームワークで、衛星画像と自然言語指示からUAVのミッションを自動生成し、火災検知タスクで93%の成功率を達成した。
- MorphoNavi: デジタルツインにおけるオブジェクト指向マッピングを用いた空陸両用ロボットナビゲーション空陸両用ロボット/ナビゲーション2025/4/1
単眼カメラのみを用いて多様な物体を検出・位置推定し、デジタルツイン上で空陸両用ロボットをナビゲートするシステムを提案。模擬災害救助シナリオで有効性を実証した。
- CognitiveDrone: UAVのリアルタイム認知タスク解決と推論のためのVLAモデルと評価ベンチマークVLA2025/3/1
ドローンの複雑な認知タスク向けに、一人称視点の画像とテキスト指示からリアルタイム4D行動指令を生成するVLAモデルと、推論モジュールを組み合わせた改良版、および認知タスク評価用ベンチマークを提案した論文。
- UAV-VLPA*:大規模環境での最適経路生成のための視覚・言語・経路・行動システム経路計画2025/3/1
衛星画像と視覚言語モデル、GPTの自然言語処理を組み合わせ、テキスト指示から飛行計画を生成するUAVシステムを提案。TSP最適化とA*による障害物回避で経路長を18.5%削減した。
- UAV-VLRR: 視覚言語情報を用いたNMPCによるUAV捜索救助の迅速応答VLA2025/3/1
視覚言語モデルとLLMでシーンを解釈し、障害物回避機能付き非線形モデル予測制御でドローンを飛行させる捜索救助システムを開発し、既存の自動操縦や人間のパイロットより高速な応答を実現した。
- RaceVLA: 人間らしい挙動を実現するVLAベースのレーシングドローン航法VLA2025/3/1
視覚・言語・行動(VLA)モデルをドローンレース用データセットで微調整し、人間パイロットのような適応的な航法を実現した研究。
- UAV-VLA:大規模航空ミッション生成のための視覚言語行動システムVLA2025/1/1
衛星画像とVLM・GPTを組み合わせ、テキスト指示から飛行経路と行動計画を生成するUAV向けシステムを提案。
- SafeSwarm: 密集群衆下で着陸するドローン群のための分散安全強化学習群制御2025/1/1
安全学習と強化学習を組み合わせ、障害物や機体間の衝突を避けながら移動する着陸パッドへ群れで着陸する分散制御を実現し、実機実験で高精度・無衝突着陸を示した。
- FlightAR: 複数映像ストリームと物体検出を統合した没入型ドローン操縦支援ARインターフェースヒューマンドローンインタラクション2024/10/1
ドローンのFPVカメラと底面カメラ映像をARでHMDに重畳表示し、周囲状況の把握と直感的操縦を支援するインターフェースを開発、FPVゴーグルより高いユーザ評価を得た。
- TiltXter: ピペット遠隔操作のためのCNNによる傾斜角電気触覚レンダリング触覚2024/9/1
ロボットグリッパで把持した変形可能なピペットの傾きをCNNで推定し、その情報を電気触覚刺激として提示することで、遠隔操作の精度と成功率を向上させるシステムを提案した。
- AirTouch: Towards Safe Human-Robot Interaction Using Air Pressure Feedback and IR Mocap System2023/8/1
- CoboGuider: Haptic Potential Fields for Safe Human-Robot Interaction2021/10/1