Valerii Serpiva
収録論文 24本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AgenticSwarm: 異種マルチUAVミッションのための意味的知覚と適応的タスク割り当て群制御2026/9/18
航空画像と言語指示からミッション表現を構築し、制約付きタスク割り当てと障害発生時の再計画を統合したマルチUAVエージェントフレームワークを提案。
- AgenticDiffusion: 視覚ベースUAVナビゲーションのためのエージェント型拡散経路計画ナビゲーション2026/6/1
言語指示と複数視点(前方視点と俯瞰視点)を組み合わせ、拡散モデルによる経路計画とNMPCを統合した屋内UAVナビゲーションフレームワークを提案。実環境で80%の成功率を達成。
- 蒸留型視覚言語信頼性ガイド付き拡散モデルによる空中ナビゲーションナビゲーション2026/6/1
UAVの自律ナビゲーション向けに、観測の信頼性を考慮した拡散ベースの経路生成プランナーを提案。視覚言語モデルから蒸留した信頼性ヒートマップで不確実領域を検出し、ESDFコストで物理障害物と同等に扱うことで、衝突率を大幅に低減した。
- DreamToNav: 生成ビデオ計画によるロボットの汎用ナビゲーションナビゲーション2026/3/1
生成ビデオモデルを計画エンジンとして使い、自然言語指示からロボットの動作を合成し、その映像から軌道を抽出して実機で実行するナビゲーションフレームワークを提案した。
- 拡散モデルによるテキスト指示からの空撮シネマトグラフィドローン制御2026/1/1
自然言語の指示と機体カメラの初期画像から拡散モデルで飛行軌道を生成し、ドローンが自動でシネマティックな映像を撮影するシステムを提案した。
- HumanDiffusion: 捜索救助UAVのための人間条件付き目標を持つ視覚ベース拡散軌道プランナVLA2026/1/1
RGB画像から人間を検出し、拡散モデルで人間を考慮したナビゲーション軌道を生成する軽量プランナを提案し、救助UAVの実環境タスクで80%の成功率を示した。
- EmbodiedDiffusion:異種ロボットナビゲーションのための走行可能性誘導型視覚拡散モデルナビゲーション2025/12/1
RGB画像から走行可能性マップと軌道を同時に生成する拡散ベースの枠組みを提案し、プランナー不要で異種ロボットへの迅速な適応を実現した。
- PhysicalAgent:基盤世界モデルによる汎用認知ロボティクスの実現VLA2025/9/1
テキスト指示から拡散モデルで動画デモを生成し、ロボットで実行・失敗時に再計画する反復ループで、多様なロボットのマニピュレーション成功率を最大80%まで高めた。
- FlightDiffusion:拡散モデルによるFPV動画生成で自律ドローン訓練を革新VLA2025/9/1
単一フレームからFPV動画と行動空間を生成する拡散モデルを提案し、大規模な訓練データを合成してドローンのナビゲーション性能とsim-to-real転移を向上させた。
- VLH:視覚・言語・触覚基盤モデル触覚2025/8/1
視覚と言語の理解から空中での力覚・振動フィードバックを生成する基盤モデルVLHを提案し、ドローンとVRで人間とのインタラクション性能を評価した。
- AttentionSwarm: 動的環境におけるCrazyflieドローンのための注意制御バリア関数を用いた強化学習群制御2025/3/1
注意機構と制御バリア関数を組み合わせ、動的なドローン競争環境で衝突回避と軌道最適化を実現する群制御手法を提案し、Crazyflie 2.1で95-100%の衝突回避率を達成した。
- CognitiveDrone: UAVのリアルタイム認知タスク解決と推論のためのVLAモデルと評価ベンチマークVLA2025/3/1
ドローンの複雑な認知タスク向けに、一人称視点の画像とテキスト指示からリアルタイム4D行動指令を生成するVLAモデルと、推論モジュールを組み合わせた改良版、および認知タスク評価用ベンチマークを提案した論文。
- UAV-VLRR: 視覚言語情報を用いたNMPCによるUAV捜索救助の迅速応答VLA2025/3/1
視覚言語モデルとLLMでシーンを解釈し、障害物回避機能付き非線形モデル予測制御でドローンを飛行させる捜索救助システムを開発し、既存の自動操縦や人間のパイロットより高速な応答を実現した。
- RaceVLA: 人間らしい挙動を実現するVLAベースのレーシングドローン航法VLA2025/3/1
視覚・言語・行動(VLA)モデルをドローンレース用データセットで微調整し、人間パイロットのような適応的な航法を実現した研究。
- AgilePilot: 物体検出を活用した動的環境におけるリアルタイム経路計画のためのDRLベースドローンエージェントドローン/経路計画/DRL/sim2real2025/2/1
深層強化学習とリアルタイム物体検出を組み合わせ、動的環境でドローンが安全かつ敏捷に飛行する経路計画手法を提案し、実機で90%の成功率を達成した。
- SafeSwarm: 密集群衆下で着陸するドローン群のための分散安全強化学習群制御2025/1/1
安全学習と強化学習を組み合わせ、障害物や機体間の衝突を避けながら移動する着陸パッドへ群れで着陸する分散制御を実現し、実機実験で高精度・無衝突着陸を示した。
- Industry 6.0:生成AIと異種ロボット群が駆動する次世代産業群制御2024/9/1
自然言語の指示だけで製品設計から製造・組立までを自律的に行う完全自動生産システムを提案し、熟練開発者チームの4.4倍の速さで生産を完了できることを示した。
- GazeRace: 視線制御による遠隔ドローン操縦の革新遠隔操縦/視線制御2024/7/1
アイトラッキング技術とMediaPipeを用いて目の動きをドローン操作コマンドに変換し、遠隔操縦を可能にするシステムを開発した。従来の操作と比べて飛行経路長を18%短縮しつつ同等の速度を維持し、操作精度の向上とユーザーのストレス軽減を示した。
- OmniRace: 6自由度ハンドポーズ推定による直感的なレーシングドローン操作ドローン操作/ジェスチャー認識2024/7/1
6自由度の手のポーズ推定とジェスチャー認識により、高速レーシングドローンを直感的に低レベル制御するシステムを提案し、シミュレーションで従来より25.1%速い完走を実現した。
- FlockGPT: 言語指示でドローン群れを誘導する群制御2024/5/1
大規模言語モデルを使い、自然言語の指示からドローン群れの目標形状を生成・制御するインターフェースを開発し、ユーザー研究で直感的な操作と高い形状認識率を示した。
- SwarmPlay: Interactive Tic-tac-toe Board Game with Swarm of Nano-UAVs driven by Reinforcement Learning2021/8/1
- DronePaint: Swarm Light Painting with DNN-based Gesture Recognition2021/7/1
- SwarmPaint: Human-Swarm Interaction for Trajectory Generation and Formation Control by DNN-based Gesture Interface2021/6/1
- DroneTrap: Drone Catching in Midair by Soft Robotic Hand with Color-Based Force Detection and Hand Gesture Recognition2021/2/1