Iana Zhura
収録論文 14本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FlockDiffusion: 割当条件付き拡散モデルによるマルチドローンタスク割当と完了群制御2026/9/20
シーングラフエンコーダと拡散トランスフォーマを組み合わせ、複数ドローンのタスク割当と経路生成を高速かつ低コストで行う学習フレームワークを提案。
- AcousticDiffusion: 意味条件付き音響誘導拡散ポリシーによる救助支援音響ナビゲーション2026/9/18
音声認識とマイクアレイの到来方向推定を統合し、拡散モデルで経路を生成する音響誘導ナビゲーション手法を提案。四足歩行ロボットに実装し、救助者への接近性能を向上させた。
- ZeroTouch: 触覚教師あり視覚接触推定による接触リッチマニピュレーション触覚2026/9/18
訓練時のみ触覚を教師信号として使い、展開時は手首カメラ映像から接触変形・6軸力・把持圧縮目標を推定する枠組みを提案し、物体把持タスクで高い成功率を達成した。
- SmellDiffusion: 嗅覚シーングラフを用いた拡散モデルベース四足歩行ナビゲーション歩行2026/9/17
ガス漏れ源への四足ロボットナビゲーションのため、開語彙の嗅覚シーングラフと拡散プランナを組み合わせ、ピーク位置のずれを幾何ゲートで補正する手法を提案。
- GeminiPainter: 知覚・認知・計画・行動の各段階からなるシーケンス型パイプラインロボットアート2026/8/1
リアルタイム顔検出、AIによるスケッチ生成、ロボット描画を統合した自律的な肖像画生成システムを提案し、ユーザー評価で高い満足度を得た。
- 蒸留型視覚言語信頼性ガイド付き拡散モデルによる空中ナビゲーションナビゲーション2026/6/1
UAVの自律ナビゲーション向けに、観測の信頼性を考慮した拡散ベースの経路生成プランナーを提案。視覚言語モデルから蒸留した信頼性ヒートマップで不確実領域を検出し、ESDFコストで物理障害物と同等に扱うことで、衝突率を大幅に低減した。
- DiffusionAnything: 統一ナビゲーションと把持前動作のためのエンドツーエンド・インコンテキスト拡散学習VLA/ナビゲーション/マニピュレーション2026/3/1
RGB画像のみから、メートル規模のナビゲーションとセンチメートル規模のマニピュレーションを単一モデルで計画する拡散ポリシーを提案。タスクごとに5分の自己教師ありデータで学習し、未知シーンへのゼロショット汎化を実現する。
- DreamToNav: 生成ビデオ計画によるロボットの汎用ナビゲーションナビゲーション2026/3/1
生成ビデオモデルを計画エンジンとして使い、自然言語指示からロボットの動作を合成し、その映像から軌道を抽出して実機で実行するナビゲーションフレームワークを提案した。
- HumanDiffusion: 捜索救助UAVのための人間条件付き目標を持つ視覚ベース拡散軌道プランナVLA2026/1/1
RGB画像から人間を検出し、拡散モデルで人間を考慮したナビゲーション軌道を生成する軽量プランナを提案し、救助UAVの実環境タスクで80%の成功率を示した。
- EmbodiedDiffusion:異種ロボットナビゲーションのための走行可能性誘導型視覚拡散モデルナビゲーション2025/12/1
RGB画像から走行可能性マップと軌道を同時に生成する拡散ベースの枠組みを提案し、プランナー不要で異種ロボットへの迅速な適応を実現した。
- SharpSLAM: 高速ドローン向けブレ除去を備えた3Dオブジェクト指向ビジュアルSLAMSLAM2024/10/1
高速移動するドローンの画像ブレを除去することで、オブジェクト指向SLAMの位置推定・マッピング・物体再構成の精度を向上させる手法を提案した。
- LocoNeRF: A NeRF-based Approach for Local Structure from Motion for Precise Localization2023/10/1
- NeuroSwarm: Multi-Agent Neural 3D Scene Reconstruction and Segmentation with UAV for Optimal Navigation of Quadruped Robot2023/8/1
- HyperDog: An Open-Source Quadruped Robot Platform Based on ROS2 and micro-ROS2022/9/1