Xiaomin Lin
University of South Florida
収録論文 24本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SonarVoxNet: 3Dソナーによるダイバーの3Dバウンディングボックス検出3D知覚/水中ロボティクス2026/10/1
3Dソナーの点群から、自由な姿勢をとるダイバーの9自由度の向き付き3Dバウンディングボックスを検出する手法を提案し、完全な3D姿勢ラベル付きの初の公開データセットDiver3Dを構築した。
- AquaBEV-Nav: 水中ナビゲーションと探査のための学習型BEV占有マップ水中ナビゲーション2026/9/26
単眼深度推定を介さずにRGB画像から直接BEV占有マップを予測し、水中探査の安全性と効率を高めるフレームワークを提案。
- AquaBEV: 3Dソナー監視による単眼水中BEV占有予測水中ロボティクス/BEV予測2026/9/3
水中ロボットの安全航行のため、単眼RGB画像からBEV占有マップを予測するモデルを提案。訓練時に3Dソナーを幾何学的監視として用い、キャリブレーション不要の極座標表現と因果デコードで精度を向上させた。
- 前方視ソナーと3Dソナーのキャリブレーションと比較分析による水中物体認識の向上水中認識2026/8/29
2D画像を生成する前方視ソナーと3D点群を生成する3Dソナーを組み合わせ、自動キャリブレーションとノイズフィルタリングにより特徴抽出を大幅に改善した。
- CAVE-NAV: VLMを用いた水中洞窟環境における自律3次元ナビゲーションナビゲーション2026/8/28
水中洞窟での自律ナビゲーションのために、視覚言語モデルと思考連鎖推論を用いて環境の手がかりから進行可能な方向を推定し、衝突回避を実現するフレームワークを提案した。
- uScenes: 水中ロボット知覚のためのマルチモーダルRGB・3Dソナー画像データセットデータセット2026/8/28
水中ロボットの知覚向上のため、3Dマルチビームソナー点群とRGB画像を同期したマルチモーダルデータセットuScenesを構築し公開した。
- エッジにおける具現化基盤モデル:展開制約と緩和戦略の調査エッジAI/基盤モデル2026/3/1
エッジシステムに基盤モデルを展開する際のシステム的課題を整理し、8つの結合された障壁からなる「展開ガントレット」を提案。メモリ帯域や計算レイテンシなどの制約を分析し、システム全体の協調設計の重要性を示した。
- OA-NBV: 移動ロボットによる人間中心の能動知覚のための遮蔽を考慮した次視点計画能動知覚2026/3/1
遮蔽された人物をより完全に観察できる次の移動可能な視点を自律的に選択する、遮蔽を考慮した次視点計画パイプラインを提案した。
- APPLV: 視覚言語行動モデルからの適応的プランナーパラメータ学習ナビゲーション2026/3/1
古典的プランナーのパラメータを視覚言語モデルから予測して自動調整し、高制約環境でのナビゲーション性能と汎化性を向上させる手法を提案した。
- CORAL: 水中モニタリングのための階層型VLMフレームワークにおける文脈推論と局所計画水中ロボット/VLM/ナビゲーション2026/3/1
水中環境でのオイスターリーフ監視を目的に、高次意味推論を担うVLMと低次衝突回避を担う動力学ベースプランナーを分離した階層型フレームワークCORALを提案し、探索範囲の向上と衝突削減を実現した。
- 適応的ダイナミクス計画によるロボットナビゲーションナビゲーション2025/10/1
強化学習を用いてロボットのダイナミクス特性を動的に調整し、環境の複雑さに応じて計画器が適応できるようにする手法を提案。シミュレーションと実世界実験でナビゲーションの成功率、安全性、効率が向上することを示した。
- DREAM: ドメイン認識推論による効率的な自律型水中モニタリング水中ロボット/VLA2025/9/1
VLMを活用し、事前位置情報なしで牡蠣や沈没船などの対象を探索・監視する水中ロボットの自律フレームワークを提案し、従来手法より少ないステップで広範囲をカバーできることを示した。
- EDEN: 内嗅皮質に着想を得た自己中心ナビゲーションのロボット実装ナビゲーション2025/6/1
哺乳類の内嗅皮質-海馬系に着想を得て、グリッドセル表現と強化学習を組み合わせ、視覚・運動センサのみで経路統合とゴール指向ナビゲーションを行うフレームワークEDENを提案し、シミュレータで高成功率を達成した。
- AAM-SEALS: 海・空・陸を横断する空中水中マニピュレータのためのシミュレータsim2real2024/12/1
空・水・陸をシームレスに移動して作業できる空中水中マニピュレータ(AAM)向けに、粒子法による流体力学を組み込んだフォトリアルな統合シミュレータを開発し、実機との位置追従誤差比較でその忠実度を検証した。
- ViewActive: 単一画像からの能動的視点最適化視点最適化2024/9/1
1枚の2D画像から3D視点品質場を予測し、ロボットが最適な観測視点を能動的に選べるようにする軽量ネットワークを提案。
- 不変拡張カルマンフィルタを用いた水中ロボットの自己位置推定による3次元水質マッピング水中ロボット/自己位置推定2024/9/1
GPSと水質センサを搭載したBlueROV2で、不変拡張カルマンフィルタにより位置補正しながら浅水域の3次元水質マップを作成する手法を提案し、カキ養殖場で実証した。
- ODYSSEE: エッジ電子機器上のセンサシステムによるカキ検出水中ロボティクス2024/9/1
Stable Diffusionで実データを水増しし、YOLOv10ベースのモデルを水中ロボットのエッジ環境で動かしてカキを検出、mAP@50 0.657を達成した研究。
- MARVIS: 動きと幾何学を考慮した実像・虚像セグメンテーションセグメンテーション2024/3/1
水面での反射・屈折による実像と虚像を、動きと幾何学の情報を活用して高精度に領域分割する手法を提案し、シミュレーションと実世界の両方で再学習なしに機能することを示した。
- UIVNAV: Underwater Information-driven Vision-based Navigation via Imitation Learning2023/9/1
- Detecting Olives with Synthetic or Real Data? Olive the Above2023/8/1
- Whale Detection Enhancement through Synthetic Satellite Images2023/8/1
- ChatSim: Underwater Simulation with Natural Language Prompting2023/8/1
- SeaDroneSim: Simulation of Aerial Images for Detection of Objects Above Water2022/10/1
- OysterSim: Underwater Simulation for Enhancing Oyster Reef Monitoring2022/9/1