Selamawit Asfaw
収録論文 4本 ・ フィジカルAI/ロボット学習
自動運転VLAヒューマンドローンインタラクション3D物体検出/マルチセンサー融合
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VDT-Auto: VLM誘導拡散トランスフォーマーによるエンドツーエンド自動運転自動運転2025/2/1
視覚言語モデル(VLM)で環境を幾何的・文脈的に理解し、拡散トランスフォーマーで行動を生成するエンドツーエンド自動運転パイプラインを提案。nuScenesで平均L2誤差0.52m・衝突率21%を達成。
- Shake-VLA: 視覚言語行動モデルによる双腕ロボットのカクテル調製システムVLA2025/1/1
視覚・音声・言語モデルを統合したVLAシステムで、双腕ロボットが材料の検出・計量・混合作業を行い、カクテルを自動調製する。
- FlightAR: 複数映像ストリームと物体検出を統合した没入型ドローン操縦支援ARインターフェースヒューマンドローンインタラクション2024/10/1
ドローンのFPVカメラと底面カメラ映像をARでHMDに重畳表示し、周囲状況の把握と直感的操縦を支援するインターフェースを開発、FPVゴーグルより高いユーザ評価を得た。
- FADet: 局所特徴注意に基づくマルチセンサー3D物体検出ネットワーク3D物体検出/マルチセンサー融合2024/5/1
カメラ・LiDAR・レーダーそれぞれの特性に応じた局所特徴注意モジュールを設計し、これらを融合することで複雑な長尾シーンでも高精度な3D物体検出を実現した。