Siqi Yang
収録論文 4本 ・ フィジカルAI/ロボット学習
ナビゲーション音声・映像編集マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SPW-Nav: 言語誘導ナビゲーションのためのストリーミングパノラマワールドモデルナビゲーション2026/10/6
単一のパノラマ画像から、言語指示に従って2K 360度ビデオをリアルタイムでストリーミング生成するパノラマワールドモデルを提案。
- 指示に基づく音声・映像同時編集フレームワークInstructAV2AV音声・映像編集2026/5/18
指示文に従って音声と映像を同時に編集する初のエンドツーエンドフレームワークを提案し、大規模データセットと新しい注意機構で高品質な編集を実現した。
- UAVのための視覚・言語ナビゲーション:進展、課題、研究ロードマップナビゲーション2026/4/1
UAVが人間の高レベルな指示を解釈し複雑な3D環境で長期的なタスクを実行するための視覚・言語ナビゲーション(UAV-VLN)に関する包括的なサーベイ論文。技術の進化を分類し、シミュレーションから実世界への適用における課題を分析し、将来の研究ロードマップを提案している。
- RiEMann: 点群セグメンテーション不要の準リアルタイムSE(3)同変ロボットマニピュレーションマニピュレーション2024/3/1
シーン点群から対象物をセグメンテーションせずに直接操作目標姿勢を予測するSE(3)同変な模倣学習フレームワークを提案し、5〜10回のデモで学習して未知のSE(3)変換や妨害物体に頑健、準リアルタイムで動作することを示した。