Yang Zhou
New York University
収録論文 50本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- M3GD: カメラ-LiDARマルチモーダル・マルチビュー幾何拡散による新規視点合成新規視点合成2026/9/24
LiDARと画像の基盤モデルを組み合わせ、カメラ投影後の特徴共有構造を利用してマルチビュー拡散生成器を条件付けし、RGBと深度の新規視点合成を改善する手法を提案。
- AURORA: 自然言語駆動型エージェントフレームワークによる信頼性の高い空陸協調シミュレーションの理解・推論・オーケストレーションsim2real2026/9/17
自然言語から空陸協調シミュレーションシナリオを生成し、実行時検証と局所修復により要求された相互作用を忠実に実現するエージェントフレームワークを提案。
- SpatialCLI: 空間ツールで推論し、その後ツールなしで推論する学習VLA2026/7/30
視覚言語モデルに空間ツールを使った推論を教え、徐々にその能力を内部化させる3段階フレームワークを提案。ベンチマークで大幅な性能向上を実証した。
- 自動運転車のための縦運動を考慮した横方向制御:ロバスト非線形制御フレームワーク自動運転/横方向制御2026/7/1
縦方向の速度・加速度変化を考慮した横方向制御のためのロバスト非線形制御フレームワークを提案し、パラメータ不確かさに対してLyapunov再設計とINDIの2つのロバスト制御手法を解析・検証した。
- SUMO: 非線形状態空間モデルによる任意の動きのセグメンテーションと追跡トラッキング/セグメンテーション2026/6/29
視覚的手がかりに依存せず、ロボティクス由来の非線形状態空間モデルと選択的アンセンテッドフィルタを用いて、ゼロショットで動物体のセグメンテーションと追跡を統合するフレームワークを提案した。
- 車両プラトゥーンのための横方向ストリング安定性群制御2026/6/1
本論文は、車両プラトゥーンにおける横方向の経路追従誤差の伝播を扱う新しい枠組みを提案し、車載センサのみでは誤差減衰が不可能である一方、V2V通信により真の誤差減衰が可能になることを示した。
- 物理基盤のマルチエージェントダイナミクスベンチマーク:ワールドモデルにおけるワールドモデル2026/6/1
ワールドモデルの生成するマルチエージェント衝突シナリオの物理的妥当性を評価するフレームワークCrashTwinを提案し、既存モデルが視覚品質は高いが物理法則に反する挙動を示すことを明らかにした。
- ForgeVLA: 言語アノテーションなしの連合視覚言語行動学習VLA2026/5/8
分散した視覚・行動ペアから、言語アノテーションやデータ集約なしにVLAモデルを学習する連合学習フレームワークを提案した。
- 車両プラトゥーンの横方向ストリング安定性:定式化、定義、および解析群制御2026/5/1
本論文は、隊列走行における横方向の追従誤差の伝播を扱う横方向ストリング安定性の枠組みを提案し、弧長(オイラー的)視点に基づく定義と2つの制御戦略を解析する。
- グラフニューラル計画と予測制御による通信制約下のマルチロボット未ラベル動作計画群制御2026/5/1
マルチロボットの未ラベル動作計画問題に対し、グラフ注意プランナーと非線形モデル予測制御を組み合わせた階層的枠組みを提案し、シミュレーションと実機クアッドローター実験で有効性を示した。
- 共に飛ぶ:未知環境における航空ロボットチームのための人間誘導型没入共有制御群制御2026/5/1
VRベースの共有制御フレームワークを提案し、オペレータがドローンチームをリアルタイムで誘導しながら衝突回避と協調ナビゲーションを実現する。
- HoLoArm: 衝突に耐えるクアッドローターのための変形可能アームドローン/衝突耐性/強化学習2026/5/1
トンボの翅の結節構造に着想を得た柔軟アームを持つクアッドローターを提案し、強化学習制御により衝突後の回復と安定飛行を実現した。
- LMGenDrive: マルチモーダル理解と生成的ワールドモデルを統合したエンドツーエンド運転自動運転2026/4/1
本論文は、LLMベースのマルチモーダル理解と生成的ワールドモデルを統合した初のエンドツーエンド自動運転フレームワークLMGenDriveを提案し、将来の運転ビデオと制御信号を同時生成することで、長尾・オープンワールドシナリオへの一般化を向上させる。
- DriveDreamer-Policy: 幾何学的基盤を持つ世界行動モデルによる生成と計画の統合自動運転2026/4/1
運転タスク向けに、深度生成・将来ビデオ生成・動作計画を単一アーキテクチャで統合した世界行動モデルを提案し、閉ループ計画と世界生成の両方で高性能を達成した。
- 幾何学的有用性スコアリングによるTransformerベース単眼SLAMの高速化SLAM2026/4/1
単眼SLAMの計算冗長性を減らすため、フレームのマッピング価値を事前に予測する軽量なゲーティングネットワークLeanGateを提案し、90%以上の冗長フレームをスキップして85%以上の計算削減と5倍のスループット向上を実現した。
- NeuroMesh: 分散型マルチロボット協調のための統合ニューラル推論フレームワーク群制御2026/4/1
異種ロボット間での学習モデル展開を容易にする、統一パイプラインを持つ分散型ニューラル推論フレームワークを提案。空中・地上ロボットの協調タスクで有効性を実証した。
- NavTrust: 実世界環境における信頼性を評価する身体性ナビゲーションのベンチマークナビゲーション2026/3/1
RGB・深度・指示の現実的な劣化を体系的に与え、7つの最先端ナビゲーション手法の性能低下を明らかにし、4つの緩和策を評価した統一ベンチマークを提案。
- DrivingGen: 自動運転のための生成ビデオ世界モデルの包括的ベンチマーク自動運転/世界モデル2026/1/1
自動運転向けの生成ビデオ世界モデルを評価する初の包括的ベンチマークDrivingGenを提案し、多様なデータセットと新指標で14の最先端モデルを比較した。
- VLMからのリスク意味蒸留によるエンドツーエンド自動運転の強化自動運転/VLA2025/11/1
VLMが持つリスク推論をBEV特徴量に蒸留するRiskHeadを提案し、エンドツーエンド自動運転モデルの汎化性能とリスク対象への注意を向上させた研究。
- 動的環境におけるスケーラブルな3Dシーン再構成のための適応的キーフレーム選択3D再構成2025/10/1
動的環境での3D再構成の品質向上のため、光度・構造類似度誤差と運動量に基づく閾値調整を組み合わせた適応的キーフレーム選択手法を提案し、既存手法より高品質な再構成を実現した。
- エッジ上のマルチモーダルセンサ融合と視覚言語モデルによる自動運転のリアルタイム事故回避VLA2025/8/1
軽量VLMを微調整し、インフラからの危険警告と車載センサデータを統合して安全な軌道を生成するエッジ向けフレームワークREACTを提案。DeepAccidentで衝突率77%削減、推論遅延0.57秒を達成。
- GhostShell: 具現化システムにおける並行行動プログラミングのためのストリーミングLLM関数呼び出しVLA2025/8/1
LLMの生成ストリームから関数呼び出しを逐次解析し、マルチチャネルスケジューリングで複数ロボットコンポーネントの並行・並列動作を実現する手法を提案。実機33タスクで有効性を検証した。
- 自動運転車は自然言語で接続されるべきである協調運転2025/7/1
協調運転における既存の通信手段の限界を指摘し、意図や推論を自然言語で直接伝えることで、反応的な知覚データ共有から能動的な調整へと転換することを提唱した論文。
- クエリベース適応集約による汎用視覚的位置認識のためのマルチデータセット共同学習視覚的位置認識2025/7/1
学習済みクエリを参照コードブックとして用いる特徴集約手法QAAを提案し、複数データセットの共同学習で汎用的な視覚的位置認識モデルを実現した。
- AirV2X: 空陸一体の車両間協調システムV2X2025/6/1
ドローンを路側機の代わりに使う車両間協調運転の大規模データセットAirV2X-Perceptionを構築し、車両対ドローンアルゴリズムの標準評価を可能にした。
- 展開可能で汎化可能な自律性に向けた動作予測の動向:再訪と展望動作予測2025/5/1
動作予測モデルの汎化性と実展開性に焦点を当て、ロボティクス・自動運転・人間動作への応用を中心に、手法・表現・評価プロトコルの分類と課題を整理したサーベイ。
- 自動運転車の車間追従における非線形振動応答:交通状態と制御入力の制限を考慮した理論解析車間追従制御2025/5/1
交通状態と制御入力の飽和制限を考慮し、記述関数法を用いて自動運転車の車間追従システムの非線形周波数応答を理論的に解析する枠組みを提案した。
- 自動運転のための生成AI:フロンティアと機会自動運転2025/5/1
生成AI(VAE・GAN・拡散モデル・LLM)を自動運転スタック全体にどう応用するかを体系的に整理したサーベイ。データ生成からEnd-to-End運転、デジタルツイン、評価・安全・規制まで課題と研究方向をまとめる。
- AI2-Active Safety: 車両ダイナミクスを考慮したAI駆動型インタラクション認識アクティブ安全解析自動運転/安全解析2025/5/1
自転車モデルとハイパーグラフAIを組み合わせ、周囲車両との相互作用を考慮した高精度な衝突予測(TTC)を確率的に算出するフレームワークを提案。
- 仮想道路で賢く安全に:混在交通の安全解析のためのデジタルツインフレームワークsim2real2025/4/1
ドローンLiDARや地図・車両センサデータから高精細3D道路を生成し、CARLA・SUMO・PhysXを統合したデジタルツインで自動運転車と一般車が混在する交通の安全性を物理的に評価する。
- LangCoop: 言語による協調運転協調運転2025/4/1
自然言語を通信媒体として用いることで、通信帯域を大幅に削減しつつ協調自動運転を実現する新手法を提案した。
- 球面上の時間最適凸化Reeds-Shepp経路経路計画2025/4/1
球面上を前後進できる車両の時間最適経路計画を解析し、最適経路が3種類の基本動作からなる最大6区間で構成されることを示した。
- Aether: 幾何学認識を統合した統一的世界モデリング世界モデル2025/3/1
4D動的再構成・行動条件付き動画予測・目標条件付き視覚計画を同時に学習する世界モデルを提案し、実世界データなしでもゼロショットで汎化できることを示した。
- SenseRAG: LLMベース自動運転のための能動的クエリによる環境知識ベース構築自動運転/VLA2025/1/1
マルチモーダルなセンサデータをLLMが読める知識ベースに統合し、能動的RAGと思考連鎖プロンプトで自動運転の状況認識・予測性能を向上させるフレームワークを提案。
- AutoTrust: 自動運転向け大規模視覚言語モデルの信頼性ベンチマークVLA2024/12/1
自動運転向け視覚言語モデルの信頼性を、信憑性・安全性・堅牢性・プライバシー・公平性の観点から評価するベンチマークを構築し、6つのモデルを比較評価した。
- OpenEMMA: エンドツーエンド自動運転のためのオープンソースマルチモーダルモデル自動運転2024/12/1
マルチモーダル大規模言語モデルを活用し、Chain-of-Thought推論を組み込んだオープンソースのエンドツーエンド自動運転フレームワークを提案。
- SmartPretrain: モデル非依存・データセット非依存の運動予測のための表現学習運動予測2024/10/1
複数の運転データセットを統合し、対照学習と再構成学習を組み合わせた自己教師あり事前学習フレームワークを提案。モデルやデータセットに依存せず運動予測性能を向上させる。
- ハイパーグラフによるマルチモーダル相互作用推論を用いた運動生成運動予測2024/9/1
複数車両の群相互作用と多様な運転行動をハイパーグラフニューラルネットでモデル化し、自動運転車の運動予測精度と信頼性を高めるフレームワークRHINOを提案した。
- 分割ビュー位置埋め込みによるマルチビュー3D物体検出3D物体検出2024/7/1
カメラ視点ごとに特徴を分割して位置埋め込みを工夫し、マルチビュー3D物体検出の精度を向上させた手法を提案。
- CoPeD:実環境におけるマルチロボット協調知覚のための包括的データセットマルチロボット協調知覚2024/5/1
空中・地上ロボットの協調による実世界マルチロボット知覚データセットを構築し、多様な視点・センサ情報と注釈を提供して協調知覚研究を促進する。
- SmartRefine: シナリオ適応型の効率的な運動予測リファインメントフレームワーク運動予測2024/3/1
各シナリオの特性に応じてリファインメントの設定と反復回数を適応的に選び、最小限の追加計算で運動予測精度を向上させる汎用的な手法を提案。
- A Generic Stochastic Hybrid Car-following Model Based on Approximate Bayesian Computation2023/12/1
- Visual Environment Assessment for Safe Autonomous Quadrotor Landing2023/11/1
- ContactGen: Generative Contact Modeling for Grasp Generation2023/10/1
- Graph-Based Interaction-Aware Multimodal 2D Vehicle Trajectory Prediction using Diffusion Graph Convolutional Networks2023/9/1
- Learning Navigational Visual Representations with Semantic Map Supervision2023/7/1
- PENet: A Joint Panoptic Edge Detection Network2023/3/1
- Contact2Grasp: 3D Grasp Synthesis via Hand-Object Contact Constraint2022/10/1
- Vision-based Relative Detection and Tracking for Teams of Micro Aerial Vehicles2022/7/1
- Multi-Robot Collaborative Perception with Graph Neural Networks2022/1/1