Ryo Hachiuma
収録論文 6本 ・ フィジカルAI/ロボット学習
空間推論VLA歩行予測群衆予測
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SpatialClaw:エージェント的空間推論のためのアクションインターフェース再考空間推論2026/6/11
視覚言語モデルによる空間推論を強化するため、コードをアクションインターフェースとして用いる訓練不要のフレームワークSpatialClawを提案。状態を持つPythonカーネル上で柔軟に知覚・幾何プリミティブを組み合わせ、中間結果に応じて分析を適応させる。
- V2V-GoT: マルチモーダル大規模言語モデルと思考グラフによる車車間協調自動運転VLA2025/9/1
車車間通信とマルチモーダル大規模言語モデルを組み合わせ、思考グラフ推論を用いて遮蔽物がある状況でも協調的な知覚・予測・計画を行う手法を提案した。
- 文脈内学習によるあらゆる歩行者軌道予測歩行予測2025/6/1
歩行者軌道予測において、シナリオごとの微調整なしに文脈内学習で適応するTrajICLを提案。時空間類似性と予測誘導による例選択で高精度を実現。
- V2V-LLM: マルチモーダル大規模言語モデルによる車車間協調自動運転VLA2025/2/1
車車間通信で複数車両の知覚情報をマルチモーダルLLMで統合し、物体特定や計画などの運転タスクに答えるV2V-QAデータセットとベースライン手法を提案した論文。
- CrowdMAC: マスク付き群衆密度補完によるロバストな群衆密度予測群衆予測2024/7/1
検出漏れで欠損した過去の群衆密度マップから将来を予測するため、マスク補完と予測を同時学習するフレームワークを提案し、7つの大規模データセットで最高性能を達成した。
- Dynamics-Regulated Kinematic Policy for Egocentric Pose Estimation2021/6/1