Jiaxin Liu
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 検索関連性を超えて:視覚言語運転のためのシーン接地型リスク含意VLA2026/9/28
運転シーンの知覚事実から知識グラフとSWRL推論でリスク関係を導出し、VLMと拡散プランナーの判断を条件付けることで、検索ベースの安全知識より計画安全性を向上させた。
- Event-VLA: アクション条件付きイベント融合によるロバストな視覚言語行動モデルVLA2026/6/1
照明変化に弱い既存のVLAモデルに対し、イベントカメラのストリームをアクションクエリ経由で融合するEvent-VLAを提案し、低照度下での操作成功率を向上させた。
- トート搬送ロボットシステムの注文処理のためのオムニスケール学習型逐次意思決定フレームワーク群制御2026/5/1
トート搬送ロボットシステムにおける注文処理の逐次意思決定を、構造化組合せ最適化とマルチエージェント強化学習を組み合わせた汎用フレームワークで解決し、小規模で最適性ギャップ3.5%未満、大規模でトート移動を8-12%削減することを示した。
- DeepSight: 潜在状態予測による長期的世界モデリングを用いたエンドツーエンド自動運転自動運転2026/5/1
自動運転のための世界モデルを提案し、BEV空間で将来フレームの潜在意味特徴を並列予測することで長期的な状態予測を行い、さらに適応的なテキスト推論で長尾シナリオの性能を向上させ、閉ループベンチマークでSOTAを達成した。
- UniHM: 視覚言語モデルによる統合器用手操作器用操作/VLA2026/3/1
自由形式の言語指示に基づいて物理的に実現可能な器用な手の操作を生成する統合フレームワークを提案。異なる手の形態を共通コードブックにマッピングし、人間の物体操作データのみで学習することで、実世界の遠隔操作データなしに汎用性の高い操作シーケンスを生成する。
- 変形するロボットのための動力学事前分布を用いた単眼状態推定状態推定2025/11/1
柔軟に変形するロボットでも剛体前提の姿勢推定を拡張できるよう、変形-力モデルと連続時間Bスプライン運動モデルを組み合わせ、単眼視からメートルスケールと重力方向を復元する手法を提案。
- 観測前のリスクを見抜く:視覚言語モデルによる自動運転の潜在的リスク推論VLA2025/11/1
自動運転における「まだ観測されていない潜在的リスク」を推論するための視覚言語データセットPotentialRiskQAと、それに基づく推論フレームワークPR-Reasonerを提案した。
- 半教師ありGRU-カルマンフィルタによる3D多物体追跡3D多物体追跡2024/11/1
学習可能なカルマンフィルタをGRUに組み込み、半教師あり学習で3D多物体追跡の精度と収束性を改善した手法を提案。
- A Spatial Calibration Method for Robust Cooperative Perception2023/4/1
- Road Traffic Law Adaptive Decision-making for Self-Driving Vehicles2022/4/1