Yifei Liu
収録論文 7本 ・ フィジカルAI/ロボット学習
動画生成熱知覚画像変換sim2realステレオ深度推定協調知覚RFセンシング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SparseCtrl-HOI: 人間と物体のインタラクション動画生成のためのスパース時間制御動画生成2026/7/7
人間と物体のインタラクション動画生成において、少数のキーフレームと高レベルな動作プリエントのみを用いて、物理的に妥当な遷移を生成するスパース時間制御フレームワークを提案した。
- AnyThermal:熱知覚のための汎用表現学習に向けて熱知覚2026/2/1
RGB-Thermalデータセットと収集プラットフォームを構築し、視覚基盤モデルから蒸留することで、多様な環境とタスクに適用可能な熱画像バックボーンを学習した。
- ThermalDiffusion: 自律ナビゲーションのための視覚画像から熱画像への変換画像変換2025/6/1
条件付き拡散モデルを用いてRGB画像を熱画像に変換し、熱カメラ向けデータ不足を補う手法を提案。
- 潜在状態ダイナミクスの残差で世界モデルを適応させるsim2real2025/4/1
シミュレーションで事前学習した潜在状態の世界モデルを、実環境のダイナミクスとの差分(残差)で補正し、視覚ベースのタスクで実機に転移できるようにした研究。
- FIReStereo: 視界不良環境におけるUAS深度知覚のための森林赤外ステレオデータセットステレオ深度推定2024/9/1
煙・雨・夜間など視界が悪い環境でも使えるよう、熱赤外ステレオカメラとLiDAR・IMUで都市・森林を撮影した大規模データセットを構築し、代表的なステレオ深度推定手法を評価した。
- リスク占有:車路雲連携による新たな高効率パラダイム協調知覚2024/8/1
車路雲統合アーキテクチャの下で、物体検出と局所マッピングを4次元(路面x・y座標、リスク、時間)の単一表現に統合した新しいリスク占有(RiskOcc)知覚パラダイムを提案し、その有効性を経路計画で検証した。
- 電波による視覚認識の実現RFセンシング2024/5/1
回転式ミリ波レーダーと信号処理・機械学習を組み合わせ、LiDARに匹敵する高解像度3Dイメージングを実現し、電波領域での表面法線推定・意味セグメンテーション・物体検出などの視覚認識タスクを可能にした。