論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/1/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文歩行者意図予測画像認識
VIT-Ped: 歩行者行動分析のための意図予測トランスフォーマー
歩行者の横断意図を予測するため、複数のデータモダリティを活用したTransformer/ViTベースのアルゴリズムを提案し、JAADデータセットでSOTA性能を達成した。
原題: VIT-Ped: Visionary Intention Transformer for Pedestrian Behavior Analysis / Aly R. Elkammar, Karim M. Gamaleldin, Catherine M. Elias
日本語で読む → - 論文マニピュレーションロボティクス
ノイズデータからの深層ロバストKoopman学習
ノイズを含むデータからバイアスを低減したKoopman演算子を学習するオートエンコーダベースの手法を提案し、マニピュレータの予測・追従制御で有効性を示した。
原題: Deep Robust Koopman Learning from Noisy Data / Aditya Singh, Rajpal Singh, Jishnu Keshavan
日本語で読む → - 論文サービスロボットロボティクス
指標から意味へ:小売店におけるロボット導入の混合手法フィールド実験からの洞察
寝具店に会話型サービスロボットを12日間導入し、ロボット単体と什器併用の効果を検証。ロボットは立ち止まりを増やしたが、店員の接客や購入には繋がりにくいことをインタビューで説明した。
原題: From Metrics to Meaning: Insights from a Mixed-Methods Field Experiment on Retail Robot Deployment / Sichao Song, Yuki Okafuji, Takuya Iwamoto 他
日本語で読む → - 論文教育ロボティクスHCI
MotiBo: 自己決定理論に基づく対話型デジタルストーリーテリングロボットが学生の動機づけに与える影響
人型ロボットを用いた対話型デジタルストーリーテリングシステムMotiBoを開発し、紙媒体やPowerPointと比較して、学生の行動的・認知的エンゲージメントを有意に向上させることを示した研究。
原題: MotiBo: The Impact of Interactive Digital Storytelling Robots on Student Motivation through Self-Determination Theory / Ka Yan Fung, Tze Leung Rick Lui, Yuxing Tao 他
日本語で読む → - 論文ヒューマノイド/模倣学習ロボティクス
人間同士のデモンストレーションから全身ヒューマノイド相互作用を学習する
人間同士の相互作用データを物理的に整合する形でヒューマノイドに再ターゲティングし、いつ・どこで行動するかを分離して学習する階層的政策で全身協調動作を実現した。
原題: Learning Whole-Body Human-Humanoid Interaction from Human-Human Demonstrations / Wei-Jin Huang, Yue-Yi Zhang, Yi-Lin Wei 他
日本語で読む → - 論文3Dセマンティックマッピングロボティクス
熱・可視・LiDAR融合によるリアルタイム3Dセマンティックマッピングのためのマルチモーダル信号処理
可視・赤外画像をピクセルレベルで融合し、LiDAR点群を投影して熱源をセグメンテーションすることで、温度情報をセマンティック層として付加した3Dマップを生成する手法を提案。
原題: Multimodal Signal Processing For Thermo-Visible-Lidar Fusion In Real-time 3D Semantic Mapping / Jiajun Sun, Yangyi Ou, Haoyuan Zheng 他
日本語で読む → - 論文ナビゲーションロボティクス
AnyLocを用いた単眼カメラによるトポロジカルマッピングとナビゲーション
単眼カメラのみでAnyLocに基づくトポロジカルマップを構築し、ループ検出と視覚ナビゲーションを実現する軽量な手法を提案した。
原題: Topological Mapping and Navigation using a Monocular Camera based on AnyLoc / Wenzheng Zhang, Yoshitaka Hara, Sousuke Nakamura
日本語で読む → - 論文VLAロボティクス
汎用大規模言語モデルによるドローン指揮統制インターフェース
MCP標準とMavlinkを組み合わせ、LLMや機体に依存しない汎用的なドローン管制インターフェースを構築し、実機飛行制御を実証した。
原題: A Universal Large Language Model -- Drone Command and Control Interface / Javier N. Ramos-Silva, Peter J. Burke
日本語で読む → - 論文制御/学習制御ロボティクス
安全保証付き自律走行車両の軌道追従のための双四元数学習制御
双四元数フレームワークでSE(3)上の軌道追従制御器を設計し、ガウス過程回帰で未知外乱をオンライン学習・補償することで、確率的な安定性保証を実現した。
原題: Dual-quaternion learning control for autonomous vehicle trajectory tracking with safety guarantees / Omayra Yago Nieto, Alexandre Anahory Simoes, Juan I. Giribet 他
日本語で読む → - 論文ナビゲーションロボティクス
ワンステップ世界モデルによる効率的なマルチモーダルナビゲーションシステム
拡散の多段処理をやめてワンステップ生成と3D U-Netで世界モデルを軽量化し、アンカー初期化の最適化計画と組み合わせてリアルタイムなマルチモーダルゴールナビゲーションを実現した。
原題: An Efficient and Multi-Modal Navigation System with One-Step World Model / Wangtian Shen, Ziyang Meng, Jinming Ma 他
日本語で読む → - 論文建設ロボット/HRCロボティクス
人とロボットの建設協働における即興性の向上:分類体系と研究ロードマップ
建設ロボットの即興能力を6段階で分類するタクソノミーを提案し、214件の文献レビューを通じて現状の課題と今後の研究方向を整理した。
原題: Advancing Improvisation in Human-Robot Construction Collaboration: Taxonomy and Research Roadmap / David Wireko Atibila, Vineet R. Kamat, Carol C. Menassa
日本語で読む → - 論文VLAロボティクス
大規模言語モデルによるシミュレーション環境でのドローン multitask 操作の強化
微調整したCodeT5とAirSimを組み合わせ、自然言語コマンドからドローン操作用コードを自動生成してマルチタスクを実行する手法を提案。
原題: Large Language Models to Enhance Multi-task Drone Operations in Simulated Environments / Yizhan Feng, Hichem Snoussi, Jing Teng 他
日本語で読む → - 論文マルチモーダルHCI
音響フィールド動画によるマルチモーダルなシーン理解
ビームフォーミングマイクアレイで音の強度を空間的に可視化した「音響フィールド動画」をVLMに入力し、通常の動画よりシーン理解の正答率が38.3%から67.4%に向上することを示した。
原題: Acoustic Field Video for Multimodal Scene Understanding / Daehwa Kim, Chris Harrison
日本語で読む → - 論文ナビゲーション支援HCI
社会的相互作用における委任は時間とともにどう変化するか?視覚障害者向けロボットナビゲーション
視覚障害者6名が博物館でナビゲーション支援ロボットと繰り返しタスクを行い、ロボットに任せるか自分で行動するかの戦略と選好が時間とともにどう変化するかを調査した。
原題: How Does Delegation in Social Interaction Evolve Over Time? Navigation with a Robot for Blind People / Rayna Hata, Masaki Kuribayashi, Allan Wang 他
日本語で読む → - 論文HRI/倫理ロボティクス
ロボット虐待に対する人間の反応:擬人化と道徳基盤の二重の役割
ロボットへの虐待を見たときの反応を調査し、擬人化の程度が道徳的配慮の有無を決め、道徳基盤がその理由づけの仕方を形作ることを明らかにした。
原題: Whether We Care, How We Reason: The Dual Role of Anthropomorphism and Moral Foundations in Robot Abuse / Fan Yang, Renkai Ma, Yaxin Hu 他
日本語で読む → - 論文HRIロボティクス
ソーシャルロボットを推薦システムとして再構想する:基礎、フレームワーク、応用
ソーシャルロボットのパーソナライズを強化するため、推薦システムの技術をモジュール式に統合するフレームワークを提案した論文。
原題: Reimagining Social Robots as Recommender Systems: Foundations, Framework, and Applications / Jin Huang, Fethiye Irmak Doğan, Hatice Gunes
日本語で読む → - 論文HRIロボティクス
HARMONI: LLMを用いたマルチユーザーヒューマンロボットインタラクションのマルチモーダル個別化
大規模言語モデルを活用し、社会的支援ロボットが複数ユーザーとの長期的な対話を持続的に個別化・適応させるマルチモーダルフレームワークを提案。介護施設での実証実験を含む評価で、話者識別や記憶更新、倫理的に整合した個別化を実現した。
原題: HARMONI: Multimodal Personalization of Multi-User Human-Robot Interactions with LLMs / Jeanne Malécot, Hamed Rahimi, Jeanne Cattoni 他
日本語で読む → - 論文視覚ナビゲーションロボティクス
OpenNavMap: マルチセッション外観ベーストポメトリックマッピングによるスケーラブルな視覚ナビゲーション
画像ノードを共視性・オドメトリ・走行可能性グラフで整理し、3D基盤モデルをオンデマンドで活用する軽量なランドマークフリー地図構築システムを提案。19kmの実環境データで高精度な視覚ナビゲーションを実現した。
原題: OpenNavMap: Multi-Session Appearance-Based Topometric Mapping for Scalable Visual Navigation / Jianhao Jiao, Changkun Liu, Jingwen Yu 他
日本語で読む → - 論文強化学習/探索機械学習
価値誘導フローによる高次元連続制御のスケーラブルな探索
価値関数が誘導する確率フローに沿ってネイティブな高次元行動空間で探索を行う強化学習手法Qflexを提案し、高次元連続制御ベンチマークや全身筋骨格モデルの俊敏な運動制御で優れた性能を示した。
原題: Scalable Exploration for High-Dimensional Continuous Control via Value-Guided Flow / Yunyue Wei, Chenhui Zuo, Yanan Sui
日本語で読む → - 論文マニピュレーションロボティクス
触覚記憶を備えたソフトロボット:マスク付きエンコーディングとソフト手首による堅牢な物体挿入
ソフト手首と触覚検索ベース制御を統合し、マスク付き触覚軌道トランスフォーマーで時空間表現を学習することで、不確実性下でのペグ挿入を堅牢に実現した。
原題: Tactile Memory with Soft Robot: Robust Object Insertion via Masked Encoding and Soft Wrist / Tatsuya Kamijo, Mai Nishimura, Cristian C. Beltran-Hernandez 他
日本語で読む → - 論文ヒューマンロボット協調/視線計測ロボティクス
GAZELOAD: 産業用ヒューマンロボット協調作業におけるメンタルワークロード計測のためのマルチモーダル視線追跡データセット
産業用協働ロボットとの作業中にスマートグラスで計測した視線・瞳孔データと環境・タスク情報を同期したデータセットを構築し、作業負荷推定アルゴリズムの評価基盤を提供する。
原題: GAZELOAD A Multimodal Eye-Tracking Dataset for Mental Workload in Industrial Human-Robot Collaboration / Bsher Karbouj, Baha Eddin Gaaloul, Jorg Kruger
日本語で読む → - 論文ナビゲーションロボティクス
IROS:VLMを用いた屋内ナビゲーションのためのデュアルプロセスアーキテクチャ
VLMレベルの文脈推論と軽量知覚モジュールを組み合わせ、必要な時だけVLMを呼び出す二重プロセス設計により、低コストなオンデバイス環境でリアルタイム屋内ナビゲーションを実現した。
原題: IROS: A Dual-Process Architecture for Real-Time VLM-Based Indoor Navigation / Joonhee Lee, Hyunseung Shin, Jeonggil Ko
日本語で読む → - 論文マニピュレーションロボティクス
DexTac: 手ごと教示による接触を考慮した視触覚ポリシーの学習
人間の教示から接触力分布と接触領域を取得し、視触覚ポリシーに組み込むことで、器用な手が複雑な接触作業を自律的に行えるようにしたフレームワーク。
原題: DexTac: Learning Contact-aware Visuotactile Policies via Hand-by-hand Teaching / Xingyu Zhang, Chaofan Zhang, Boyue Zhang 他
日本語で読む → - 論文経路計画ロボティクス
RPT*: 確率的終端を持つ目標探索のための大域的計画法
各候補地点に目標が存在する確率を与え、訪問順序に依存する期待コストを最小化する新たな経路計画問題HPP-PTを定式化し、動的計画法と新ヒューリスティクスによる最適保証付き探索手法RPT*を提案した。
原題: RPT*: Global Planning with Probabilistic Terminals for Target Search in Complex Environments / Yunpeng Lyu, Chao Cao, Ji Zhang 他
日本語で読む → - 論文モデル予測制御ロボティクス
HPTune: 衝突回避のための階層的先回りチューニングによるモデル予測制御
実行されなかった行動も評価に取り入れた階層的先回りチューニングでMPCのパラメータを効率的に調整し、ドップラーLiDARと組み合わせて複雑環境での衝突回避を実現した。
原題: HPTune: Hierarchical Proactive Tuning for Collision-Free Model Predictive Control / Wei Zuo, Chengyang Li, Yikun Wang 他
日本語で読む → - 論文協調SLAMロボティクス
惑星模擬環境における分散型協調SLAM:データセット・課題・教訓
火星類似地形で3台のロボットをアドホック通信で動かし、通信制限が分散協調SLAMに与える影響を検証するとともに、実測通信データを含む新データセットを公開した。
原題: Multi-Robot Decentralized Collaborative SLAM in Planetary Analogue Environments: Dataset, Challenges, and Lessons Learned / Pierre-Yves Lajoie, Karthik Soma, Haechan Mark Bong 他
日本語で読む → - 論文sim2realロボティクス
WheelArm-Sim:支援ロボティクスにおける統合制御のための操作・移動複合マルチモーダル合成データ生成シミュレータ
車椅子とロボットアームを統合したWheelArmシステムの機械学習モデル開発に向け、Isaac Sim上で操作と移動を組み合わせたマルチモーダル合成データを生成するシミュレータを提案し、13タスク・232軌道・67,783サンプルのデータセットを収集して有効性を検証した。
原題: WheelArm-Sim: A Manipulation and Navigation Combined Multimodal Synthetic Data Generation Simulator for Unified Control in Assistive Robotics / Guangping Liu, Tipu Sultan, Vittorio Di Giorgio 他
日本語で読む → - 論文模倣学習/宇宙機制御ロボティクス
専門家デモンストレーションを用いた模倣学習による宇宙機のランデブ・ドッキング制御
専門家のデモンストレーションから直接制御方策を学ぶ模倣学習フレームワークを提案し、モデルに依存せず6自由度のランデブ・ドッキング制御を高精度かつ省エネルギーに実現した。
原題: Imitation learning-based spacecraft rendezvous and docking method with Expert Demonstration / Shibo Shao, Dong Zhou, Guanghui Sun 他
日本語で読む → - 論文群制御ロボティクス
CoCoPlan: 動的未知環境におけるマルチロボットシステムの適応的協調と通信
限られた通信環境でマルチロボットのタスク計画と断続的通信を同時最適化する枠組みを提案し、タスク完了率と通信効率を改善した。
原題: CoCoPlan: Adaptive Coordination and Communication for Multi-robot Systems in Dynamic and Unknown Environments / Xintong Zhang, Junfeng Chen, Yuxiao Zhu 他
日本語で読む → - 論文飛行ロボットナビゲーションロボティクス
AsterNav: 暗闇で受動計算により自律飛行する航空ロボットナビゲーション
赤外線単眼カメラと符号化レンズ、構造光を組み合わせ、深層学習モデルAsterNetで深度推定を行い、暗闇での自律飛行ナビゲーションを実現した。
原題: AsterNav: Autonomous Aerial Robot Navigation In Darkness Using Passive Computation / Deepak Singh, Shreyas Khobragade, Nitin J. Sanket
日本語で読む →