論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文姿勢推定/IMU校正ロボティクス
外部機器不要のIMU運動加速度校正・補償による姿勢推定フィルタの精度向上
IMUの運動による遠心・接線加速度をジャイロ計測から補償し、外部機器なしでIMUの内部パラメータと取り付け位置を推定する校正法を提案。シミュレーションと実機で姿勢推定精度が向上することを示した。
原題: Motion-Acceleration Calibration and Compensation in IMUs without External Equipment for Attitude Estimation Filters / Fabian Arzberger, Andreas Nüchter
日本語で読む → - 論文模倣学習/マニピュレーションロボティクス
S2A2: 音響空間情報を用いた操作タスクのための視聴覚模倣学習
音響情報を活用した操作タスクを新たに定義し、視覚特徴と音響空間・信号情報を統合する模倣学習フレームワークS2A2を提案した。シミュレーションと実機実験で有効性を検証した。
原題: S2A2: Audio-Visual Imitation Learning for Manipulation Tasks Using Acoustic Spatial Information / Kaneyoshi Hiratsuka, Benjamin Yen, Ryosuke Kojima
日本語で読む → - 論文VLNロボティクス
DART-VLN: 離散視覚言語ナビゲーションのためのテスト時メモリ減衰と反復防止正則化
メモリベースの離散VLNエージェントの推論時失敗を軽減するため、学習不要の推論時フレームワークを提案。古いメモリの重み付けを下げるメモリ減衰と、即座の逆戻りを防ぐ反復防止正則化を導入し、R2RとREVERIEで性能維持・向上と効率改善を実証した。
原題: DART-VLN: Test-Time Memory Decay and Anti-Loop Regularization for Discrete Vision-Language Navigation / Shaoheng Zhang, Zhichen Li, Jie Mei
日本語で読む → - 論文共有制御ロボティクス
触覚型ヒューマンロボット共有制御のための個別化安全介入学習
ユーザーのデモンストレーションから安全介入の好みを学習し、触覚フィードバックを個別化するフレームワークを提案。微分可能な制御バリア関数に基づく最適化層で安全パラメータを自動調整する。
原題: Learning Personalized Safety Interventions for Haptic Human-Robot Shared Control / Dawei Zhang, Roberto Tron
日本語で読む → - 論文環境認識ロボティクス
人間とロボットの協調と環境理解のためのロボットの文脈認識
この論文は、動的な人間中心環境で動作する移動ロボットの文脈認識を向上させるため、人間の再識別と追跡による協調改善と、環境の幾何学的・意味的理解の強化という2つの研究方向を提案している。
原題: Robotic Contextual Awareness for Human-Robot Collaboration and Environmental Understanding / Federico Rollo
日本語で読む → - 論文医療画像ナビゲーションロボティクス
幾何学認識に基づく気管支内視鏡ナビゲーションのための高ゲインオブザーバ融合によるビジュアルオドメトリ
気管支内視鏡ナビゲーションにおいて、テクスチャの乏しい気道画像や管腔構造の特異点に頑健な、消失点キューを活用した幾何学認識ビジュアルオドメトリ手法を提案し、実肺データで誤差を50%以上削減した。
原題: Geometry-Aware Visual Odometry for Bronchoscopic Navigation via High-Gain Observer Fusion / Mohammadreza Kasaei, Francis Xiatian Zhang, Feng Li 他
日本語で読む → - 論文マニピュレーションロボティクス
KAI: データ効率的な関節物体操作のための運動学的認識インターフェース
関節物体の運動学的構造を捉えた中間表現KAIを導入し、ポリシー学習に組み込むことで、少ないデモデータでも高い成功率を達成する手法を提案した。
原題: KAI: A Kinematic-Aware Interface for Data-Efficient Articulated Object Manipulation / Yaping Li, Zhaxizhuoma, Qiaojun Yu 他
日本語で読む → - 論文制御ロボティクス
Neural-ESO: 証明可能なロバスト学習ベース制御のための二経路アーキテクチャ
ニューラルネットワークによる予測経路と従来の拡張状態オブザーバによる補正経路を組み合わせた外乱抑制フレームワークを提案し、リプシッツ制約により閉ループ誤差の一様有界性を保証。クアッドローター着陸タスクで有効性を検証した。
原題: Neural-ESO: A Dual-Pathway Architecture for Provably Robust Learning-Based Control / Fan Zhang, Richie Suganda, Jinfeng Chen 他
日本語で読む → - 論文強化学習/多目的最適化機械学習
ベイズ最適化を用いた省エネルギー強化学習のための高効率パレートフロントモデリング
強化学習の多目的最適化において、報酬関数の重み選択を多目的ベイズ最適化で自動化し、少ない評価回数で多様なトレードオフ解を発見する手法を提案・実証した。
原題: Sample-Efficient Pareto Front Modeling for Energy-Aware Reinforcement Learning Using Bayesian Optimization / Georg Schäfer, Jakob Rehrl, Stefan Huber 他
日本語で読む → - 論文HRI/デザインロボティクス
トラウマに配慮したソーシャルロボットのためのタッチ設計:直接的・間接的駆動のデザイン空間
PTSDを持つ人々へのタッチベースのインタラクションをトラウマインフォームドケアの原則に沿って設計するためのデザイン空間を提案した論文。
原題: Designing Touch for Trauma-Informed Social Robots: A Design Space for Direct and Indirect Actuation / Madeleine Rischer, Benedikt Bußmann
日本語で読む → - 論文遠隔操作ロボティクス
3DGS駆動の動的視点と振動触覚による水中遠隔操作フレームワーク:fNIRSによる検証
水中ロボット遠隔操作のための、3Dガウススプラッティングによる動的視点生成と振動触覚スーツを組み合わせたマルチモーダル操作アーキテクチャを提案し、人間被験者実験で遅延耐性と認知負荷を評価した。
原題: A 3DGS-Driven Dynamic Viewpoint and Vibrotactile Framework for Subsea Teleoperation Validated via fNIRS / Fang Xu, Tianyu Zhou, Ruitong Tian 他
日本語で読む → - 論文自動運転/自己対戦学習画像認識
Pictura: 運転のためのスケールでの視点ビュー自己対戦
GPU加速シミュレータPicturaを導入し、各エージェントの視点画像を用いた自己対戦学習で運転ポリシーを訓練。特権的な観測を使わずに、大規模な画像ベースの自己対戦学習を実現した。
原題: Pictura: Perspective-View Self-Play at Scale for Driving / Yuan Yin, Elias Ramzi, Marc Lafon 他
日本語で読む → - 論文模倣学習機械学習
ミラー学習:三人称観察からの模倣学習
三人称のデモ映像から、生成モデルで視点変換と逆動力学モデルを用いて一人称の模倣データを合成し、ポリシー学習を可能にする手法を提案した。
原題: Mirror Learning / Yunpeng Liu, Matthew Niedoba, Oluwanifemi A. Adekanye 他
日本語で読む → - 論文シミュレーションロボティクス
GPUSimBench: 身体化AIにおけるスケーラブルで信頼性の高いGPU加速シミュレータに向けて
GPUベースのロボットシミュレータ(Isaac LabやGenesisなど)のスケーラビリティ、物理的一貫性、計算の決定性を評価するベンチマークGPUSimBenchを提案し、GPUバッチ実行に起因する非決定性と再現性の問題を明らかにした。
原題: GPUSimBench: Towards Scalable and Reliable GPU-Accelerated Simulators in Embodied AI / Huzhenyu Zhang, Shenghai Yuan, Wenrui Yan 他
日本語で読む → - 論文マニピュレーションロボティクス
受取者中心のロボットから人への手渡し:把持を考慮した物体姿勢制御
非対称な工具を人間に手渡す際、把持しやすい向きにロボットが自動調整する適応型ハンドオーバーシステムを提案し、実験で有効性を示した。
原題: Receiver-Centered Robot-to-Human Handover with Grasp-Aware Object Orientation / Federico Biagi, Dario Onfiani, Simone Silenzi 他
日本語で読む → - 論文ヘルスケアロボティクスロボティクス
ソーシャルロボットによる身体的フレイルと転倒リスク指標の評価:高齢者を対象とした実地評価
高齢者のフレイル評価を自動化するため、ソーシャルロボットが標準テストを案内し、臨床スコアと生体力学的指標を計測する枠組みを提案し、81名の高齢者で6ヶ月間実地評価した。
原題: Assessing Physical Frailty and Fall-Risk Indicators with Social Robots: An in situ Evaluation with Older Adults / Aniol Civit, Antonio Andriella, Alba Martínez 他
日本語で読む → - 論文VLA/UAV追跡ロボティクス
CosFly-VLA: UAV追跡のための空間認識型視覚言語行動モデル
建物や障害物による遮蔽中でもターゲットを追跡できる、空間認識を備えた視覚言語行動(VLA)モデルを提案。大規模データでの事前学習とカリキュラム学習、強化学習により、遮蔽時の追跡性能を向上させる。
原題: CosFly-VLA: A Spatially Aware Vision-Language-Action Model for UAV Tracking / Ruilong Ren, Songsheng Cheng, Yunpeng Zhou 他
日本語で読む → - 論文自動運転レース/軌道計画ロボティクス
ゲーム理論的ガイダンスを備えたハイブリッドサンプリングベース軌道プランナーによる自動運転レース
自動運転レース向けに、ゲーム理論の戦略的推論とサンプリングベースの軌道生成を組み合わせたハイブリッドプランナーを提案。オフライン学習したポテンシャル関数で相互作用を捉え、オンラインで勾配最適化により動的コストバイアスを生成し、高周波サンプリングプランナーに統合することで、ブロッキングなどの防御行動を実現しつつ計算負荷を抑えた。
原題: A Hybrid Sampling-Based Trajectory Planner with Game-Theoretic Guidance for Autonomous Racing / Alexander Langmann, Frederico Pita de Araujo, Mattia Piccinini 他
日本語で読む → - 論文HRI/VLMHCI
ソーシャルロボットから見た世界:視覚言語モデルによる人間とロボットの対話拡張
Pepperロボットに視覚言語モデルを統合し、対話に視覚情報を加えることで応答時間の増加を抑えつつ状況理解を向上させる実験を行った。
原題: The World According to a Social Robot -- Augmenting Human-Robot Dialogue With Vision Language Models / Thomas Sievers
日本語で読む → - 論文意図予測AI
INTENT: 交差点シナリオにおける車両意図予測のためのLSTMフレームワークと包括的なアブレーション分析
交差点で2秒先の車両の意図(直進、左折、右折)をLSTMで予測するフレームワークを提案し、InDデータセットで99.71%の精度を達成した。
原題: INTENT: An LSTM Framework for Vehicle Intention Prediction in Intersection Scenarios with Comprehensive Ablation Analysis / Logine M. Zaki, Catherine M. Elias
日本語で読む → - 論文自動運転画像認識
エンドツーエンド自動運転におけるポストトレーニング
エンドツーエンド自動運転モデルの模倣学習後のポストトレーニング手法を、監督信号の種類に基づいて4つのファミリーに分類し、各手法の能力・限界・課題を体系的に整理したサーベイ論文。
原題: Post-Training in End-to-End Autonomous Driving / Ruining Yang, Muxing Wang, Yixiao Chen 他
日本語で読む → - 論文歩行位置推定/センサフュージョンロボティクス
四元数平均に基づく適応相補フィルタを用いた足装着型AHRSによる歩行者デッドレコニング
足に装着したAHRSを用いた歩行者位置推定(PDR)の精度向上のため、角速度・加速度・磁気の四元数をMarkleyの平均法で融合し、歩行位相と磁気外乱に応じて重みを適応調整するQAACFを提案した。実験で既存手法より低い誤差を達成しつつ、カルマンフィルタより計算コストを削減した。
原題: Quaternion-Averaging-Based Adaptive Complementary Filter for Pedestrian Dead Reckoning With a Foot-Mounted AHRS / Shunsei Yamagishi, Lei Jing
日本語で読む → - 論文強化学習ロボティクス
CoRe: 視覚言語モデルフィードバックを用いた選好整合強化学習のための複合報酬
強化学習における報酬設計の課題に対し、タスク知識に基づく形式的報酬と観測から学習する残差報酬を、視覚言語モデルのフィードバックで統合するハイブリッドフレームワークCoReを提案し、人間の介入なしに選好整合的なポリシー学習を実現した。
原題: CoRe: Combined Rewards with Vision-Language Model Feedback for Preference-Aligned Reinforcement Learning / Hexian Ni, Tao Lu, Yinghao Cai
日本語で読む → - 論文模倣学習/階層的制御ロボティクス
二重プロセス原子スキル学習:意味推論とリアルタイム制御の分離
言語条件付き模倣学習において、高次の意味推論と低次の動作生成を非同期に分離する新しい階層的枠組みDASLを提案し、複合タスクの汎化性能を向上させた。
原題: Dual-Process Atomic Skill Learning: Decoupling Semantic Reasoning and Real-Time Control / Jun Chen, Erdent Bao, Wenlong Dong 他
日本語で読む → - 論文強化学習/収穫ロボットロボティクス
階層強化学習を用いたクラスタ状イチゴ収穫における視覚ベース障害物分離
クラスタ状に生るイチゴの収穫で、熟果を覆う未熟果を視覚で認識し、階層強化学習により障害物分離と把持を段階的に行う手法を提案した。シミュレーションと実機で高い成功率を達成した。
原題: Vision-Based Obstacle Separation for Strawberry Harvesting in Clusters Using Hierarchical Reinforcement Learning / Teng Li, Hanfei Shi, Chunjiang Zhao 他
日本語で読む → - 論文群制御ロボティクス
ITNTNにおける知的マルチUAVナビゲーション:階層型LLMアプローチ
高高度プラットフォーム上の大規模LLMとUAV上の軽量エッジLLMを階層的に組み合わせ、DRLコントローラを誘導することで、動的な統合地上・非地上ネットワークでの衝突回避とハンドオーバー対応ナビゲーションを実現する。
原題: Intelligent Multi-UAV Navigation in ITNTNs: A Hierarchical LLM Approach / Zijiang Yan, Hao Zhou, Wael Jaafar 他
日本語で読む → - 論文自動運転/自己教師あり学習画像認識
CRISP: 予測型ワールドモデル事前学習による運転用時空間カメラ・レーダーバックボーン
カメラとレーダーの融合表現を、将来のLiDAR点群予測という事前学習タスクで学習するバックボーンを提案。推論時はカメラとレーダーのみで動作し、下流タスクに転移可能。
原題: CRISP: A Spatiotemporal Camera-Radar Backbone for Driving via Forecasting-Based World-Model Pretraining / Jingyu Song, Yi Liu, Katherine A. Skinner
日本語で読む → - 論文自動運転計画ロボティクス
構造化シーン知識と検証可能な推論-行動整合性を備えた自動運転のための認知デュアルプロセス計画
自動運転の高次計画のため、構造化チェーン・オブ・ソート(S-CoT)スキーマと軽量なシーン複雑度推定に基づくデュアルプロセス計画フレームワークを提案し、ルーチンシーンでは高速なメタアクション予測、複雑シーンでは構造化推論とルールベース検証による報酬を用いた強化学習で計画精度を向上させた。
原題: Cognitive Dual-Process Planning for Autonomous Driving with Structured Scene Knowledge and Verifiable Reasoning-Action Consistency / Zhongyao Yang, Haoyu Li, Yu Yan 他
日本語で読む → - 論文VLAロボティクス
CAC-VLA: 視覚言語行動モデルのための文脈ゲート型行動条件付け
VLAモデル内に軽量な潜在行動インターフェースを導入し、文脈ゲートで行動エキスパートへの影響を調整することで、ロボット操作の成功率を向上させた。
原題: CAC-VLA: Context-Gated Action Conditioning for Vision-Language-Action Models / Yifu Xiong, Wenhao Yu, Jiaxuan Lin 他
日本語で読む → - 論文動作計画ロボティクス
時空間凸集合グラフに基づく探索型の時空間・マルチロボット動作計画
時空間凸集合のグラフ上で経路探索を行い、動的障害物や複数ロボットの干渉を扱う動作計画手法を提案した。
原題: Search-Based Spatiotemporal and Multi-Robot Motion Planning on Graphs of Space-Time Convex Sets / Jingtao Tang, Zining Mao, Lufan Yang 他
日本語で読む →