論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文器用操作/触覚/視覚-触覚融合ロボティクス
FingerEye: 連続的な視覚-触覚センシングによる器用な操作の学習
指先にカメラと変形可能な接触インターフェースを統合し、接触前後の連続的な視覚-触覚フィードバックで器用な操作を学習するフレームワークを提案。グループ構造化モダリティ融合により、シミュレーションと実世界の両方で成功率を大幅に向上させた。
原題: FingerEye: Learning Dexterous Manipulation with Continuous Vision-Tactile Sensing / Zhixuan Xu, Yichen Li, Xuanye Wu 他
日本語で読む → - 論文モーションプランニングロボティクス
原語ベースの打ち切り拡散による差動駆動移動マニピュレータの効率的軌道生成
差動駆動移動マニピュレータの軌道生成を学習で強化し、キーポイント抽出と拡散モデルの改良により成功率と多様性を向上させた。
原題: Primitive-based Truncated Diffusion for Efficient Trajectory Generation of Differential Drive Mobile Manipulators / Long Xu, Choilam Wong, Yuhang Zhong 他
日本語で読む → - 論文群制御ロボティクス
マーシャリングヤード内の自律配送車両の協調運用フレームワーク
配送ヤード内の自律車両のタスク割り当てを動的優先度スコアリングで最適化し、スループット向上とデッドロック防止を実証した論文。
原題: Framework for Collaborative Operation of Autonomous Delivery Vehicles Within a Marshaling Yard / James O'Hara, Karl Wunderlich, Gregory Stevens
日本語で読む → - 論文運転注意予測画像認識
シーンから物体へ:テキスト誘導による二重視線予測
運転者の物体レベルの注意予測を実現するため、データ構築からモデル設計までの新しい枠組みを提案し、マルチモーダル大規模言語モデルとSAM3を用いて物体レベルの視線データセットを構築し、デュアルブランチの視線予測モデルを開発した。
原題: From Scene to Object: Text-Guided Dual-Gaze Prediction / Zehong Ke, Yanbo Jiang, Jinhao Li 他
日本語で読む → - 論文運動計画/時相論理cs.LO
ファジィ経路の論理
経路を第一級の対象として扱う新しい時相論理を提案し、幾何と論理を分離することで、運動計画の仕様記述をより直感的かつ学習しやすくした。
原題: Logic of Fuzzy Paths / Kush Grover, Pratham Gupta, Jan Křetínský
日本語で読む → - 論文触覚/3次元再構成画像認識
TouchAnything: 拡散モデルによるスパースなロボット触覚からの3次元再構成
少数の触覚センサ情報と物体の大まかなクラス情報から、事前学習済みの2次元拡散モデルを幾何学的先行知識として活用し、物体の正確な3次元形状を再構成するフレームワークを提案した。
原題: TouchAnything: Diffusion-Guided 3D Reconstruction from Sparse Robot Touches / Langzhe Gu, Hung-Jui Huang, Mohamad Qadri 他
日本語で読む → - 論文強化学習/UAVロボティクス
限られたシミュレーション訓練下での捜索救助UAVミッションにおける目標条件付き強化学習のためのルールベース高レベルコーチング
固定ルールの高レベルアドバイザとオンライン学習する低レベル強化学習コントローラを組み合わせた階層型意思決定フレームワークを提案し、限られた訓練環境でも早期の安全性とサンプル効率を向上させる。
原題: Rule-based High-Level Coaching for Goal-Conditioned Reinforcement Learning in Search-and-Rescue UAV Missions Under Limited-Simulation Training / Mahya Ramezani, Holger Voos
日本語で読む → - 論文配送/ルーティングロボティクス
風の不確実性環境下における空陸協調マルチUAV配送のためのロバストなエネルギー考慮型ルーティング
風の影響を考慮したエネルギー消費モデルに基づき、UAV配送の帰還可能性をリアルタイムに評価するオンライン計画フレームワークを提案し、シミュレーションで成功率を向上させた。
原題: Robust Energy-Aware Routing for Air-Ground Cooperative Multi-UAV Delivery in Wind-Uncertain Environments / Tianshun Li, Hongliang Lu, Yanggang Sheng 他
日本語で読む → - 論文遠隔操作ロボティクス
Adaptor: 少数ショット学習とオペレータ横断汎化による支援遠隔操作の高度化
支援遠隔操作におけるオペレータ間の意図認識のばらつきを、ノイズ注入による軌道摂動と幾何学的キーフレーム抽出、および視覚言語モデルとの融合を用いた少数ショット学習フレームワークで解決する。
原題: Adaptor: Advancing Assistive Teleoperation with Few-Shot Learning and Cross-Operator Generalization / Yu Liu, Yihang Yin, Tianlv Huang 他
日本語で読む → - 論文生体模倣ロボティクスロボティクス
生体模倣ロボット関節を用いた関節受容器の固有受容能の探求
ロボット技術で作った生体模倣関節を用いて、I型関節受容器の固有受容能を定量評価し、曲げ・ねじり動作で平均誤差2度未満の位置感覚を実現できることを示した。
原題: Exploring the proprioceptive potential of joint receptors using a biomimetic robotic joint / Akihiro Miki, Shun Hasegawa, Sota Yuzaki 他
日本語で読む → - 論文パラレルマニピュレータロボティクス
冗長パラレルマニピュレータの用語と幾何学的側面について
パラレルキネマティクスマシン(PKM)における冗長性の分類を整理し、構成空間の幾何学に基づく一貫した用語と、入力特異点を回避する冗長駆動方式の幾何学的な説明を提案した論文。
原題: On the Terminology and Geometric Aspects of Redundant Parallel Manipulators / Andreas Mueller
日本語で読む → - 論文視覚言語モデルロボティクス
ROS 2向けFlorence-2ラッパー:ロボットシステムのためのマルチモードローカル視覚言語推論
ロボットシステムで利用可能な視覚言語モデルFlorence-2をROS 2で扱うためのラッパーを開発し、トピック駆動・サービス・アクションの3つのインタラクション方式とローカル実行を実現した。
原題: A ROS 2 Wrapper for Florence-2: Multi-Mode Local Vision-Language Inference for Robotic Systems / J. E. Domínguez-Vidal
日本語で読む → - 論文全身操作/VLAロボティクス
HEX: 人間型アライメント専門家によるクロスエンボディ全身操作
全身協調操作を実現するため、人間型ロボットに特化した状態中心フレームワークHEXを提案。多様な身体構造に適用可能な状態表現と、全身協調と時間的運動ダイナミクスをモデル化する専門家混合機構を導入し、実機での操作成功率と汎化性能を向上させた。
原題: HEX: Humanoid-Aligned Experts for Cross-Embodiment Whole-Body Manipulation / Shuanghao Bai, Meng Li, Xinyuan Lv 他
日本語で読む → - 論文3D再構成画像認識
LiDAR-慣性オドメトリとRGB直接ラベル転送によるインクリメンタルな意味論支援メッシュ生成
LiDAR-慣性スキャンから高品質な3Dメッシュを生成する際に、RGB画像のセマンティックラベルをフレーム単位で転送・融合し、TSDF融合を意味論で支援することで、点群の疎密やドリフトによる境界の不正確さを改善する手法を提案した。
原題: Incremental Semantics-Aided Meshing from LiDAR-Inertial Odometry and RGB Direct Label Transfer / Muhammad Affan, Ville Lehtola, George Vosselman
日本語で読む → - 論文自動運転評価cs.SE
TRACE: 自動運転評価のためのCARLAにおける事故のトポロジー認識型再構築
NHTSAの事故報告書を、道路トポロジーを保持した高忠実度CARLAシミュレーションに自動再構築するパイプラインを提案し、52の多様な事故シナリオのベンチマークを構築した。
原題: TRACE: Topology-aware Reconstruction of Accidents in CARLA for AV Evaluation / Nahian Salsabil, Sebastian Elbaum
日本語で読む → - 論文ロボット学習/逆動力学モデルロボティクス
StableIDM: 時空間リファインメントによるマニピュレータ切断下での逆動力学モデルの安定化
ロボットの視覚観測から動作指令を予測する逆動力学モデル(IDM)が、マニピュレータが画像から切れて見える状況で性能劣化する問題に対し、空間的特徴集約と時間的平滑化を組み合わせたフレームワークを提案し、精度と実ロボット成功率を向上させた。
原題: StableIDM: Stabilizing Inverse Dynamics Model against Manipulator Truncation via Spatio-Temporal Refinement / Kerui Li, Zhe Jing, Xiaofeng Wang 他
日本語で読む → - 論文歩行/モデル予測制御ロボティクス
RK-MPC: 不整地環境における四足歩行のための残差クープマンモデル予測制御
四足歩行ロボットのモデル誤差をデータ駆動で補正する残差予測器をクープマン理論に基づき組み込み、実時間性を保ちつつ予測精度を向上させたMPCフレームワークを提案。シミュレーションと実機で不整地歩行を実証した。
原題: RK-MPC: Residual Koopman Model Predictive Control for Quadruped Locomotion in Offroad Environments / Sriram S. K. S. Narayanan, Umesh Vaidya
日本語で読む → - 論文VLAAI
PRTS: 対比表現を用いたプリミティブ推論とタスク実行システム
視覚言語行動モデルを、教師あり模倣学習ではなく目標条件付き強化学習として再構成し、言語指示を目標として扱うことで、物理的な到達可能性を評価する統一埋め込み空間を学習する基盤モデルを提案した。
原題: PRTS: A Primitive Reasoning and Tasking System via Contrastive Representations / Yang Zhang, Jiangyuan Zhao, Chenyou Fan 他
日本語で読む → - 論文軌道計画ロボティクス
DAG-STL: 信号時相論理仕様下でのゼロショット軌道計画のための階層的フレームワーク
未知のダイナミクス下でSTL仕様を満たす軌道を計画するため、論理推論と軌道生成を分離し、分解・割り当て・生成の3段階からなる階層的フレームワークDAG-STLを提案した。
原題: DAG-STL: A Hierarchical Framework for Zero-Shot Trajectory Planning under Signal Temporal Logic Specifications / Ruijia Liu, Ancheng Hou, Xiao Yu 他
日本語で読む → - 論文安全性ロボティクス
RedVLA: 視覚言語行動モデルに対する物理的レッドチーミング
VLAモデルの物理的安全性リスクを事前検出するため、リスクシナリオ合成とリスク増幅の2段階からなるレッドチーミングフレームワークRedVLAを提案し、生成データで軽量ガードSimpleVLA-Guardも構築した。
原題: RedVLA: Physical Red Teaming for Vision-Language-Action Models / Yuhao Zhang, Borong Zhang, Jiaming Fan 他
日本語で読む → - 論文触覚/HRIHCI
表現的なロボットタッチの設計における「他者性」という品質
ロボットタッチの設計において、現実再現ではなく「他者性」を品質として捉え、曖昧さや多様な解釈を生む表現的なタッチデザインを提案する論文。
原題: Otherness as a Quality in Designing Expressive Robotic Touch / Ran Zhou, Laurens Boer, Daniel Leithinger 他
日本語で読む → - 論文強化学習/波面制御astro-ph.IM
モデルベース強化学習による焦点面波面制御
強化学習を用いて、望遠鏡の焦点面画像から非共通光路収差を自動検出・補正する新しい制御手法を提案した論文。
原題: Focal plane wavefront control with model-based reinforcement learning / Jalo Nousiainen, Iremsu Taskin, Markus Kasper 他
日本語で読む → - 論文UAV制御ロボティクス
外乱を考慮した予測型ビジュアルサーボによるUAVパイプライン近接点検
クアッドローターによるパイプライン近接点検のための、画像ベースのビジュアルサーボモデル予測制御(VMPC)と拡張状態カルマンフィルタを組み合わせた自律点検フレームワークを提案し、シミュレーションと実機実験で有効性を示した。
原題: Autonomous UAV Pipeline Near-proximity Inspection via Disturbance-Aware Predictive Visual Servoing / Wen Li, Hui Wang, Jinya Su 他
日本語で読む → - 論文マニピュレーションロボティクス
不確実性下での高精度接触操作のためのハイブリッド制御ポリシーの学習
強化学習を用いて、位置制御と力制御を動的に切り替えるハイブリッド制御ポリシーを学習し、不確実性の高い環境下での繊細なコネクタ挿入などの接触操作を高精度で実現する手法を提案した。
原題: Learning Hybrid-Control Policies for High-Precision In-Contact Manipulation Under Uncertainty / Hunter L. Brown, Geoffrey Hollinger, Stefan Lee
日本語で読む → - 論文ローカライゼーション画像認識
COMPASS: フロアプランに基づく視覚的ローカライゼーションのためのコンパクトなマルチチャネル事前地図とシーンシグネチャ
フロアプランの幾何情報と意味情報を活用し、二つの魚眼カメラを搭載したロボットの位置姿勢を推定するアルゴリズムを提案した。
原題: COMPASS: COmpact Multi-channel Prior-map And Scene Signature for Floor-Plan-Based Visual Localization / Muhammad Shaheer, Miguel Fernandez-Cortizas, Asier Bikandi-Noya 他
日本語で読む → - 論文SLAM画像認識
幾何学的有用性スコアリングによるTransformerベース単眼SLAMの高速化
単眼SLAMの計算冗長性を減らすため、フレームのマッピング価値を事前に予測する軽量なゲーティングネットワークLeanGateを提案し、90%以上の冗長フレームをスキップして85%以上の計算削減と5倍のスループット向上を実現した。
原題: Accelerating Transformer-Based Monocular SLAM via Geometric Utility Scoring / Xinmiao Xiong, Bangya Liu, Hao Wang 他
日本語で読む → - 論文VLAロボティクス
AnchorVLA: アンカー拡散による効率的なエンドツーエンド移動操作
移動操作において、拡散ポリシーの多様な行動生成を保ちつつ、推論コストを削減するため、アンカー軌道周辺で局所的に拡散する手法を提案し、実行時のドリフトを軽減する自己補正機構も導入した。
原題: AnchorVLA: Anchored Diffusion for Efficient End-to-End Mobile Manipulation / Jia Syuen Lim, Zhizhen Zhang, Peter Bohm 他
日本語で読む → - 論文マニピュレーションロボティクス
精密な物体配置のための分離点拡散
物体配置タスクを階層的かつ分離された点拡散フレームワークでモデル化し、配置精度と汎化性能を向上させた。
原題: Disentangled Point Diffusion for Precise Object Placement / Lyuxing He, Eric Cai, Shobhit Aggarwal 他
日本語で読む → - 論文経路計画ロボティクス
トレーラー牽引車両のハイブリッドA*に基づく後退経路計画
トレーラー牽引車両の後退駐車を、ジャックナイフ防止と衝突回避を考慮した改良ハイブリッドA*アルゴリズムで計画する手法を提案した。
原題: Hybrid A*-Based Reverse Path-Planning of a Vehicle with Trailer System / Xincheng Cao, Haochong Chen, Bilin Aksun-Guvenc 他
日本語で読む → - 論文群制御ロボティクス
OmniRobotHome: リアルタイム人機協調のためのマルチカメラ家庭プラットフォーム
家庭内ロボットの認識性能が対人インタラクションの質を左右するという主張を検証するため、48台の同期カメラと3台のマニピュレータを備えた実環境テストベッドを構築し、認識性能を劣化させた際のインタラクション品質の低下を定量的に示した。
原題: OmniRobotHome: A Multi-Camera Home Platform for Real-Time Human-Robot Interaction / Junyoung Lee, Inhee Lee, Sookwan Han 他
日本語で読む →