論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ナビゲーションロボティクス
GSAT: 自己教師あり学習と異常検知による多様な地形の幾何学的走行可能性推定
ロボットの安全な自律航法のため、自己教師あり学習と異常検知を組み合わせ、負例なしで走行可能領域を分類する新しい手法を提案した。
原題: GSAT: Geometric Traversability Estimation using Self-supervised Learning with Anomaly Detection for Diverse Terrains / Dongjin Cho, Miryeong Park, Juhui Lee 他
日本語で読む → - 論文歩行ロボティクス
不連続な足場におけるヒューマノイド歩行のための知覚型可変タイミング足踏み計画
障害物や危険な地面領域により不連続な足場環境で、足の配置と歩行タイミングを同時に計画する混合整数モデル予測制御フレームワークを提案。深度画像から凸な可踏領域を抽出し、DCMダイナミクスに基づく安全性制約を組み込むことで、実時間で動的に一貫した歩容を生成する。
原題: Perceptive Variable-Timing Footstep Planning for Humanoid Locomotion on Disconnected Footholds / Zhaoyang Xiang, Upama Pant, Ayonga Hereid
日本語で読む → - 論文ロボット制御ロボティクス
高精度ヘキサポッドロボットアクチュエータのモデルベース熱ドリフト補償
ヘキサポッドロボットのアクチュエータの熱膨張による位置誤差を、表面温度から膨張状態を推定するモデルを用いて補正し、実験で80%以上の誤差低減を実証した。
原題: Model-based thermal drift compensation for high-precision hexapod robot actuators / Clément Robert, Alain Vissiere, Olivier Company 他
日本語で読む → - 論文位置推定ロボティクス
犬のデッドレコニングのためのモデルベースおよびニューラル支援アプローチ
慣性センサのみを用いて生物学的な犬とロボット犬の正確な位置推定を行うため、モデルベースとニューラル支援の3つのアルゴリズムを提案し、実データで評価した。
原題: Model-Based and Neural-Aided Approaches for Dog Dead Reckoning / Gal Versano, Itai Savin, Itzik Klein
日本語で読む → - 論文ナビゲーションロボティクス
深層強化学習とベイズ推論の統合による移動ロボットの物体探索
物体探索のためのハイブリッドフレームワークを提案。ベイズ推論で物体位置の信念地図を更新し、深層RLでその確率的表現から行動を選択する。シミュレーションで成功率向上と探索効率改善を確認。
原題: Integrating Deep RL and Bayesian Inference for ObjectNav in Mobile Robotics / João Castelo-Branco, José Santos-Victor, Alexandre Bernardino
日本語で読む → - 論文データ収集/構成的一般化ロボティクス
汎用ロボットデータフライホイールに向けて:高次元因子分解と構成
ロボットデータの多様性不足と効率性の課題に対し、データ分布を因子空間に分解し、因子ごとの収集と反復学習で構成的一般化を促すF-ACILフレームワークを提案。実世界実験で少ないデモ数で大幅な性能向上を実証した。
原題: Towards Generalizable Robotic Data Flywheel: High-Dimensional Factorization and Composition / Yuyang Xiao, Yifei Zhou, Haoran Wang 他
日本語で読む → - 論文状態推定ロボティクス
等変フィルタ変換による一貫性と効率性を備えた視覚慣性航法
視覚慣性航法において、異なる対称性を持つ等変フィルタ間の変換則を導出し、一貫性を保証しつつ計算効率を向上させる手法を提案した。
原題: Equivariant Filter Transformations for Consistent and Efficient Visual--Inertial Navigation / Chungeng Tian, Fenghua He, Ning Hao
日本語で読む → - 論文VLAロボティクス
FocusVLA: 視覚言語行動モデルにおける視覚情報の焦点化
VLAモデルの性能が視覚表現の質ではなく視覚情報の活用方法に制限されることを示し、注意をタスク関連領域に集中させるFocusVLAを提案した。
原題: FocusVLA: Focused Visual Utilization for Vision-Language-Action Models / Yichi Zhang, Weihao Yuan, Yizhuo Zhang 他
日本語で読む → - 論文UAV制御ロボティクス
イベント-深度融合に基づく高速UAV障害物回避のためのエンドツーエンド飛行制御ネットワーク
深度カメラとイベントカメラの相補的な特性を双方向クロスアテンションで融合し、模倣学習で訓練したエンドツーエンドの飛行制御ネットワークを提案。高速飛行時の障害物回避成功率を大幅に向上させた。
原題: An End-to-end Flight Control Network for High-speed UAV Obstacle Avoidance based on Event-Depth Fusion / Dikai Shang, Jingyue Zhao, Shi Xu 他
日本語で読む → - 論文空中マニピュレーションロボティクス
AeroGrab: 混雑環境における空中把持のための統合フレームワーク
混雑環境での空中把持を実現するため、言語指示に基づく対象物の能動的探索と衝突を考慮した把持候補の評価を統合したエンドツーエンドのパイプラインを提案した。実環境実験でその有効性を示した。
原題: AeroGrab: A Unified Framework for Aerial Grasping in Cluttered Environments / Shivansh Pratap Singh, Naveen Sudheer Nair, Samaksh Ujjawal 他
日本語で読む → - 論文イベントカメラ画像認識
効率的なイベントカメラボリュームシステム
イベントカメラのストリームを連続時間のディラックインパルス列としてモデル化し、DCT/DTFT/DWT変換と密度適応型選択により圧縮するフレームワークを提案。圧縮アーティファクトを除去しつつ、下流タスクでの汎化性能を向上させる。
原題: Efficient Event Camera Volume System / Juan Camilo Soto, Ian Noronha, Saru Bharti 他
日本語で読む → - 論文バイオハイブリッドロボティクスロボティクス
バイオハイブリッドロボットシステムのためのワイヤレス生体電子制御アーキテクチャ
組織工学によるバイオハイブリッドロボットのワイヤレス制御を、信号伝達・空間選択性・拡張性・界面安定性を統合した共設計問題として定式化し、3つの制御戦略を分析して設計指針を提案した論文。
原題: Wireless bioelectronic control architectures for biohybrid robotic systems / Hiroyuki Tetsuka, Minoru Hirano
日本語で読む → - 論文VLAロボティクス
ROI駆動フォビエーション注意による視覚-言語-行動システムの統一エゴセントリック表現
エンドエフェクタの姿勢を前方運動学で外部カメラに投影し、手中心の関心領域(ROI)を切り出すことで、手首カメラなしに高解像度の局所情報と全体文脈を両立するデータ表現を提案した。
原題: ROI-Driven Foveated Attention for Unified Egocentric Representations in Vision-Language-Action Systems / Xinhai Sun, Xiang Shi, Menglin Zou 他
日本語で読む → - 論文VLA画像認識
DualCoT-VLA: 視覚と言語の連鎖的推論を並列化した視覚言語行動モデル
複雑なタスクで苦戦するVLAモデルに対し、視覚的CoTと言語的CoTを並列に統合し、推論遅延を減らして高性能を実現した。
原題: DualCoT-VLA: Visual-Linguistic Chain of Thought via Parallel Reasoning for Vision-Language-Action Models / Zhide Zhong, Junfeng Li, Junjie He 他
日本語で読む → - 論文群制御ロボティクス
連結された四脚ロボットによる協調運搬タスクのためのマルチエージェント局所衝突回避学習
四脚ロボット2台が物体を連結して運搬する際、事前地図や経路計画なしにセンサ情報のみで障害物を回避しながら目標方向へ追従する強化学習ベースの階層的制御手法を提案した。
原題: Learning Multi-Agent Local Collision-Avoidance for Collaborative Carrying tasks with Coupled Quadrupedal Robots / Francesca Bray, Simone Tolomei, Andrei Cramariuc 他
日本語で読む → - 論文VLA/ロバスト性/メモリロボティクス
RoboHarness:メモリ拡張型ポリシーハーネスによる視覚言語行動モデルの文脈内適応ロバスト性向上
凍結したVLAモデルを微調整なしでロバスト化するため、デュアルメモリRAGとマルチモーダルLLMによる帰属駆動オーケストレータ、MCP介入を備えたオンラインパイプラインと、オフラインのメモリ統合を提案し、平均成功率を56.6%向上させた。
原題: RoboHarness: A Memory-Augmented Policy Harness for Vision-Language-Action Model Robustness via In-Context Adaptation / Zhuoran Li, Zhiyang Li, Kaijun Zhou 他
日本語で読む → - 論文楽器ロボットHCI
半自動フルートロボットとその音響センシング
フルート演奏の指使いと低音域のエンブシュア制御を自動化する半自動ロボットを開発し、MIDI入力による自動運指とヘッドジョイント回転による低音域支援を実現した。音響解析により全音域での正確なピッチ生成と低音域での音色変化を確認した。
原題: Semi-Automatic Flute Robot and Its Acoustic Sensing / Hikari Kuriyama, Hiroaki Sonoda, Kouki Tomiyoshi 他
日本語で読む → - 論文制御/状態推定制御
未モデル化ダイナミクスを伴う差動駆動ロボットのEKF状態推定に基づく知的制御
未知の非線形ダイナミクスを持つ差動駆動ロボットに対し、ニューラルネットワークと拡張カルマンフィルタを組み合わせた制御・状態推定フレームワークを提案し、シミュレーションと実機で速度追従誤差を最大53.91%削減した。
原題: Intelligent Control of Differential Drive Robots Subject to Unmodeled Dynamics with EKF-based State Estimation / Amos Alwala, Yuchen Hu, Gabriel da Silva Lima 他
日本語で読む → - 論文ナビゲーションロボティクス
車いす向け社会的認識と透明性を備えた自律移動ナビゲーションフレームワーク
車いす利用者のための自律移動システムに、大規模言語モデルを用いて他者の意図を予測し社会的状況を認識する意思決定機構と、各経由点での判断理由をテキストで提示する透明性機能を統合したフレームワークを提案し、シミュレーションで評価した。
原題: SAATT Nav: a Socially Aware Autonomous Transparent Transportation Navigation Framework for Wheelchairs / Yutong Zhang, Shaiv Y. Mehra, Bradley S. Duerstock 他
日本語で読む → - 論文ナビゲーションロボティクス
SignNav: 大規模屋内環境における標識を活用した意味的視覚ナビゲーション
標識の意味的手がかりを解釈して目的地へ移動する新しいナビゲーションタスクSignNavを提案し、空間・時間認識トランスフォーマー(START)モデルで80%の成功率を達成した。
原題: SignNav: Leveraging Signage for Semantic Visual Navigation in Large-Scale Indoor Environments / Jian Sun, Yuming Huang, He Li 他
日本語で読む → - 論文オドメトリロボティクス
SE(3)-LIO: SE(3)多様体上の同時分布ポーズによる滑らかなIMU伝播を用いた高精度・高ロバストなLiDAR-慣性オドメトリ
本論文では、IMU伝播をSE(3)多様体上で行い、回転変化を並進に適切に反映させるとともに、予測ポーズ間の相関を考慮した不確かさを運動補償に組み込むことで、LiDAR-慣性オドメトリの精度とロバスト性を向上させる手法を提案している。
原題: SE(3)-LIO: Smooth IMU Propagation With Jointly Distributed Poses on SE(3) Manifold for Accurate and Robust LiDAR-Inertial Odometry / Gunhee Shin, Seungjae Lee, Jei Kong 他
日本語で読む → - 論文VLAロボティクス
AnoleVLA: 深い状態空間モデルを用いたモバイル操作のための軽量視覚言語行動モデル
言語指示に基づくロボット操作のための軽量な視覚言語行動モデルを提案し、深い状態空間モデルを用いて効率的に動作させ、実機で高い成功率と高速な推論を達成した。
原題: AnoleVLA: Lightweight Vision-Language-Action Model with Deep State Space Models for Mobile Manipulation / Yusuke Takagi, Motonari Kambara, Daichi Yashima 他
日本語で読む → - 論文マニピュレーションロボティクス
押す・押し付ける・滑らせる:低次元モデルによるモード認識型平面接触操作
平面非把持操作を、接触トポロジー選択と低次元運動学モデルに基づくモード認識型フレームワークで実現し、最適化不要の高速な操作を提案した。
原題: Push, Press, Slide: Mode-Aware Planar Contact Manipulation via Reduced-Order Models / Melih Özcan, Umut Orguner, Ozgur S. Oguz
日本語で読む → - 論文四足歩行ロボティクス
四足ロボットの斜面歩行におけるエネルギー予測
四足ロボットの野外でのエネルギー消費を、傾斜角と進行方向に基づく簡易モデルで予測する手法を提案し、実地検証でその有効性を示した論文。
原題: Energy Prediction on Sloping Ground for Quadruped Robots / Mohamed Ounally, Cyrille Pierre, Johann Laconte
日本語で読む → - 論文計画/強化学習ロボティクス
GraSP-STL: オフライン目標条件付き強化学習によるゼロショット信号時相論理計画のためのグラフベースフレームワーク
オフラインデータのみを用いて、未見のSTL仕様を満たす制御戦略をゼロショットで合成するグラフ探索ベースのフレームワークを提案した。
原題: GraSP-STL: A Graph-Based Framework for Zero-Shot Signal Temporal Logic Planning via Offline Goal-Conditioned Reinforcement Learning / Ancheng Hou, Ruijia Liu, Xiang Yin
日本語で読む → - 論文遠隔操作/模倣学習ロボティクス
HumDex: ヒューマノイド器用操作を簡単にする
ヒューマノイド全身の器用な操作のためのポータブル遠隔操作システムを提案し、IMUベースのモーショントラッキングと学習ベースのリターゲティングで高品質なデモデータ収集を実現。さらに、多様な人間の動作データでの事前学習とロボットデータでの微調整による模倣学習フレームワークを導入し、汎化性能を向上させた。
原題: HumDex: Humanoid Dexterous Manipulation Made Easy / Liang Heng, Yihe Tang, Jiajun Xu 他
日本語で読む → - 論文群制御ロボティクス
非同期センサ融合によるマルチロボットの分散協調自己位置推定
GPSの使えない環境で、各ロボットが拡張カルマンフィルタで局所的に自己位置推定しつつ、通信可能なときだけ計測情報を共有する分散協調測位フレームワークを提案。静的ランドマークと他ロボットを併用し、非同期・異なるサンプリングレートのセンサにも対応する。
原題: Decentralized Cooperative Localization for Multi-Robot Systems with Asynchronous Sensor Fusion / Nivand Khosravi, Niusha Khosravi, Mohammad Bozorg 他
日本語で読む → - 論文VLAロボティクス
Ψ₀: 汎用人型ロコマニピュレーションに向けたオープン基盤モデル
高品質な一人称視点の人間動画でVLMを事前学習し、人型ロボットの実機データで追加学習する段階的パラダイムにより、少ないデータで人型ロコマニピュレーションを実現するオープン基盤モデルを提案した。
原題: $\Psi_0$: An Open Foundation Model Towards Universal Humanoid Loco-Manipulation / Songlin Wei, Hongyi Jing, Boqian Li 他
日本語で読む → - 論文ナビゲーションロボティクス
社会的に適合したナビゲーションのためのグループ競合学習による軽量視覚言語モデルの性能向上
軽量な視覚言語モデル(VLM)の推論能力を高めるため、グループ競合学習(GCL)という戦略を提案し、社会的に適合したナビゲーションのベンチマークで性能を大幅に向上させた。
原題: Enhancing Lightweight Vision Language Models through Group Competitive Learning for Socially Compliant Navigation / Xinyu Zhang, Atsushi Konno, Toshihiko Yamasaki 他
日本語で読む → - 論文操作ロボティクス
短期的視野を超えて:非マルコフ的シミュレーションベンチマークにおける頑健な長期操作のためのVQメモリ
非マルコフ的で長期的な操作タスクを評価する新しいベンチマーク「RuleSafe」を提案し、過去の状態を離散トークンに符号化するVQメモリ表現が、既存のVLAモデルの長期計画と汎化性能を向上させることを示した。
原題: Beyond Short-Horizon: VQ-Memory for Robust Long-Horizon Manipulation in Non-Markovian Simulation Benchmarks / Honghui Wang, Zhi Jing, Jicong Ao 他
日本語で読む →