論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/23 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ベイズ学習機械学習
ベイズニューラルネットワークの全共分散スムージングによるオンライン適応
ニューラルネットワークを状態空間モデルとみなし、全共分散を保持した平滑化で重みの事後分布を閉形式更新する手法を提案し、オンライン適応やVLAモデルの方策適応に応用した。
原題: Full-Covariance Smoothing of Bayesian Neural Networks for Online Adaptation / Oren Wright, Haoming Jing, Qiaoan Shen 他
日本語で読む → - 論文空中マニピュレーションロボティクス
空中連続マニピュレータにおける空力外乱下のエンドエフェクタ位置推定のための時間学習
ドローンに搭載した連続マニピュレータのエンドエフェクタ位置を、空力外乱の影響下で推定するため、連続時間ニューラルネットワーク(CfC)を用いて残差を学習し、MLPやGRUより高精度に推定できることを示した。
原題: Temporal Learning for End-Effector Position Estimation under Aerodynamic Disturbances in Aerial Continuum Manipulation / Niloufar Amiri, Houman Masnavi, Farrokh Janabi-Sharifi
日本語で読む → - 論文VLA画像認識
潜在進化型ワールドアクションモデル
JEPAエンコーダの予測埋め込みを活用し、ビデオ拡散バックボーンに依存せずに行動生成と環境進化をモデル化するLeWAMを提案。さらにオフライン選好改善手法DemoDPOを導入した。
原題: Latent evolving World Action Model / Xueji Fang, Boqiang Duan, Hua Wu 他
日本語で読む → - 論文群制御ロボティクス
ロボット群におけるOCDMA LiDARのための動的分散型空間コード再利用
ロボット群のLiDAR干渉を抑えるため、ビーコンで維持する干渉近傍グラフに基づき空間再利用コードを動的に再割り当てする分散プロトコルを提案し、必要コード数がO(log N/log log N)で済むことを証明した。
原題: Dynamic, Decentralized Spatial Code Reuse for OCDMA LiDAR in Robot Swarms / Mohammad Hani Alomari
日本語で読む → - 論文ソフトロボティクスロボティクス
ソフトロボットのためのコロケーテッド形状制御
連続体ソフトロボットの形状を、駆動座標のみを制御するコロケーテッド制御で安定に収束させる一般フレームワークを提案し、PD/PID系制御器の安定性保証と実験検証を示した。
原題: Collocated Shape Regulation for Soft Robots / Pietro Pustina, Ebrahim Shahabi, Daniel Feliu-Talegon 他
日本語で読む → - 論文マニピュレーションロボティクス
OCC4M: 長期的操作のための物体中心4Dメモリによる時空間推論
物体中心の4Dメモリを構築し、視点が変わっても物体の位置や時間的同一性、収納関係を保持して、長期的な操作タスクの推論を可能にした研究。
原題: OCC4M: Object-Centric 4D Memory for Spatiotemporal Reasoning in Long-Horizon Manipulation / Jack B. Jedlicki, Tanguy Dieudonné, Heng Yang
日本語で読む → - 論文制御/MPPIロボティクス
運動ニューロンに着想を得たサンプリングによるモデル予測パス積分制御
運動ニューロンの動態を模した時間的に構造化されたサンプリング手法をMPPI制御に導入し、MuJoCoのアリモデルで標準的なガウスサンプリングと比較して制御の滑らかさが向上することを示した。
原題: Motoneuron-Inspired Sampling for Model Predictive Path Integral Control / Alexis Poignant, Jan Babič
日本語で読む → - 論文ワールドモデル画像認識
凍結フローは動きを忘れる:潜在フローワールドモデルにおける失われた運動の診断と復元
凍結した自己教師あり潜在空間上のフローを学習するワールドモデルが、物体の動きを失う問題を診断し、デコード経路の監督でフローのみを再学習するDARTを提案。
原題: Frozen Flows Forget: Diagnosing and Restoring Lost Motion in a Latent-flow World Model / Xiwen Chen, Rigaudiere Z. Li, Zhiruo Zhou 他
日本語で読む → - 論文VLAロボティクス
MemBodied: 視覚-言語-行動モデルのための再帰的連想記憶
VLAモデルに固定サイズのエピソード記憶を導入し、過去の観測を保持せずに履歴依存のマニピュレーションタスクを高成功率で実現した。
原題: MemBodied: Recurrent Associative Memory for Vision-Language-Action Models / Tej Deep Pala, Navonil Majumder, Bryce Goh 他
日本語で読む → - 論文ソーシャルナビゲーションロボティクス
どこに加わるべきか?言語誘導型目標予測によるロボットのグループ参加
自然言語で指定されたグループにロボットが参加するため、言語条件付きモデルでグループを特定し、人間の隊形事前分布を用いて社会的に適切な参加位置を予測する手法を提案した。
原題: Where Should I Join? Robot Group Joining via Language-Guided Goal Prediction / Zilin Fang, Zishuo Wang, Gim Hee Lee 他
日本語で読む → - 論文社会的AI/VRHCI
聞くことと映すこと:VR内の身体化AIエージェントに対する言語的調和と行動的模倣が社会的・共感的知覚に与える影響
VR内の身体化AIカウンセラーに言語的調和と表情・姿勢の模倣を組み合わせ、20名の被験者実験で共感や人間らしさの知覚への影響を調べた。
原題: Listening and Mirroring: The Effects of Verbal Attunement and Behavioral Mimicry on Social and Empathic Perceptions of Embodied AI Agents in VR / Nathalia Gomez, Haig Shamlian, Omar Khan 他
日本語で読む → - 論文身体性記憶/ベンチマーク画像認識
EmbodiedMemory-Bench:長期的な身体性タスクにおける身体性記憶のベンチマーク
長期的な身体性インタラクションにおける記憶能力を評価するEMem-Benchを提案し、空間・イベント・シーン記憶を統合する外部記憶システムEMemと8BポリシーEMem-8Bを開発した。
原題: EmbodiedMemory-Bench: Benchmarking Embodied Memory for Long-Horizon Embodied Tasks / Lizhou Liang, Xinyu Zhong, Miao Pan 他
日本語で読む → - 論文モデリング機械学習
散逸系のためのデータ駆動型離散時間深層リカレントニューラルネットワークモデリング
散逸性を構造的な重み制約と専用学習アルゴリズムで明示的に保証する深層離散時間RNNを提案し、安定性をリアプノフ理論で解析した。
原題: Data-driven discrete-time deep recurrent neural network-based modeling for dissipative systems / Tuan Luong, Hyungpil Moon
日本語で読む → - 論文マニピュレーションロボティクス
LiMA: 非同期拡散による長期想像からリアルタイム巧みな操作への橋渡し
低速な長期意図生成と高速な動作精緻化を非同期に分離した二重システム拡散フレームワークで、両腕巧みな操作をリアルタイムに実行する。
原題: LiMA: Bridging Long-term Imagination to Real-time Dexterous Manipulation via Asynchronous Diffusion / Ning Chen, Yankai Fu, Junkai Zhao 他
日本語で読む → - 論文安全フィルタロボティクス
不確実系に対する最小努力敵対ポテンシャルを用いた安全フィルタ
外乱や不確実性があるシステムでも安全を保証するため、外乱が故障を引き起こすのに必要な努力を定量化するLEAPを提案し、深層強化学習で構築する手法を開発した。
原題: LEAP-CBF: A Safety Filter for Uncertain Systems with Least-Effort Adversarial Potentials / Oswin So, Eric Yu, Chuchu Fan
日本語で読む → - 論文群制御制御
報酬率混雑ゲームとレプリケータ・ディンケルバッハ動力学
時間や作業量が制限されたロボットシステムで、単位時間あたりの報酬最大化を目指すエージェントのゲーム理論的枠組みを提案し、ディンケルバッハ変換とレプリケータ動力学による均衡・安定性解析を行った。
原題: Reward-Rate Congestion Games and Replicator--Dinkelbach Dynamics / Hassan Abdelraouf, Vaibhav Srivastava, Vijay Gupta
日本語で読む → - 論文安全強化学習ロボティクス
安全性を競技力へ:安全フィルタ付き強化学習による搾取されにくいロボット方策
競技タスク向けに、安全フィルタを敵対的RLで学習してからタスク方策を訓練する2段階フレームワークS2Cを提案し、安全性と競技性能・非搾取性を両立させた。
原題: Turning Safety into Competence: Minimally Exploitable Robot Policies via Safety-Filtered Reinforcement Learning / Ruihan Wu, Rui Yang, Donggeon David Oh 他
日本語で読む → - 論文マニピュレーションロボティクス
DEAL-Grasp: 幾何認識型巧みな把持生成のための分離アライメント表現
把持生成を「アライメント空間」での生成問題として再定式化し、剛体運動と関節運動を分離して流れマッチングで安定かつ物理的に妥当な巧みな把持を生成する手法を提案。
原題: DEAL-Grasp: Decoupled Alignment Representation for Geometry-Aware Dexterous Grasp Generation / Fuqiang Zhao, Qian Liu
日本語で読む → - 論文世界モデルロボティクス
InternW0: 効率的な実世界インタラクションのための基盤的物理世界モデル
上海AI Labが、視覚予測とロボット制御を非対称なvideo-actionアーキテクチャで統合した物理世界モデルInternW0を提案。約7,200時間のデータで学習し、化学合成やピペッティングなどの実世界タスクで評価した。
原題: InternW0: A Foundational Physical World Model for Efficient Real-World Interactions / Jisong Cai, Yao Mu, Ganlin Yang 他
日本語で読む → - 論文VLAロボティクス
InfiNoVA: 視点不変なロボットポリシーのための無限新規視点拡張
マルチカメラの実演を時間変化する3Dガウス表現として再構成し、任意の視点から幾何学的に一貫した新規視点画像を生成するデータ拡張手法を提案。未見視点での操作タスク成功率を大幅に向上させた。
原題: InfiNoVA: Infinite Novel View Augmentation for Viewpoint Invariant Robot Policies / Sai Puneeth Reddy Gottam, Elmar Rueckert, Vedant Dave
日本語で読む → - 論文ナビゲーションロボティクス
MCP経由のLLM駆動ロボットナビゲーションのための空間・意味推論
占有グリッドを画像化し意味注釈を付与する表現層をMCPツールとして提供し、既存ROSスタックを変更せずにLLMが自然言語指示でナビゲーションできる枠組みを提案した。
原題: Spatial and Semantic Reasoning for LLM-Driven Robot Navigation via MCP / Jungsoo Lee, Jaegyun Park, Wansoo Kim
日本語で読む → - 論文VLAロボティクス
視覚言語行動ポリシーのためのアドバンテージ誘導事後学習の分解
視覚言語行動ポリシーの事後学習において、アドバンテージ誘導強化学習の設計選択を分解し、段階的評価で有効なモジュール式レシピを特定した。
原題: Dissecting Advantage-Guided Post-Training for Vision-Language-Action Policies / Jiahang Cao, Hanye Zhao, Hang Lai 他
日本語で読む → - 論文線形代数/エッジGPUロボティクス
GLASS: エッジロボティクス向けのアーキテクチャ適応型・構成可能なデバイスサイド線形代数ライブラリ
GPU上でロボティクス向け線形代数・幾何計算をスレッド/ワープ/ブロック単位で実行できるヘッダオンリーCUDA C++ライブラリGLASSを提案し、実装選択をアーキテクチャごとにオフライン計測で最適化することでエッジGPUで最大73倍の高速化を実現した。
原題: GLASS: Architecture-Tuned, Composable, Device-Side Linear Algebra for Edge Robotics and Beyond / Brian Plancher
日本語で読む → - 論文VLAロボティクス
行動を変える記憶は行動を導く記憶ではない:履歴条件付きロボット方策の反事実的監査
ロボットの記憶が意思決定を導いているかを、同一の現在で二つの履歴を交差させる反事実的監査(CMA)で評価し、記憶への感度と信頼性を分離して検証した。
原題: Memory That Changes Action Is Not Memory That Guides It: Counterfactual Auditing of History-Conditioned Robot Policies / Jiajie Zhang, Yankai Xiang, Changhao Chen
日本語で読む → - 論文水陸両用移動ロボティクス
内部質量駆動による全方向水陸両用移動
内部の質量を動かすだけで回転し、陸上では転がり、水上ではフィンで推進する密閉球体ロボットMARBLEを開発した。
原題: Omnidirectional Amphibious Locomotion via Internal Mass Actuation / Niko Weaver, Boxi Xia, Li-Yu Lo 他
日本語で読む → - 論文UAV/MPPI/遮蔽回避ロボティクス
遮蔽領域を考慮したUAV飛行のためのモデル予測パス積分制御
オンライン占有マップから3次元の遮蔽境界を抽出し、隠れた移動体が到達しうる領域を予測してMPPIの軌道生成でペナルティを与えることで、遮蔽物から急に現れる障害物を回避するUAV制御手法を提案し、シミュレーションと実機で有効性を示した。
原題: OA-MPPI: Occlusion-Aware Model Predictive Path Integral Control for UAV Flight / Vittorio Palladino, Teaya Yang, Ruiqi Zhang 他
日本語で読む → - 論文外骨格・パーソナライズ機械学習
動作条件間の連続性を活用した外骨格パーソナライズのための文脈連続選好学習
外骨格のアシストを個人ごとに最適化するため、近い動作条件間で選好が滑らかに変化する性質を利用し、ガウス過程で選好を共有学習する手法CCPLを提案。少ないフィードバックで効率的に個人適合できることを足首・肘のデータで示した。
原題: Context-Continuous Preference Learning for Exoskeleton Personalization / Sunin Baek, Sungwoo Park, Daekyum Kim
日本語で読む → - 論文世界モデルロボティクス
PointCast: 剛体・関節・変形物体操作のための単一世界モデル
物体とエンドエフェクタ上の3D点集合を拡散トランスフォーマで予測する世界モデルを提案し、剛体・布・ロープ・多関節キャビネットの操作を単一アーキテクチャで扱えることを示した。
原題: PointCast: One World Model for Rigid, Articulated, and Deformable Object Manipulation / Hantao Ye, Ross Worobel, Zhuoli Xie 他
日本語で読む → - 論文強化学習/制御ロボティクス
時空間チューブ報酬を用いた信号時相論理仕様の全クラスに対する実用的強化学習
信号時相論理(STL)で表された複雑な高レベル仕様を満たすため、時空間チューブの幾何学的性質を利用した時間認識型強化学習フレームワークを提案し、入力制約を厳守しつつ履歴不要で効率的に連続制御方策を学習する。
原題: Tractable Reinforcement Learning for Full Class of Signal Temporal Logic Specifications Using Spatiotemporal Tube Reward / Vaishnavi Jagabathula, P Sangeerth, Pushpak Jagtap
日本語で読む → - 論文群制御制御
行動指向情報による分散制御とエージェント間相互作用
メッセージが受け手の行動を変える情報量を測り、それを機能と結びつける手法を提案し、四脚歩行ロボットDI-Walkerで他脚センサー利用の有効性を検証した。
原題: Action-Directed Information for Distributed Control and Agentic Interaction / Shlomo Dubnov
日本語で読む →