論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文シーン理解画像認識
GESTO: 動的シーンにおける推論のための人間中心の時空間メモリ
RGB-D観測から人間と物体のインタラクションを抽出し、永続的な4Dシーングラフに接地してイベント階層を構築する時空間メモリを提案。これにより、活動中心の時空間推論を実現する。
原題: GESTO: Human-Centric Spatio-Temporal Memory for Reasoning in Dynamic Scenes / Ermanno Bartoli, Buwei He, Dennis Rotondi 他
日本語で読む → - 論文空中マニピュレーション/制御ロボティクス
接触検査のための劣駆動空中マニピュレータのロバスト滑りモード・アドミッタンス制御
劣駆動ヘキサロータに1自由度マニピュレータを搭載し、接触検査時の力制御と軌道追従を両立するロバスト制御フレームワークを提案。滑りモード制御とアドミッタンス制御を統合し、シミュレーションでPIDより優れた性能と最大20Nの安定した力発揮を確認した。
原題: Robust Sliding Mode and Admittance Control of Underactuated Aerial Manipulators for Contact-Based Inspection / Tareq Aziz Alqutami, Yvan Petillot, Matthew W. Dunnigan 他
日本語で読む → - 論文マニピュレーションロボティクス
疎と密の融合:剛体-変形体相互作用を伴うロボット操作の対応関係に基づく手法
剛体と変形体が相互作用する操作タスク(衣類掛けや着衣補助など)のために、タスク固有の疎なキーポイントと変形体上の密な対応関係を組み合わせたハイブリッド表現を提案し、正確なキーポイント追跡と汎化を実現する。
原題: Sparse Meets Dense: Correspondence Guided Robotic Manipulation with Rigid-Deformable Interactions / Ziyu Zhu, Yue Chen, Xirui Liang 他
日本語で読む → - 論文強化学習/アクロバットロボティクス
強化学習による自転車アクロバット
強化学習を用いて自転車ロボットに多様なアクロバティックなスタント(ジャンプ、フリップ、ウィリーなど)を学習させ、状態依存トリガーでポリシーを切り替えるオーケストレータにより長期的な連続スタントを実現した。
原題: Bicycle Acrobatics with Reinforcement Learning / Shamel Fahmi, Arianna Ilvonen, Samuel Zapolsky 他
日本語で読む → - 論文オドメトリ推定ロボティクス
KING: 身体性を考慮した運動学グラフニューラルネットワークによる脚式・車輪式ロボットの統一的動作表現
脚式・車輪式ロボットの運動学を統一グラフで表現するGNNベースのモデルを提案し、多様なロボットで高精度なオドメトリ推定を実現。
原題: KING: Embodiment-Aware Kinematic Graph Neural Network for Unified Motion Representation of Legged and Wheeled Robots / Taku Okawara, Aoki Takanose, Kenji Koide 他
日本語で読む → - 論文医療ロボティクスロボティクス
MRI室内での針ベース遠隔操作のためのマスタースレーブロボットマニピュレータ
MRI室内での腹部介入を目的とした、流体伝達によるマスタースレーブ型のMR安全なロボットマニピュレータを提案。手動・デジタル・ハイブリッド・協調制御モードを備え、リアルタイムMRIガイド下での介入を可能にする。
原題: A Master-Slave Robot Manipulator for Needle-Based Teleoperation in MRI Chamber / Omar Curiel, Jing-Yuan Huang, Po-Chih Chen 他
日本語で読む → - 論文植物表現型解析画像認識
3D骨格抽出と言語解析を統合したマルチモーダル植物根表現型解析
ロボット3Dセンシングで得た点群から根の3D骨格を抽出し、その定量形態特徴を基にGPTを微調整して解釈可能な対話型解析を行う、植物根の表現型解析フレームワークを提案した。
原題: Multimodal Plant Root Phenotyping with Integration of 3D Skeleton Extraction and Language Analysis / Jiakai Lin, Zijun Li, Guoyu Lu
日本語で読む → - 論文マニピュレーションロボティクス
AdaDexGrasp: 3次元視覚触覚表現融合による適応的器用把持
視覚と触覚を統合した表現を用いて、把持計画と接触後の適応的修正を行う統一フレームワークを提案し、多様な物体での把持成功率と汎化性を向上させた。
原題: AdaDexGrasp: Adaptive Dexterous Grasping via 3D Visuo-Tactile Representation Fusion / Xirui Liang, Jiaqi Liang, Jingkai Xu 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
文脈を考慮したモーション事前分布によるヒューマノイド制御の学習
タスク文脈に応じてモーション事前分布の関連性を適応的に重み付けし、ヒューマノイド制御の性能とサンプル効率を向上させるフレームワークを提案した。
原題: Learning Context-Aware Motion Priors for Humanoid Control / Yunyang Mo, Yi Gu, Yangchen Zhou 他
日本語で読む → - 論文操作ロボティクス
EmbodiedVAE: 効率的で制御可能な身体化操作のための分離型ビデオVAE
ロボット操作の世界モデル向けに、ロボットアームの動きと背景を分離して圧縮する新しいビデオVAEを提案し、高圧縮率で高品質な再構成と精密な動作制御を実現した。
原題: EmbodiedVAE: Disentangled Video VAE for Efficient and Controllable Embodied Manipulation / Jiayi Luo, Hanxin Zhu, Chen Gao 他
日本語で読む → - 論文計画ロボティクス
PACE: 時間効率的な具現化計画のための適応予算配分
推論と実行をインターリーブし、実行時間に合わせて推論トークン予算を動的に調整することで、具現化計画の推論遅延を大幅に削減するフレームワークを提案した。
原題: PACE: Adaptive Budget Allocation for Time-Efficient Embodied Planning / Yuchen Huang, Xijiang Ying, Zhenhua Ma 他
日本語で読む → - 論文医療支援/顕微鏡/自動化HCI
LSTMによる視線とピペット動作解釈を用いた視野拡大顕微鏡の自動視野調整
ICSI手技中に作業者が行う視野調整を自動化するため、LSTMモデルでピペットの位置・速度と作業者の視線から適切な視野サイズを予測し、視野拡大顕微鏡に統合した。初心者の作業時間が60.5秒から48.0秒に短縮され、熟練者並みの速度を達成した。
原題: Automatic Field-of-View Adjustment for a View-Expansive Microscope via LSTM-Based Gaze and Pipette Motion Interpretation / Kenta Yokoe, Takuya Hara, Tadayoshi Aoyama
日本語で読む → - 論文群制御ロボティクス
計画と回避:マルチエージェント環境におけるリアルタイム航空機軌道調整
優先軌道を維持するために、周辺航空機への回避指示をリアルタイムで生成するフレームワークを提案し、実際のADS-Bデータを用いて評価した。
原題: Plan-and-Avoid: Real-Time Aircraft Trajectory Coordination in a Multi-Agent Environment / Huseyin Emre Tekaslan, Ella M. Atkins, Natasha Neogi
日本語で読む → - 論文能動的再構築ロボティクス
TRACE: 能動的シーン再構築のためのエルゴード軌道最適化
ガウススプラッティングを用いた能動的再構築において、貪欲な次善視点選択ではなく、エルゴード被覆問題として軌道を最適化する手法を提案し、ReplicaデータセットでPSNRを1.5dB向上させた。
原題: TRACE: Ergodic Trajectory Optimization for Active Scene Reconstruction / Ziyue Zheng, Linli Shi, Bingkun He 他
日本語で読む → - 論文VLAロボティクス
再構成の迷子:視覚-言語-行動モデルにおける行動表現と言語の整合
行動軌跡には言語的意味情報が含まれるが、再構成のみのトークン化で失われるため、凍結VLMで指示を復元する補助損失を加えた意味整合トークナイザSALTを提案し、SimplerEnvで成功率を大幅に向上させた。
原題: Lost in Reconstruction: Aligning Action Representations with Language in Vision-Language-Action Models / Li Wenjie, Yash Jangir, Ignacy Stepka 他
日本語で読む → - 論文複素解析math.CV
Berkson-Porta表現による正確な収縮率:鋭い閾値とそのHerglotz核障害
単位円板上の正則自己写像の半群が、内部固定点での線形化に基づく最良の収縮率を達成する条件を、Berkson-Porta表現を用いて正確に特徴づけ、自然なパラメータ族に対して鋭い閾値を導出した。また、閾値が成り立たない例を示し、その原因をHerglotz表現の測度の集中に帰着させた。
原題: Exact Contraction Rates via the Berkson--Porta Representation: A Sharp Threshold and Its Herglotz-Kernel Obstruction / Soumic Sarkar
日本語で読む → - 論文遠隔操作ロボティクス
遠隔操作車両のためのニューラルネットワークベースのテレオペレーション
通信遅延や未モデル化外乱に対処するため、波動変数法と適応RBFネットワークを組み合わせた片方向テレオペレーション方式を提案し、シミュレーションと実機検証で有効性を示した。
原題: A Neural Network Based Teleoperation for Remote Controlled Vehicles / Ning Ding, Azim Eskandarian
日本語で読む → - 論文ロボットポリシー改善ロボティクス
ループに留まる必要はない:ロボットポリシー改善のためのエージェント型ロボティクスループ
LLMコントローラが耐久性のあるトレーニング・評価・改善トランザクションを通じて使い捨てワーカーを駆動する、ロボットポリシー改善のための制御プレーンを提案。ツールの品質を測定・記録し、アーティファクト変更時に失効させることで、人間の介入なしに堅牢な改善を実現する。
原題: You Don't Need To Stay in The Loop: An Agentic Robotics Loop for Robot-Policy Improvement / Hang Yu
日本語で読む → - 論文触覚/センシングロボティクス
ポケットサイズロボットとの短時間触覚インタラクションにおける埋め込み型光電容積脈波センシングの実現可能性:IMUと信頼度ベースフィルタリングを用いた検討
ポケットサイズのコンパニオンロボットにPPGセンサを埋め込み、触覚インタラクション中の心拍数を計測する手法を提案。IMUと信頼度ベースのフィルタリングでモーションアーティファクトを低減し、手首装着センサと同等の精度を実証した。
原題: Feasibility of Embedded Photoplethysmography Sensing in Short-Duration Tactile Interactions With Pocket-Sized Robots Using IMU- and Confidence-Based Filtering / Turjja Datta, Morten Roed Frederiksen
日本語で読む → - 論文ナビゲーションロボティクス
AECNav: 効率的なゼロショットオープンボキャブラリ物体ナビゲーションのための能動的証拠統合
ゼロショット物体ナビゲーションを証拠駆動の認識から意思決定への問題として再構成し、共有エンコーディングとクラスタレベルの信念統合、情報利得に基づく能動的探索により、高精度かつ低遅延なナビゲーションを実現した。
原題: AECNav: Active Evidence Consolidation for Efficient Zero-Shot Open-Vocabulary Object Navigation / Guanlin Liu, Shaobin Ling, Renyuan Liu 他
日本語で読む → - 論文不確実性校正ロボティクス
粒子ベース共形予測による接触を考慮した不確実性校正:層状構成空間における
接触を伴うロボット動作の将来構成を確率的に保証する予測領域を生成する、幾何学的認識を持つ共形予測アルゴリズムを提案。
原題: Particle-Based Conformal Prediction for Contact-Aware Uncertainty Calibration in Stratified Configuration Spaces / Luís Marques, Kristian Popov, Dmitry Berenson
日本語で読む → - 論文群制御ロボティクス
局所通信によるスケーラブルなマルチエージェント迷路探索
未知の迷路状環境を複数エージェントが局所通信のみで協調して探索・到達する分散アルゴリズムを提案し、完全性と最適性を理論的に保証した。
原題: Scalable Multi-Agent Maze Traversal with Local Communication / Julian Rau, Jahir Argote-Gerald, Grace McFassel 他
日本語で読む → - 論文マニピュレーションロボティクス
GORDON: グラフベースのオブジェクト中心報酬による長期的操作タスクの分解
ビデオデモからオブジェクト中心のグラフ表現を学習し、密な報酬を生成することで、長期的な操作タスクを自動的にサブタスクに分解して学習する手法を提案した。
原題: GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation / Andrea Protopapa, Davide Buoso, Francesca Pistilli 他
日本語で読む → - 論文データ選択/器用操作/VLAロボティクス
SiMDex: 類似する自己中心視点動画のマイニングによるクロスエンボディ器用操作
ロボットの器用操作のためのVLAモデル訓練に有効な人間の自己中心視点動画を、類似性に基づくデータマイニングで選別するフレームワークを提案。約3200万サンプルから1.49百万件を選び、成功率を47.7%から61.1%に向上させた。
原題: SiMDex: Mining Similar Egocentric Videos for Cross-Embodiment Dexterous Manipulation / Nie Lin, Takehiko Ohkawa, Sijin Chen 他
日本語で読む → - 論文手術ロボティクスロボティクス
信頼性の高い双腕手術サブタスク操作のための軌道発散ホライズン決定
手術用VLAモデルの固定長オープンループ動作による累積誤差を軽減するため、軌道発散に基づく適応的実行ホライズン決定手法を提案し、実機で検証した。
原題: Trajectory Divergence Horizon Decision for Reliable Dual-Arm Surgical Subtask Manipulation / Mingwu Su, Guankun Wang, Jinsong Lin 他
日本語で読む → - 論文VLAロボティクス
GWM-VLA:視覚言語行動学習のための幾何認識潜在世界モデリング
視覚言語行動モデルの堅牢性を向上させるため、幾何情報を考慮した多視点状態符号化と潜在世界モデルを導入し、手首視点の予測と共有潜在行動表現によりロボット操作性能を高めた。
原題: GWM-VLA: Geometry-Aware Latent World Modeling for Vision-Language-Action Learning / Yanping Zhao, Hang Yu, Yiwei Wang 他
日本語で読む → - 論文VLAロボティクス
BridgeVLA++: 3次元操作のためのデータ効率的で汎化可能なメモリ拡張型視覚言語行動フレームワーク
事前学習済み視覚言語モデルを活用した3次元ロボット操作フレームワークBridgeVLAを拡張し、空間的・時間的メモリを統合することで、データ効率と汎化性能を保ちつつ、記憶依存の操作タスクで最先端の性能を達成した。
原題: BridgeVLA++: A Data-Efficient, Generalizable, and Memory-Augmented Vision-Language-Action Framework for 3D Manipulation / Peiyan Li, Yuze Zhu, Yixiang Chen 他
日本語で読む → - 論文計画・検証ロボティクス
スイッチングポリシーによるMDP上の制約付きsc-LTL計画の最適化
マルコフ決定過程上で、安全性制約を満たしつつ目的を最大化する最適ポリシーを合成する問題を扱い、スイッチングポリシーが最適解となることを示し、線形計画法で解けるようにした。
原題: Optimal Constrained sc-LTL Planning in MDPs via Switching Policies / Zetong Xuan, Yu Wang
日本語で読む → - 論文外骨格/制御ロボティクス
ATP: 解剖学的トルクとパッシビティベース制御による安全な上肢外骨格支援フレームワーク
上肢外骨格の安全な支援のため、解剖学的トルクとパッシビティベース制御を組み合わせたフレームワークを提案。強化学習で筋肉制御器を訓練し、オンラインでトルクを調整、エネルギータンクでパッシビティを保証する。
原題: ATP: Anatomical Torque with Passivity-based Control Framework for Safe Upper-Limb Exoskeleton Assistance / Yu Chen, Gong Chen, Xiang Li
日本語で読む → - 論文歩行ロボティクス
四足歩行のための迅速な身体適応フレームワーク
四足ロボットが身体の変化(関節の制限や質量の変化)に迅速に適応するためのオンライン適応フレームワークを提案し、シミュレーションと実機で有効性を示した。
原題: Rapid Embodiment Adaptation for Quadrupedal Locomotion / Dichen Li, Bo Ai, Nico Bohlinger 他
日本語で読む →