論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ロッド力学制御
断面変形を考慮した幾何学的厳密ロッドのリー群変分積分器
円形断面を持つ3次元コセラットロッドの断面変形を取り入れた運動方程式を導出し、リー群変分積分器で離散化することで体積保存やエネルギー保存を実現した。
原題: Lie Group Variational Integrator for the Geometrically Exact Rod with Circular Cross-Section Incorporating Cross-Sectional Deformation / Srishti Siddharth, Vivek Natarajan, Ravi N. Banavar
日本語で読む → - 論文HRIロボティクス
ヒューマンロボットインタラクションにおける擬人化と擬人模倣の明確化
HRIとソーシャルロボティクスにおいて、ユーザーがロボットに人間らしさを知覚する「擬人化」と、開発者がロボットに人間らしい特徴を設計する「擬人模倣」を概念的に区別し、今後の研究・設計・評価の基盤を提供する。
原題: Disambiguating Anthropomorphism and Anthropomimesis in Human-Robot Interaction / Minja Axelsson, Henry Shevlin
日本語で読む → - 論文ナビゲーションロボティクス
CoReLIN: 制約ベース推論によるゼロショット生涯対話型ナビゲーション
LLMとシーングラフを用いて、移動ロボットが障害物を移動させ経路を切り開きながら連続的な物体配置タスクをこなす生涯対話型ナビゲーション手法を提案。
原題: CoReLIN: Constraint-based Reasoning for Zero-shot Lifelong Interactive Navigation / Apoorva Vashisth, Manav Kulshrestha, Pranav Bakshi 他
日本語で読む → - 論文マニピュレーションロボティクス
変形物体操作のための選好整合視覚運動拡散ポリシー
衣類などの変形物体を折り畳むタスクで、人間の好みに合わせた動作を少ない実演から学習する選好整合手法RKOを提案し、実機実験で有効性を示した。
原題: Preference Aligned Visuomotor Diffusion Policies for Deformable Object Manipulation / Marco Moletta, Michael C. Welle, Danica Kragic
日本語で読む → - 論文遠隔操作ロボティクス
TriPilot-FF: 力覚フィードバックを備えた協調型全身遠隔操作システム
移動マニピュレータの全身遠隔操作のため、足踏みペダルとLiDARによるペダル力覚提示、両腕リーダーフォロワ、腕の力覚反射を統合したシステムを開発し、長期的な操作や精密な移動を支援することを示した。
原題: TriPilot-FF: Coordinated Whole-Body Teleoperation with Force Feedback / Zihao Li, Yanan Zhou, Ranpeng Qiu 他
日本語で読む → - 論文群制御ロボティクス
RANT: アリに着想を得た粒子フィルタ定位と仮想フェロモン調整による多ロボット熱帯雨林探索
ノイズの多い未知環境で、粒子フィルタ定位と仮想フェロモンによる再訪防止調整を用いて複数ロボットが協調探索するフレームワークを提案し、チームサイズや定位精度が被覆率・ホットスポット再現率に与える影響を実験的に解析した。
原題: RANT: Ant-Inspired Multi-Robot Rainforest Exploration Using Particle Filter Localisation and Virtual Pheromone Coordination / Ameer Alhashemi, Layan Abdulhadi, Karam Abuodeh 他
日本語で読む → - 論文強化学習/故障復旧機械学習
小脳に着想を得た残差制御による故障復旧:推論時適応から構造的定着まで
凍結した強化学習方策に小脳模倣のオンライン残差補正を加え、再学習なしで故障復旧を実現する枠組みを提案し、MuJoCoで最大66%の性能改善を示した。
原題: Cerebellar-Inspired Residual Control for Fault Recovery: From Inference-Time Adaptation to Structural Consolidation / Nethmi Jayasinghe, Diana Gontero, Spencer T. Brown 他
日本語で読む → - 論文マニピュレーションロボティクス
Instruct2Act: ロボット行動ネットワークによる人間指示からの行動系列生成と実行
自然言語の指示を軽量なオンデバイスパイプラインで原子行動の系列に変換し、視覚解析と軌道生成ネットワークでロボットマニピュレーションを実行する手法を提案した。
原題: Instruct2Act: From Human Instruction to Actions Sequencing and Execution via Robot Action Network for Robotic Manipulation / Archit Sharma, Dharmendra Sharma, John Rebeiro 他
日本語で読む → - 論文マニピュレーションロボティクス
RoboInter:ロボットマニピュレーションのための包括的中間表現スイート
ロボット操作のためのデータ・ベンチマーク・モデルを統合した中間表現スイートを提案し、大規模データセットとVQAベンチマーク、計画実行フレームワークを提供する。
原題: RoboInter: A Holistic Intermediate Representation Suite Towards Robotic Manipulation / Hao Li, Ziqin Wang, Zi-han Ding 他
日本語で読む → - 論文VLAロボティクス
ST4VLA: 視覚言語行動モデルのための空間誘導訓練
VLMに空間的な事前知識を組み込む二段階訓練でロボットの行動生成を改善し、SimplerEnvで新たなSOTAを達成した研究。
原題: ST4VLA: Spatially Guided Training for Vision-Language-Action Models / Jinhui Ye, Fangjing Wang, Ning Gao 他
日本語で読む → - 論文マニピュレーションロボティクス
MPPIに基づく分離型マルチアーム動作計画
サンプリングベースMPCのSTORMを拡張し、各アームが他アームを動的障害物として扱う分散型マルチアーム動作計画MR-STORMを提案。静的・動的障害物下でSOTAを上回る性能を示した。
原題: Decoupled MPPI-Based Multi-Arm Motion Planning / Dan Evron, Elias Goldsztejn, Ronen I. Brafman
日本語で読む → - 論文群制御ロボティクス
アフィン変換可能な無人地上車両
複数の移動ロボットとセルを組み合わせ、深層学習と制御によりアフィン変換(並進・回転・変形)を安全に追従できる新型無人地上車両を開発し、実験とシミュレーションで検証した。
原題: Affine Transformable Unmanned Ground Vehicle / Aron Mathias, Mohammad Ghufran, Jack Hughes 他
日本語で読む → - 論文歩行ロボティクス
複数の特化型歩行ポリシーに対する実行可能性誘導型プランニング
地形ごとに特化した複数の歩行ポリシーを、Feasibility-Netで予測した実行可能性を指標に統合し、古典的プランナで最適経路を生成する枠組みを提案した。
原題: Feasibility-Guided Planning over Multi-Specialized Locomotion Policies / Ying-Sheng Luo, Lu-Ching Wang, Hanjaya Mandala 他
日本語で読む → - 論文カメラ姿勢推定ロボティクス
平行透視誤差伝播モデルに基づくカメラ位置計測法の研究
平行透視近似を用いて画像計測誤差の伝播をモデル化し、近距離場でのカメラ姿勢推定を高精度かつ高効率に行う手法を提案した。
原題: Research on a Camera Position Measurement Method based on a Parallel Perspective Error Transfer Model / Ning Hu, Shuai Li, Jindong Tan
日本語で読む → - 論文SLAMロボティクス
計測同期と圧縮を伴うインクリメンタルマッピング
非同期な多センサデータを最適なグラフ構造で逐次統合し、地図品質を保ちつつノード数を約30%削減する因子グラフ圧縮手法を提案した論文。
原題: Incremental Mapping with Measurement Synchronization & Compression / Mark Griguletskii, Danil Belov, Pavel Osinenko
日本語で読む → - 論文SLAM/地図更新ロボティクス
Chamelion: 過渡環境における長期LiDARマッピングのための信頼性の高い変化検出
異なるシーンから要素を合成するデータ拡張で学習したデュアルヘッドネットワークにより、工事現場や再構成される屋内空間のような過渡環境でオンライン変化検出と長期地図更新を実現した。
原題: Chamelion: Reliable Change Detection for Long-Term LiDAR Mapping in Transient Environments / Seoyeon Jang, Alex Junho Lee, I Made Aswin Nahrendra 他
日本語で読む → - 論文安全制御制御
安全クリティカルシステムのためのロバストテイラー・ラグランジュ制御
テイラー展開とラグランジュ剰余を用いて制御入力が現在時刻に現れるようにし、実装時の離散化時間のみをパラメータとして安全性制約の実行可能性を保証するロバスト制御法を提案した。
原題: Robust Taylor-Lagrange Control for Safety-Critical Systems / Wei Xiao, Christos Cassandras, Anni Li
日本語で読む → - 論文VLAロボティクス
グローバル事前分布と局所一貫性を活用したデュアルメモリ拡張VLAモデルによる効率的なロボットマニピュレーション
タスクレベルの事前分布メモリと実行履歴の一貫性メモリを組み合わせ、拡散ベースのVLAモデルの推論効率と時間的一貫性を改善した手法OptimusVLAを提案。複数のシミュレーションベンチマークで成功率を大幅に向上させた。
原題: Global Prior Meets Local Consistency: Dual-Memory Augmented Vision-Language-Action Model for Efficient Robotic Manipulation / Zaijing Li, Bing Hu, Rui Shao 他
日本語で読む → - 論文マニピュレーションロボティクス
DexFormer: 履歴条件付きTransformerによるクロスエンボディメント器用マニピュレーション
履歴観測を条件とするTransformerベースの単一ポリシーで、異なる多自由度ハンドの形態や動力学をオンラインで推定し、ゼロショットで多様なハンドに適応する器用マニピュレーションを実現した。
原題: DexFormer: Cross-Embodied Dexterous Manipulation via History-Conditioned Transformer / Ke Zhang, Lixin Xu, Chengyi Song 他
日本語で読む → - 論文視覚ロバスト性・神経整合性画像認識
シンプルに進み、深く整える:Mouse vs. AI 2025の優勝ソリューション
NeurIPS 2025のMouse vs. AIコンペティションで優勝した手法を報告。視覚的ロバスト性では軽量CNN、神経整合性では深いResNet風モデルが最適であることを示した。
原題: Navigating Simply, Aligning Deeply: Winning Solutions for Mouse vs. AI 2025 / Phu-Hoa Pham, Chi-Nguyen Tran, Dao Sy Duy Minh 他
日本語で読む → - 論文VLAロボティクス
CLUE: 注意機構を用いた言語視覚理解によるクロスモーダル曖昧性解消
VLMのクロスモーダル注意を空間的に接地した信号に変換し、参照曖昧性を検出して質問すべきタイミングを判断する対話型視覚接地モデルを提案。
原題: CLUE: Crossmodal disambiguation via Language-vision Understanding with attEntion / Mouad Abrini, Mohamed Chetouani
日本語で読む → - 論文状態推定ロボティクス
粗い情報を用いた不安定システムの能動的定位
1ビットという粗いセンシング下でも不安定なシステムの初期状態を推定できる条件を示し、Voronoi分割に基づく制御と集合ベース推定を組み合わせた能動的定位アルゴリズムを提案した。
原題: Active Localization of Unstable Systems with Coarse Information / Ege Yuceel, Daniel Liberzon, Sayan Mitra
日本語で読む → - 論文歩行ロボティクス
ECO: ヒューマノイド歩行のためのエネルギー制約付き強化学習最適化
エネルギー消費を報酬から切り離し明示的な不等式制約として扱う制約付き強化学習フレームワークECOを提案し、ヒューマノイドBRUCEで省エネかつ安定した歩行を実現した。
原題: ECO: Energy-Constrained Optimization with Reinforcement Learning for Humanoid Walking / Weidong Huang, Jingwen Zhang, Jiongye Li 他
日本語で読む → - 論文視覚言語ナビゲーションロボティクス
ドリフトを未然に防ぐ:堅牢な視覚言語ナビゲーションのための遡及的修正
視覚言語ナビゲーションにおける模倣学習の誤差蓄積問題に対し、過去の有効な状態から修正軌道を合成するオンラインフレームワークBudVLNを提案し、R2R-CEとRxR-CEで最高性能を達成した。
原題: Nipping the Drift in the Bud: Retrospective Rectification for Robust Vision-Language Navigation / Gang He, Zhenyang Liu, Kepeng Xu 他
日本語で読む → - 論文逆運動学ロボティクス
解析的逆運動学を変数変換に用いた最適化ベース逆運動学の新定式化
解析的逆運動学の解を変数変換として利用することで、衝突回避などの非凸制約を含む最適化ベース逆運動学を解きやすくする新手法を提案し、複数のソルバーで成功率の向上を実証した。
原題: A Framework for Combining Optimization-Based and Analytic Inverse Kinematics / Thomas Cohn, Lihan Tang, Alexandre Amice 他
日本語で読む → - 論文マニピュレーションロボティクス
効率的な連続被覆率推定のための制約多様体探索
産業用ロボットアームが工具を表面に垂直に保ちながらワークを完全に覆えるかを、サンプリングベースで効率的に推定する手法を提案した。
原題: Constraint Manifold Exploration for Efficient Continuous Coverage Estimation / Robert Wilbrandt, Rüdiger Dillmann
日本語で読む → - 論文VLA画像認識
スパース動画生成による実世界の視界外ビジョン言語ナビゲーション
動画生成モデルを視界外ナビゲーションに初導入し、20秒先の未来をスパースに生成することでサブ秒推論を実現した手法SparseVideoNavを提案。
原題: Sparse Video Generation Propels Real-World Beyond-the-View Vision-Language Navigation / Hai Zhang, Siqi Liang, Li Chen 他
日本語で読む → - 論文医療ロボティクスロボティクス
超音波仙骨骨切り術における自律ロボットと手技の比較分析:予備研究
超音波骨切り術を7自由度ロボットアームと光学トラッキングで自律化し、ファントム実験で手技より高精度な軌道・深さ制御を実現した。
原題: Comparative Analysis of Autonomous Robotic and Manual Techniques for Ultrasonic Sacral Osteotomy: A Preliminary Study / Daniyal Maroufi, Yash Kulkarni, Justin E. Bird 他
日本語で読む → - 論文VLA画像認識
VLANeXt:強いVLAモデルを構築するためのレシピ
VLA設計空間を統一フレームワークで再検討し、12の知見をまとめた実践的レシピと、LIBEROなどでSOTAを上回るモデルVLANeXtを提案した論文。
原題: VLANeXt: Recipes for Building Strong VLA Models / Xiao-Ming Wu, Bin Fan, Kang Liao 他
日本語で読む → - 論文VLAロボティクス
見て、感じて、動く:大規模一人称視点人間データから能動的知覚を学ぶ
大規模な一人称視点の人間データを活用し、情報を能動的に集めながら操作するVLAフレームワークCoMe-VLAを提案。記憶機構と認知補助により多様な長期タスクで高い適応性を示した。
原題: Act, Sense, Act: Learning Active Perception from Large-Scale Egocentric Human Data / Jialiang Li, Yi Qiao, Yunhan Guo 他
日本語で読む →