論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文シーングラフ/農業ロボティクスロボティクス
SG-DOR: 方向条件付き遮蔽推論を備えたシーングラフ学習によるピーマン植物の収穫支援
ピーマン植物の点群から、果実と葉の物理的接続や方向ごとの遮蔽関係を表すシーングラフを推論し、収穫時の介入計画に役立つ関係情報を提供する手法を提案。
原題: SG-DOR: Learning Scene Graphs with Direction-Conditioned Occlusion Reasoning for Pepper Plants / Rohit Menon, Niklas Mueller-Goldingen, Sicong Pan 他
日本語で読む → - 論文歩行ロボティクス
容易に分離可能な関節を持つ脚式モジュラーロボットの関節負荷と機動性を両立する歩容生成
脚式モジュラーロボットの歩容生成において、関節負荷を最小化しつつ移動速度と安定性を維持するパレート最適解をNSGA-IIIで導出する手法を提案し、シミュレーションと実機実験で有効性を示した。
原題: Gait Generation Balancing Joint Load and Mobility for Legged Modular Robots with Easily Detachable Joints / Kennosuke Chihara, Takuya Kiyokawa, Kensuke Harada
日本語で読む → - 論文VLA画像認識
GST-VLA: 構造化ガウス空間トークンを用いた3次元深度認識型視覚言語行動モデル
視覚観測を3次元ガウスプリミティブに変換し、深度認識型の思考連鎖推論と行動生成を統合したVLAモデルを提案した。
原題: GST-VLA: Structured Gaussian Spatial Tokens for 3D Depth-Aware Vision-Language-Action Models / Md Selim Sarowar, Omer Tariq, Sungho Kim
日本語で読む → - 論文ナビゲーションロボティクス
視覚言語行動モデルには経路逸脱検出のためのアテンションヘッドが既に存在する
凍結したVLAモデルの少数のアテンションヘッドを監視するだけで、追加計算なしに経路逸脱を高精度で検出できることを発見し、検出後は軽量なRLポリシーで復帰させるパイプラインを実機で実証した。
原題: Your Vision-Language-Action Model Already Has Attention Heads For Path Deviation Detection / Jaehwan Jeong, Evelyn Zhu, Jinying Lin 他
日本語で読む → - 論文ナビゲーションロボティクス
生涯学習型身体化ナビゲーション学習
大規模言語モデルを用いた身体化ナビゲーションエージェントが、複数のタスクを連続的に学習しながらも過去の知識を保持できる生涯学習フレームワークUni-Walkerを提案した。
原題: Lifelong Embodied Navigation Learning / Xudong Wang, Jiahua Dong, Baichen Liu 他
日本語で読む → - 論文動作生成ロボティクス
安定性誘導探索による多様な動作生成
ブラックボックスシミュレーションを用いて、多様な長期的操作を発見する新しい手法を提案。RRT探索とサンプリングベースMPCを組み合わせ、安定状態の多様体からサンプリングして探索を誘導する。
原題: Stability-Guided Exploration for Diverse Motion Generation / Eckart Cobo-Briesewitz, Tilman Burghoff, Denis Shcherba 他
日本語で読む → - 論文マニピュレーションロボティクス
ゼロショットなオープンワールド物体操作のための明示的世界モデル構築
ロボットのオープンワールド物体操作を、環境のデジタルツインを構築し物理シミュレータで操作戦略を探索・評価することで、行動デモなしにゼロショットで実現するフレームワークを提案した。
原題: Building Explicit World Model for Zero-Shot Open-World Object Manipulation / Xiaotong Li, Gang Chen, Javier Alonso-Mora
日本語で読む → - 論文歩行ロボティクス
CASSR: 到達可能性に基づく連続A*探索によるリアルタイム足踏み計画
二足歩行ロボットの足踏み計画を、連続的な運動学的制約をA*探索内で再帰的に伝播させることで高速化し、最大30歩の接触列を125ms未満で計画する手法を提案した。
原題: CASSR: Continuous A-Star Search through Reachability for real time footstep planning / Jiayi Wang, Steve Tonneau
日本語で読む → - 論文制約付き生成機械学習
事前学習生成モデルの橋渡しによる制約付き生成の改善
複雑な実世界の制約領域内でサンプルを生成するため、事前学習済み生成モデルを微調整して制約を満たしつつ現実性を保つ手法を提案した。
原題: Improved Constrained Generation by Bridging Pretrained Generative Models / Xiaoxuan Liang, Saeid Naderiparizi, Yunpeng Liu 他
日本語で読む → - 論文ナビゲーションロボティクス
SaferPath: 学習による誘導と安全制約付き制御を用いた階層的視覚ナビゲーション
既存のエンドツーエンドモデルから得た誘導を、安全制約付き最適化制御モジュールで洗練する階層的視覚ナビゲーションフレームワークを提案し、未見環境での衝突を減らし成功率を向上させる。
原題: SaferPath: Hierarchical Visual Navigation with Learned Guidance and Safety-Constrained Control / Lingjie Zhang, Zeyu Jiang, Changhao Chen
日本語で読む → - 論文力制御ロボティクス
異種材料を含むサンプル掻き取り作業のための適応力制御学習
不均一な材料を含むバイアル瓶からの掻き取り作業を自動化するため、強化学習を用いてインピーダンス制御の目標力を適応的に調整する枠組みを提案した。
原題: Learning Adaptive Force Control for Contact-Rich Sample Scraping with Heterogeneous Materials / Cenk Cetin, Shreyas Pouli, Gabriella Pizzuto
日本語で読む → - 論文ヒューマノイド動作生成ロボティクス
PhyGile: 物理プレフィックス誘導による俊敏な汎用人型ロボット動作追従のための動作生成
物理誘導プレフィックスを用いて人型ロボットのネイティブ動作を直接生成し、汎用動作追従コントローラと組み合わせることで、実機で俊敏かつ安定した全身動作を実現するフレームワークを提案した。
原題: PhyGile: Physics-Prefix Guided Motion Generation for Agile General Humanoid Motion Tracking / Jiacheng Bao, Haoran Yang, Yucheng Xin 他
日本語で読む → - 論文VLAロボティクス
黄金のチケット:単一のノイズベクトルで生成ロボットポリシーを改善
事前学習済みの拡散・フローマッチングポリシーに対し、ガウス分布から毎回サンプリングする代わりに固定の初期ノイズ(黄金のチケット)を与えることで、追加学習なしにタスク成功率を向上させる手法を提案。
原題: You've Got a Golden Ticket: Improving Generative Robot Policies With A Single Noise Vector / Omkar Patil, Ondrej Biza, Thomas Weng 他
日本語で読む → - 論文動作計画ロボティクス
知覚制約下におけるシーングラフを用いたサンプリングベース動作計画
高自由度ロボットが複数の物体や人を監視しながら動作するための、シーングラフと知覚コストを統合したロードマップベースの動作計画手法を提案した。
原題: Sampling-Based Motion Planning with Scene Graphs Under Perception Constraints / Qingxi Meng, Emiliano Flores, Thai Duong 他
日本語で読む → - 論文模倣学習/操作ロボティクス
VolumeDP: 操作ポリシー学習のためのボリューム表現モデリング
2D画像から直接3D動作を予測する既存手法の2D-3Dミスマッチを解消するため、画像特徴を3Dボリューム表現に変換し、タスク関連ボクセルを選択して動作予測を行う新しいポリシーアーキテクチャを提案した。
原題: VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning / Tianxing Zhou, Feiyang Xue, Zhangchen Ye 他
日本語で読む → - 論文VLAロボティクス
自律ドローンレース向けの堅牢な密結合フィルタ型単眼視覚慣性状態推定とグラフベース評価
ゲート角の画素再投影誤差をESKFに直接組み込むことで、少ない特徴点でも動作するドローンレース向け状態推定手法を提案し、GNSSのない環境での評価用に因子グラフ最適化フレームワークも導入した。
原題: Robust Tightly-Coupled Filter-Based Monocular Visual-Inertial State Estimation and Graph-Based Evaluation for Autonomous Drone Racing / Maulana Bisyir Azhari, Donghun Han, Sung Jun Park 他
日本語で読む → - 論文ナビゲーションロボティクス
不確かさを考慮したロボットナビゲーションのためのガウス混合モデルに基づく逆知覚契約
ガウス混合モデルを用いて知覚誤差の多峰性・非凸性を捉える不確かさ集合を学習し、より安全で保守的でないロボットナビゲーションを実現する手法を提案した。
原題: Gaussian Mixture-Based Inverse Perception Contract for Uncertainty-Aware Robot Navigation / Bingyao Du, Joonkyung Kim, Yiwei Lyu
日本語で読む → - 論文VLAロボティクス
VTAM:視覚と言語を超え、触覚を統合したビデオ・触覚・行動モデル
映像から行動を予測するVAMに触覚を追加し、接触の多い繊細な操作を安定化させるマルチモーダル世界モデルを提案。ポテトチップスの把持などで大幅な性能向上を実現。
原題: VTAM: Video-Tactile-Action Models for Complex Physical Interaction Beyond VLAs / Haoran Yuan, Weigang Yi, Zhenyu Zhang 他
日本語で読む → - 論文人物検出/追跡画像認識
天井クレーン搭載LiDARによる人物検出と追跡
天井クレーンに搭載したLiDARを用いて、屋内作業空間での人物検出と追跡を行う手法を提案。現場固有のデータセットを構築し、3D検出器を適応させて追跡性能を評価した。
原題: Person Detection and Tracking from an Overhead Crane LiDAR / Nilusha Jayawickrama, Henrik Toikka, Risto Ojala
日本語で読む → - 論文マニピュレーションロボティクス
Dance2Hesitate: ダンサーが教えるためらい動作のマルチモーダルデータセット
ロボットのためらい動作を理解可能にするため、ダンサーが演じたためらい動作のマルチモーダルデータセットを構築し、公開した。
原題: Dance2Hesitate: A Multi-Modal Dataset of Dancer-Taught Hesitancy for Understandable Robot Motion / Srikrishna Bangalore Raghu, Anna Soukhovei, Divya Sai Sindhuja Vankineni 他
日本語で読む → - 論文ナビゲーションロボティクス
認定ニューラルHamilton-Jacobi到達可能性による偶発事象を考慮した計画
未知環境での多目標ナビゲーションのために、学習ベースの到達可能性とサンプリングベースの計画を統合し、安全性を保証するフレームワークを提案した。
原題: Contingency-Aware Planning via Certified Neural Hamilton-Jacobi Reachability / Kasidit Muenprasitivej, Derya Aksaray
日本語で読む → - 論文ロボット操作/報酬学習ロボティクス
DINOへの報酬付与:視覚基盤モデルによる密な報酬の予測
ロボット操作タスクにおいて、カメラ画像から言語条件付きの密な報酬関数を学習する手法「Rewarding DINO」を提案。デモ軌跡ではなくタスクの意味を学習し、シミュレーションと実世界の両方で汎化性能を示した。
原題: Rewarding DINO: Predicting Dense Rewards with Vision Foundation Models / Pierre Krack, Tobias Jülg, Wolfram Burgard 他
日本語で読む → - 論文衛星観測計画ロボティクス
静止衛星データと階層的計画を用いた衛星観測の動的ターゲティング
衛星観測の動的ターゲティング性能を向上させるため、静止衛星からの補助データを活用し、階層的計画手法を導入した。従来のオンセンサー予測データのみを用いる手法と比較し、最大で性能が向上することを示した。
原題: Dynamic Targeting of Satellite Observations Using Supplemental Geostationary Satellite Data and Hierarchical Planning / Akseli Kangaslahti, Itai Zilberstein, Alberto Candela 他
日本語で読む → - 論文支援技術/ロボット食事支援ロボティクス
ピボット式キリガミ食器:手持ちおよびロボット支援食事のための器具
本論文は、手の震えや運動障害を持つ人々のために、ピボット機構を用いたキリガミ(切り紙)式の食器を開発し、手持ちとロボット搭載の両方で使用できることを示した。
原題: A Pivot-Based Kirigami Utensil for Hand-Held and Robot-Assisted Feeding / Keone Leao, Grace Brotherson, Iain Mischel 他
日本語で読む → - 論文グリッパー/把持ロボティクス
膨張式シリコンポケットを備えた軟硬ハイブリッドグリッパーによる摩擦調整把持
剛性シェルと空気圧で膨らむシリコンポケットを組み合わせたグリッパー指を提案し、把持力を上げずに摩擦を能動的に変えて、重い・滑りやすい・壊れやすい物体を安全に把持できることを実証した。
原題: Soft Rigid Hybrid Gripper with Inflatable Silicone Pockets for Tunable Frictional Grasping / Hoang Hiep Ly, Cong-Nhat Nguyen, Doan-Quang Tran 他
日本語で読む → - 論文位置推定画像認識
BEV-SLD: LiDAR鳥瞰画像を用いた自己教師ありシーンランドマーク検出によるグローバル位置推定
LiDARの鳥瞰画像からシーン固有のランドマークを自己教師ありで検出し、一貫性損失を用いてグローバル位置推定を行う手法を提案した。
原題: BEV-SLD: Self-Supervised Scene Landmark Detection for Global Localization with LiDAR Bird's-Eye View Images / David Skuddis, Vincent Ress, Wei Zhang 他
日本語で読む → - 論文歩行ロボティクス
不安全ステップペナルティとスパースLiDAR標高マッピングによる階段上の全方向ヒューマノイド歩行
階段上の安全な全方向歩行を実現するため、密な不安全ステップペナルティとスパースLiDARによる標高マップ生成を組み合わせた単一ステージ訓練フレームワークを提案した。シミュレーションと実機で高い安全性と実環境での安定性を確認した。
原題: Omnidirectional Humanoid Locomotion on Stairs via Unsafe Stepping Penalty and Sparse LiDAR Elevation Mapping / Yuzhi Jiang, Yujun Liang, Junhao Li 他
日本語で読む → - 論文生活支援ロボティクスロボティクス
在宅高齢者のための公平なロボット家具エージェント:ADLに基づく設計探求
高齢者の日常生活動作(ADL)における困難を軽減するため、ロボット家具エージェントの設計を探求した論文。インタビューから要件を導出し、コンピュータビジョンと生成AIを活用した概念を提案している。
原題: Towards Equitable Robotic Furnishing Agents for Aging-in-Place: ADL-Grounded Design Exploration / Hansoo Lee, Changhee Seo, Subin Park 他
日本語で読む → - 論文セグメンテーション画像認識
MotionBits: 剛体の運動レベル解析によるビデオセグメンテーション
剛体の運動を基本単位とする新しいセグメンテーション概念「MotionBit」を提案し、手動ラベル付きベンチマークと学習不要のグラフベース手法で既存手法を上回る性能を示した。
原題: MotionBits: Video Segmentation through Motion-Level Analysis of Rigid Bodies / Howard H. Qian, Kejia Ren, Yu Xiang 他
日本語で読む → - 論文光通信/イベントカメラロボティクス
イベントカメラと移動送信機によるリアルタイム光通信
イベントカメラを用いて移動する光送信機を追跡し、リアルタイムでメッセージを復号する光通信システムを開発した。幾何情報を活用したUKFにより、従来比7倍高速な処理と95%以上の復号精度を実現した。
原題: Real-Time Optical Communication Using Event-Based Vision with Moving Transmitters / Harmeet Dhillon, Pranay Katyal, Brendan Long 他
日本語で読む →