論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーション画像認識
デジタルツイン駆動の繊維分類と異物認識による自動選別システム
デジタルツインとVLMを組み合わせ、双腕ロボットが衣類を把持・検査・分類し異物も検出する自動選別システムを構築し、9種のVLMを223シーンで評価した。
原題: Digital Twin Driven Textile Classification and Foreign Object Recognition in Automated Sorting Systems / Serkan Ergun, Tobias Mitterer, Hubert Zangl
日本語で読む → - 論文世界モデルロボティクス
PlayWorld: 自律的な遊びからロボットの世界モデルを学習する
ロボットの自己遊びデータのみから高忠実度のビデオ世界モデルを学習する手法を提案し、物理的に一貫した物体操作の予測を実現した。
原題: PlayWorld: Learning Robot World Models from Autonomous Play / Tenny Yin, Zhiting Mei, Zhonghe Zheng 他
日本語で読む → - 論文手術ナビゲーション/自律制御ロボティクス
純視覚気管支鏡ロボット自律化のための長期・短期エージェント
CT由来の仮想目標と内視鏡映像のみを用い、外部トラッキングなしで気管支鏡ナビゲーションを自律実行する枠組みを提案。短期反応エージェントと長期戦略エージェントを階層化し、矛盾時は世界モデル批評家が将来視覚状態を予測して行動を選択する。ファントム・摘出豚肺・生体豚で検証し、専門医と同等の性能を示した。
原題: Long-Short Term Agents for Pure-Vision Bronchoscopy Robotic Autonomy / Junyang Wu, Mingyi Luo, Fangfang Xie 他
日本語で読む → - 論文拡散計画/安全フィルタロボティクス
PC-Diffuser: 拡散ベース軌道計画のための経路整合型カプセルCBF安全フィルタ
拡散モデルによる軌道計画のノイズ除去ループに、カプセル距離バリア関数と経路整合型安全フィルタを組み込み、生成軌道の安全性を保証しつつ学習分布から大きく外れないようにする手法を提案。
原題: PC-Diffuser: Path-Consistent Capsule CBF Safety Filtering for Diffusion-Based Trajectory Planner / Eugene Ku, Yiwei Lyu
日本語で読む → - 論文シーン表現ロボティクス
Kernel-SDF: カーネル回帰を用いたリアルタイム符号付距離関数推定のためのオープンソースライブラリ
カーネル回帰とガウス過程回帰を組み合わせ、ストリーミングセンサデータから不確かさを考慮した符号付距離関数をリアルタイムで推定するオープンソースライブラリを開発した。
原題: Kernel-SDF: An Open-Source Library for Real-Time Signed Distance Function Estimation using Kernel Regression / Zhirui Dai, Tianxing Fan, Mani Amani 他
日本語で読む → - 論文安全強化学習機械学習
制約付き楽観的探索を用いたオフポリシー安全強化学習
安全制約を満たすオフポリシー強化学習アルゴリズムCOX-Qを提案し、コスト制約付き探索と分布価値学習により、サンプル効率と安全性を両立させた。
原題: Off-Policy Safe Reinforcement Learning with Constrained Optimistic Exploration / Guopeng Li, Matthijs T. J. Spaan, Julian F. P. Kooij
日本語で読む → - 論文ナビゲーションロボティクス
IntentReact: トポロジカルな意図による反応的オブジェクト中心ナビゲーションの誘導
オブジェクト目標ナビゲーションにおいて、局所的な観測のみに依存する反応的制御と大域的なトポロジカル計画のギャップを埋めるため、意図(intent)と呼ばれる低次元の方向信号を導入し、学習されたウェイポイント予測を条件付けてナビゲーションを誘導するフレームワークを提案した。
原題: IntentReact: Guiding Reactive Object-Centric Navigation via Topological Intent / Yanmei Jiao, Anpeng Lu, Wenhan Hu 他
日本語で読む → - 論文形状推定ロボティクス
エネルギー最小化によるテンセグリティマニピュレータの自己受容的形状推定
各支柱にIMUを取り付け傾斜角のみを用い、エネルギー最小化でテンセグリティマニピュレータ全体の形状を推定する手法を提案・実証した。
原題: Proprioceptive Shape Estimation of Tensegrity Manipulators Using Energy Minimisation / Tufail Ahmad Bhat, Shuhei Ikemoto
日本語で読む → - 論文模倣学習機械学習
混合密度ヘッドを備えたリキッドネットワークによる効率的な模倣学習
拡散ポリシーと比較し、リキッドニューラルネットワークと混合密度ヘッドを組み合わせたポリシーが、少ないパラメータで高精度・高速な模倣学習を実現することを示した論文。
原題: Liquid Networks with Mixture Density Heads for Efficient Imitation Learning / Nikolaus Correll
日本語で読む → - 論文安全工学AI
能力の影:安全工学におけるAI支援の理論と限界
AI支援が安全工学の分析品質を向上させるのか、それとも系統的な盲点を生むのかを形式化し、能力の影という概念を導入して、協調構造に応じた性能限界を導出した論文。
原題: The Competence Shadow: Theory and Bounds of AI Assistance in Safety Engineering / Umair Siddique
日本語で読む → - 論文群制御ロボティクス
実環境における認識を考慮した通信不要のマルチUAV協調制御
GNSSが使えない森林などの複雑環境で、搭載LiDARによるSLAMと障害物・他機検出のみを用い、通信なしで安全にマルチロボットを協調させる認識考慮型3Dナビゲーション手法を提案・実証した。
原題: Perception-Aware Communication-Free Multi-UAV Coordination in the Wild / Manuel Boldrer, Michal Kamler, Afzal Ahmad 他
日本語で読む → - 論文マニピュレーションロボティクス
MemoAct: アトキンソン=シフリン記憶モデルに着想を得たロボットマニピュレーション向け階層的記憶拡張ポリシー
人間の記憶モデルに倣い、感覚・短期・長期の階層的記憶を組み合わせてロボットのマニピュレーションを記憶依存タスクで高精度化するポリシーを提案し、新ベンチマークで有効性を示した。
原題: MemoAct: Atkinson-Shiffrin-Inspired Hierarchical Memory-Augmented Policy for Robotic Manipulation / Liufan Tan, Jiale Li, Gangshan Jing
日本語で読む → - 論文変形物体追跡画像認識
TrackDeform3D: 変形物体のためのマーカーレス自律型3Dキーポイント追跡とデータセット収集
RGB-Dカメラのみを用いて変形物体の3Dキーポイントを検出・追跡し、大規模データセットを自律的に収集するフレームワークを提案。6物体・110分の軌跡データを構築した。
原題: TrackDeform3D: Markerless and Autonomous 3D Keypoint Tracking and Dataset Collection for Deformable Objects / Yeheng Zong, Yizhou Chen, Alexander Bowler 他
日本語で読む → - 論文操作ロボティクス
DreamPlan: ビデオワールドモデルによる視覚言語プランナーの効率的な強化学習ファインチューニング
ロボット操作のための視覚言語モデルプランナーを、実世界での試行錯誤を避け、ビデオ生成モデルによる仮想ロールアウトを用いて強化学習でファインチューニングする手法を提案した。
原題: DreamPlan: Efficient Reinforcement Fine-Tuning of Vision-Language Planners via Video World Models / Emily Yue-Ting Jia, Weiduo Yuan, Tianheng Shi 他
日本語で読む → - 論文マニピュレーションロボティクス
GraspADMM: ADMM最適化による巧みな把持合成の改善
物体上の目標接触点と手の実際の接触位置をADMMで分離し、把持の多様性を保ちながら動的安定性と運動学的実現可能性を両立させる把持合成フレームワークを提案した。
原題: GraspADMM: Improving Dexterous Grasp Synthesis via ADMM Optimization / Liangwang Ruan, Jiayi Chen, He Wang 他
日本語で読む → - 論文自動運転/VLAロボティクス
Uni-World VLA: 自動運転のための世界モデリングと計画の交互実行
自動運転向けに、将来フレーム予測と軌道計画を交互に行う統合VLAモデルを提案し、閉ループな意思決定を実現した。
原題: Uni-World VLA: Interleaved World Modeling and Planning for Autonomous Driving / Qiqi Liu, Huan Xu, Jingyu Li 他
日本語で読む → - 論文ナビゲーションロボティクス
視覚言語モデルによる動的制御バリア関数の調整:安全・適応・リアルタイムな視覚ナビゲーション
ロボットのナビゲーションにおいて、視覚言語モデル(VLM)がカメラ画像からリスクを推定し、制御バリア関数(CBF)の安全フィルタの保守性をリアルタイムに調整するフレームワークAlphaAdjを提案。固定パラメータと比較して効率を最大18.5%向上させつつ衝突回避を維持する。
原題: Dynamic Control Barrier Function Regulation with Vision-Language Models for Safe, Adaptive, and Realtime Visual Navigation / Jeffrey Chen, Rohan Chandra
日本語で読む → - 論文宇宙機/推定ロボティクス
シスルナ空間認識のための統合軌道・姿勢推定とセンサータスキングフレームワーク:乗法Unscentedカルマンフィルタを用いた自律的アプローチ
シスルナ領域の宇宙状況認識に向けて、観測センサ配置の最適化と情報理論に基づくセンサータスキングを行い、乗法Unscentedカルマンフィルタで軌道・姿勢を高精度に推定する統合フレームワークを提案した。
原題: Unified Orbit-Attitude Estimation and Sensor Tasking Framework for Autonomous Cislunar Space Domain Awareness Using Multiplicative Unscented Kalman Filter / Smriti Nandan Paul, Siwei Fan
日本語で読む → - 論文ロボットシステムロボティクス
精密光学システムの閉ループロボット組立・位置合わせ・自己回復のためのフレームワーク
ロボットによる精密光学システムの自律的な構築・位置合わせ・自己回復を実現するフレームワークを提案し、レーザー共振器の完全自律組み立てを実証した。
原題: A Framework for Closed-Loop Robotic Assembly, Alignment and Self-Recovery of Precision Optical Systems / Seou Choi, Sachin Vaidya, Caio Silva 他
日本語で読む → - 論文HRIロボティクス
人間とロボットの相互作用における影響力のある行動の特定
転移エントロピーを用いて、遠隔操作ロボットとの会話中にロボットの行動が人間の反応に与える影響を分析し、重要な行動を特定する手法を提案した論文。
原題: Identifying Influential Actions in Human-Robot Interactions / Haoyang Jiang, Chenfei Xu, Yuya Okadome 他
日本語で読む → - 論文群制御ロボティクス
強化学習による仮想魚の動き制御を用いた魚群の誘導
強化学習で訓練した仮想魚を画面に表示し、実魚の群れを目標方向へ誘導する手法を提案・実証した論文。
原題: Controlling Fish Schools via Reinforcement Learning of Virtual Fish Movement / Yusuke Nishii, Hiroaki Kawashima
日本語で読む → - 論文マニピュレーションロボティクス
HyReach: 未知の雑然環境における視覚誘導型ハイブリッドマニピュレータのリーチング
剛体と軟体を組み合わせた連続体マニピュレータで、視覚と3D再構成に基づく動作計画により、未見の雑然環境でも2cm以下の誤差で対象物に到達できるシステムを実現した。
原題: HyReach: Vision-Guided Hybrid Manipulator Reaching in Unseen Cluttered Environments / Shivani Kamtikar, Kendall Koe, Justin Wasserman 他
日本語で読む → - 論文ビデオ異常検出ロボティクス
TIMID: ロボット実行ビデオにおける時間依存ミスの検出
ロボットの高次タスク実行中に発生する時間的・空間的なミスを検出する新しいアーキテクチャTIMIDを提案。ビデオとタスク・ミスのプロンプトを入力とし、フレーム単位でミスの有無を予測する。弱教師あり学習とシミュレーションデータで訓練し、実ロボットへのゼロショット転送を実現。
原題: TIMID: Time-Dependent Mistake Detection in Videos of Robot Executions / Nerea Gallego, Fernando Salanova, Claudio Mannarano 他
日本語で読む → - 論文VLA/推論高速化ロボティクス
HeiSD: 運動学的認識を備えた身体化視覚言語行動モデルのためのハイブリッド投機的復号
VLAモデルの推論を高速化するため、ドラフタベースと検索ベースの投機的復号を統合したハイブリッド手法HeiSDを提案し、検証スキップ機構と運動学に基づく融合指標により高速化と成功率を両立した。
原題: HeiSD: Hybrid Speculative Decoding for Embodied Vision-Language-Action Models with Kinematic Awareness / Zihao Zheng, Zhihao Mao, Sicheng Tian 他
日本語で読む → - 論文ナビゲーションロボティクス
MRPoS: 空間ポインティングと大規模言語モデルを用いた音声対話による複合現実ベースのロボットナビゲーションインターフェース
複合現実(MR)環境でのロボットナビゲーションにおいて、従来のエアタップ操作に代わり、空間ポインティングと大規模言語モデル(LLM)による音声対話を組み合わせた自然なマルチモーダルインターフェースを提案し、タスク完了時間と作業負荷を削減した。
原題: MRPoS: Mixed Reality-Based Robot Navigation Interface Using Spatial Pointing and Speech with Large Language Model / Eduardo Iglesius, Masato Kobayashi, Yuki Uranishi
日本語で読む → - 論文ナビゲーションロボティクス
AERR-Nav: ゼロショット物体ナビゲーションのための適応的探索・回復・回想戦略
未知の多階建て環境でのゼロショット物体ナビゲーションを改善するため、ロボットの状態を動的に切り替える適応的戦略と、高速・低速思考モードを備えた探索状態を提案した。
原題: AERR-Nav: Adaptive Exploration-Recovery-Reminiscing Strategy for Zero-Shot Object Navigation / Jingzhi Huang, Junkai Huang, Haoyang Yang 他
日本語で読む → - 論文VLAロボティクス
KineVLA: 運動学を考慮した視覚言語行動モデルと二段階行動分解
言語指示に運動学的属性(方向、軌道、姿勢、相対変位など)を細かく組み込んだ新しいVLAタスクを提案し、目標の不変性と運動学的可変性を分離する二段階行動表現と推論トークンを持つKineVLAフレームワークを導入した。シミュレーションと実機で精度・制御性・汎化性が向上することを示した。
原題: KineVLA: Towards Kinematics-Aware Vision-Language-Action Models with Bi-Level Action Decomposition / Gaoge Han, Zhengqing Gao, Ziwen Li 他
日本語で読む → - 論文モーションプランニングロボティクス
ロボットマニピュレータのための汎用ニューラルモーションプランナーに向けて:課題と機会
この論文は、ロボットマニピュレータのモーションプランニングにおけるニューラルプランナーの現状をレビューし、その利点と限界を分析して、汎用性の高いプランナーを構築するための道筋を示しています。
原題: Toward Generalist Neural Motion Planners for Robotic Manipulators: Challenges and Opportunities / Davood Soleymanzadeh, Ivan Lopez-Sanchez, Hao Su 他
日本語で読む → - 論文テレオペレーション/リターゲティングロボティクス
キロヘルツ対応:制約付き器用なリターゲティングのためのスケーラブルフレームワーク
非線形最適化に頼らず、関節微分空間での凸二次計画問題として再定式化し、制御バリア関数で安全性を保証する、高速で安全な器用な手のテレオペレーション用モーションリターゲティング手法を提案した。
原題: Kilohertz-Safe: A Scalable Framework for Constrained Dexterous Retargeting / Yinxiao Tian, Ziyi Yang, Zinan Zhao 他
日本語で読む → - 論文スパイキングニューラルネットワーク/強化学習cs.MA
S2Act: シンプルなスパイキングアクター
スパイキングニューラルネットワークを用いた強化学習ポリシーを、レートベースのLIFニューロンで近似し、ReLU活性化関数に整合するようにパラメータを調整することで、複雑な確率的環境でも安定して学習・展開できる軽量なフレームワークを提案した。
原題: S2Act: Simple Spiking Actor / Ugur Akcal, Seung Hyun Kim, Mikihisa Yuasa 他
日本語で読む →