論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文家庭用ロボット/プライバシーHCI
「ペットみたいだけど、データは集めないで」:複数人世帯における家庭用ロボットのプライバシー設計選好
15世帯との参加型デザインセッションを通じて、家庭用ロボットに対するプライバシー懸念と望ましい設計を調査し、データ管理権限や通知システムなど実用的な設計提言をまとめた。
原題: "It's like a pet...but my pet doesn't collect data about me": Multi-person Households' Privacy Design Preferences for Household Robots / Jennica Li, Shirley Zhang, Dakota Sullivan 他
日本語で読む → - 論文ソフトロボティクス/接触計画ロボティクス
ソフトロボットのための相補性に基づく統合接触モデリングと計画
ソフトロボットの接触を線形相補性問題(LCP)で統一的にモデル化し、冗長接触や悪条件を三段階の前処理で解決するとともに、MPCCによる接触を伴う軌道最適化を実現した。
原題: Unified Complementarity-Based Contact Modeling and Planning for Soft Robots / Milad Azizkhani, Yue Chen
日本語で読む → - 論文VLAロボティクス
PhysMem: 身体性物理推論のためのテスト時メモリのスケーリング
VLMロボットプランナがテスト時に経験から物理法則を学び、仮説を検証してから適用するメモリフレームワークを提案。実世界の操作タスクで成功率が大幅に向上。
原題: PhysMem: Scaling Test-Time Memory for Embodied Physical Reasoning / Haoyang Li, Yang You, Hao Su 他
日本語で読む → - 論文世界モデル画像認識
WorldArena:身体性世界モデルの知覚と機能的実用性を評価する統合ベンチマーク
身体性世界モデルを映像知覚品質と下流タスクでの機能的実用性の両面から評価する統合ベンチマークWorldArenaを提案し、14モデルの実験から知覚と機能の間に大きなギャップがあることを示した。
原題: WorldArena: A Unified Benchmark for Evaluating Perception and Functional Utility of Embodied World Models / Yu Shang, Zhuohang Li, Yiding Ma 他
日本語で読む → - 論文VLAロボティクス
SA-VLA: 空間認識型フローマッチングによる視覚-言語-行動強化学習
フローマッチング型VLAポリシーの強化学習適応時に空間的帰納バイアスが失われる問題に対し、空間表現の融合・幾何学的進捗に基づく密報酬・空間条件付き探索戦略を組み合わせ、空間分布シフト下での汎化性能を高める手法を提案。
原題: SA-VLA: Spatially-Aware Flow-Matching for Vision-Language-Action Reinforcement Learning / Xu Pan, Zhenglin Wan, Xingrui Yu 他
日本語で読む → - 論文人ロボット対話ロボティクス
内的発話と永続メモリによる因子分解推論:根拠に基づく人とロボットの対話
対話型ロボット支援のため、意図認識・メモリ・内的発話・クエリ生成などをモジュール化し、根拠に基づく応答と検証可能な意思決定を実現する認知アーキテクチャJANUSを提案した。
原題: Factored Reasoning with Inner Speech and Persistent Memory for Evidence-Grounded Human-Robot Interaction / Valerio Belcamino, Mariya Kilina, Alessandro Carfì 他
日本語で読む → - 論文触覚ロボティクス
二足歩行ロボットのための柔らかい表面を持つ視覚ベース触覚センサ
柔らかい変形層と視覚センサを組み合わせた足裏触覚センサを開発し、接触位置・姿勢、せん断、圧力中心、地形分類を推定して、二足歩行ロボットのバランス制御と地形認識を向上させた。
原題: Soft Surfaced Vision-Based Tactile Sensing for Bipedal Robot Applications / Jaeeun Kim, Junhee Lim, Yu She
日本語で読む → - 論文自動運転ロボティクス
UniMotion: シミュレーション・予測・計画を統合するモーションフレームワーク
自動運転における運動シミュレーション・予測・計画を単一のTransformerモデルで統合し、Waymoデータセットで高い性能と汎化を示した研究。
原題: UniMotion: A Unified Motion Framework for Simulation, Prediction and Planning / Nan Song, Junzhe Jiang, Jingyu Li 他
日本語で読む → - 論文触覚HCI
PuppetAI:触覚豊かな感情ロボットインタラクションを設計するためのカスタマイズ可能なプラットフォーム
ケーブル駆動のソフトロボットとパペット風ジェスチャーフレームワークを組み合わせ、音声入力に応じて感情的な動きをリアルタイム生成するモジュール式プラットフォームを提案。
原題: PuppetAI: A Customizable Platform for Designing Tactile-Rich Affective Robot Interaction / Jiaye Li, Tongshun Chen, Siyi Ma 他
日本語で読む → - 論文模倣学習ロボティクス
HumanX: 人間の動画からヒューマノイドの俊敏で汎用的なインタラクションスキルを獲得
人間の動画から物理的に妥当なロボット動作データを生成し、模倣学習でUnitree G1にゼロショット転移するフレームワーク。バスケやサッカーなど5領域10スキルを獲得。
原題: HumanX: Toward Agile and Generalizable Humanoid Interaction Skills from Human Videos / Yinhuai Wang, Qihan Zhao, Yuen Fui Lau 他
日本語で読む → - 論文群制御ロボティクス
モジュール型飛行システムのためのダウンウォッシュを考慮した構成最適化
多数の同型モジュール型飛行ロボットに対し、モジュール間のダウンウォッシュ干渉を制約として考慮しつつ、タスクに応じた組み立て構成を生成・最適選択するフレームワークを提案した。
原題: Downwash-aware Configuration Optimization for Modular Aerial Systems / Mengguang Li, Heinz Koeppl
日本語で読む → - 論文3D形状補完画像認識
LaS-Comp: 潜在空間と幾何空間の一貫性を利用したゼロショット3D形状補完
3D基盤モデルの幾何学的事前知識を活用し、学習なしで多様な部分観測から3D形状を補完する手法を提案。明示的な置換と暗黙的な精緻化の2段階設計で高精度な補完を実現した。
原題: LaS-Comp: Zero-shot 3D Completion with Latent-Spatial Consistency / Weilong Yan, Haipeng Li, Hao Xu 他
日本語で読む → - 論文継続学習/物体認識/ドローン画像認識
屋内ドローンのためのリプレイベース継続的物体認識
屋内ドローン向けの時系列一貫性を保った14,400フレームのデータセットを構築し、限られたメモリ予算下でリプレイベースのクラス増分学習手法を評価した。
原題: Learning on the Fly: Replay-Based Continual Object Perception for Indoor Drones / Sebastian-Ion Nae, Mihai-Eugen Barbu, Sebastian Mocanu 他
日本語で読む → - 論文3D物体検出/4Dレーダーロボティクス
HyperDet: ハイパー4Dレーダー点群による3D物体検出
LiDARを訓練時のみ用いて4Dレーダー点群を時空間蓄積・前景生成・ドップラー整合拡張で強化し、推論時はレーダーのみで標準3D検出器を高精度化する枠組み。
原題: HyperDet: 3D Object Detection with Hyper 4D Radar Point Clouds / Yichun Xiao, Runwei Guan, Jin Jin 他
日本語で読む → - 論文VLA画像認識
JEPA-VLA:VLAモデルに動画予測埋め込みが必要な理由
動画で事前学習した予測埋め込み(V-JEPA 2)をVLAモデルに適応的に統合し、サンプル効率と汎化性能を大幅に向上させる手法を提案。
原題: JEPA-VLA: Video Predictive Embedding is Needed for VLA Models / Shangchen Miao, Ningya Feng, Jialong Wu 他
日本語で読む → - 論文空中マニピュレーションロボティクス
斜面上への着陸のための固有感覚的接触位置推定を備えた全方向デュアルアーム空中マニピュレータ
双腕の全方向空中マニピュレータを開発し、トルクオブザーバによる固有感覚的な接触検出と位置推定で、視覚に頼らず斜面上への着陸を実現した。
原題: Omnidirectional Dual-Arm Aerial Manipulator with Proprioceptive Contact Localization for Landing on Slanted Roofs / Martijn B. J. Brummelhuis, Nathan F. Lepora, Salua Hamaza
日本語で読む → - 論文VLAロボティクス
検証のスケーリングは視覚-言語-行動の整合性において方策学習のスケーリングより効果的になり得る
視覚-言語-行動モデルの指示と行動のずれを減らすため、テスト時に言い換え指示と行動候補を増やして検証する手法CoVerを提案し、方策事前学習のスケーリングより高い性能を示した。
原題: Scaling Verification Can Be More Effective than Scaling Policy Learning for Vision-Language-Action Alignment / Jacky Kwok, Xilun Zhang, Mengdi Xu 他
日本語で読む → - 論文安全制御ロボティクス
オープンワールドロボットのための文脈的安全推論とグラウンディング
VLMで視覚から文脈依存の安全規則を推論し、環境に接地させて制御バリア関数で強制するCOREを提案。未知環境でも文脈に適した安全行動を実現する。
原題: Contextual Safety Reasoning and Grounding for Open-World Robots / Zachary Ravichandran, David Snyder, Alexander Robey 他
日本語で読む → - 論文マニピュレーションロボティクス
NovaPlan: 閉ループ動画言語計画によるゼロショット長期的マニピュレーション
VLMと動画生成を組み合わせ、生成動画から物体キーポイントと人間の手の姿勢を抽出してロボット動作に変換する階層的フレームワークを提案。訓練や実演なしで長期的な組立作業やエラー回復を実現した。
原題: NovaPlan: Zero-Shot Long-Horizon Manipulation via Closed-Loop Video Language Planning / Jiahui Fu, Junyu Nan, Lingfeng Sun 他
日本語で読む → - 論文意味セグメンテーションロボティクス
インスタンス誘導によるロボット意味セグメンテーションのための教師なしドメイン適応
3Dマップから多視点一貫性のある擬似ラベルを生成し、基盤モデルのゼロショットインスタンスセグメンテーションで補正することで、実環境でのロボットの意味セグメンテーションを教師なしで適応させる手法を提案。
原題: Instance-Guided Unsupervised Domain Adaptation for Robotic Semantic Segmentation / Michele Antonazzi, Lorenzo Signorelli, Matteo Luperto 他
日本語で読む → - 論文VLAロボティクス
RoboPaint: 人間の実演から任意のロボット・任意の視点へ
人間の多感覚デモを触覚対応リターゲティングとIsaac Simレンダリングでロボット訓練データに変換するReal-Sim-Realパイプラインを提案し、VLAモデルが80%の成功率を達成した。
原題: RoboPaint: From Human Demonstration to Any Robot and Any View / Jiacheng Fan, Zhiyue Zhao, Yiqian Zhang 他
日本語で読む → - 論文モデルベース制御ロボティクス
SPLIT: 自律走行車の制御指向モデリングのための誤差ダイナミクスのスパースインクリメンタル学習
車両モデルを不変要素と変動要素に分解し、局所的なインクリメンタル学習とGPのスパース化により、リアルタイム制御に適した高精度なハイブリッドモデルを構築する手法を提案。
原題: SPLIT: Sparse Incremental Learning of Error Dynamics for Control-Oriented Modeling in Autonomous Vehicles / Yaoyu Li, Chaosheng Huang, Jun Li
日本語で読む → - 論文マニピュレーションロボティクス
GeoLanG: 幾何学認識と統合RGB-Dマルチモーダル学習による言語誘導把持
CLIPを基盤に視覚と言語を統合し、深度情報を幾何学的事前知識として活用することで、雑然とした環境でも言語指示に基づく把持を実現するエンドツーエンド手法を提案。
原題: GeoLanG: Geometry-Aware Language-Guided Grasping with Unified RGB-D Multimodal Learning / Rui Tang, Guankun Wang, Long Bai 他
日本語で読む → - 論文予測/知覚ロボティクス
限られた視野のセンサデータから動的マップ状態を予測する
限られた視野の時系列センサデータを1枚の画像形式で表現し、画像変換モデルを用いて周囲の動的マップ状態を高精度に予測する手法を提案した。
原題: Predicting Dynamic Map States from Limited Field-of-View Sensor Data / Knut Peterson, David Han
日本語で読む → - 論文マルチモーダルHRIロボティクス
音声・感情・動作を統合するVLMベースのヒューマノイドロボット向けエッジ展開可能なマルチモーダルフレームワーク
VLMを基盤に、音声・表情・ジェスチャーを感情的に一貫させて生成するフレームワークSeM²を提案し、知識蒸留によりエッジ上でも95%の性能を維持するSeM²_eを実装した。
原題: Bridging Speech, Emotion, and Motion: a VLM-based Multimodal Edge-deployable Framework for Humanoid Robots / Songhua Yang, Xuetao Li, Xuanye Fei 他
日本語で読む → - 論文触覚ロボティクス
Ori-Sense:ソフトロボティクス応用のための折り紙容量センシング
逆Kresling折り紙構造を模した柔軟な容量センサを開発し、ねじり変形を容量変化に変換してソフトロボットの固有感覚フィードバックを可能にした。
原題: Ori-Sense: origami capacitive sensing for soft robotic applications / Hugo de Souza Oliveira, Xin Li, Mohsen Jafarpour 他
日本語で読む → - 論文群制御ロボティクス
分散型かつ完全オンボード:小型航空機のための距離支援協調測位とナビゲーション
各ロボットがオンボードのオドメトリとロボット間距離のみを用いて分散的に相対姿勢を推定し、因子グラフ推論に基づく編隊制御で協調ナビゲーションを実現する手法を提案し、実機実験で検証した。
原題: Decentralized and Fully Onboard: Range-Aided Cooperative Localization and Navigation on Micro Aerial Vehicles / Abhishek Goudar, Angela P. Schoellig
日本語で読む → - 論文機構設計ロボティクス
幾何学から平面性を生み出すロボット
球の平面への幾何学的反転を利用し、リンク長と接続関係だけで平面運動を実現するFlat-Plane Mechanismsを提案し、メートルからミクロンスケールでの位置決めや3Dプリンティングに応用した。
原題: Robots That Generate Planarity Through Geometry / Jakub F. Kowalewski, Abdulaziz O. Alrashed, Jacob Alpert 他
日本語で読む → - 論文自動運転/強化学習ロボティクス
ハミルトン・ヤコビ到達可能性と強化学習による自転車との安全なインタラクション
自動運転車が自転車と安全かつ効率的に相互作用するため、ハミルトン・ヤコビ到達可能性解析と深層Q学習を組み合わせ、安全性を考慮した報酬設計と自転車の反応モデルを導入したフレームワークを提案。
原題: Interacting safely with cyclists using Hamilton-Jacobi reachability and reinforcement learning / Aarati Andrea Noronha, Jean Oh
日本語で読む → - 論文モバイルマニピュレーションロボティクス
YOR: 汎用ロボティクス研究のための自作モバイルマニピュレータ
全方向移動ベース・伸縮リフト・双腕を組み合わせた低コスト(1万ドル以下)のオープンソース移動マニピュレータを開発し、全身協調動作や双腕操作、自律ナビゲーションを実証した。
原題: YOR: Your Own Mobile Manipulator for Generalizable Robotics / Manan H Anjaria, Mehmet Enes Erciyes, Vedant Ghatnekar 他
日本語で読む →