論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA/触覚/マニピュレーションロボティクス
視覚言語行動モデルへの物理フィードバック統合のためのモジュール型感覚ストリーム
視覚言語行動モデル(VLA)に触覚やトルクなどの複数の物理センサ信号を統合するモジュール型フレームワークを提案し、実世界実験で性能向上を実証した。
原題: Modular Sensory Stream for Integrating Physical Feedback in Vision-Language-Action Models / Jimin Lee, Huiwon Jang, Myungkyu Koo 他
日本語で読む → - 論文コンピュータビジョン画像認識
第4回海事コンピュータビジョンワークショップ(MaCVi):チャレンジ概要
CVPR 2026で開催される海事コンピュータビジョンのワークショップで、5つのベンチマークチャレンジの設定、評価プロトコル、データセット、結果をまとめ、上位チームの技術レポートも紹介している。
原題: 4th Workshop on Maritime Computer Vision (MaCVi): Challenge Overview / Benjamin Kiefer, Jan Lukas Augustin, Jon Muhovič 他
日本語で読む → - 論文VLAロボティクス
VLA Foundry: 視覚言語行動モデル訓練のための統合フレームワーク
LLM、VLM、VLAの訓練を単一コードベースで統合するオープンソースフレームワークを提案し、スクラッチからの訓練と事前学習済みバックボーンを用いた訓練の両方をサポートし、シミュレータ上で評価した。
原題: VLA Foundry: A Unified Framework for Training Vision-Language-Action Models / Jean Mercat, Sedrick Keh, Kushal Arora 他
日本語で読む → - 論文ソフトロボティクスロボティクス
つる型ロボットにおける局所選択的剛性化と形状保持を可能にする再構成可能な空気圧ジョイント
つる型ロボットの軸剛性と形状保持を改善するため、圧力で剛性を変えられる再構成可能な空気圧ジョイントを提案し、実験でその有効性を示した。
原題: A Reconfigurable Pneumatic Joint Enabling Localized Selective Stiffening and Shape Locking in Vine-Inspired Robots / Ayodele James Oyejide, Ustaz A. Yaqub, Samir Erturk 他
日本語で読む → - 論文生涯学習/記憶管理ロボティクス
忘れることを学ぶ:生涯ロボット展開のための階層的エピソディックメモリ
ロボットが長期間の運用で記憶容量を超えないよう、ユーザーとの対話を通じて重要度を学習し、不要な記憶を選択的に忘れる階層的エピソディックメモリフレームワークを提案した。
原題: Learning to Forget -- Hierarchical Episodic Memory for Lifelong Robot Deployment / Leonard Bärmann, Joana Plewnia, Alex Waibel 他
日本語で読む → - 論文群制御ロボティクス
群れサイズ変動がオペレータの作業負荷に与える影響
人間と群ロボットのチーム運用において、群れサイズの増減がオペレータの主観的作業負荷に与える影響を実験で調査した。小さな増加は負荷を低く保つが、小さな減少は負荷を高く維持し、大きな変化はリセット効果をもたらすことを示した。
原題: Effects of Swarm Size Variability on Operator Workload / William Hunt, Aleksandra Landowska, Horia A. Maior 他
日本語で読む → - 論文マニピュレーションロボティクス
全身移動マニピュレーションのためのスケーラブルな軌道生成
GPU加速フレームワークAutoMoMaを提案し、移動ベースとアームの運動学を統合したAKRモデリングと並列軌道最適化により、多様な環境・ロボットでの大規模な物理的に有効な軌道データを高速生成する。
原題: Scalable Trajectory Generation for Whole-Body Mobile Manipulation / Yida Niu, Xinhai Chang, Xin Liu 他
日本語で読む → - 論文オフライン強化学習機械学習
フィッシャー装飾子:局所輸送写像によるフローポリシーの精緻化
オフライン強化学習におけるフローポリシーの最適化を、局所輸送写像として再定式化し、フィッシャー情報行列に基づく異方性最適化を導入して、従来の等方性近似による最適性ギャップを改善した。
原題: Fisher Decorator: Refining Flow Policy via a Local Transport Map / Xiaoyuan Cheng, Haoyu Wang, Wenxuan Yuan 他
日本語で読む → - 論文歩行ロボティクス
スイッチ:ヒューマノイドロボットの俊敏なスキル切り替えの実現
ヒューマノイドロボットが複数の移動スキルをシームレスに切り替えられるようにする階層型マルチスキルシステムを提案した論文。
原題: Switch: Learning Agile Skills Switching for Humanoid Robots / Yuen-Fui Lau, Qihan Zhao, Yinhuai Wang 他
日本語で読む → - 論文安全性ロボティクス
視覚言語行動の安全性:脅威、課題、評価、およびメカニズム
VLAモデルの安全性に関する包括的なサーベイを提供し、攻撃・防御・評価・展開の観点から脅威を整理した。
原題: Vision-Language-Action Safety: Threats, Challenges, Evaluations, and Mechanisms / Qi Li, Bo Yin, Weiqi Huang 他
日本語で読む → - 論文VLA/操作ロボティクス
SpatialVAM: 空間認識型マルチビュービデオ拡散によるデータ効率的なロボットポリシー
3D空間構造と時間変化を同時に捉えるため、空間認識型のマルチビューヒートマップビデオとRGBビデオを生成する初の3Dビデオ行動モデルを提案し、少数のデモで汎用的な操作を実現した。
原題: SpatialVAM:Spatial-Aware Multi-View Video Diffusion as a Data-Efficient Robot Policy / Peiyan Li, Yixiang Chen, Yuan Xu 他
日本語で読む → - 論文生体信号推定ロボティクス
GEGLU-TransformerによるIMUからEMGへの推定と少数ショット適応
ウェアラブルロボティクス向けに、慣性計測ユニット(IMU)から筋電図(EMG)の筋活動包絡線を推定する適応的学習フレームワークを提案。TransformerエンコーダとGEGLU活性化関数を組み合わせ、被験者間の一般化と迅速な個人適応を実現した。
原題: GEGLU-Transformer for IMU-to-EMG Estimation with Few-Shot Adaptation / Miroljub Mihailovic, Luca Tonin, Stefano Tortora 他
日本語で読む → - 論文模倣学習ロボティクス
ロボットの文脈内模倣学習のための階層的時空間アクショントークナイザ
階層的なベクトル量子化と時空間情報を利用した新しいアクショントークナイザを提案し、模倣学習の性能を向上させた。
原題: A Hierarchical Spatiotemporal Action Tokenizer for In-Context Imitation Learning in Robotics / Fawad Javed Fateh, Ali Shah Ali, Murad Popattia 他
日本語で読む → - 論文VLA/推論高速化画像認識
VLA-InfoEntropy: 学習不要の視覚注意情報エントロピーによるVLAモデルの推論高速化と成功率向上
視覚言語行動(VLA)モデルの推論を高速化するため、画像エントロピーと注意エントロピーを用いて重要領域を動的に選択し、冗長な視覚情報を削減する手法を提案した。
原題: VLA-InfoEntropy: A Training-Free Vision-Attention Information Entropy Approach for Vision-Language-Action Models Inference Acceleration and Success / Chuhang Liu, Yayun He, Zuheng Kang 他
日本語で読む → - 論文群制御ロボティクス
COMB: ミツバチのための共通オープンモジュール型ロボットプラットフォーム
標準的な観察巣箱フレーム内で動作する、コンパクトでオープンソースのモジュール式メカトロニクスプラットフォームを提案し、生きたミツバチの巣内実験を可能にする。
原題: COMB: Common Open Modular robotic platform for Bees / Pranav Kedia, Marie Messerich, Tim Landgraf
日本語で読む → - 論文群制御制御
要素ベースのフォーメーション制御:連続体力学からの統一的視点
連続体力学の変形勾配を用いて、フォーメーション制御のための統一的な要素ベースのフレームワークを構築し、様々な幾何学的不変性を実現する分散制御則を導出した。
原題: Element-based Formation Control: a Unified Perspective from Continuum Mechanics / Kun Cao, Lihua Xie
日本語で読む → - 論文ハンド/劣駆動/手首統合ロボティクス
SoftHand Model-W: 3Dプリントによる手首と手根管を統合した人間型・劣駆動ロボットハンド
Pisa/IIT SoftHandを基に、拮抗腱機構と2自由度の腱駆動手首を統合した3Dプリント製の人間型劣駆動ハンドを開発し、手首の駆動がアームの補償動作を減らし作業時間を短縮することを実証した。
原題: SoftHand Model-W: A 3D-Printed, Anthropomorphic, Underactuated Robot Hand with Integrated Wrist and Carpal Tunnel / Dhillon B. Merritt, Christopher J. Ford, Haoran Li 他
日本語で読む → - 論文自動運転/シミュレーションロボティクス
GPU加速による不確実性下の安全重要AEBシステムのリアルタイムモンテカルロ評価
自動緊急ブレーキ(AEB)の性能を不確実性を考慮して評価するため、GPU並列化したモンテカルロシミュレーションフレームワークを提案し、最大54.57倍の高速化とリアルタイム実行可能性を示した。
原題: Real-Time GPU-Accelerated Monte Carlo Evaluation of Safety-Critical AEB Systems Under Uncertainty / Akshay Karjol, Shadi Alawneh
日本語で読む → - 論文UAV制御ロボティクス
AWARE: 人間参加型インタラクション下でのLiDAR-慣性オドメトリ強化のための適応的全身体能動回転制御
狭視野LiDARを搭載したUAVの自己位置推定精度を向上させるため、機体の回転を能動的に活用し、MPCと強化学習を組み合わせてセンサ視野を拡張するフレームワークを提案した。
原題: AWARE: Adaptive Whole-body Active Rotating Control for Enhanced LiDAR-Inertial Odometry under Human-in-the-Loop Interaction / Yizhe Zhang, Jianping Li, Liangliang Yin 他
日本語で読む → - 論文マニピュレーションロボティクス
ボタンを押す: 優しい押下動作の計測学習
ボタン押し操作を対象に、訓練時のみ物体にセンサを取り付け、接触音を検出するエンコーダを学習し、推論時は視覚と音声のみで接触力の低い操作を実現する手法を提案した。
原題: You're Pushing My Buttons: Instrumented Learning of Gentle Button Presses / Raman Talwar, Remko Proesmans, Thomas Lips 他
日本語で読む → - 論文マニピュレーションロボティクス
CLASP: オープンボキャブラリの机上物体把持のための閉ループ非同期空間知覚
机上物体の把持を対象に、視覚言語モデルの空間的幻覚と開ループ実行の脆弱性を克服するため、非同期閉ループフレームワークCLASPを提案した。
原題: CLASP: Closed-loop Asynchronous Spatial Perception for Open-vocabulary Desktop Object Grasping / Yiran Ling, Wenxuan Li, Siying Dong 他
日本語で読む → - 論文航空交通管理制御
高密度空域におけるコンフリクト解決時のeVTOL航空機のエネルギーオーバーヘッド推定
高密度都市空域でのeVTOL航空機のコンフリクト解決操作がエネルギー消費に与える影響を、シミュレーションと機械学習モデルを用いて定量評価した論文。
原題: eVTOL Aircraft Energy Overhead Estimation under Conflict Resolution in High-Density Airspaces / Alex Zongo, Peng Wei
日本語で読む → - 論文カバレッジ制御ロボティクス
カーネル平均埋め込みによる無限時間エルゴード制御
カーネル平均埋め込みに基づくエルゴード制御を無限時間に拡張し、長時間のカバレッジタスクを効率的に解く手法を提案した。
原題: Infinite-Horizon Ergodic Control via Kernel Mean Embeddings / Christian Hughes, Ian Abraham
日本語で読む → - 論文マニピュレーションロボティクス
言語指示による把持のための実行状態監視を備えた物理エージェントループ
言語指示による把持操作を、実行状態を監視しながら再試行やユーザー確認を行う物理エージェントループとして再構成し、ロバスト性と解釈可能性を向上させた。
原題: A Physical Agentic Loop for Language-Guided Grasping with Execution-State Monitoring / Wenze Wang, Mehdi Hosseinzadeh, Feras Dayoub
日本語で読む → - 論文視覚位置推定画像認識
LSGS-Loc: 大規模UAVシナリオ向けの堅牢な3DGSベースの視覚位置推定
大規模なUAV環境での視覚位置推定を強化するため、スケール認識の初期化とラプラシアンに基づく信頼性マスキングを導入した3DGSベースのパイプラインを提案した。
原題: LSGS-Loc: Towards Robust 3DGS-Based Visual Localization for Large-Scale UAV Scenarios / Xiang Zhang, Tengfei Wang, Fang Xu 他
日本語で読む → - 論文群制御ロボティクス
FORMULA: ニューラル障壁学習を用いた安全保証付きフォーメーションMPC
マルチロボットのフォーメーション制御において、MPCとニューラルCBFを統合し、手動設計なしで安全性を保証する分散型フレームワークを提案した。
原題: FORMULA: FORmation MPC with neUral barrier Learning for safety Assurance / Qintong Xie, Weishu Zhan, Peter Chin
日本語で読む → - 論文群制御ロボティクス
小規模学習・大規模展開:拡散モデルに基づくマルチロボット計画の活用
少数エージェントで訓練した拡散モデルベースのプランナーが、展開時に多数のエージェントへ一般化できることを示した論文。
原題: Train-Small Deploy-Large: Leveraging Diffusion-Based Multi-Robot Planning / Siddharth Singh, Soumee Guha, Qing Chang 他
日本語で読む → - 論文群制御ロボティクス
PRO-SPECT: 確率的環境下でのエネルギー考慮型UAV-UGV協調計画における確率的に安全なスケーラブル計画法
UAVとUGVチームが確率的環境でエネルギー制約を満たしつつ任務を完了するための、リスクを確率的に保証する計画アルゴリズムを提案した論文。
原題: PRO-SPECT: Probabilistically Safe Scalable Planning for Energy-Aware Coordinated UAV-UGV Teams in Stochastic Environments / Roger Fowler, Cahit Ikbal Er, Benjamin Johnsenberg 他
日本語で読む → - 論文HMI/自動運転ロボティクス
車外HMIのための車両外装部品の露出度測定におけるフルカラー空間記録の展開手法の活用
自動運転車の意図を歩行者に伝えるeHMIの設置箇所を決めるため、メッシュ展開とUnityシミュレーションで車両各部の歩行者からの可視頻度を計測し、バンパーやグリルだけでは不十分で、フロントガラスとフェンダーへの分散配置を提案した。
原題: Using Unwrapped Full Color Space Recording to Measure the Exposedness of Vehicle Exterior Parts for External Human Machine Interfaces / Jose Gonzalez-Belmonte, Jaerock Kwon
日本語で読む → - 論文自動運転画像認識
DVGT-2: 大規模自動運転のためのビジョン・ジオメトリ・アクションモデル
自動運転のための新しいVGAパラダイムを提案し、オンライン推論可能なストリーミング型のDVGT-2を導入。密な3Dジオメトリと軌道計画を同時に出力し、多様なカメラ設定で微調整なしに適用可能。
原題: DVGT-2: Vision-Geometry-Action Model for Autonomous Driving at Scale / Sicheng Zuo, Zixun Xie, Wenzhao Zheng 他
日本語で読む →