論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マルチモーダルHRIロボティクス
音声・感情・動作を統合するVLMベースのヒューマノイドロボット向けエッジ展開可能なマルチモーダルフレームワーク
VLMを基盤に、音声・表情・ジェスチャーを感情的に一貫させて生成するフレームワークSeM²を提案し、知識蒸留によりエッジ上でも95%の性能を維持するSeM²_eを実装した。
原題: Bridging Speech, Emotion, and Motion: a VLM-based Multimodal Edge-deployable Framework for Humanoid Robots / Songhua Yang, Xuetao Li, Xuanye Fei 他
日本語で読む → - 論文車両制御ロボティクス
衝突後の単一トラック・アッカーマン車両におけるヒューリスティック操舵と駆動力関数を用いた軌道復元
衝突後の横揺れやヨー過渡を抑え、操舵と駆動力を協調制御するヒューリスティックな復元制御則を提案し、シミュレーションで有効性を検証した。
原題: Post-Collision Trajectory Restoration for a Single-track Ackermann Vehicle using Heuristic Steering and Tractive Force Functions / Samsaptak Ghosh, M. Felix Orlando, Sohom Chakrabarty
日本語で読む → - 論文飛行ロボットロボティクス
オンボードセンシングと計算による昆虫サイズ羽ばたきロボットの制御飛行
1.29グラムの昆虫サイズ羽ばたきロボットが、オンボードのセンサと計算だけでホバリングや軌道追従を実現し、モーションキャプチャ外でも障害物回避と着陸に成功した。
原題: Controlled Flight of an Insect-Scale Flapping-Wing Robot via Integrated Onboard Sensing and Computation / Yi-Hsuan Hsiao, Quang Phuc Kieu, Zhongtao Guan 他
日本語で読む → - 論文空中マニピュレーションロボティクス
堅牢な空中マニピュレーションのための精密リアルタイム力覚把持システム
低コストな磁気式触覚センサを6つ用いて、ドローンの把持力をリアルタイムに計測・制御するシステムを開発し、壊れやすい物体の把持や重量測定を機体上のみで実現した。
原題: A Precise Real-Time Force-Aware Grasping System for Robust Aerial Manipulation / Kenghou Hoi, Yuze Wu, Annan Ding 他
日本語で読む → - 論文マニピュレーションロボティクス
意図と実行のギャップを活用:視覚運動ポリシーにおける暗黙的インピーダンスの学習
遠隔操作のマスタ指令とスレーブ応答のズレをノイズではなく力覚情報として活用し、意図クローニングにより暗黙的なインピーダンス制御を実現する枠組みを提案した。
原題: Mind the Gap: Learning Implicit Impedance in Visuomotor Policies via Intent-Execution Mismatch / Cuijie Xu, Shurui Zheng, Zihao Su 他
日本語で読む → - 論文協調自己位置推定ロボティクス
車両を超えて:GPS困難な都市環境における点群融合による協調自己位置推定
GPSが不安定な都市部で、車車間・路車間通信とLiDAR・ステレオカメラの点群を融合し、SLAMベースの協調自己位置推定を行う手法を提案した。
原題: Beyond the Vehicle: Cooperative Localization by Fusing Point Clouds for GPS-Challenged Urban Scenarios / Kuo-Yi Chao, Ralph Rasshofer, Alois Christian Knoll
日本語で読む → - 論文安全性制御
実世界で基盤モデル搭載ロボットに必要なモジュール式セーフティガードレール
基盤モデルを組み込んだロボットの安全性を行動・意思決定・人間中心の3次元で整理し、監視と介入からなるモジュール式ガードレールをアーキテクチャ基盤として提案する。
原題: Modular Safety Guardrails Are Necessary for Foundation-Model-Enabled Robots in the Real World / Joonkyung Kim, Wenxi Chen, Davood Soleymanzadeh 他
日本語で読む → - 論文マニピュレーションロボティクス
ALORE: 脚式マニピュレータによる大型物体の自律再配置
脚式マニピュレータが多様な大型物体を衝突回避しながら効率的に再配置するシステムを提案。階層強化学習とタスク・モーション計画を組み合わせ、実機実験で有効性を示した。
原題: ALORE: Autonomous Large-Object Rearrangement with a Legged Manipulator / Zhihai Bi, Yushan Zhang, Kai Chen 他
日本語で読む → - 論文宇宙ランデブー誘導ロボティクス
近距離ランデブー軌道設計と誘導のための自律型エンドツーエンド凸最適化フレームワーク:ハードウェアテストベッドによる検証
深層学習による知覚と凸最適化に基づく軌道設計・誘導を統合し、センサ故障やエンジン故障にも対応する近距離ランデブー自律フレームワークCORTEXを提案し、シミュレーションとハードウェア実験で検証した。
原題: An Autonomous, End-to-End, Convex-Based Framework for Close-Range Rendezvous Trajectory Design and Guidance with Hardware Testbed Validation / Minduli C. Wijayatunga, Julian Guinane, Nathan D. Wallace 他
日本語で読む → - 論文VLAロボティクス
GeneralVLA:知識誘導型軌道計画による汎化可能な視覚-言語-行動モデル
基盤モデルの汎化能力を活かし、アフォーダンス認識・3D軌道計画・制御を階層化したVLAモデルを提案。実機データや人間の実演なしでゼロショットのマニピュレーションを実現する。
原題: GeneralVLA: Generalizable Vision-Language-Action Models with Knowledge-Guided Trajectory Planning / Guoqing Ma, Siheng Wang, Zeyu Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
混雑空間におけるメイクスパン効率の良い物体再配置のためのマルチエージェントモンテカルロ木探索
混雑環境での非単調な物体再配置を効率的に行うため、集中型タスク割り当てと非同期実行を組み合わせたマルチエージェントMCTSフレームワークCAM-MCTSを提案し、シミュレーションと実機で有効性を示した。
原題: Multi-Agent Monte Carlo Tree Search for Makespan-Efficient Object Rearrangement in Cluttered Spaces / Hanwen Ren, Junyong Kim, Aathman Tharmasanthiran 他
日本語で読む → - 論文VLAロボティクス
EgoActor: 視覚言語モデルによるヒューマノイドロボットの空間認識型一人称視点行動へのタスク計画の接地
一人称視覚言語モデルEgoActorを提案し、高レベル指示から歩行・頭部動作・操作コマンドを直接予測してヒューマノイドの知覚と実行をリアルタイムに統合する。
原題: EgoActor: Grounding Task Planning into Spatial-aware Egocentric Actions for Humanoid Robots via Visual-Language Models / Yu Bai, MingMing Yu, Chaojie Li 他
日本語で読む → - 論文VLAロボティクス
ProAct: 構造認識型能動応答のためのベンチマークとマルチモーダルフレームワーク
75タスク・91,581アノテーションからなる能動エージェント用ベンチマークProAct-75を構築し、タスクグラフとMLLMを活用したベースラインProAct-Helperを提案した。
原題: ProAct: A Benchmark and Multimodal Framework for Structure-Aware Proactive Response / Xiaomeng Zhu, Fengming Zhu, Weijie Zhou 他
日本語で読む → - 論文sim2realロボティクス
タンゴは二人で踊る:ロボット倉庫における注文スケジューリングとマルチエージェント経路探索の統合シミュレータ
ロボット倉庫の注文スケジューリングと経路探索を分離せず統合し、物理制約や障害回復も考慮したシミュレータWareRoverを提案。既存手法が現実的な制約下で苦戦することを示した。
原題: It Takes Two to Tango: A Holistic Simulator for Joint Order Scheduling and Multi-Agent Path Finding in Robotic Warehouses / Haozheng Xu, Wenhao Li, Zifan Wei 他
日本語で読む → - 論文強化学習機械学習
PolicyFlow: 連続正規化フローを用いた強化学習のための方策最適化
PPOに連続正規化フロー(CNF)方策を組み込み、全軌道の尤度評価を避けて速度場の変化で重要度比を近似する新手法を提案し、多様な環境で有効性を示した。
原題: PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning / Shunpeng Yang, Ben Liu, Hua Chen
日本語で読む → - 論文深度補完画像認識
OASIS-DC: スパース統合単眼擬似深度の出力レベル整合による汎化可能な深度補完
単眼基盤モデルの相対深度をスパースな距離計測で校正して擬似メトリック深度事前分布を作り、それを洗練ネットワークで補正することで、ラベルが極端に少ない状況でも高精度な深度補完を実現した。
原題: OASIS-DC: Generalizable Depth Completion via Output-level Alignment of Sparse-Integrated Monocular Pseudo Depth / Jaehyeon Cho, Jhonghyun An
日本語で読む → - 論文sim2realロボティクス
ベイズ最適化とローバー・地形シミュレーションによる車輪と制御の同時設計
変形地形上の全車両閉ループシミュレーションとベイズ最適化を用いて、ローバーの車輪形状とステアリング制御パラメータを同時に設計するフレームワークを提案し、逐次設計との比較や計算コストの分析を行った。
原題: Co-Design of Rover Wheels and Control using Bayesian Optimization and Rover-Terrain Simulations / Huzaifa Mustafa Unjhawala, Khizar Shaikh, Luning Bakke 他
日本語で読む → - 論文VLAロボティクス
BTGenBot-2: 小型言語モデルによる効率的なビヘイビアツリー生成
自然言語のタスク指示とロボットの行動プリミティブから実行可能なビヘイビアツリーをXMLで直接生成する1Bパラメータのオープンソース小型言語モデルを提案し、標準ベンチマークを構築した。
原題: BTGenBot-2: Efficient Behavior Tree Generation with Small Language Models / Riccardo Andrea Izzo, Gianluca Bardaro, Matteo Matteucci
日本語で読む → - 論文VLAロボティクス
AutoFly: 実環境でのUAV自律ナビゲーションのための視覚-言語-行動モデル
RGB入力から擬似深度特徴を抽出するエンコーダと二段階学習を組み合わせ、粗い指示のみでUAVが自律的に経路計画と障害物回避を行うVLAモデルを提案し、自律行動に焦点を当てた新データセットも構築した。
原題: AutoFly: Vision-Language-Action Model for UAV Autonomous Navigation in the Wild / Xiaolou Sun, Wufei Si, Wenhui Ni 他
日本語で読む → - 論文飛行ロボティクス/再計画ロボティクス
FC-Vision: 未知環境における遮蔽物のない航空目標構造物スキャンのためのリアルタイム可視性認識リプランニング
飛行中に未知の障害物が現れても、目標構造物の遮蔽を能動的に回避しながらリアルタイムで経路を再計画し、スキャン品質を保つフレームワークを提案した。
原題: FC-Vision: Real-Time Visibility-Aware Replanning for Occlusion-Free Aerial Target Structure Scanning in Unknown Environments / Chen Feng, Yang Xu, Shaojie Shen
日本語で読む → - 論文模倣学習ロボティクス
PRISM: 単一パス多感覚模倣学習のためのPerformer RS-IMLE
RGB・深度・触覚・音声・固有感覚を統合する時間的多感覚エンコーダとPerformerベースの線形注意生成器を組み合わせ、IMLEのバッチ全体拒絶サンプリング変種により単一パスで高速(30-50Hz)な模倣学習を実現した手法。
原題: PRISM: Performer RS-IMLE for Single-pass Multisensory Imitation Learning / Amisha Bhaskar, Pratap Tokekar, Stefano Di Cairano 他
日本語で読む → - 論文歩行ロボティクス
TTT-Parkour: 知覚型ロボットパルクールのための高速テスト時訓練
RGB-Dで実地形を高精度に再構成し、その上で方策を高速微調整するreal-to-sim-to-real手法により、人型ロボットが未知の複雑地形を10分以内で走破できるようにした。
原題: TTT-Parkour: Rapid Test-Time Training for Perceptive Robot Parkour / Shaoting Zhu, Baijun Ye, Jiaxuan Wang 他
日本語で読む → - 論文シーン再構成画像認識
Picasso: 物理制約付きサンプリングによるシーン全体の再構成
物体間の接触や物理的整合性を考慮し、遮蔽やノイズがあっても物理的に妥当な多物体シーン再構成を行う手法を提案し、実世界データセットと評価指標も公開した。
原題: Picasso: Holistic Scene Reconstruction with Physics-Constrained Sampling / Xihang Yu, Rajat Talak, Lorenzo Shaikewitz 他
日本語で読む → - 論文模倣学習ロボティクス
マルチタスク軌道からの解釈可能なスキルのオフライン発見
弱いタスクラベルと自己教師あり学習を組み合わせて、長期的なマルチタスクのオフラインデータから再利用可能なスキルを発見し、階層的な模倣学習を実現するフレームワークLOKIを提案した。
原題: Offline Discovery of Interpretable Skills from Multi-Task Trajectories / Chongyu Zhu, Mithun Vanniasinghe, Jiayu Chen 他
日本語で読む → - 論文VLAロボティクス
MobileManiBench:モバイルマニピュレーションのためのモデル検証を簡素化するベンチマーク
NVIDIA Isaac Simと強化学習を用いて、多様なモバイルマニピュレーション軌道を自動生成する大規模ベンチマークを構築し、代表的なVLAモデルの性能を評価した。
原題: MobileManiBench: Simplifying Model Verification for Mobile Manipulation / Wenbo Wang, Fangyun Wei, QiXiu Li 他
日本語で読む → - 論文HRI倫理HCI
人間とロボットの相互作用における倫理的非対称性:Sparrowの仮説の実証的検証
人間がロボットに対して道徳的判断を下す際の倫理的非対称性仮説をオンライン実験で検証し、仮説は支持されなかった。
原題: Ethical Asymmetry in Human-Robot Interaction - An Empirical Test of Sparrow's Hypothesis / Minyi Wang, Christoph Bartneck, Michael-John Turp 他
日本語で読む → - 論文自動運転/VLAロボティクス
SteerVLA:長尾運転シーンで視覚言語行動モデルを操舵する
VLMの常識推論で細かい言語指示を生成し、VLA運転ポリシーを操舵する手法を提案。閉ループベンチマークで長尾シーンの性能を大幅に改善した。
原題: SteerVLA: Steering Vision-Language-Action Models in Long-Tail Driving Scenarios / Tian Gao, Celine Tan, Catherine Glossop 他
日本語で読む → - 論文空中マニピュレーションロボティクス
空中ピックアンドプレースのための懸垂変形ケーブルの連続体・ハイブリッドダイナミクスの非線形予測制御
伸縮可能なケーブルの空中マニピュレーションのため、PDEモデルを有限差分法で離散化し、固有直交分解で低次元モデルを抽出、非線形モデル予測制御を適用して振動抑制とペイロードの着脱に対応した。
原題: Nonlinear Predictive Control of the Continuum and Hybrid Dynamics of a Suspended Deformable Cable for Aerial Pick and Place / Antonio Rapuano, Yaolei Shen, Federico Califano 他
日本語で読む → - 論文ドローン自律飛行ロボティクス
安全シールド強化学習による高密度環境での高速ビジョンベース飛行
物理情報を活用した強化学習とリアルタイム安全フィルタを組み合わせ、7.5m/sの高速で障害物を回避しながらドローンを自律飛行させる手法を提案した。
原題: High-Speed Vision-Based Flight in Clutter with Safety-Shielded Reinforcement Learning / Jiarui Zhang, Chengyong Lei, Chengjiang Dai 他
日本語で読む → - 論文強化学習機械学習
空間平滑化による価値学習
オフライン目標条件付き強化学習において、距離的制約を局所空間測度の期待値として再解釈し、微分演算子を必要とせずに構造化された価値表現を学習する手法を提案。
原題: Mollified Value Learning / Hrishikesh Viswanath, Juanwu Lu, S. Talha Bukhari 他
日本語で読む →