論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文歩行ロボティクス
多接触全身軌道最適化によるヒューマノイド歩行の運動学的・動学的モーションリターゲティング
モーションキャプチャと床反力データを用い、剛体動力学と接触相補性制約を課した多接触全身軌道最適化としてリターゲティングを行うことで、物理的に整合したヒューマノイド歩行軌道を生成するフレームワークを提案した。
原題: Kinodynamic Motion Retargeting for Humanoid Locomotion via Multi-Contact Whole-Body Trajectory Optimization / Xiaoyu Zhang, Steven Haener, Varun Madabushi 他
日本語で読む → - 論文物体探索ロボティクス
3Dシーングラフ上の関係意味推論によるオープンワールド対話型物体探索
3Dシーングラフ上で関係探索ヒューリスティクスを用いて効率的に物体を探索するSCOUTを提案し、LLMから軽量モデルへの知識蒸留とベンチマークSymSearchを導入した。
原題: Relational Semantic Reasoning on 3D Scene Graphs for Open World Interactive Object Search / Imen Mahdi, Matteo Cassinelli, Fabien Despinoy 他
日本語で読む → - 論文VLAロボティクス
視覚言語行動モデルのための実用的な世界モデルベース強化学習に向けて
VLAモデルの強化学習を実世界ではなく世界モデル内で行う枠組みVLA-MBPOを提案し、マルチビュー整合性と誤差蓄積を抑える設計で性能とサンプル効率を改善した。
原題: Towards Practical World Model-based Reinforcement Learning for Vision-Language-Action Models / Zhilong Zhang, Haoxiang Ren, Yihao Sun 他
日本語で読む → - 論文マニピュレーションロボティクス
視点汎化を超えて:多視点デモがもたらすものとロボット操作のためのその合成方法
多視点デモデータがロボット操作の性能と汎化に与える影響を体系的に分析し、単眼入力から新視点ビデオを合成する自己教師ありフレームワークRoboNVSを提案した。
原題: Beyond Viewpoint Generalization: What Multi-View Demonstrations Offer and How to Synthesize Them for Robot Manipulation? / Boyang Cai, Qiwei Liang, Jiawei Li 他
日本語で読む → - 論文遠隔操作ロボティクス
ネットワーク遅延下における視覚ベース遠隔操作の非線形性能劣化
自律走行車の遠隔操作におけるネットワーク遅延が、カメラベースの車線維持制御の安定性に与える影響を実験的に調査し、遅延が150msから225msの間で安定性が急激に崩れることを示した。また、遅延注入と計測が可能なROS 2テストベッドLAVTを開発した。
原題: Nonlinear Performance Degradation of Vision-Based Teleoperation under Network Latency / Aws Khalil, Jaerock Kwon
日本語で読む → - 論文歩行ロボティクス
Safe-SAGE: ラプラス変調ポアソン安全関数による社会意味適応型安全誘導
視覚と言語の意味理解を統合し、ポアソン安全関数とラプラス誘導場で障害物ごとに安全余裕を変える脚ロボットのナビゲーション手法を提案。
原題: Safe-SAGE: Social-Semantic Adaptive Guidance for Safe Engagement through Laplace-Modulated Poisson Safety Functions / Lizhi Yang, Ryan M. Bena, Meg Wilkinson 他
日本語で読む → - 論文マニピュレーションロボティクス
電気油圧アクチュエータで駆動するセンサレス・本質的柔軟筋骨格ロボットハンド
Peano-HASELアクチュエータを前腕に配置し、プーリ機構で腱変位を増幅した筋骨格型ロボットハンドを開発。電流監視のみで把持検出と接触対応制御を実現し、紙風船などの壊れやすい物体を安全に把持できることを示した。
原題: A Sensorless, Inherently Compliant Anthropomorphic Musculoskeletal Hand Driven by Electrohydraulic Actuators / Misato Sonoda, Ronan Hinchet, Amirhossein Kazemipour 他
日本語で読む → - 論文因子グラフ最適化ロボティクス
認証可能な因子グラフ最適化によるロバストM推定の実装
外れ値と非凸最適化に対処するため、適応的再重み付けM推定を、内部の重み付き最小二乗問題を認証可能な解法で解くことで実装し、ポーズグラフ最適化やランドマークSLAMで有効性を示した。
原題: Implementing Robust M-Estimators with Certifiable Factor Graph Optimization / Zhexin Xu, Hanna Jiamei Zhang, Helena Calatrava 他
日本語で読む → - 論文3D多物体追跡画像認識
Fusion-Poly: 時空間融合に基づく3D多物体追跡のための多面体フレームワーク
LiDARとカメラの非同期観測を活用し、同期・非同期タイムスタンプで軌道を更新する3D多物体追跡フレームワークを提案。
原題: Fusion-Poly: A Polyhedral Framework Based on Spatial-Temporal Fusion for 3D Multi-Object Tracking / Xian Wu, Yitao Wu, Xiaoyu Li 他
日本語で読む → - 論文sim2realロボティクス
Fire as a Service:熱的・視覚的に正確な火災ダイナミクスでロボットシミュレータを拡張
既存のロボットシミュレータに高忠実度かつ計算効率の良い火災シミュレーションを非同期で追加するフレームワークを提案し、熱伝達や煙の再現、マルチモーダル知覚データ収集、行動クローニングによる方策学習を可能にした。
原題: Fire as a Service: Augmenting Robot Simulators with Thermally and Visually Accurate Fire Dynamics / Anton R. Wagner, Madhan Balaji Rao, Helge Wrede 他
日本語で読む → - 論文VLAロボティクス
MEM: 視覚言語行動モデルのためのマルチスケール具現化メモリ
ロボットの長期タスク遂行のために、ビデオベースの短期記憶とテキストベースの長期記憶を組み合わせたマルチスケールメモリアーキテクチャを提案し、15分に及ぶ複雑なタスクを可能にした。
原題: MEM: Multi-Scale Embodied Memory for Vision Language Action Models / Marcel Torne, Karl Pertsch, Homer Walke 他
日本語で読む → - 論文自動運転画像認識
潜在世界行動モデリングによるエンドツーエンド自動運転
空間認識と動力学を考慮した潜在世界表現を用いた効率的なエンドツーエンド自動運転フレームワークを提案し、軌道計画性能を向上させた。
原題: Latent-WAM: Latent World Action Modeling for End-to-End Autonomous Driving / Linbo Wang, Yupeng Zheng, Qiang Chen 他
日本語で読む → - 論文VLAロボティクス
ロボットはいつ考えるべきか?強化学習による資源認識型推論で身体性ロボットの意思決定を実現
身体性ロボットがLLM推論をいつ・どの役割で・どれだけ使うかを強化学習で適応的に決める階層的枠組みRARRLを提案し、タスク成功率向上と遅延削減を実現した。
原題: When Should a Robot Think? Resource-Aware Reasoning via Reinforcement Learning for Embodied Robotic Decision-Making / Jun Liu, Pu Zhao, Zhenglun Kong 他
日本語で読む → - 論文群制御cs.DS
関節運動を伴うプログラム可能物質の準線形時間再構成
幾何学的アモエボット構造の再構成問題を扱い、関節運動モデルにおいて任意の構造を標準的な線分構造へO(√n log n)ラウンドで再構成できることを証明した。
原題: Sublinear-Time Reconfiguration of Programmable Matter with Joint Movements / Manish Kumar, Othon Michail, Andreas Padalkin 他
日本語で読む → - 論文VLAロボティクス
一歩ずつ報酬を与えよう:連続環境における視覚言語ナビゲーションのためのステップ認識型対照アライメント
連続環境での視覚言語ナビゲーションにおいて、失敗軌跡から有効な接頭辞と逸脱点を特定するステップ単位の監査と、状況に応じたグループ構築により、密な報酬信号を抽出して学習を安定化させるSACAを提案し、最先端性能を達成した。
原題: Let's Reward Step-by-Step: Step-Aware Contrastive Alignment for Vision-Language Navigation in Continuous Environments / Haoyuan Li, Rui Liu, Hehe Fan 他
日本語で読む → - 論文タスク計画ロボティクス
VersualRL: 視覚的実行フィードバックによる閉ループ言語強化学習を用いたタスクレベルロボット計画
視覚言語モデルが実行結果を批評し、言語モデルが行動木を更新する閉ループ枠組みを提案し、実機ロボットの多段階タスクで有効性を示した。
原題: VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning / Dmitrii Plotnikov, Iaroslav Kolomiets, Dmitrii Maliukov 他
日本語で読む → - 論文VLAロボティクス
履歴条件付き時空間視覚トークン枝刈りによる効率的な視覚言語ナビゲーション
VLAベースの視覚言語ナビゲーション向けに、再学習不要で視覚トークンを時空間的に枝刈りする手法を提案し、精度を保ちつつ推論を高速化、四足ロボットでの実機検証も行った。
原題: History-Conditioned Spatio-Temporal Visual Token Pruning for Efficient Vision-Language Navigation / Qitong Wang, Yijun Liang, Ming Li 他
日本語で読む → - 論文共同計画/対話/意図推定ロボティクス
いつ尋ねるべきか:明示的対話と暗黙的意図手がかりによる人間ロボット共同計画の不確実性解消
ロボットが不確実性を解消するため、明示的な対話と暗黙的な非言語手がかりの2つの通信チャネルを統合した人間ロボット共同計画システムを提案し、シミュレーションと実機UAVで検証した。
原題: Knowing When to Ask: Resolving Uncertainty in Human-Robot Joint Planning via Explicit Dialogue and Implicit Intent Cues / Zeyu Fang, Yuxin Lin, Cheng Liu 他
日本語で読む → - 論文VLAロボティクス
MMaDA-VLA:マルチモーダル指示と生成を統合した大規模拡散視覚-言語-行動モデル
離散拡散を用いて将来の目標観察と行動チャンクを同一トークン空間で同時にデノイズするVLAモデルを提案し、LIBEROで98.0%の成功率を達成した。
原題: MMaDA-VLA: Large Diffusion Vision-Language-Action Model with Unified Multi-Modal Instruction and Generation / Yang Liu, Pengxiang Ding, Tengyue Jiang 他
日本語で読む → - 論文VLAロボティクス
IROSA: 自然言語による対話型ロボットスキル適応
LLMをツール選択・パラメータ化に用い、微調整なしで自然言語からロボットスキルを適応させるフレームワークを提案し、軸受リング挿入タスクで速度調整・軌道修正・障害物回避を実証した。
原題: IROSA: Interactive Robot Skill Adaptation using Natural Language / Markus Knauer, Samuel Bustamante, Thomas Eiband 他
日本語で読む → - 論文歩行ロボティクス
人間の動作模倣学習だけでは生体力学的に妥当な歩行キネティクスは保証されない
動作模倣学習にキネティクス情報を組み込まない場合、歩行の関節モーメント推定精度が低下することを示し、キネティクスを考慮した学習の必要性を明らかにした。
原題: Imitation Learning from Human Motion Alone Does Not Guarantee Biomechanically Plausible Gait Kinetics / Xinyi Liu, Jangwhan Ahn, Edgar Lobaton 他
日本語で読む → - 論文ヒューマンロボットインタラクションHCI
視覚的ストーリーテリングのための具現化されたコンパニオン
描画ロボットと大規模言語モデルを統合し、人間と機械が対話しながら共同で視覚的な物語を創り出す芸術的システムを提案した。専門家による評価で、独自の美的アイデンティティと展示価値が確認された。
原題: An Embodied Companion for Visual Storytelling / Patrick Tresset, Markus Wulfmeier
日本語で読む → - 論文VLAロボティクス
階層的潜在行動モデル
長期的な時間構造を捉えるため、事前学習済みの潜在行動モデルを低レベル抽出器として用い、潜在行動系列を高レベルの潜在スキルに集約する階層的潜在行動モデルHiLAMを提案した。
原題: Hierarchical Latent Action Model / Hanjung Kim, Lerrel Pinto, Seon Joo Kim
日本語で読む → - 論文共有自律制御HCI
DiSCo: 共有自律のための拡散シーケンスコパイロット
共有自律制御において、拡散ポリシーを用いてユーザーの行動履歴に整合する行動シーケンスを計画する手法DiSCoを提案し、シミュレーションの運転・ロボットアームタスクで性能を向上させた。
原題: DiSCo: Diffusion Sequence Copilots for Shared Autonomy / Andy Wang, Xu Yan, Brandon McMahan 他
日本語で読む → - 論文拡散プランナー機械学習
エネルギーベースの自己教師あり行動ゲーティングによる拡散プランナーの改善
拡散プランナーの推論時に、JEPAで学習した潜在予測誤差をエネルギーとして候補軌道を再ランキングし、動的に矛盾する計画を排除して性能と堅牢性を高める手法SAGEを提案。
原題: Improving Diffusion Planners by Self-Supervised Action Gating with Energies / Yuan Lu, Dongqi Han, Yansen Wang 他
日本語で読む → - 論文シミュレーション/設計最適化ロボティクス
身体化された人間シミュレーションによるインタラクティブロボティクスの定量的設計・解析
筋骨格モデルと強化学習制御を組み合わせた人間-ロボット相互作用のシミュレーションフレームワークを開発し、外骨格の設計と制御を同時最適化した。
原題: Embodied Human Simulation for Quantitative Design and Analysis of Interactive Robotics / Chenhui Zuo, Jinhao Xu, Michael Qian Vergnolle 他
日本語で読む → - 論文歩行ロボティクス
HybridMimic: ハイブリッドRL-セントロイダル制御による人型ロボットの動作模倣
学習ポリシーがセントロイダルモデルベースのコントローラを動的に変調し、連続的な接触状態と目標重心速度を予測することで、ドメインシフト下でも物理的に実現可能なフィードフォワードトルクを生成する人型ロボットの動作模倣フレームワークを提案した。実機実験でベース位置追従誤差を13%削減した。
原題: HybridMimic: Hybrid RL-Centroidal Control for Humanoid Motion Mimicking / Ludwig Chee-Ying Tay, I-Chia Chang, Yan Gu
日本語で読む → - 論文歩行ロボティクス
何本脚でも歩ける:不整地を歩行する多脚ロボットの制御
2脚につき3アクチュエータを持つセグメント型ロボットで、6〜16脚の不整地歩行を実現する軽量な制御アーキテクチャを提案し、シミュレーションで検証した。
原題: Walking on Rough Terrain with Any Number of Legs / Zhuoyang Chen, Xinyuan Wang, Shai Revzen
日本語で読む → - 論文マニピュレーションロボティクス
果実収穫ロボットのための能動的到達可能性推定
RGB-D知覚と能動学習を組み合わせ、果実がロボットの手の届く位置にあるかを直接予測することで、収穫ロボットの知覚から行動へのパイプラインを効率化した研究。
原題: Learning What Can Be Picked: Active Reachability Estimation for Efficient Robotic Fruit Harvesting / Nur Afsa Syeda, Mohamed Elmahallawy, Luis Fernando de la Torre 他
日本語で読む → - 論文マニピュレーションロボティクス
順方向デモンストレーションからの逆タスク学習によるタスクパラメータ外挿
順方向と逆方向のタスクを共通表現で学習し、新規条件の順方向デモのみから対応する逆タスクを実行できる手法を提案。シミュレーションと実機の複雑なマニピュレーションで既存手法を上回る。
原題: Task Parameter Extrapolation via Learning Inverse Tasks from Forward Demonstrations / Serdar Bahar, Fatih Dogangun, Matteo Saveriano 他
日本語で読む →