論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文機構設計ロボティクス
シザーリンク機構の形状変化と描画
シザーリンク機構の幾何学を最適化し、形状変化と描画タスクを実現する手法を提案し、実験で検証した。
原題: Morphing of and writing with a scissor linkage mechanism / Mohanraj A, S Ganga Prasath
日本語で読む → - 論文マニピュレーションロボティクス
Bi-Adapt: 意味的対応による新規カテゴリ3D物体への少数ショット両手操作適応
視覚基盤モデルを活用してカテゴリをまたぐアフォーダンス対応を学習し、新規カテゴリの物体に対する両手操作を少数データで効率的に汎化させるフレームワークを提案した。
原題: Bi-Adapt: Few-shot Bimanual Adaptation for Novel Categories of 3D Objects via Semantic Correspondence / Jinxian Zhou, Ruihai Wu, Yiwei Liu 他
日本語で読む → - 論文ロッド力学制御
断面変形を考慮した幾何学的厳密ロッドのリー群変分積分器
円形断面を持つ3次元コセラットロッドの断面変形を取り入れた運動方程式を導出し、リー群変分積分器で離散化することで体積保存やエネルギー保存を実現した。
原題: Lie Group Variational Integrator for the Geometrically Exact Rod with Circular Cross-Section Incorporating Cross-Sectional Deformation / Srishti Siddharth, Vivek Natarajan, Ravi N. Banavar
日本語で読む → - 論文世界モデルロボティクス
ContactGaussian-WM: 動画から物理に基づく世界モデルを学習
接触の多い動画から、微分可能な剛体物理エンジンを通して物理法則を学習する世界モデルを提案し、データ合成やMPCに応用した。
原題: ContactGaussian-WM: Learning Physics-Grounded World Model from Videos / Meizhong Wang, Wanxin Jin, Kun Cao 他
日本語で読む → - 論文HRIロボティクス
ヒューマンロボットインタラクションにおける擬人化と擬人模倣の明確化
HRIとソーシャルロボティクスにおいて、ユーザーがロボットに人間らしさを知覚する「擬人化」と、開発者がロボットに人間らしい特徴を設計する「擬人模倣」を概念的に区別し、今後の研究・設計・評価の基盤を提供する。
原題: Disambiguating Anthropomorphism and Anthropomimesis in Human-Robot Interaction / Minja Axelsson, Henry Shevlin
日本語で読む → - 論文軌道予測ロボティクス
脚は腕より重要:ロボットの一人称視点による人間軌道予測における下半身姿勢の予測価値
ロボットの一人称視点から人間の骨格特徴を用いて軌道予測を行い、下半身の3Dキーポイントが予測精度を13%向上させることを示した研究。
原題: Legs Over Arms: On the Predictive Value of Lower-Body Pose for Human Trajectory Prediction from Egocentric Robot Perception / Nhat Le, Daeun Song, Xuesu Xiao
日本語で読む → - 論文マニピュレーションロボティクス
DECO: 触覚アダプタを備えた双腕巧み操作のための分離型マルチモーダル拡散トランスフォーマ
視覚・固有感覚・触覚を分離した条件付け経路で統合する拡散トランスフォーマDECOを提案し、双腕巧み操作の触覚データセットDECO-50を公開。実機実験で成功率72.25%を達成し、触覚アダプタが複雑な接触タスクで20%向上。
原題: DECO: Decoupled Multimodal Diffusion Transformer for Bimanual Dexterous Manipulation with a Plugin Tactile Adapter / Xukun Li, Yu Sun, Lei Zhang 他
日本語で読む → - 論文世界モデル画像認識
GeoWorld: 幾何学的世界モデル
潜在表現を双曲空間に写像するHyperbolic JEPAと幾何学的強化学習を導入し、長期的な視覚計画の精度を向上させた世界モデル。
原題: GeoWorld: Geometric World Models / Zeyu Zhang, Danning Li, Ian Reid 他
日本語で読む → - 論文sim2realロボティクス
物理を考慮したニューラル制御によるマルチロータの制御方策学習の効率的な知識転移
強化学習と教師あり制御配分を組み合わせた物理を考慮したニューラル制御アーキテクチャを提案し、方策ライブラリからの初期化によりマルチロータの制御方策学習を最大73.5%効率化できることを示した。
原題: Efficient Knowledge Transfer for Jump-Starting Control Policy Learning of Multirotors through Physics-Aware Neural Architectures / Welf Rehberg, Mihir Kulkarni, Philipp Weiss 他
日本語で読む → - 論文自己位置推定ロボティクス
環境適応型GNSS共分散ダイナミクスの平滑学習による自動運転レース
GNSSの測定共分散の時間変化を深層学習でモデル化し、環境に応じて適応的かつ時間的に滑らかな共分散推定を実現する枠組みLACEを提案。自動運転レースカーでGNSS劣化環境における自己位置推定性能の向上を実証した。
原題: Environment-Aware Learning of Smooth GNSS Covariance Dynamics for Autonomous Racing / Y. Deemo Chen, Arion Zimmermann, Thomas A. Berrueta 他
日本語で読む → - 論文AUVナビゲーション/MPCロボティクス
海流を活用する段階ゲート型MPC:単調コスト整形と速度適応によるエネルギー効率の高いAUVナビゲーション
海流の「追い風」度合いを段階的に評価し、MPCのコスト項をゲート制御することで、AUVが海流を活用して省エネルギー航行を実現する手法を提案した。
原題: Ocean Current-Harnessing Stage-Gated MPC: Monotone Cost Shaping and Speed-to-Fly for Energy-Efficient AUV Navigation / Spyridon Syntakas, Kostas Vlachos
日本語で読む → - 論文VLAロボティクス
ユーザーはロボット基盤モデルの性能をタスク成功率とその先でどう理解するか
ロボット基盤モデルの評価情報を非専門家がどう解釈するかを調査し、タスク成功率に加えて失敗事例や新規タスクへの推定情報も重視することを明らかにした。
原題: How Users Understand Robot Foundation Model Performance through Task Success Rates and Beyond / Isaac Sheidlower, Jindan Huang, James Staley 他
日本語で読む → - 論文VLAロボティクス
ロボットのための選択的知覚:マルチモーダルVLAにおけるタスク適応型アテンション
手首カメラとテキスト指示から各視点のタスク関連度をリアルタイムに推定し、不要な視点の計算を抑制する動的融合フレームワークを提案。実機マニピュレーションで推論効率と制御性能の両方を改善した。
原題: Selective Perception for Robot: Task-Aware Attention in Multimodal VLA / Young-Chae Son, Jung-Woo Lee, Yoon-Ji Choi 他
日本語で読む → - 論文自律飛行ロボティクス
視覚ベース自律飛行のためのF'とROS2ハイブリッドアーキテクチャ:設計と実験的検証
NASAのF'フライトソフトウェアとROS2をProtocol Buffersで連携させ、屋内クアッドコプターの視覚ナビゲーション飛行実験でリアルタイム性能と統合の堅牢性を検証した。
原題: Hybrid F' and ROS2 Architecture for Vision-Based Autonomous Flight: Design and Experimental Validation / Abdelrahman Metwally, Monijesu James, Aleksey Fedoseev 他
日本語で読む → - 論文拡散ポリシー/選好学習ロボティクス
RoDiF: 破損した人間フィードバックに頑健な拡散ポリシーの直接ファインチューニング
拡散ポリシーのファインチューニングにDPOを適用する統一MDP定式化を提案し、人間の選好ラベルにノイズがあっても頑健に学習できるRoDiFを開発した。
原題: RoDiF: Robust Direct Fine-Tuning of Diffusion Policies with Corrupted Human Feedback / Amitesh Vatsa, Zhixian Xie, Wanxin Jin
日本語で読む → - 論文群制御ロボティクス
流体に着想を得た分散型でスケーラブルな群制御フレームワーク
流体の流れを模倣し、エージェント間通信なしで大規模ドローンの群れを分散制御する手法を提案し、シミュレーションで流体力学の解と比較して有効性を示した。
原題: FISC: A Fluid-Inspired Framework for Decentralized and Scalable Swarm Control / Mohini Priya Kolluri, Ammar Waheed, Zohaib Hasnain
日本語で読む → - 論文群制御ロボティクス
RANT: アリに着想を得た粒子フィルタ定位と仮想フェロモン調整による多ロボット熱帯雨林探索
ノイズの多い未知環境で、粒子フィルタ定位と仮想フェロモンによる再訪防止調整を用いて複数ロボットが協調探索するフレームワークを提案し、チームサイズや定位精度が被覆率・ホットスポット再現率に与える影響を実験的に解析した。
原題: RANT: Ant-Inspired Multi-Robot Rainforest Exploration Using Particle Filter Localisation and Virtual Pheromone Coordination / Ameer Alhashemi, Layan Abdulhadi, Karam Abuodeh 他
日本語で読む → - 論文強化学習機械学習
未知の実行可能性を持つパラメータロバスト回避問題を強化学習で解く
強化学習を用いて、安全な方策が存在する初期条件の部分集合を特定しながら、その集合上で到達可能性問題を解く手法FGEを提案した。
原題: Solving Parameter-Robust Avoid Problems with Unknown Feasibility using Reinforcement Learning / Oswin So, Eric Yang Yu, Songyuan Zhang 他
日本語で読む → - 論文自動運転/軌道計画ロボティクス
拡散モデルによる自動運転のための安全でスタイル化された軌道計画
拡散モデルを用いて、安全制約と運転スタイルをリアルタイムに両立させる軌道計画フレームワークSDD Plannerを提案し、ベンチマークと実車試験で有効性を示した。
原題: Safe and Stylized Trajectory Planning for Autonomous Driving via Diffusion Model / Shuo Pei, Yong Wang, Yuanchen Zhu 他
日本語で読む → - 論文制御/強化学習ロボティクス
自律走行レースにおけるPure PursuitのパラメータをPPOでオンライン調整
強化学習(PPO)を用いてPure Pursuitの先読み距離とステアリングゲインをオンラインで同時調整し、地図ごとの再調整なしに追従性能を向上させる手法を提案。
原題: Learning to Tune Pure Pursuit in Autonomous Racing: Joint Lookahead and Steering-Gain Control with PPO / Mohamed Elgouhary, Amr S. El-Wakeel
日本語で読む → - 論文歩行ロボティクス
ECO: ヒューマノイド歩行のためのエネルギー制約付き強化学習最適化
エネルギー消費を報酬から切り離し明示的な不等式制約として扱う制約付き強化学習フレームワークECOを提案し、ヒューマノイドBRUCEで省エネかつ安定した歩行を実現した。
原題: ECO: Energy-Constrained Optimization with Reinforcement Learning for Humanoid Walking / Weidong Huang, Jingwen Zhang, Jiongye Li 他
日本語で読む → - 論文VLAロボティクス
VLA-JEPA:潜在世界モデルで視覚-言語-行動モデルを強化
未来のフレームを教師信号に使い、現在の観測だけから潜在空間で状態予測を学習するJEPA型事前学習で、VLAポリシーの汎化とロバスト性を高めた。
原題: VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model / Jingwen Sun, Wenyao Zhang, Zekun Qi 他
日本語で読む → - 論文連続ロボットロボティクス
ユークリッドノルムに基づく腱駆動連続ロボットの可到達静的ワークスペース最適化
腱駆動連続ロボットの可到達静的ワークスペースを最大化するため、遺伝的アルゴリズムで腱力を最適化する手法を提案し、外力・トルク下での有効性をシミュレーションで示した。
原題: Feasible Static Workspace Optimization of Tendon Driven Continuum Robot based on Euclidean norm / Mohammad Jabari, Carmen Visconte, Giuseppe Quaglia 他
日本語で読む → - 論文視覚言語ナビゲーションロボティクス
ドリフトを未然に防ぐ:堅牢な視覚言語ナビゲーションのための遡及的修正
視覚言語ナビゲーションにおける模倣学習の誤差蓄積問題に対し、過去の有効な状態から修正軌道を合成するオンラインフレームワークBudVLNを提案し、R2R-CEとRxR-CEで最高性能を達成した。
原題: Nipping the Drift in the Bud: Retrospective Rectification for Robust Vision-Language Navigation / Gang He, Zhenyang Liu, Kepeng Xu 他
日本語で読む → - 論文ナビゲーションロボティクス
WildOS: 野外環境におけるオープンボキャブラリ物体探索
地図や深度センサに頼らず、視覚言語モデルで探索方向を意味的に評価し、長距離のオープンボキャブラリ物体探索を実現するシステムを提案。
原題: WildOS: Open-Vocabulary Object Search in the Wild / Hardik Shah, Erica Tevere, Deegan Atha 他
日本語で読む → - 論文ロボティクスミドルウェアロボティクス
DORA: データフロー指向ロボティクスアーキテクチャ
ロボットミドルウェアのシリアライズ・デシリアライズのオーバーヘッドを削減するため、明示的なデータ依存関係の指定とゼロコピー通信を可能にするデータフロー指向アーキテクチャを提案し、シミュレーションと実機で評価した。
原題: DORA: Dataflow Oriented Robotic Architecture / Xiaodong Zhang, Baorui Lv, Xavier Tao 他
日本語で読む → - 論文遠隔操作ロボティクス
TriPilot-FF: 力覚フィードバックを備えた協調型全身遠隔操作システム
移動マニピュレータの全身遠隔操作のため、足踏みペダルとLiDARによるペダル力覚提示、両腕リーダーフォロワ、腕の力覚反射を統合したシステムを開発し、長期的な操作や精密な移動を支援することを示した。
原題: TriPilot-FF: Coordinated Whole-Body Teleoperation with Force Feedback / Zihao Li, Yanan Zhou, Ranpeng Qiu 他
日本語で読む → - 論文AR/ロボットプログラミングロボティクス
拡張現実支援ロボットプログラミングにおける空間能力の影響の調査
AR支援ロボットプログラミングが従来手法と比べて学習体験を向上させるか、また空間能力の影響を緩和するかを実験で検証した。
原題: Investigating the Influence of Spatial Ability in Augmented Reality-assisted Robot Programming / Nicolas Leins, Jana Gonnermann-Müller, Malte Teichmann 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
VividFace:ヒューマノイドロボットのためのリアルタイムでリアルな表情シャドウイング
ヒューマノイドロボットが人間の表情をリアルタイムかつリアルに模倣するシステムVividFaceを提案。0.05秒以内の遅延で多様な表情を再現する。
原題: VividFace: Real-Time and Realistic Facial Expression Shadowing for Humanoid Robots / Peizhen Li, Longbing Cao, Xiao-Ming Wu 他
日本語で読む → - 論文視覚ナビゲーションロボティクス
Structure-from-Motionを活用した航空機地上移動のための堅牢なビジョンベース地図マッチング
地上画像からSfMで地平面モザイクを構築し、衛星画像とマッチングすることで航空機の自律地上航法を支援する視覚支援ナビゲーションパイプラインを提案。
原題: Exploiting Structure-from-Motion for Robust Vision-Based Map Matching for Aircraft Surface Movement / Daniel Choate, Jason Rife
日本語で読む →