論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/21 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文HRI/対話ロボティクス
MyBuddyヒューマノイドロボット向けLLMベース対話型AI知識アシスタント
Raspberry Pi搭載の13軸ヒューマノイドロボットMyBuddyに、LLMによる言語理解と推論、音声認識・合成、WikipediaやarXivなどの知識検索を統合し、多ターン対話と感情サポートを可能にする対話型AIアシスタントを実装した。
原題: LLM-based Conversational AI Knowledge Assistant for MyBuddy Humanoid Robot / Hanxiao Chen
日本語で読む → - 論文軌道計画ロボティクス
剛性車輪を持つ車両型移動ロボットの非滑り制約下における最短時間軌道
車両型移動ロボットの最短時間軌道を、車輪の非滑り制約を動力学に基づいて考慮して導出し、従来の運動学的な軌道プリミティブに3つの新しいプリミティブを追加した。
原題: Minimum Time Trajectories for a Car-Like Mobile Robot Moving with Rigid Wheels Under Non-Sliding Constraints / Joseph Ben-Asher, Elon Rimon, Leeor Ravina
日本語で読む → - 論文SLAMロボティクス
BayesianGS-SLAM: 確率論的定式化による不確実性を考慮したニューラルレンダリングSLAM
3DガウシアンスプラッティングSLAMにおいて、色と深度の予測不確実性を推定し、マッピング・トラッキング・キーフレーム選択に統合するフレームワークを提案。
原題: BayesianGS-SLAM: Uncertainty-Aware Neural Rendering SLAM via Probabilistic Formulation / Kyeongsu Kang, Seongbo Ha, Sibaek Lee 他
日本語で読む → - 論文音響センシング/マッピングロボティクス
平坦な海底を超えて:サイドスキャンソナー再構成を支援する閉形式二視点制約
サイドスキャンソナーの二視点幾何制約を定式化し、特徴点が球と平面の交線上に拘束されることを証明するとともに、モンテカルロシミュレーションで曖昧さの軌跡の大きさを特徴づけ、測量計画の指針を示した。
原題: Beyond the Flat Seafloor: A Closed-Form Two-View Constraint to Aid Sidescan Sonar Reconstruction / Kalin Norman, Joshua G. Mangelson
日本語で読む → - 論文マニピュレーションロボティクス
接触アンカリング再ターゲティングと残差方策学習による人間実演からの器用なロボットマニピュレーション
人間の動作キャプチャから接触構造を抽出し、物理的に整合する軌道へ変換してロボットハンドの器用な操作方策を学習する3段階パイプラインを提案した。
原題: Dexterous Robot Manipulation from Human Demonstrations via Contact-Anchored Retargeting and Residual Policy Learning / Zihao Yang, Chengyuan Liu, Yu Zhou 他
日本語で読む → - 論文柔軟ロボットモデリングロボティクス
分離断面構成則によるトリムヘリコイド柔軟アームのCosseratモデリング
トリムヘリコイド柔軟アームの荷重を支える螺旋領域が分離している構造を考慮し、各領域を局所座標で評価して背骨に引き戻す分離断面構成則を提案し、動的Cosseratモデルに組み込んで高精度な位置予測と高速計算を実現した。
原題: Cosserat Modeling of Trimmed Helicoid Soft Arms with a Separated-Section Constitutive Law / Zhihang Qin, Linxin Hou, Zeyu Zhong 他
日本語で読む → - 論文sim2realロボティクス
AquaOrbit: 断続的な視覚フィードバック下での水中ターゲット周回のためのSim-to-Real強化学習
視覚が途切れる水中環境で、目標を見失っても復帰モジュールで安定化・再捕捉しながら周回する強化学習制御器を開発し、シミュレーションから実機へゼロショット転移させた。
原題: AquaOrbit: Sim-to-Real Reinforcement Learning for Underwater Target Orbiting under Intermittent Visual Feedback / Kanzhong Yao, Jinyi Leng, Hao Zhang 他
日本語で読む → - 論文ロコマニピュレーションロボティクス
HOTICE: 混雑環境における全身ヒューマノイド物体搬送
混雑環境で物体を運ぶため、ロボットと荷物の衝突回避を統合したポテンシャル場と、上下半身を分離しつつ全身協調を保つ二重エージェント強化学習、専門家から一般化への蒸留を組み合わせた全身ロコマニピュレーション学習フレームワーク。
原題: HOTICE: Whole-Body Humanoid Object Transportation in Cluttered Environments / Toan Nguyen, Weiduo Yuan, Siheng Zhao 他
日本語で読む → - 論文歩行ロボティクス
REDACT: 未知の視覚劣化下での堅牢な知覚歩行
クリーンな深度画像のみで学習し、未知の視覚ノイズや遮蔽があっても有用な深度情報を保持する教示-生徒フレームワークを提案し、歩行性能の低下を抑えた。
原題: REDACT: Robust Perceptive Locomotion under Unseen Visual Corruption / Natapat Kirdwichai, Tobias Driskell-Poole, Andrei Sontea 他
日本語で読む → - 論文マニピュレーションロボティクス
触覚はいつ重要か? 混雑環境での巧みな把持における視覚とインタラクションのギャップを描く
混雑した卓上での巧みな把持において、視覚のみ・力覚・触覚・それらの統合を実機で比較し、インタラクション感覚が接触の早期棄却や再把持を可能にし、把持成功率を大きく向上させることを示した研究。
原題: When Does Touch Matter? Charting the Vision-Interaction Gap in Cluttered Dexterous Grasping / Hao Jiang, Luis Dominguez, Daniel Seita
日本語で読む → - 論文VLAロボティクス
Imagine-RL:予測残差信頼度で導くクロスアテンションによる世界モデル拡張VLA強化学習
凍結したVLA方針をノイズ空間強化学習で微調整する際、視覚・力覚の潜在世界モデルで将来の結果を予測し、その予測残差を信頼度として活用することで接触の多い操作タスクの成功率を大幅に向上させた。
原題: Imagine-RL: Residual-Confidence-Guided Cross-Attention for World-Model-Augmented VLA Reinforcement Learning / Kejia Hu, Wentong Zhai, Bo Zhao 他
日本語で読む → - 論文VLAロボティクス
CARE: 経験に基づく原子的修正実行によるVision-Language-Actionポリシーの回復
VLAポリシーの失敗ロールアウトから段階別の失敗分布を学習し、推論時に3Dモニタリングで原子的な修正動作をトリガーすることで、ロボット操作の回復性能を向上させるフレームワーク。
原題: CARE: Experience-Guided Atomic Corrective Execution for Vision-Language-Action Policies / Junlan Xiao, Junwei Jiang, Zaibin Zhang 他
日本語で読む → - 論文音響位置推定ロボティクス
強化学習による適応的時間対応を用いた音響ベースのUAV位置推定
音響によるUAV位置推定において、強化学習で音声窓長を動的に調整し、精度を保ちつつ遅延を削減する手法を提案。
原題: Audio-based UAV Localization with Adaptive Temporal Correspondence via Reinforcement Learning / Haoxiang Lei, Mingzheng Feng, Daotong Wang 他
日本語で読む → - 論文VLAロボティクス
RoboTalk: マルチモーダル実演からのマルチロボット通信と協調の学習
小規模VLMをオンデバイスで動かすため、調理タスクのマルチモーダル軌道データセットを生成し、ロボット間の自然言語通信と協調行動を学習させる手法を提案した。
原題: RoboTalk: Learning Multi-Robot Communication and Coordination from Multimodal Demonstrations / Dorian Benhamou Goldfajn, Mason Nakamura, Saaduddin Mahmud 他
日本語で読む → - 論文水中マッピング/ソナーロボティクス
オドメトリ支援による前方監視ソナーを用いた水中ロボットのリアルタイムマッピング
前方監視ソナーの劣化画像からFFTノイズ除去・MCFAR検出・境界接続で特徴を抽出し、姿勢を考慮した投影と占有蓄積で2.5D地図をリアルタイム構築する手法を提案。プール実験でRMSE 3cm未満、1フレーム42.4msを達成。
原題: Odometry-Aided Real-Time Mapping for Underwater Robots Using Forward-Looking Sonar / Siyuan Du, Kanzhong Yao, Youdong Wang 他
日本語で読む → - 論文自動運転/ワールドモデル画像認識
関係性に基づく潜在ワールドモデルによる自動運転
交通シーングラフを意味的教師信号として使い、視覚的潜在表現を訓練時に整合させることで、推論時には追加計算なしに軌道予測誤差と衝突率を改善した。
原題: Relationally Grounded Latent World Models for Autonomous Driving / Fabian Schmidt, Markus Enzweiler, Abhinav Valada
日本語で読む → - 論文VLAロボティクス
ME-Brain-1.0:記憶・認知・行動による自己進化型身体知能
行動実行から経験獲得・進化を経て実行改善へと至る閉ループで自己進化する身体知能システムを提案し、再学習なしにベンチマークで大幅な性能向上を達成した。
原題: ME-Brain-1.0: Memory, Cognition and Action for Evolving Embodied Intelligence / Wei He, Hengtao Li, Zhongrui Yu 他
日本語で読む → - 論文VLAロボティクス
ActiveArena:ロボットマニピュレーションにおける能動的知覚のベンチマークと理解
能動的知覚と操作を評価するためのシミュレータと35タスクのベンチマーク、および13種のVLA構成を提案し、記憶管理やOOD汎化の要因を分析した。
原題: ActiveArena: Benchmarking and Understanding Active Perception in Robotic Manipulation / Yibo Li, Enshen Zhou, Rui Chen 他
日本語で読む → - 論文能動知覚AI
LEAP-NBV: 基盤モデルによる次善視点計画のための軽量エッジ能動知覚
大規模なHuman Mesh Recoveryモデルを蒸留・量子化してエッジデバイス上で動作させ、オクルージョン対応の能動知覚ループで次善視点計画をリアルタイム実行する軽量フレームワークを提案。
原題: LEAP-NBV: Lightweight Edge Active-Perception for Foundation-Model Next-Best-View Planning / Boxun Hu, Jiawei Ge, Axel Krieger 他
日本語で読む → - 論文マニピュレーションロボティクス
フレーズ単位のロボット古琴演奏:両腕動作計画と音触覚インタラクション監視
双腕ロボットで古琴のフレーズ演奏を実現するため、指の割り当てや接触タイミングを階層的に計画し、視覚・触覚・聴覚フィードバックを統合したシステムを開発した。
原題: Phrase-Level Robotic Guqin Performance: Bimanual Motion Planning and Audio-Tactile Interaction Monitoring / Zhen Wang, Zhiheng Chen, Tianyuan Bao 他
日本語で読む → - 論文マニピュレーションロボティクス
平面果樹園における視覚運動ロボット剪定のためのハイブリッド強化学習
シミュレーションと合成データのみで学習した視覚運動制御器により、平面仕立てのリンゴとサクランボの木をロボットで剪定し、実環境へゼロショット転移を実現した。
原題: Visuomotor Robotic Pruning in Planar Orchards Using Hybrid Reinforcement Learning / Abhinav Jain, Cindy Grimm, Stefan Lee
日本語で読む → - 論文sim2realロボティクス
OpenFlyScan:民生ドローン向け品質誘導型空中再構成システム
3Dガウシアンスプラッティングの再構成品質を予測し、不足領域を補う追加撮影を計画・実行する民生ドローン向けシステムを提案。
原題: OpenFlyScan: A Quality-Guided Aerial Reconstruction System for Consumer Drones / Zhongrui You, Zhen Li, Junli Liu 他
日本語で読む → - 論文VLAロボティクス
Opt2VLA: 接触の多いヒューマノイド全身マニピュレーションのための力認識型視覚-言語-行動モデル
ヒューマノイドの全身操作において、VLAモデルが運動目標と接触力の指令を同時に予測し、強化学習ベースの全身制御器で追従する力認識型フレームワークを提案。軌道最適化で接触を考慮した訓練データを生成し、接触の多い3タスクで力の調整精度が向上することを示した。
原題: Opt2VLA: Force-Aware Vision-Language-Action for Contact-Rich Humanoid Whole-Body Manipulation / Fukang Liu, Yipu Chen, Jaehwi Jang 他
日本語で読む → - 論文触覚ロボティクス
Touch2Robot: 人間のデモンストレーションループにロボットの触覚を統合
人間の手の動きと触覚グローブの計測から、対象ロボットハンドの接触をシミュレーション上で可視化し、デモ中にフィードバックすることで、ロボットへの転移性能とデータ収集効率を向上させるフレームワーク。
原題: Touch2Robot: Robot Touch in the Human Demonstration Loop / Shengcheng Luo, Xiaoyang Cheng, Hong Ying 他
日本語で読む → - 論文マニピュレーションロボティクス
適応的重み付き制御バリア関数による冗長ロボットの安全制御
冗長ロボットの安全制約を満たしつつ、負荷の偏りによる追従誤差を低減する重み付き制御バリア関数を提案し、適応的重み付けで性能を向上させた。
原題: Safety Control of a Hyper-redundant Robot via Adaptive Weighted Control Barrier Functions / Zijian Cai, Kiwan Wong, Wenci Xin 他
日本語で読む → - 論文sim2realロボティクス
Uranus: 身体性AIのための次世代シミュレーション基盤の構築
関節軌道条件付き自己回帰拡散モデルを用いたデータ駆動型ロボットシミュレータUranusを提案し、ストリーミング生成、低遅延、多様なロボット制御に対応した。
原題: Uranus: Building the Next-Generation Simulation Infrastructure for Embodied AI / Wenkang Qin, Yukun Zhou, Noah Shen 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
PredActor: 予測的行動拡散による操縦可能なオンボードヒューマノイド制御
固有感覚のみを用いて行動と将来状態軌道を同時生成し、テスト時にも目標へ操縦できるヒューマノイド制御ポリシーを提案。
原題: PredActor: Predictive Action Diffusion for Steerable Onboard Humanoid Control / Lei Ye, Haibo Gao, Yitang Li 他
日本語で読む → - 論文世界モデル評価画像認識
HappyWorld-Bench:世界モデルの信頼性を評価する総合ベンチマーク
生成世界モデルがエージェントの相互作用下でどれだけ信頼できるかを、動画・空間・身体性の3トラックで評価するベンチマークを提案し、14の動画モデル、9の空間システム、8の身体性モデルを評価した。
原題: HappyWorld-Bench / Zhiqi Bai, Junai Cai, Yixin Chen 他
日本語で読む → - 論文触覚ロボティクス
Tactile-JEPA: 分散型触覚センサのためのトポロジー考慮型自己教師あり表現学習
触覚センサの空間配置をグラフで表現し、マスク予測による自己教師あり学習でトポロジーを考慮した表現を獲得する手法を提案。力推定誤差を6.3%、手内姿勢誤差を20.8%削減した。
原題: Tactile-JEPA: Topology-Aware Self-Supervised Representation Learning for Distributed Tactile Sensors / Elizaveta Kovtun, Matvey Konovalov, Andrey Sakhovskiy 他
日本語で読む → - 論文触覚ロボティクス
高帯域単点触覚センシングによる触覚知覚の学習
単点の高帯域触覚信号を時間周波数スペクトログラムに変換し、視覚用エンコーダで処理することで、遮蔽された操作タスクを実現するフレームワークを提案。
原題: Learning tactile perception from high-bandwidth single-point sensing / Joseph Rigal, Emmanuel Virot, Caroline Pascal
日本語で読む →