論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文手話認識ロボティクス
低コストなハイブリッド貯水池計算モデルによる孤立手話ビデオ認識
手話認識を軽量な貯水池計算で実現し、深層学習に匹敵する精度を低コストで達成した。
原題: A Low-Cost Hybrid Reservoir Computing Model for Isolated Sign Language Video Recognition / Nitin Kumar Singh, Arie Rachmad Syulistyo, Yuichiro Tanaka 他
日本語で読む → - 論文触覚/操作ロボティクス
ReTouch: オンライン更新型触覚予測による接触豊富な器用操作の実現
触覚予測を実行時のフィードバックでオンライン更新するVLAモデルReTouchを提案し、接触を伴う器用操作の成功率を大幅に向上させた。
原題: ReTouch: Empowering Contact-Rich Dexterous Manipulation with Online-Refined Tactile Prediction / Shiqi Zhang, Xin Zhang, Yedong Shen 他
日本語で読む → - 論文触覚ロボティクス
ハニカムジャミング機構を用いた剛性提示型ウェアラブル触覚デバイスによる双方向遠隔操作
ハニカムジャミング機構を使った軽量(20g)なウェアラブル触覚デバイスを開発し、遠隔操作で物体の硬さを提示できることを実証した論文。
原題: A Wearable Stiffness-Rendering Haptic Device with a Honeycomb Jamming Mechanism for Bilateral Teleoperation / Thomas M. Kwok, Bohan Zhang, Wai Tuck Chow
日本語で読む → - 論文システムズエンジニアリングロボティクス
SysML駆動の自律UAV設計のためのモデルベースシステムズエンジニアリングフレームワーク
自律UAVの開発をSysMLで構造化し、要件から論理アーキテクチャ、ROS 2ソフトウェア実装までを体系的にマッピングするMBSEフレームワークを提案した論文。
原題: Model-Based Systems Engineering Framework for SysML-Driven Design of Autonomous UAVs / Deekshitha Angadi, Naveena Budda, Vikas Agarwal 他
日本語で読む → - 論文マルチエージェント協調ロボティクス
SyncPlan: 明示的同期と適応的修正による長期的LLM協調
LLMベースのマルチエージェント協調において、効率と適応性のトレードオフを解決するため、明示的な同期プリミティブとプラン陳腐化検出器を備えた計画・実行・修正フレームワークを提案した。
原題: SyncPlan: Long-Horizon LLM Coordination with Explicit Synchronization and Adaptive Correction / Shen You, Xiaoming Zhu, Weining Weng 他
日本語で読む → - 論文制御ファームウェアロボティクス
ツリー構造ロボット制御ファームウェアの静的タイミングオーケストレーション
ロボット制御ファームウェアをツリー構造のデバイスモデルから生成する際に、コンパイル時情報を用いて実行順序を静的に決定し、レイテンシを最小化するスケジューリング機構を提案した。実機評価でタイミング性能と応答性の向上を確認した。
原題: Static Timing Orchestration for Tree-Structured Robot Control Firmware / Wang Xi, Feiran Wei, Mo Deng 他
日本語で読む → - 論文器用操作ロボティクス
C2Dex: 単眼ビデオからの接触整合的な器用操作の再構築とリターゲティング
単眼ビデオから器用なロボット操作のデモを転送する際、接触の安定性と物理的妥当性を保つフレームワークC2Dexを提案。物体側の安定接触を共有表現として、軌道の再構築と異なる手の形態へのリターゲティングを改善し、シミュレーションと実機で高い成功率を達成した。
原題: C2Dex: Contact-Consistent Reconstruction and Retargeting for Dexterous Manipulation from Monocular Video / Jie Ren, Zhehao Jiang, Yinhong Yang 他
日本語で読む → - 論文支援技術/ヒューマンインターフェースHCI
bFaaaP: 頭部角度でペダル操作を実現する包括的ピアノ演奏支援 -- 足を使わずにアコースティック/電子ピアノで奏者の意図を定量的に再現
足が使えない演奏者向けに、頭部の角度でサステインペダルを操作できる装置を開発。スマートフォンのAR顔追跡とBLE通信でペダルを制御し、定量的な制御則により自然な表現を実現した。
原題: bFaaaP: An Inclusive, Head-Angle Piano-Pedal Interaction that Quantitatively Reproduces a Pianist's Intended Pedalling -- Foot-Free, for Acoustic and Electronic Pianos / Tomoyuki Shishido, Masahiro Ootaki, Hiroyuki Narusawa
日本語で読む → - 論文データ収集画像認識
Ego-OSCAR: 自己中心視点のオープンソースステレオキャプチャシステム
低コストでオープンなヘッドマウント型ステレオ慣性計測装置を開発し、550時間の自己中心視点データセットとソフトウェアスタックを公開した論文。
原題: Ego-OSCAR: Egocentric Open source Stereo CAptuRe System / Gunjan Paul, Senthil Palanisamy, Satpal Singh Rathore 他
日本語で読む → - 論文HRI/報酬学習AI
人間と自律システムのチームにおける二次の心の理論による信念の同期(拡張版)
好みに基づく報酬学習を人間と自律システムのチーム問題として再構成し、教師が学習者のモデルを維持して効率的なカリキュラムを設計し、学習者が教師のモデルを二次的にモデル化して理解表明を発することで信念を同期させる手法を提案した。シミュレーションでその有効性を示した。
原題: Synchronizing Beliefs with Second-Order Theory-of-Mind in Human-Autonomy Teams (Extended Version) / Jack Mirenzi, Henny Admoni
日本語で読む → - 論文身体化エージェント自然言語
スキル進化による自己進化型身体化エージェント
モデルの重みを固定したまま、再利用可能なスキルとコンテキストコードのハーネスを進化させることで、訓練なしで身体化エージェントを適応させるフレームワークSHAPERを提案した。
原題: Self-Evolving Embodied Agents via Skill-Harness Evolution / Peidong Wang, Zhiming Ma, Ying Chang 他
日本語で読む → - 論文空中ロボット/エンドエフェクタロボティクス
空中レイアウト:天井への精密な飛行中マーキングのためのコンプライアントでアクチュエータ付きエンドエフェクタの設計と制御
天井にミリメートル精度で線を描くため、Gough-Stewart機構を備えた新しいスマートエンドエフェクタを搭載した空中ロボットシステムを提案し、設計と実験でその有効性を実証した。
原題: Aerial Layouting: Design and Control of a Compliant and Actuated End-Effector for Precise In-flight Marking on Ceilings / Christian Lanegger, Marco Ruggia, Marco Tognon 他
日本語で読む → - 論文LLM/制御設計ロボティクス
複雑な動的システムにおけるフィードバックコントローラ設計のための大規模言語モデルのベンチマーキングと推論蒸留
複雑な動的システムのフィードバックコントローラ設計におけるLLMの性能を評価するベンチマークを構築し、エッジ展開向けに推論蒸留で小型モデルを開発した。
原題: Benchmarking and Reasoning Distillation of Large Language Models for Feedback Controller Design in Complex Dynamical Systems / Zhongchao Zhou, Yixuan Xie, Wenwei Yu 他
日本語で読む → - 論文外骨格/制御ロボティクス
ATP: 解剖学的トルクとパッシビティベース制御による安全な上肢外骨格支援フレームワーク
上肢外骨格の安全な支援のため、解剖学的トルクとパッシビティベース制御を組み合わせたフレームワークを提案。強化学習で筋肉制御器を訓練し、オンラインでトルクを調整、エネルギータンクでパッシビティを保証する。
原題: ATP: Anatomical Torque with Passivity-based Control Framework for Safe Upper-Limb Exoskeleton Assistance / Yu Chen, Gong Chen, Xiang Li
日本語で読む → - 論文歩行ロボティクス
四足歩行のための迅速な身体適応フレームワーク
四足ロボットが身体の変化(関節の制限や質量の変化)に迅速に適応するためのオンライン適応フレームワークを提案し、シミュレーションと実機で有効性を示した。
原題: Rapid Embodiment Adaptation for Quadrupedal Locomotion / Dichen Li, Bo Ai, Nico Bohlinger 他
日本語で読む → - 論文経路計画ロボティクス
たるみのあるテザーを持つ移動ロボットのための絡まりのない軌道計画
たるみのあるテザーを持つ移動ロボットが、静的な障害物環境で絡まりを回避しながら動的に実行可能な軌道を計画するアルゴリズムを提案した。トポロジカルモデルとホモトピー制約を用いた3段階パイプラインで安全な軌道を生成する。
原題: Entanglement-Free Trajectory Planning for Tethered Mobile Robots with a Slack Tether / Gianpietro Battocletti, Dimitris Boskos, Bart De Schutter
日本語で読む → - 論文姿勢推定画像認識
高さ制約付き2点最小解法:イベントカメラとアクティブLEDマーカーによる姿勢推定
IMUや高度計から得られる傾き角とカメラ高さを利用し、2つのLEDマーカーのみでカメラ姿勢を推定する最小解法を提案した。閉形式と線形最小二乗の両方で解を導出し、実データで精度を検証した。
原題: A Height-Constrained 2-Point Minimal Solver for Pose Estimation from Active LED Markers with Event Cameras / Runze Yuan, Alexander Kappler, Jun Zhang 他
日本語で読む → - 論文不確実性校正ロボティクス
粒子ベース共形予測による接触を考慮した不確実性校正:層状構成空間における
接触を伴うロボット動作の将来構成を確率的に保証する予測領域を生成する、幾何学的認識を持つ共形予測アルゴリズムを提案。
原題: Particle-Based Conformal Prediction for Contact-Aware Uncertainty Calibration in Stratified Configuration Spaces / Luís Marques, Kristian Popov, Dmitry Berenson
日本語で読む → - 論文強化学習ロボティクス
アクチュエータレベル方策によるケーブル駆動パラレルロボット構成を横断した深層強化学習の一般化
ケーブル駆動パラレルロボット(CDPR)の制御に、ロボット構成に依存しないアクチュエータレベル方策を導入し、シミュレーションで訓練した方策を実機に転移して汎化性能を実証した。
原題: Generalizing deep reinforcement learning across cable-driven parallel robot configurations with actuator-level policies / Abir Bouaouda, Mohamed Boutayeb, François Charpillet 他
日本語で読む → - 論文VLAロボティクス
GWM-VLA:視覚言語行動学習のための幾何認識潜在世界モデリング
視覚言語行動モデルの堅牢性を向上させるため、幾何情報を考慮した多視点状態符号化と潜在世界モデルを導入し、手首視点の予測と共有潜在行動表現によりロボット操作性能を高めた。
原題: GWM-VLA: Geometry-Aware Latent World Modeling for Vision-Language-Action Learning / Yanping Zhao, Hang Yu, Yiwei Wang 他
日本語で読む → - 論文操作/ベンチマークロボティクス
RoboSynChallenge: 合成操作スキルの一般化による実世界の巧みな操作の習得
実世界データ不足を補うため、大規模合成データ生成と標準化された実ロボット評価を統合した操作ポリシーの一般化を競うベンチマークを提案し、未見の実環境での評価を行う。
原題: RoboSynChallenge: Mastering Real-World Dexterity via Generalizing Synthesized Manipulation Skills / Runyi Zhao, Ruixin Wu, Chengkun Li 他
日本語で読む → - 論文制御制御
拍動組織における神経糸配置のためのプレビュー型相対運動制御
心臓や呼吸による拍動で動く組織に対して、挿入ツールの先端を相対的に正確に配置するためのプレビュー型モデル予測制御を開発し、シミュレーションで精度向上を実証した。
原題: Preview-Based Relative-Motion Control of an Insertion Tool for Neural-Thread Placement in Pulsating Tissue / Yongyan Cao
日本語で読む → - 論文医療ロボティクスロボティクス
RoSE:内視鏡ステント試験用のロボット軟性食道
生体模倣型のロボット軟性食道(RoSE)を開発し、悪性食道狭窄による嚥下障害治療用ステントの留置試験を行い、ステントの径方向力と移動への影響を評価した。
原題: RoSE: A Robotic Soft Esophagus for Endoprosthetic Stent Testing / Dipankar Bhattacharya, Sherine Jesna V. A., Leo K. Cheng 他
日本語で読む → - 論文軌道予測ロボティクス
SIPTraj: 物理誘導によるシーン相互作用を用いたマップフリーのエンドツーエンド軌道予測
高精細地図を使わずに、エージェントの軌道予測を物理的制約を考慮して行う新しいフレームワークを提案。階層的エンコーダと物理誘導デコーダにより、シーン文脈の接地と運動学的実現可能性を同時に改善した。
原題: SIPTraj: Map-Free End-to-End Trajectory Prediction via Physics-Guided Scene Interaction / Feifei Liu, Zejun Wei, Haozhe Wang 他
日本語で読む → - 論文SLAM画像認識
無限SLAMトランスフォーマー:無制限のフロントエンド・バックエンド処理のためのSLAMFormer-∞
距離制限なしで長距離のフロントエンドとバックエンド処理をサポートする初の幾何学トランスフォーマーを提案し、17kmを超える軌跡でも動作可能なことを示した。
原題: SLAMFormer-$\infty$: Infinite SLAM Transformer for Unbounded Frontend and Backend Processing / Zhijian Fang, Weicheng Zheng, Yijun Yuan 他
日本語で読む → - 論文データ選択/器用操作/VLAロボティクス
SiMDex: 類似する自己中心視点動画のマイニングによるクロスエンボディ器用操作
ロボットの器用操作のためのVLAモデル訓練に有効な人間の自己中心視点動画を、類似性に基づくデータマイニングで選別するフレームワークを提案。約3200万サンプルから1.49百万件を選び、成功率を47.7%から61.1%に向上させた。
原題: SiMDex: Mining Similar Egocentric Videos for Cross-Embodiment Dexterous Manipulation / Nie Lin, Takehiko Ohkawa, Sijin Chen 他
日本語で読む → - 論文手術ロボティクスロボティクス
信頼性の高い双腕手術サブタスク操作のための軌道発散ホライズン決定
手術用VLAモデルの固定長オープンループ動作による累積誤差を軽減するため、軌道発散に基づく適応的実行ホライズン決定手法を提案し、実機で検証した。
原題: Trajectory Divergence Horizon Decision for Reliable Dual-Arm Surgical Subtask Manipulation / Mingwu Su, Guankun Wang, Jinsong Lin 他
日本語で読む → - 論文VLAロボティクス
BridgeVLA++: 3次元操作のためのデータ効率的で汎化可能なメモリ拡張型視覚言語行動フレームワーク
事前学習済み視覚言語モデルを活用した3次元ロボット操作フレームワークBridgeVLAを拡張し、空間的・時間的メモリを統合することで、データ効率と汎化性能を保ちつつ、記憶依存の操作タスクで最先端の性能を達成した。
原題: BridgeVLA++: A Data-Efficient, Generalizable, and Memory-Augmented Vision-Language-Action Framework for 3D Manipulation / Peiyan Li, Yuze Zhu, Yixiang Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
NestDex: コパイロット支援遠隔操作による入れ子型ポリシー学習を用いた器用な操作
器用な操作のデモ収集を容易にするため、学習済みの手先スキルを遠隔操作に組み込んだ入れ子型ポリシー学習フレームワークを提案し、実機実験でその有効性を示した。
原題: NestDex: Nested Policy Learning with Copilot Assisted Teleoperation for Dexterous Manipulation / James Zhao, Jinhe Tang, Mingyuan Ba 他
日本語で読む → - 論文知覚/アクセシビリティ推定eess.IV
可視性を超えて:スパースLiDARからのリアルタイム表面アクセシビリティ場
スパースLiDAR点群から、ツールの形状と接近経路のクリアランスを考慮した表面のアクセシビリティをリアルタイムに推定する手法を提案。GPU上で動作し、センサレートで更新される。
原題: Beyond Visibility: Real-Time Surface Accessibility Fields from Sparse LiDAR / Bradley Scott, Sam Schofield, Richard Green
日本語で読む →