論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/17 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文顔認識/解釈可能性画像認識
SCOUT: 顔認識テンプレートのオープンボキャブラリ編集のための意味概念発見
顔認識テンプレート内の意味概念を直接発見・操作するフレームワークを提案し、自然言語記述から潜在特徴の意味仮説を生成して安定性を検証することで、編集可能な意味方向を獲得する。
原題: SCOUT: Semantic Concept Discovery for Open-Vocabulary Editing of face Recognition Templates / Leon Todorov, Peter Rot, Peter Peer 他
日本語で読む → - 論文模倣学習ロボティクス
MatchingPolicy: 対応関係を考慮したポリシーによる物体横断的な文脈内学習の実現
デモとシーンの対応関係を明示的に分離し、密な意味的対応に基づいてロボットの動作を条件付ける拡散ポリシーを導入。未見の物体やカテゴリへの汎化性能を向上させた。
原題: MatchingPolicy: Correspondence-Aware Policy Enables Cross-Object In-Context Learning / Qijin She, Hanyang Yu, Zeming Li 他
日本語で読む → - 論文マニピュレーションロボティクス
統一条件・行動モデリングによる高精度ワンステップ行動生成
条件と行動を共有トークン空間で統一的にモデリングするUCA-Flowを提案し、推論速度を大幅に向上させつつ成功率を9.3ポイント改善した。
原題: Unified Condition-Action Modeling for Accurate One-Step Action Generation / Xinyu Zhou, Zikun Cai, Kuangji Zuo 他
日本語で読む → - 論文全身制御ロボティクス
ヒューマノイドロボットによるアメリカンフットボールのタイトスパイラル投げ
ヒューマノイドロボットがアメリカンフットボールを正確に投げるための全身制御戦略を提案し、リリース時のスピン注入と接触ダイナミクスを扱う。
原題: Throwing a Tight Spiral American Football by a Humanoid Robot / Zaid Mahboob, Bowen Weng
日本語で読む → - 論文制御/マルチロータロボティクス
レディネス障壁関数:過アクチュエーションマルチロータ配分の前方不変制御権限
過アクチュエーションマルチロータの配分問題で、制御権限を前方不変量として扱い、制御障壁関数を用いてトルクレベルで制約を課すことで、連続性と権限保証を両立する手法を提案した。
原題: Readiness Barrier Functions: Forward-Invariant Control Authority for Overactuated Multirotor Allocation / Giuseppe Silano
日本語で読む → - 論文マニピュレーションロボティクス
意味と密度を考慮したアクセシビリティ維持型マルチオブジェクト配置計画
家庭用ロボットが棚に複数の物体を順次配置する際、意味的な整理、空間の高密度利用、操作のしやすさを同時に考慮する計画手法SDPPを提案した。
原題: Semantic- and Density-Aware Planning for Accessibility-Preserving Multi-Object Placement / Benno Wingender, Nils Dengler, Nicolas Busch 他
日本語で読む → - 論文VLA/プランニングロボティクス
ニューロシンボリック具現化エージェント
視覚言語モデルとシンボリックプランニングを組み合わせ、家庭内の長期的タスクを実行可能な計画として生成するエージェントを提案。探索と制約付き計画により、実行可能性を保証しつつ高い成功率を達成。
原題: Neurosymbolic Embodied Agents / Mohammad Albinhassan, Yuming Feng, Alessandra Russo 他
日本語で読む → - 論文模倣学習ロボティクス
SurgVIL: オープンソース手術動画による手術ロボット模倣学習の大規模化
手術ロボットの模倣学習において、実組織の動画データから弱い教師信号として運動学を推定し、ファントムデータと組み合わせて学習することで、実組織や分布外環境への汎化性能を向上させるフレームワークを提案した。
原題: SurgVIL: Scaling Surgical Robot Imitation Learning with Open-source Surgical Videos / Xinhao Chen, JuoTung Chen, Nigel Nelson 他
日本語で読む → - 論文VLA/操作ロボティクス
SparkVLA: 長期的操作のための適応アクションチャンクを備えた停止認識型階層VLA
階層型VLAシステムにおけるサブタスクの停止タイミングとアクションチャンク長の相互依存関係を単一のランキング問題として定式化し、統一候補セットから最適解を選択する新しい手法を提案した。
原題: SparkVLA: Stop-Aware Hierarchical VLA with Adaptive Action Chunking for Long-Horizon Manipulation / Xunyao Lei, Renjun Wu, Tianlin Huo 他
日本語で読む → - 論文セキュリティロボティクス
状態が攻撃面となるとき:LLM駆動型具現化エージェントにおける状態意味注入攻撃
LLM駆動の具現化エージェントにおいて、環境状態を改ざんする「状態意味注入攻撃」を提案し、その脅威と防御の必要性を示した論文。
原題: When State Becomes an Attack Surface: State-Semantic Injection in LLM-Driven Embodied Agents / Jiawei Liu, Jiacheng Guo, Tian Zhang 他
日本語で読む → - 論文3D再構成ロボティクス
OccamView: フレーム予算制約下のアクティブ3Dガウス再構成のためのオブジェクト条件付き視点選択
限られたフレーム予算で3Dガウス再構成を行う際、物体の隠れ領域を考慮した視点選択手法を提案し、再構成の完全性を向上させた。
原題: OccamView: Object-Conditioned View Selection for Frame-Budgeted Active 3D Gaussian Reconstruction / Hongbo Gao, Wei Zhang, Zeyu Ni 他
日本語で読む → - 論文センサ融合ロボティクス
カルマンフィルタ情報融合におけるIMUパラメータ設定
アラン分散キャリブレーションに基づくIMUパラメータ設定法をカルマンフィルタ枠組みで検討し、連続時間フィルタのプロセス不確かさを定式化して、2つの典型的なセンサ融合システムで有効性を示した。
原題: The Setting of IMU Parameters in Kalman Filtering-based Information Fusion / Qiang Hu, Yanhua Zou, Shuaiyi Huo 他
日本語で読む → - 論文軌道上ナビゲーションロボティクス
軌道プランナー:衛星エージェントの軌道上障害物回避のための潜在世界モデル
軌道上の衛星ナビゲーション向けに、潜在空間で将来状態を予測する2段階の世界モデルを提案し、物理状態を復元するプローブを導入。シミュレーションで91.7%の成功率を達成。
原題: Orbit-Planner: Towards Latent World Models for On-Orbit Obstacle Avoidance of Satellite Agents / Zhijian Li, Chao Ren, Peijin Wang 他
日本語で読む → - 論文強化学習/ベンチマークAI
クロノクックド:強化学習エージェントにおける暗黙の区間タイミングのベンチマーク
調理シナリオを通じて、強化学習エージェントの時間知覚能力を評価するベンチマークスイートを提案し、時間情報が明示されない環境での性能を検証する。
原題: Chronocooked: A Benchmark for Implicit Interval Timing in Reinforcement Learning Agents / Amrapali Pednekar, Alvaro Garrido-Perez, Yara Khaluf 他
日本語で読む → - 論文歩行AI
不整地での脚式移動のための軌跡レベル自動カリキュラム学習
不整地での脚式移動ポリシー学習において、地形マップから直接タスクを生成する軌跡レベルの自動カリキュラム学習フレームワークを提案し、成功率を大幅に向上させた。
原題: Trajectory-Level Automatic Curriculum Learning for Legged Locomotion on Unstructured Terrain / Rocky Liu, Tengyu Liu, Baoxiong Jia 他
日本語で読む → - 論文ナビゲーションロボティクス
実世界動画からのスケーラブル学習による都市ナビゲーションのロングテール顕在化
ウェブ上の未編集な一人称視点動画からメトリック軌跡とナビゲーション意味情報を自動アノテーションし、視覚言語行動ポリシーを訓練して都市ナビゲーションのロングテールな稀なシナリオを体系的に明らかにする枠組みを提案した。
原題: Exposing the Long-tail in Embodied Urban Navigation via Scalable Learning from In-the-Wild Videos / Bingyi Xia, Han Bao, Zhewei Chen 他
日本語で読む → - 論文LLM評価ロボティクス
監視・警備ロボット向けアイデンティティ依存LLM出力のベンチマーキング
LLMが生成する監視・警備ロボットの設計記述が、人口統計学的アイデンティティのラベルによって読みやすさに系統的な差が出るかを評価した論文。
原題: Benchmarking Identity-Sensitive LLM Outputs for Surveillance and Security Robots / Nneka Hyman, Jasmine Khan, Raj Korpan
日本語で読む → - 論文群制御ロボティクス
採餌ロボット群のための適応的反発フェロモンクラスタリング
ロボット群の採餌効率を高めるため、探索済み領域に反発フェロモンを配置して未探索領域へ誘導する適応的反発フェロモンクラスタリング(ARPC)を提案し、シミュレーションで既存手法より優れた性能を示した。
原題: Adaptive Repulsive Pheromone Clustering for Foraging Robot Swarms / Carlos Pena-Caballero, Constantine Tarawneh, Qi Lu
日本語で読む → - 論文シミュレーション/運動制御ロボティクス
ラムダ保持制御:予測的筋骨格シミュレーションにおける最小タスク報酬から創発する人間らしい運動
平衡点仮説に着想を得たλ保持制御器を提案し、筋駆動骨格モデルが最小限の報酬だけで人間らしいスプリント動作を1時間以内に学習できることを示した。
原題: Lambda-Hold Control: Human-Like Movement Emerges from a Minimal Task Reward in Predictive Musculoskeletal Simulation / Jun Hyuk Lee, Chihyeong Lee, Jooeun Ahn
日本語で読む → - 論文群制御ロボティクス
プランナー条件付き拡散による協調マルチエージェント探索
複数のプランナーのデモから学習し、プランナーIDを条件として与えることで多様な軌道を生成できる拡散ポリシーを提案。局所的な再ランキングでエージェント間の重複を減らし、協調探索を実現した。
原題: Planner-Conditioned Diffusion for Coordinated Multi-Agent Exploration / Marcus Yu Siong Teo, Jeric Lew, Tanishq Duhan 他
日本語で読む → - 論文ナビゲーションロボティクス
DPNet: 視覚ベースUAVナビゲーションのための効率的な行き止まり予測と回避
RGB-D入力から行き止まりの相対距離と方位を予測する軽量ニューラルネットワークを提案し、軌道ライブラリを刈り込んでUAVが行き止まりを回避しながら滑らかに飛行できるようにした。実データでの追加学習なしで実世界に適用でき、50Hzでの高速再計画を実現する。
原題: DPNet: Efficient Dead-End Prediction and Avoidance for Vision-Based UAV Navigation / Ruibin Zhang, Lun Pan, Zelong Xia 他
日本語で読む → - 論文リハビリテーションロボティクスロボティクス
ロボット支援上肢タスク特異的トレーニングのための可変的な理学療法士-患者間相互作用の学習
この論文は、タスク特異的トレーニング中の理学療法士と患者の相互作用を学習し、新しいタスクバリエーションで療法士のトルクを再現するフレームワークを提案しています。少数のデモンストレーションからタスクパラメータ化ガウス混合モデルを用いて個人化された相互作用を学習し、評価では従来手法と同等以上の性能を示しました。
原題: Learning Varying Physical Therapist-Patient Interactions for Robot-mediated Upper Limb Task-Specific Training / Jia Quan Loh, Vincent Crocher, Marlena Klaic 他
日本語で読む → - 論文医療ロボティクスロボティクス
US-VLA: 腹部超音波検査のための視覚・言語・動作モデル
臨床的な意味目標を明示的に符号化し、リアルタイムの超音波フィードバックに基づいてプローブ操作を生成する超音波検査自動化のための視覚・言語・動作モデルを提案した。肝臓と腎臓の検査データセットを構築し、プローブ操作タスクでの有効性と汎化性を示した。
原題: US-VLA: An Ultrasound Vision-Language-Action Model for Embodied Abdomina / Cheng Zhang, Xingzheng Wu, Guihao Yan 他
日本語で読む → - 論文センサ融合ロボティクス
サイクロプス:色を夢見るカメラとしてのLiDAR
低照度や高ダイナミックレンジ環境で劣化するカメラの代わりに、照明に依存しないLiDAR強度をRGBビデオに変換するフレームワーク「Cyclops」を提案し、カメラなしで終日認識タスクを可能にする。
原題: Cyclops: LiDAR as a Camera That Dreams in Color / Wei Gao, Jian Shu, Mingle Zhao 他
日本語で読む → - 論文VLAロボティクス
教えて育てる:汎用ロボット学習のためのエージェント中心アーキテクチャ
この論文は、少数のデモから再利用可能なスキルブロックを学習し、新しいシーンでそれらを組み合わせてタスクを実行するエージェント中心のアーキテクチャ(TGL)を提案し、再学習の負担を軽減する。
原題: Teach and Grow: An Agent-Centered Architecture for General Robot Learning / Chang Nie, Zhe Liu, Hesheng Wang
日本語で読む → - 論文ソフトロボティクスロボティクス
重力負荷下での大型高力ソフトロボットマニピュレータの設計最適化
ソフトロボットの腕の形状を最適化し、自重による座屈を防ぎつつブロッキング力を最大化する手法を提案。閉形式解を示し、実験で有効性を検証した。
原題: Design Optimization for Large High-Force Soft Robot Manipulators Under Gravitational Loads / Isara Cholaseuk, Penelope Llibre, Alexa Kyriacou 他
日本語で読む → - 論文VQA/操作計画画像認識
PROBE: VLMエージェントによる操作基盤の視覚質問応答
ロボットが隠れた物体を探すために操作が必要な動的シーンでの視覚質問応答(MG-VQA)を提案し、シミュレータとベンチマークを構築、VLMエージェントの性能を評価・微調整する手法を示した。
原題: PROBE: Manipulation-Grounded Visual Question Answering with VLM Agents / Vineet Bhat, Siyi Chen, Alex Zook 他
日本語で読む → - 論文水中追跡制御
移動地平線推定によるTDoA計測を用いた水中ターゲット追跡
水中ターゲット追跡のためのTDoA計測に基づく移動地平線推定(MHE)手法を提案し、シミュレーションでEKFより頑健な追跡性能を示した。
原題: Moving Horizon Estimation for Underwater Target Tracking Based on Time-Difference-of-Arrival Measurements / Anton Tolstonogov, David Cabecinhas, Pedro Batista 他
日本語で読む → - 論文地理的定位画像認識
X$^2$Localizer: プログレッシブなクロスビュー動画地理的定位のためのクロス粒度アライメント
本論文は、地上視点の動画を対応する航空画像に位置づけるクロスビュー動画地理的定位(CVG)を、部分的な観測や動的な時間予算に対応できるプログレッシブな設定(PCVG)に拡張し、新しいフレームワークX$^2$Localizerを提案する。
原題: X$^2$Localizer: Cross-grained Alignment for Progressive Cross-view Video Geo-localization / Zichao Zeng, Weijia Fan, Yufan Chen 他
日本語で読む → - 論文自動運転/倫理/強化学習機械学習
倫理的判断ヘッド:人間のフィードバックからの強化学習による自動運転車の規範倫理の実装
自動運転車の倫理的判断を強化学習で実装するフレームワークを提案し、功利主義とカント主義の二つの規範を評価した。人間の好みに基づく報酬モデルを用いて訓練し、倫理フレームワークの学習可能性の非対称性を明らかにした。
原題: The Ethical Decision Head: Operationalizing Normative Ethics in Autonomous Vehicles via Reinforcement Learning from Human Feedback / Thomas Mbrice, Ammar Ali, Sami Mian 他
日本語で読む →