論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/22 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA/強化学習ロボティクス
CounterAlign: 視覚言語行動モデルのための反事実的監督
専門家のデモンストレーションのみから、指示を入れ替えることで反事実的なデータを合成し、オフライン強化学習の報酬モデルを学習する手法を提案。ロボット操作の堅牢性を向上させる。
原題: CounterAlign: Counterfactual Supervision for Vision-Language-Action Models / Haru Kondoh, Kei Ota, Asako Kanezaki 他
日本語で読む → - 論文安全性評価AI
GuardianBench:身体化AIにおける潜在的な文脈リスクのための同一シーン指示対比ベンチマーク
同一シーンで指示だけを変えた安全/不安全の対比ペアからなるベンチマークを構築し、VLMが指示に鈍感で安全判断を誤ることを示し、軽量な事後学習手法で改善を実証した。
原題: GuardianBench: A Same-Scene Instruction-Contrastive Benchmark for Latent Contextual Risk in Embodied AI / Zhesheng Zhang, Jiahao Lu, Wei Liu 他
日本語で読む → - 論文掘削/模倣学習ロボティクス
視覚目標条件付き制御による自律掘削
掘削ロボットの動作を、画像上の目標領域マスクと行動チャンク変換器を用いて制御する枠組みを提案し、シミュレーションで高い目標達成率と作業効率を実証した。
原題: Vision Guided Target Conditioned Control for Autonomous Excavation / Shuai Zhao, Ji-An Pan, Junwei Li 他
日本語で読む → - 論文UAVナビゲーション画像認識
AirAlign: ジオメトリを考慮したUAV最終メートル航法のための相対ポーズ整列
UAVの最終接近段階での正確なポーズ整列を実現するため、事前学習済みの視覚幾何再構成モデルを用いてRGB画像ペアから相対ポーズを推定するフレームワークを提案した。
原題: AirAlign: Geometry-Aware Relative Pose Alignment for UAV Last-Meter Navigation / Jinyi Zhou, Shuo Feng, Yufei Wu 他
日本語で読む → - 論文遠隔操作/空中マニピュレーションロボティクス
力センサレス触覚フィードバックを用いた全方向空中マニピュレーションの安全重視型双方向遠隔操作
本論文は、全方向空中マニピュレータの遠隔操作において、制御バリア関数に基づく安全フィルタを導入し、力センサなしで触覚フィードバックを実現する手法を提案する。実験により、自由飛行中の不要なフィードバックを回避しつつ、物理的相互作用時の安定性を向上させることを示した。
原題: Safety-Critical Bilateral Teleoperation for Omnidirectional Aerial Manipulation Using Force-Sensorless Haptic Feedback / Yubin Kim, Jinwoo Lee, Yongjun You 他
日本語で読む → - 論文触覚ロボティクス
多感覚触覚データからの材料知覚と分類のための解釈可能な深層学習フレームワーク
触覚データから材料を知覚・分類するための、解釈可能な3つの深層学習モデルからなるフレームワークを開発した。熱的手がかりが特に重要であることを示した。
原題: An Interpretable Deep Learning Framework for Material Perception and Classification from Multisensory Tactile Data / Li Zou, Dave Hogendoorn, Yasemin Vardar
日本語で読む → - 論文ヒューマノイド/自律システムロボティクス
GOLEM: 電気自動車バッテリー分解に向けたモジュール型ヒューマノイド自律システム
GOLEMは、Unitree H1-2ヒューマノイドロボットを用いてEVバッテリーパックの分解を自動化する、オープンソースのモジュール型システムアーキテクチャを提案する。歩行、操作、動的安定性、ナビゲーション、空間記憶を独立モジュールとして抽象化し、シミュレーションから実機まで一貫した開発・比較を可能にした。
原題: GOLEM: Modular Humanoid Autonomy Towards Electric Vehicle Battery Disassembly / Max Conway, William Xie, Allen Devaraj 他
日本語で読む → - 論文視触覚表現学習ロボティクス
VT-MUSE: 操作のためのマルチモーダル統合シーケンシャル視触覚表現学習
視覚と触覚の時系列情報を統合する表現学習フレームワークを提案し、シミュレーションと実世界で操作タスクの成功率を大幅に向上させた。
原題: VT-MUSE: Multimodal Unified Sequential Visuotactile Representation Learning for Manipulation / Congsheng Xu, Qiaochu Yang, Fangyuan Shi 他
日本語で読む → - 論文群制御ロボティクス
分布シフト下での不均一マルチロボットタスク割り当てのためのモデルベース強化学習
不均一なマルチロボットシステムにおけるタスク割り当てとスケジューリングを、予測を考慮した適応ロールアウトフレームワークで解決し、分布シフトに対する頑健性を向上させた。
原題: Model-Based Reinforcement Learning for Heterogeneous Multi-Robot Task Assignment Under Distribution Shifts / Daniel Garces, Sara Castro, Adrian Haimovich 他
日本語で読む → - 論文群制御ロボティクス
モデルフリー適応パラメータ調整による効率的なマルチロボット倉庫運用
倉庫内のロボット群の動作を制御するパラメータを、極値探索制御を用いて実測のスループットに応じて自動調整し、固定パラメータよりも平均5%のスループット向上を達成した。
原題: Model-Free Adaptive Parameter Tuning for Efficient Multi-Robot Warehouse Operations / Pratap Tokekar, Mouhacine Benosman, Rahul Chandan 他
日本語で読む → - 論文模倣学習ロボティクス
模倣学習におけるデモンストレーション忘却の再考:ロボット工学の視点から
ロボットの模倣学習において、ユーザーが削除を要求したデモンストレーションの影響を評価する新しい監査手法を提案。行動と証拠の2軸で再学習との整合性を検証する。
原題: Rethinking Demonstration Unlearning in Imitation Learning for Robotics / Jiazhuo Li, Yu Zhang, Yiming Fei 他
日本語で読む → - 論文テスト自動化cs.SE
ExploreAI: ブラックボックスVR・3Dアプリケーションの再現可能な観測回帰テストのためのエージェント型探索知識ベース
LLMを活用したエージェント型フレームワークで、VR/3Dアプリの探索的テストを自動化し、観測結果を構造化知識ベースとして保存して再現可能な回帰テストを実現する。
原題: ExploreAI: Agentic Exploration Knowledge Bases for Reproducible Observable-Regression Testing of Black-Box VR and 3D Applications / Jiajie Wang, Kebin Peng, Wei Wang 他
日本語で読む → - 論文歩行ロボティクス
ガイド付き支援カリキュラムと段階的報酬によるヒューマノイドの自然な立ち上がり動作合成
強化学習を用いて、デモや参照軌道なしにヒューマノイドの自然な立ち上がり動作をゼロから合成する手法を提案。支援力と椅子の高さのカリキュラム、多様な初期姿勢、生体力学的報酬により、8段階の椅子の高さで97%以上の成功率を達成。
原題: Natural Sit-to-Stand Motion Synthesis For Humanoids via Guided Assistance Curricula and Staged Rewards / Meet Pal Singh, Vyankatesh Ashtekar, Ashish Dutta
日本語で読む → - 論文HRI/教示学習ロボティクス
教示はプロセスである:人間とロボットの対話的学習における人間の教示決定をモデル化するTOSSフレームワーク
人間がロボットに教える際の直感的な判断ロジックをボトムアップに分析し、教示決定をトリガー・目的・シグナル・戦略のネットワークとして捉えるTOSSフレームワークを提案した論文。
原題: Teaching is a Process: The TOSS Framework for Modeling Human Teaching Decisions in Human-Interactive Robot Learning / Bernhard Hilpert, Kim Baraka, Joost Broekens
日本語で読む → - 論文データセット解析画像認識
公開ブドウ病害データセットにおけるショートカット学習:アノテーション粒度は原因ではなく調整因子
公開ブドウ病害データセットで、クラス間のアノテーション粒度の違いがモデルの誤検出(特に他種画像での偽陽性)に与える因果的影響を、反事実的再学習とプラセボ対照実験により検証した論文。
原題: Shortcut Learning in a Public Grape Disease Dataset: Annotation Granularity as a Modulator, Not a Cause / Pushuo Wang
日本語で読む → - 論文軌道計画ロボティクス
OpenSCvx: オープンソースのモジュール式で拡張可能な非線形軌道計画パッケージ
軌道最適化問題をシンボリックに記述し、自動的に数値最適化問題を構築・解決するオープンソースのPythonフレームワークを紹介する論文。
原題: OpenSCvx: An Open-Source Modular and Extensible Nonlinear Trajectory Planning Package / Christopher R. Hayner, Griffin J. Norris, Fabio Spada 他
日本語で読む → - 論文HRI/活動認識ロボティクス
パーソナライゼーションが重要な理由:EMG-IMUベースのHRI活動認識における被験者間課題
EMGとIMU信号を用いた人間とロボットのインタラクション(HRI)における活動・ジェスチャ認識を研究し、53クラスの新しいデータセットMAGIC-HRIを導入。被験者間の一般化ギャップを明らかにし、少数のサンプル注入によるパーソナライゼーションが認識性能を大幅に向上させることを示した。
原題: Why Personalization Matters: Cross-Subject Challenges in EMG-IMU-based HRI Activity Recognition / Ruan Rithelle Chagas de Faria Carminati, Giovanni Braglia, Luigi Biagiotti 他
日本語で読む → - 論文VLA/操作AI
ForeTime-VLA: 世界行動モデルからの因果的未来トークン蒸留によるコンベアベルト操作
コンベア上の移動物体を操作するため、将来の接触イベントを予測するVLAポリシーを提案。凍結した世界行動モデルから未来情報を蒸留し、推論時のコストを抑えつつ把持成功率を大幅に向上させた。
原題: ForeTime-VLA: Causal Future-Token Distillation from a World Action Model for Conveyor-Belt Manipulation / Siyuan Ma, Yutian Zhang, Boshi Zhang 他
日本語で読む → - 論文群制御制御
重要ミッションにおけるフェイルオペレーショナルなドローン群のための安全性駆動アーキテクチャフレームワーク
本論文は、ドローン群の安全認証を可能にするため、SAE ARP4754Bに基づく混合クリティカリティアーキテクチャを提案し、Safety MonitorによるRTAゲートウェイとHealth Vectorに基づくフェイルオペレーショナルなタスク再割り当てを実現する。
原題: A Safety-Driven Architectural Framework for Fail-Operational Drone Swarms in Critical Missions / Luiz Giacomossi, Zafer Yigit, Marwan Shakarna 他
日本語で読む → - 論文宇宙探査ロボティクス
宇宙ロボットによる地球外採掘:探査、サンプリング、抽出
宇宙資源の採掘を実現するためのロボット技術を包括的にレビューし、6段階のアーキテクチャを提案した論文。
原題: Mining beyond Earth with Space Robots: Exploration, Sampling, and Extraction / Dong Li, Dujun Nie, Xiaotong Zhang 他
日本語で読む → - 論文自動運転/物体検出画像認識
自動運転のための意味的属性を備えたマルチモーダル交通標識検出
カメラとLiDARを組み合わせ、反射特性を利用した変形可能な融合モジュールと非線形運動モデルのトラッカーにより、長距離・地域非依存でロバストな交通標識検出を実現した。
原題: Multi-Modal Traffic Sign Detection with Semantic Attributes for Autonomous Driving / Meda Lazar, Sourab Sridhar, Shashwata Gupta 他
日本語で読む → - 論文VLA画像認識
視覚-言語-行動モデルにおけるトークン圧縮のための最小知覚差モデリング
本論文は、視覚-言語-行動(VLA)モデルのトークン圧縮において、下流の行動応答に基づく最小知覚差(JND)を導入し、許容範囲内の行動変化を保証する軽量なJND推定器を提案する。
原題: Just Noticeable Difference Modeling for Token Compression in Vision-Language-Action Models / Zhuoyuan Li, Rui Zhao, Jin Wang 他
日本語で読む → - 論文V2X/協調運転/VLMロボティクス
路側協調自動運転:データ基盤から視覚言語エンドツーエンド推論へ
V2X協調運転のためのシミュレーションプラットフォームとVQAデータセットを構築し、視覚言語モデルを用いたエンドツーエンドの協調運転フレームワークAURORAを提案した。閉ループ評価で高い性能を達成した。
原題: Roadside-Cooperative Autonomous Driving: From Data Platform to Vision-Language End-to-End Reasoning / Yitao Xu, Tong Wu, Yiyan Wu 他
日本語で読む → - 論文ロボット学習ロボティクス
模倣を超えて:オフポリシーQプランニングによるロボットポリシーの自己改善
大規模な視覚運動BCポリシーに小さなオフポリシーQ関数を組み合わせ、推論時の価値誘導選択とオンライン自己改善を実現。失敗データを活用してベンチマークと実ロボットタスクの成功率を大幅に向上させた。
原題: Beyond Imitation: Self-Improving Robot Policies via Off-Policy Q-Planning / Varun Giridhar, Anant Khandelwal, Jeremy A. Collins 他
日本語で読む → - 論文経路計画AI
凸集合グラフ上のシュタイナー巡回セールスマン問題に対する統一分岐限定探索
凸集合のグラフ上でシュタイナーTSPを定式化し、訪問順序と連続軌道を同時に最適化する統一分岐限定探索法を提案した。移動マニピュレータの検査タスクで有効性を示した。
原題: Unified Branch-and-Bound Search for the Steiner Traveling Salesman Problem on Graphs of Convex Sets / Jingtao Tang, Hang Ma
日本語で読む → - 論文ディープフェイク検出画像認識
特徴ロバスト拡張と根拠に基づく説明最適化による説明可能なディープフェイク検出
画像品質低下への耐性と説明の正確性を両立するため、劣化対応の拡張と教師あり対比学習、および証拠に基づく選好最適化を導入した説明可能なディープフェイク検出フレームワークを提案した。
原題: Explainable Deepfake Detection with Feature-robust Augmentation and Evidence-grounded Explanation Optimization / Zhu Xu, Jiaqi Tang, Pokai Chen 他
日本語で読む → - 論文VLA/社会的知能AI
信念なき行動:視覚言語モデルにおける心の理論の協調的社会行動への変換の測定
心の理論の推論と社会的行動のギャップを測るベンチマークMOSAICを導入し、VLMがToM制約下で一貫した行動を生成できないことを示した。
原題: Belief Without Behavior: Measuring the Translation of Theory of Mind into Coordinated Social Action in Vision-Language Models / Tonglin Yan, Gregoire Sergeant-Perthuis, David Rudrauf
日本語で読む → - 論文3D再構築ロボティクス
3DガウシアンスプラッティングとAstrobeeを用いた国際宇宙ステーションのその場再構築
Astrobeeロボットの画像データを用いて、国際宇宙ステーション内部を3Dガウシアンスプラッティングで高精細に再構築する手法を提案し、既存手法より高品質かつ高速であることを示した。
原題: In-Situ Reconstruction of the International Space Station Using 3D Gaussian Splatting and Astrobee / Hudson Kim, Ryan Soussan, Brian Coltin 他
日本語で読む → - 論文状態推定ロボティクス
IMU不要のボディフレーム状態推定:クアッドコプター向けスパースシーンフロー
ステレオカメラとモーター推力のみで、慣性センサなしにクアッドコプターの姿勢・速度・角速度などを推定するビジョンオンリーの状態推定システムを提案。静止点を慣性基準として利用し、拡張カルマンフィルタとバンドル調整を組み合わせる。
原題: IMU-Free Body-Frame State Estimation with Sparse Scene Flow for Quadcopters / Daniel Grønhaug, Sofie Markeset, Mathias Kolberg
日本語で読む → - 論文動画偽造検出画像認識
ResNet-LSTM-CBAMとDCTハイブリッドネットワークによる空間・周波数領域の動画偽造検出システム
空間特徴抽出にResNet-LSTM-CBAM、周波数特徴抽出にDCTを組み合わせた動画偽造検出モデルを提案し、ベンチマークで高精度を達成した。
原題: Spatiality-Frequency Domain Video Forgery Detection System Based on ResNet-LSTM-CBAM and DCT Hybrid Network / Zihao Liao, Sheng Hong, Yu Chen
日本語で読む →