論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御cs.DC
匿名グラフにおける位置認識型分散配置
色付きノードと色付きロボットを対象に、各ロボットが同じ色の異なるノードに配置されるよう移動する新問題を定式化し、時間とメモリの保証付き決定アルゴリズムを提案した。
原題: Location-Aware Dispersion on Anonymous Graphs / Himani, Supantha Pandit, Gokarna Sharma
日本語で読む → - 論文3Dセグメンテーション画像認識
Clutt3R-Seg: 散乱シーンでの言語指示把持のためのスパースビュー3Dインスタンスセグメンテーション
散乱環境での言語指示に基づく把持のため、ノイズの多いマスクを手がかりに階層的なインスタンス木を構築し、少数視点でも頑健なゼロショット3Dインスタンスセグメンテーションを実現した。
原題: Clutt3R-Seg: Sparse-view 3D Instance Segmentation for Language-grounded Grasping in Cluttered Scenes / Jeongho Noh, Tai Hyoung Rhee, Eunho Lee 他
日本語で読む → - 論文自動運転/強化学習ロボティクス
ベクトル意味表現と記号推論による人間中心の自動緊急ブレーキのための強化学習強化
自動運転の緊急ブレーキにおいて、意味・空間・形状情報を統合したニューロシンボリック特徴表現と、ソフト一階論理による報酬関数を提案し、安全性と政策の堅牢性を向上させた。
原題: Reinforcement Learning Enhancement Using Vector Semantic Representation and Symbolic Reasoning for Human-Centered Autonomous Emergency Braking / Vinal Asodia, Iman Sharifi, Saber Fallah
日本語で読む → - 論文VLAロボティクス
World Guidance: 行動生成のための条件空間における世界モデリング
未来の観測をコンパクトな条件に圧縮して行動推論に注入し、VLAモデルが未来の行動と条件を同時に予測することで、精密な行動生成と高い汎化性能を実現するフレームワークを提案した。
原題: World Guidance: World Modeling in Condition Space for Action Generation / Yue Su, Sijin Chen, Haixin Shi 他
日本語で読む → - 論文安全性解析ロボティクス
分散型高度交通システムにおけるオフロードサービス安全解析のための多段階フレームワーク
自動運転車の機能を遠隔サービスにオフロードする際の安全性を検証する多段階フレームワークを提案し、計算複雑性と省エネ性能を評価した。
原題: Multi-Staged Framework for Safety Analysis of Offloaded Services in Distributed Intelligent Transportation Systems / Robin Dehler, Oliver Schumann, Jona Ruof 他
日本語で読む → - 論文マニピュレーションロボティクス
IRIS: 学習駆動型タスク特化型シネマロボットアームによる視覚運動制御
3Dプリント製の低コスト6自由度ロボットアームとTransformerベースの模倣学習を組み合わせ、人間の実演から映画撮影向けの滑らかなカメラ軌道を自律的に学習・実行するシステムを構築した。
原題: IRIS: Learning-Driven Task-Specific Cinema Robot Arm for Visuomotor Motion Control / Qilong Cheng, Matthew Mackay, Ali Bereyhi
日本語で読む → - 論文軌道最適化ロボティクス
SURE: 軌道最適化による安全な不確実性対応ロボット環境インタラクション
接触タイミングの不確実性を考慮し、複数の軌道分岐と再統合を可能にする軌道最適化フレームワークを提案。カートポールと卵キャッチの実験で成功率を大幅に改善。
原題: SURE: Safe Uncertainty-Aware Robot-Environment Interaction using Trajectory Optimization / Zhuocheng Zhang, Haizhou Zhao, Xudong Sun 他
日本語で読む → - 論文群制御cs.MA
マルチエージェント探索のための反事実的条件付き尤度報酬
各エージェントの探索貢献をチーム全体の探索に対する独自の寄与として評価する反事実的条件付き尤度報酬を提案し、疎な報酬の協調タスクでの学習を加速させる。
原題: Counterfactual Conditional Likelihood Rewards for Multiagent Exploration / Ayhan Alp Aydeniz, Robert Loftin, Kagan Tumer
日本語で読む → - 論文マニピュレーションロボティクス
壊れても動き続ける:身体性とタスクに条件付けられた拡散ポリシーによる故障時能動軌道生成
ロボットの関節故障時でもタスクを継続できるよう、現在の身体状態とタスク制約に条件付けられた拡散モデルベースの軌道生成手法DEFTを提案し、シミュレーションと実機で有効性を示した。
原題: Moving On, Even When You're Broken: Fail-Active Trajectory Generation via Diffusion Policies Conditioned on Embodiment and Task / Gilberto G. Briscoe-Martinez, Yaashia Gautam, Rahul Shetty 他
日本語で読む → - 論文GUIエージェントロボティクス
VAGEN: 軌跡に基づく段階的対話検証によるGUIエージェントの報酬モデリング
GUIエージェントの検証を、軌跡の直接証拠と環境への能動的プロービングを段階的に組み合わせて行うツール拡張型検証エージェントVAGENを提案し、OSWorldやAndroidWorldで評価精度と効率の両立を示した。
原題: Agentic Reward Modeling: Verifying GUI Agent via Progressive Trajectory-Grounded Interaction / Chaoqun Cui, Jing Huang, Shijing Wang 他
日本語で読む → - 論文自動運転/VLAロボティクス
SteerVLA:長尾運転シーンで視覚言語行動モデルを操舵する
VLMの常識推論で細かい言語指示を生成し、VLA運転ポリシーを操舵する手法を提案。閉ループベンチマークで長尾シーンの性能を大幅に改善した。
原題: SteerVLA: Steering Vision-Language-Action Models in Long-Tail Driving Scenarios / Tian Gao, Celine Tan, Catherine Glossop 他
日本語で読む → - 論文軌道ロボティクス/強化学習AI
強化学習による多数デブリランデブー計画の最適化:燃料補給と適応的衝突回避の統合
小型衛星による複数デブリ除去のため、燃料補給と適応的衝突回避を組み込んだマスク付きPPO強化学習でランデブー順序と軌道を最適化する枠組みを提案した。
原題: Optimizing Mission Planning for Multi-Debris Rendezvous Using Reinforcement Learning with Refueling and Adaptive Collision Avoidance / Agni Bandyopadhyay, Gunther Waxenegger-Wilfing
日本語で読む → - 論文VLAロボティクス
World-Gymnast: 世界モデル内での強化学習によるロボット訓練
実世界の動画と行動データから学習した世界モデル内でVLA方針を強化学習し、実機性能で教師あり学習やシミュレータを上回ることを示した。
原題: World-Gymnast: Training Robots with Reinforcement Learning in a World Model / Ansh Kumar Sharma, Yixiang Sun, Ninghao Lu 他
日本語で読む → - 論文クロスビュー地理的位置推定画像認識
(MGS)²-Net:微視的幾何スケールと巨視的幾何構造を統合したクロスビュー地理的位置推定
斜めの航空写真と衛星写真の幾何学的なずれに対処するため、深度情報でスケールを補正し、幾何学的勾配で建物のファサードを除去する新手法を提案し、クロスビュー地理的位置推定で最高精度を達成した。
原題: (MGS)$^2$-Net: Unifying Micro-Geometric Scale and Macro-Geometric Structure for Cross-View Geo-Localization / Minglei Li, Mengfan He, Chunyu Li 他
日本語で読む → - 論文HRI/健康増進HCI
関係性家電:家庭での健康増進のための冷蔵庫内ロボット
冷蔵庫内に人型ロボット頭部を設置し、おやつ選択時に健康推奨を行う対話型ロボットのパイロット研究。参加者はロボットを説得力があり社会的に魅力的と感じ、おやつ選択への意識が高まった。
原題: Relational Appliances: A Robot in the Refrigerator for Home-Based Health Promotion / Timothy Bickmore, Mehdi Arjmand, Yunus Terzioglu
日本語で読む → - 論文歩行・バランス制御ロボティクス
超機動車両:走行・バランス・ジャンプを実現する自転車ロボットのシステム設計
自転車と反動質量を組み合わせ、最小限のアクチュエータで走行・バランス・ジャンプを実現するロボットを設計し、強化学習で多様なアクロバティック動作を実現した。
原題: System Design of the Ultra Mobility Vehicle: A Driving, Balancing, and Jumping Bicycle Robot / Benjamin Bokser, Daniel Gonzalez, Aaron Preston 他
日本語で読む → - 論文VLAロボティクス
ST-BiBench:双腕身体性タスクにおけるマルチストリーム・マルチモーダル協調のMLLMベンチマーク
双腕ロボットの身体性タスクを対象に、マルチモーダル大規模言語モデルの時空間的なマルチストリーム協調能力を評価する多層ベンチマークST-BiBenchを提案し、30以上のモデルを評価して高次推論と細粒度実行の乖離を明らかにした。
原題: ST-BiBench: Benchmarking Multi-Stream Multimodal Coordination in Bimanual Embodied Tasks for MLLMs / Xin Wu, Zhixuan Liang, Yue Ma 他
日本語で読む → - 論文車酔い・シミュレータ妥当性ロボティクス
テスト環境は重要か?実路・テストコース・ドライビングシミュレータ間の車酔い比較
実路・テストコース・ドライビングシミュレータの3環境で同じ車酔い誘発条件を再現し、主観・客観指標を比較した。シミュレータは低周波(0.5Hz未満)の動きを再現できず、車酔いスコアが有意に低いことを示した。
原題: Does the testing environment matter? Carsickness across on-road, test-track, and driving simulator conditions / Georgios Papaioannou, Barys Shyrokau
日本語で読む → - 論文自動運転ロボティクス
人間のデモンストレーションなしで新しい都市を走行する学習
地図とメタ情報のみを用いた自己対戦型マルチエージェント強化学習により、人間のデモンストレーションなしで運転ポリシーを新しい都市に適応させる手法NOMADを提案した。
原題: Learning to Drive in New Cities Without Human Demonstrations / Zilin Wang, Saeed Rahmani, Daphne Cornelisse 他
日本語で読む → - 論文HRIロボティクス
家族のためのロボット設計:家庭のルーティンにおける文脈的リマインダーのための現場プロトタイピング
10家族と協働でロボットのリマインダー行動を設計し、4日間の家庭内実験を通じて、タイミングや権限、家族力学に関する課題を明らかにした。
原題: Designing Robots for Families: In-Situ Prototyping for Contextual Reminders on Family Routines / Michael F. Xu, Enhui Zhao, Yawen Zhang 他
日本語で読む → - 論文sim2real画像認識
SAGE: 身体性AIのためのスケーラブルなエージェント型3Dシーン生成
ユーザーが指定した身体性タスクを理解し、複数の生成器と評価器を組み合わせて物理的に妥当でシミュレータ対応の3D環境を自動生成するエージェントフレームワークを提案。
原題: SAGE: Scalable Agentic 3D Scene Generation for Embodied AI / Hongchi Xia, Xuan Li, Zhaoshuo Li 他
日本語で読む → - 論文sim2realロボティクス
GeCo-SRT: ロボットのクロスタスクSim-to-Real転移のための幾何認識型継続適応
局所幾何特徴をドメイン・タスク不変な知識として活用し、継続的なSim-to-Real転移を可能にする幾何認識型Mixture-of-Expertsと優先経験再生を提案。新タスク適応でデータ効率を大幅に改善。
原題: GeCo-SRT: Geometry-aware Continual Adaptation for Robotic Cross-Task Sim-to-Real Transfer / Wenbo Yu, Wenke Xia, Weitao Zhang 他
日本語で読む → - 論文触覚ロボティクス
把持・滑り・転がり:触覚による形状復元のための接触モード比較分析
触覚を備えた多指ハンドで物体を把持・滑らせ・転がす3つの接触モードを比較し、情報理論的な探索と形状補完モデルを組み合わせることで、より少ない接触回数で高精度な形状復元を実現した。
原題: Grasp, Slide, Roll: Comparative Analysis of Contact Modes for Tactile-Based Shape Reconstruction / Chung Hee Kim, Shivani Kamtikar, Tye Brady 他
日本語で読む → - 論文マニピュレーションロボティクス
FlowHOI: 巧みなロボット操作のためのフロー型意味論に基づく手と物体のインタラクション生成
言語指示と3Dシーン再構成を条件に、フローマッチングで手姿勢・物体姿勢・接触状態からなる手と物体のインタラクション系列を生成し、ロボット操作へ転移可能にする手法を提案。
原題: FlowHOI: Flow-based Semantics-Grounded Generation of Hand-Object Interactions for Dexterous Robot Manipulation / Huajian Zeng, Lingyun Chen, Jiaqi Yang 他
日本語で読む → - 論文強化学習セキュリティcs.CR
信頼できないシミュレータに注意:強化学習における報酬なしバックドア攻撃
シミュレータのダイナミクスを改ざんして、報酬を操作せずに強化学習エージェントに行動レベルのバックドアを仕込み、特定のトリガーで危険な行動を引き起こす攻撃手法「Daze」を提案し、実機ロボットへの転移も示した。
原題: Beware Untrusted Simulators -- Reward-Free Backdoor Attacks in Reinforcement Learning / Ethan Rathbun, Wo Wei Lin, Alina Oprea 他
日本語で読む → - 論文触覚ロボティクス
SpikingTac:高精度動的触覚インプリント追跡のための小型ニューロモルフィック視触覚センサ
低コストで小型なイベントカメラモジュールを組み込んだニューロモルフィック触覚センサを開発し、粘弾性ヒステリシスを考慮した更新則により1000Hzの知覚と350Hzの追跡を実現した。
原題: SpikingTac: A Miniaturized Neuromorphic Visuotactile Sensor for High-Precision Dynamic Tactile Imprint Tracking / Tianyu Jiang, Chaofan Zhang, Shaolin Zhang 他
日本語で読む → - 論文VLAロボティクス
Vision-Language-Actionロボットのメタモルフィックテスト
VLAモデルを搭載したロボットのテストオラクル問題を緩和するため、メタモルフィック関係を提案し、入力変更が軌道に与える影響を評価する手法を検証した。
原題: Metamorphic Testing of Vision-Language Action-Enabled Robots / Pablo Valle, Sergio Segura, Shaukat Ali 他
日本語で読む → - 論文マニピュレーションロボティクス
上手くいく動作を模倣:人間動画からのシミュレーション選別モジュール型方策学習
人間の動画から把持後の動作を学び、シミュレーションで把持の適合性を選別することで、ロボットデータなしに精密なマニピュレーションを実現するモジュール型方策学習フレームワークを提案。
原題: Imitating What Works: Simulation-Filtered Modular Policy Learning from Human Videos / Albert J. Zhai, Kuo-Hao Zeng, Jiasen Lu 他
日本語で読む → - 論文自己位置推定ロボティクス
Graph-Loc: 低観測性・遮蔽環境下でのコンパクトな構造地図事前分布を用いたロバストなグラフベースLiDAR姿勢追跡
点と線の軽量グラフで表現した地図事前分布に対し、LiDARスキャンから抽出した点・線を不均衡最適輸送で対応付けることで、遮蔽や低観測性に強い姿勢追跡を実現した。
原題: Graph-Loc: Robust Graph-Based LiDAR Pose Tracking with Compact Structural Map Priors under Low Observability and Occlusion / Wentao Zhao, Yihe Niu, Zikun Chen 他
日本語で読む → - 論文ソフトロボティクス/触覚ロボティクス
調整可能な柔軟多孔質弾性ソフトセンシングを用いた表面ベースマニピュレーション
格子密度を変えることで剛性とセンサ感度を同時に調整できる柔軟多孔質弾性センシング(COPESS)を開発し、繊細な物体操作を可能にした。
原題: Surface-based Manipulation Using Tunable Compliant Porous-Elastic Soft Sensing / Gayatri Indukumar, Muhammad Awais, Diana Cafiso 他
日本語で読む →