論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/11 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
STAR: 視覚・触覚・言語・行動モデルにおけるスパース触覚表現学習による巧みなマニピュレーション
200時間の双腕巧みな操作データセットを構築し、触覚信号のスパース性に対処する視覚・触覚・言語・行動モデルSTARを提案。実世界4タスクで平均61%の成功率を達成した。
原題: STAR: Sparse Tactile Representation Learning in Vision-Tactile-Language-Action Models for Dexterous Manipulation / Xiangcheng Liu, Tianhao Wu, Le Zheng 他
日本語で読む → - 論文マニピュレーションロボティクス
磁気浮上システムに把持機能を統合したGripper MagBot
磁気浮上搬送システム上で把持・操作を可能にするため、3つのMagLevムーバを機械的に結合した低コスト6自由度パラレルマニピュレータと1自由度グリッパを提案し、ピックアンドプレースを実証した。
原題: From Transportation to Manipulation: Enabling Grasping in Magnetic Robotics / Lara Bergmann, Noah Greis, Cedric Grothues 他
日本語で読む → - 論文マニピュレーションロボティクス
転倒寸前:力誘導能動知覚による形状非依存な3次元重心推定
ロボットが物体を準静的に押して戻す動作を行い、転倒直前の力と角度の計測から、形状情報なしで質量・重心高さ・転倒角を5%以下の誤差で推定する手法を提案。
原題: Before the Tipping Point: Force-Guided Active Perception for Shape-Agnostic Estimation of 3D Centers of Mass / Steven M. Hyland, Jing Xiao, Cagdas D. Onal
日本語で読む → - 論文マニピュレーションロボティクス
幾何学的事前学習による模倣学習の効率改善
平面・物体・手のみの単純な幾何学シーンで自動生成したデータで事前学習し、少ない実演データで模倣学習を効率化する手法を提案。
原題: Improving Imitation Learning Efficiency for Manipulation through Geometric Prior Pretraining / Shogo Iwakata, Tomohiro Motoda, Ryosuke Yamada 他
日本語で読む → - 論文マニピュレーションロボティクス
制約に基づく強化学習による接触の多いロボット挿入のための可変インピーダンス制御
力制限と接触フィードバックに条件付けられた方策が残留動作・挿入速度・ゲインを出力し、ゲインを許容範囲に射影することで、再学習や手動再調整なしに異なる力制限下で挿入を成功させる可変インピーダンス強化学習を提案。
原題: Constraint-Grounded Reinforcement Learning for Variable Impedance Control in Contact-Rich Robotic Insertion / Lin He, Min Deng
日本語で読む → - 論文マニピュレーションロボティクス
変形可能な線状物体の成形におけるオンライン材料推定に基づく条件付き拡散ポリシー
多視点画像と関節状態から材料ラベルをオンライン推定し、そのラベルで条件付けした拡散ポリシーにより、変形可能な線状物体の形状制御を実現した。
原題: Online Material Estimation for Conditioned Diffusion Policy in Shaping Deformable Linear Objects / Ryunosuke Yamada, Tomohiro Motoda, Yukiyasu Domae 他
日本語で読む → - 論文マニピュレーションロボティクス
強化学習ベース適応制御のための実行時増分トランスフォーマー
強化学習中にアテンションヘッドを動的に増減させる機構を提案し、摩擦メモリを持つマニピュレータの適応制御で長期的な失敗を解消した。
原題: Runtime-Incremental Transformer for Reinforcement-Learning-Based Adaptive Control / Giansalvo Cirrincione, Adriano Fagiolini
日本語で読む → - 論文マニピュレーションロボティクス
ObstaDiff: 障害物認識表現による汎化可能な拡散ポリシー学習
障害物を意識した視覚表現を組み込んだ拡散ポリシーを提案し、雑然とした農業環境でのロボットマニピュレーションの汎化性能を向上させた。
原題: ObstaDiff: Generalizable Diffusion Policy Learning via Obstacle-aware Representations / Jiawen Wang, Kevin Yao, Khalid Jawed
日本語で読む → - 論文マニピュレーションロボティクス
LTLDiff: 有限線形時相論理によるデータ生成と拡散ポリシーを用いたマルチエージェントロボットマニピュレーション
自然言語指示から有限線形時相論理(LTLf)仕様を学習し、その論理埋め込みを条件としてデモ生成と拡散ポリシー学習を行うことで、マルチエージェント協調マニピュレーションの成功率を向上させたフレームワーク。
原題: LTLDiff: Finite Linear Temporal Logic-Guided Data Generation and Diffusion Policies for Multi-agent Robotic Manipulation / Chuhan Meng, Haiyan Yin
日本語で読む → - 論文移動マニピュレーションロボティクス
MoPA: サブシステム特化型知覚アラインメントによる協調的移動マニピュレーション
移動とマニピュレーションで異なる知覚表現を二重ストリームで抽出し、行動レベルで協調させるフレームワークを提案。ManiSkill-HABで最高性能、実機でも成功率76.3%を達成。
原題: MoPA: Coordinated Mobile Manipulation via Subsystem-Specific Perception Alignment / Guangyu Chen, Qiwei Liang, Shaolong Zhu 他
日本語で読む → - 論文マニピュレーションロボティクス
実時間ヤコビアン推定による器用な把持ペン書きの高速学習
把持したペンを用いた手先内操作による文字書きを、実機上での実時間ヤコビアン推定に基づく制御で実現し、約18秒の初期化で学習を開始、サブミリ精度を達成した。
原題: Rapid Learning of Dexterous In-Hand Pen Writing through Real-Time Jacobian Estimation / Kai Stewart, Yasunori Toshimitsu, Robert K. Katzschmann
日本語で読む → - 論文マニピュレーションロボティクス
新型劣駆動多指ハンドにおける受動的安定性の準静的解析
差動バネ式スライダ機構を備えた3指劣駆動ハンドを提案し、把持物体の安定平衡姿勢を準静的に解析して、物体サイズが円筒・球把持の安定性に与える影響を調べた。
原題: Quasi-static analysis of passive stability in a novel underactuated multi-finger hand / Léonie Plancoulaine, Sylvain Guégan, Franck Plestan 他
日本語で読む → - 論文マニピュレーションロボティクス
RodForesight: 細長ロッド挿入のための世界モデル強化拡散ポリシー
細長いロッドの挿入タスクを粗接近と予測挿入の2段階に分け、拡散ポリシーと行動条件付き世界モデルを組み合わせて挿入前に候補行動の効果を予測・選択することで成功率を向上させた学習フレームワーク。
原題: RodForesight: A World Model Enhanced Diffusion Policy for Slender Rod Insertion / Chuanbo Yu, Mingyu Yue, Yan Lyu 他
日本語で読む → - 論文マニピュレーションロボティクス
Attention-DP3: 幾何整合型注意条件付けによる空間的物体認識3D拡散ポリシー
RGB画像から対象物体をセグメンテーションして3D点群に持ち上げ、物体レベルの幾何的手がかりを注意機構で拡散ポリシーに注入することで、 clutter の多い操作シーンでも安定して対象を操作できるようにした手法。
原題: Attention-DP3: Spatially Object-aware 3D Diffusion Policy via Geometry-aligned Attentional Conditioning / Changbo Yan, Zhongbo Zhang, Zaibin Zhang 他
日本語で読む → - 論文空中マニピュレーションロボティクス
接触を考慮した劣駆動空中マニピュレータのための漸進的モデル予測制御
劣駆動のクアッドロータに1自由度アームを搭載し、NMPCと全身INDIを組み合わせて、接触力を保ちながら空中で文字を書く制御を実現した。
原題: Contact-Aware Incremental Model Predictive Control for an Underactuated Aerial Manipulator / Darwin Liu, Tamas Keviczky, Sihao Sun
日本語で読む → - 論文マニピュレーションロボティクス
記憶を計画として:記憶に基づく計画立案による世界行動モデリング
長期記憶が必要な非マルコフ的操作タスクに対し、記憶を言語指示と視覚文脈を含むセグメント記録として表現し、それを計画に変換して実行するMaP-WAMを提案した論文。
原題: Memory as Plans: World-Action Modeling with Memory-Grounded Planning / Sizhe Zhao, Haozhe Xie, Weiyu Zhao 他
日本語で読む → - 論文マニピュレーションロボティクス
SEED-UMI: 人間とロボットで外骨格を共有する一対一の器用なデモンストレーション
人間とロボットが同じ外骨格を装着し、関節エンコーダと手首カメラの計測を共有することで、接触の多いタスクの模倣学習を効率化するフレームワークを提案。
原題: SEED-UMI: Sharing the Exoskeleton between human and robot for onE-to-one Dexterous demonstration / Tengbo Yu, Jiahao Wu, Daohan Li 他
日本語で読む → - 論文マニピュレーションロボティクス
表現豊かなロボットピアニスト:グラフ模倣と音楽的ダイナミクスで複雑なピアノ曲を演奏
強化学習とグラフベースの運指最適化、物理に基づく音響モデルを組み合わせ、人間らしい表現力で多様なピアノ曲を演奏できるロボットハンドを実現した。
原題: Expressive Robotic Pianist: Mastering Complex Piano Repertoire with Graph-Mimic and Musical Dynamics / Yanhong Liang, Xianwei Liu, Chaojie Fu 他
日本語で読む → - 論文マニピュレーションロボティクス
複数ロボットによる全身皮膚鏡画像の自動撮像スキャナ
4台のUR10マニピュレータにカメラを搭載し、皮膚病変を皮膚鏡レベルで自動撮像する全身スキャナを開発。臨床評価で既存の全身撮影装置を上回り、接触型皮膚鏡に匹敵する性能を示した。
原題: Multi-Robot Scanner for Automated Full-Body Dermoscopic Imaging / Valerio Franchi, Rafael Garcia, Nuno Gracias 他
日本語で読む → - 論文マニピュレーションロボティクス
生成動画プランをシミュレーションで接地し多様な器用操作コントローラを実現
生成された手と物体のインタラクション動画をシミュレーションで接地し、多様な把持や操作を実行できる器用なロボットハンドコントローラを学習する手法を提案。
原題: Grounding Generated Video Plans in Simulation Towards Versatile Dexterous Controllers / Tianyue Wu, Boyuan An, Shuqi Zhao 他
日本語で読む → - 論文マニピュレーションロボティクス
GTA-2: 接地されたタスク軸によるロボットマニピュレーションスキル合成のためのマルチVLMフレームワーク
4つのVLMエージェントがタスクを分解し、キーポイントや軸・制御パラメータを接地させて、実機ロボットのマニピュレーションスキルをゼロショットで生成するフレームワーク。
原題: GTA-2: A Multi-VLM Framework for Synthesizing Robot Manipulation Skills via Grounded Task Axes / M. Yunus Seker, Shobhit Aggarwal, Ruwan Wickramarachchi 他
日本語で読む → - 論文マニピュレーションロボティクス
制約多様体の微分可能チャートに沿った計画:汎用IKソルバーを用いて
IKFastなどの汎用逆運動学ソルバーが出力する解析的IKを微分可能に扱うため、逆関数定理を用いて勾配を計算する手法を提案し、マニピュレータの制約付き軌道計画に応用した。
原題: Planning along Differentiable Charts of Constraint Manifolds with General-Purpose IK Solvers / Thomas Cohn, Seiji Shaw, Harel Biggie 他
日本語で読む → - 論文視触覚/マニピュレーションロボティクス
リフティングのためのコンパクト視触覚ワールドモデル:予測・報酬整合・力制約
視触覚ワールドモデルと想像内でのactor-critic学習を用い、触覚情報が力予測精度を向上させる一方、力制約下でのタスク成功率には課題が残ることを示した。
原題: Compact Visuotactile World Models for Lifting: Prediction, Reward Alignment, and Force Constraints / Qinzhen Ma, Sida Peng
日本語で読む → - 論文マニピュレーションロボティクス
片手で二部品を組み立てるイン・ハンド・アセンブリ
2つの剛体部品を片手だけで把持・位置合わせして組み立てるタスクを強化学習で解き、シミュレーション学習から実機へゼロショット転移を実現した。
原題: Assembling Two Parts in One Hand / Liuao Pei, Tianyue Wu, Hui Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
DUET-DINO: ロボットマニピュレーションの潜在計画のための同時クロスビュー世界モデリング
側面カメラと手首カメラの観測をクロスビュー条件付けで統合し、7自由度エンドエフェクタ制御のための行動条件付き潜在世界モデルを学習する手法を提案。到達・角度付き到達・把持持ち上げタスクで単一視点や独立二視点のベースラインを上回る性能を達成した。
原題: DUET-DINO: Simultaneous Cross-View World Modeling for Latent Planning in Robot Manipulation / Nisarga Nilavadi, Ralf Römer, Moritz Reuss 他
日本語で読む → - 論文マニピュレーションロボティクス
3DWay: 3D一貫性ウェイポイントによるロボット操作の一般化
多視点画像から3D一貫性のあるウェイポイントを予測し、ロボット操作の一般化を向上させる手法を提案した論文。
原題: 3DWay: Generalizing Robot Manipulation via 3D Consistent Waypoints / Ziqin Huang, Yingyue Li, Chenyangguang Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
CASD: チャンク整合セマンティック蒸留による多段階ロボット操作
行動チャンク全体に対するセマンティックな目標を生成し、ポリシー学習を改善する手法を提案。オフラインVLMでデモを段階に分割し、その重み付き目標を予測するジェネレータを訓練し、ポリシーを条件付けする。
原題: CASD: Chunk-Aligned Semantic Distillation for Multi-StageRobot Manipulation / Tinghe Ding, Jiahao Li, He Wang
日本語で読む → - 論文マニピュレーションロボティクス
FOCIポリシー:関係的操作ポリシーのためのオブジェクト中心相互作用に焦点を当てる
物体間の相対運動に基づく相互作用中心のフレームワークを提案し、デモから重要な相互作用区間を抽出してスキルを表現することで、少ないデータで高い性能を達成する操作ポリシーを開発した。
原題: FOCI Policy: Focus on Object-Centric Interactions for Relational Manipulation Policies / Ze Fu, Pinhao Song, Yutong Hu 他
日本語で読む → - 論文マニピュレーションロボティクス
Dex-X: シミュレーションによるインタラクションを用いた人間のビデオからの視覚-触覚器用操作学習
人間のビデオデモから、シミュレーションで触覚情報を補完し、視覚と触覚を統合した器用な操作ポリシーを学習するフレームワークを提案。実機へのゼロショット転送を達成した。
原題: Dex-X: Learning Visual-Tactile Dexterous Manipulation From Human Videos with Simulated Interaction / Ruoqu Chen, Feixiang Ruan, Liu Cao 他
日本語で読む → - 論文マニピュレーションロボティクス
EquiGQNet: 共有等変点群符号化による高速な把握品質評価
6自由度の把握候補を高速かつ正確に評価するため、SO(3)等変な「一度符号化してから回転」方式と中間レベル行動融合を組み合わせた把握品質評価器EquiGQNetを提案した。シミュレーションと実機で従来法と同等以上の性能を保ちつつ、計画時間を6.9倍高速化した。
原題: EquiGQNet: Fast Grasp Quality Evaluation via Shared Equivariant Point Cloud Encoding / Sungwon Seo, Jaeseog Won, Jiyou Shin 他
日本語で読む →