Han Ding
AWS AI
収録論文 24本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Prism-GRPO: 同一結果グループの分割による高速なVLAポリシー最適化VLA2026/8/18
GRPOの強化学習において、成功/失敗が同一のグループを品質スコアで分割し、学習信号を回復することでロールアウト効率を向上させる手法を提案した。
- 物理情報に基づくスライディングウィンドウ粒子フィルタによる触覚のみを用いた手中6自由度物体姿勢推定の精緻化触覚/姿勢推定2026/8/18
視覚が使えない状況で、手のひらの触覚センサ情報のみを用いて、把持物体の6自由度姿勢を高精度に推定する手法を提案した論文。物理的な接触条件を考慮した粒子フィルタと時間的な情報統合により、従来法より精度が向上することを示した。
- TurboVLA: RTX 4090上で32Hz・1GB未満のVRAMで動作するリアルタイム視覚言語行動モデルVLA2026/7/1
従来のLLM中心のVLAアーキテクチャを、視覚と言語を独立にエンコードし軽量な双方向相互作用で直接行動にマッピングする方式に再設計し、計算コストとメモリ使用量を大幅に削減した。LIBEROで97.7%の成功率を達成し、大規模モデルに匹敵する性能を小規模で実現した。
- 段階認識と粗さ制約を備えた多段階ロボット研磨用拡散ポリシーマニピュレーション2026/6/1
多段階のロボット研磨作業において、工程段階の推定と粗さ制約付き拡散サンプリングを導入し、段階遷移の安定性と表面品質を向上させる手法を提案した。
- 四足壁面歩行ロボット向けの高負荷密度・接着力制御可能な電磁永久磁石足歩行2026/5/1
四足ロボットが鉄磁性面を登るための、高負荷密度で接着力を制御できる電磁永久磁石足を提案し、最大1000N以上の接着力と200:1以上の荷重比を実現した。
- 表面拘束ポリシー:表面拘束かつ動的に実現可能なロボットスキルの学習模倣学習2026/5/1
拡散ベースの模倣学習に表面形状の拘束と動的実現可能性を組み込み、自由曲面に沿ったロボット動作を生成する新しいポリシーを提案した。
- 変形組織上の手術用ロボット露出タスクのための学習ベース適応制御手術ロボティクス2026/5/1
手術中に組織で覆われた関心領域を露出するため、学習ベースの適応制御フレームワークを提案。視覚的境界の変化を監視し、深層変形推定モデルで把持点を最適化して自律的に組織を牽引する。
- AX=YB問題に対する不確実性を考慮した最適校正法校正2026/5/1
ハンドアイ校正問題に対し、Lie代数に基づく反復最適化で大域的最適解を近似し、データの不確実性を明示的にモデル化せずに相対不確実性指標で反復を動的調整する手法を提案。高不確実性条件下で精度を大幅に向上させた。
- MoRI: 長期的操作タスクのためのRLとILエキスパートの混合マニピュレーション2026/4/1
強化学習と模倣学習のエキスパートを動的に切り替えるシステムMoRIを提案し、複雑な実世界操作タスクで高成功率と少ない介入を実現した。
- 解剖学的先行知識に基づく自律ロボット心臓超音波標準断面取得フレームワーク医用画像/ロボット制御2026/3/1
心臓超音波の標準断面を自動取得するため、解剖学的先行知識を組み込んだセグメンテーションと強化学習によるプローブ調整を統合したフレームワークを提案した。
- AsyncMDE: 非同期空間メモリによるリアルタイム単眼深度推定単眼深度推定2026/3/1
凍結した基盤モデルと軽量な高速パスを非同期に組み合わせ、フレーム間の冗長性を活用してエッジ上でリアルタイムに単眼深度推定を行う手法を提案。
- DepthCache: 深度ガイドによる学習不要の視覚トークン統合でVLAモデル推論を高速化VLA/推論高速化2026/3/1
VLAモデルの推論遅延を減らすため、深度情報を構造的先行知識として使い、視覚トークンを領域ごとに異なる比率で統合する学習不要のフレームワークを提案。LIBEROベンチマークで最大1.28倍の高速化を達成し、成功率の低下は1%未満に抑えた。
- 不安全ステップペナルティとスパースLiDAR標高マッピングによる階段上の全方向ヒューマノイド歩行歩行2026/3/1
階段上の安全な全方向歩行を実現するため、密な不安全ステップペナルティとスパースLiDARによる標高マップ生成を組み合わせた単一ステージ訓練フレームワークを提案した。シミュレーションと実機で高い安全性と実環境での安定性を確認した。
- 脚式ロボットの動的動作のための3段階全身外乱抑制制御フレームワーク歩行2025/8/1
脚式ロボットの不確実性・外乱・故障に対処するため、移動ホライズン拡張状態オブザーバと3段階全身外乱抑制制御を組み合わせたフレームワークを提案し、シミュレーションと四脚ロボット実験で有効性を検証した。
- 歩容駆動型強化学習フレームワークによるヒューマノイドロボットの制御歩行2025/6/1
歩容計画と強化学習を組み合わせ、ヒューマノイドロボットの二足歩行を効率的に学習させるフレームワークを提案し、シミュレーションと実験で有効性を示した。
- 測地線長DMPに基づくロボット研削スキル学習マニピュレーション2025/4/1
測地線長を用いた動的運動プリミティブ(Geo-DMP)を提案し、位置・姿勢・力を同期してモデル化することで、ロボット研削スキルの高精度な学習と汎化を実現した。
- 脚式ロボットの外乱推定:動的ゲインによる事前規定収束脚式ロボット/外乱推定2025/3/1
脚式ロボットの外乱推定において、動的ゲインと比較関数を組み合わせることで、外乱の上界情報なしに推定誤差の収束を事前に規定できる連続時間オンラインオブザーバを提案した。
- MonoSLAM: 大域構造最適化によるロバスト単眼SLAMSLAM2025/3/1
点・線・消失点の特徴を統合し、大域プリミティブ構造情報を活用することで、低テクスチャ環境でも高精度に自己位置推定と地図構築を行う単眼SLAMシステムを提案した。
- 脚式ロボットの動的運動のための全身外乱抑制制御フレームワーク歩行2025/2/1
脚式ロボットが外部外乱やモデル不確かさに耐えるための全身制御フレームワークを提案し、二足・四足ロボットのシミュレーションと四足ロボットの実機実験で有効性を検証した。
- 剛性エンコーディングに基づく保守的力学系の生成運動計画2024/11/1
剛性と力学系の関係を定式化し、保守的剛性を埋め込むことで受動性が保証された力学系を学習する手法を提案した。
- 腹腔鏡手術における主意図予測のための手術活動文法の活用手術支援ロボティクス2024/9/1
手術手順の文法構造と視覚情報を組み合わせ、腹腔鏡映像から重要な手術意図を高精度に予測するフレームワークを提案した。
- Spiral Complete Coverage Path Planning Based on Conformal Slit Mapping in Multi-connected Domains2023/9/1
- An Active Sense and Avoid System for Flying Robots in Dynamic Environments2020/10/1
- Learning to Navigate from Simulation via Spatial and Semantic Information Synthesis with Noise Model Embedding2019/10/1