Na Li
収録論文 14本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RLE-Bench:ロボット学習エンジニアとしてのコーディングエージェントの適性試験ベンチマーク2026/9/28
コーディングエージェントのロボット開発能力を評価するため、制御・方策学習・知覚・機械設計の4ワークフローにまたがるベンチマークRLE-Benchを提案し、RLE指数で能力を比較した。
- 物理的インタラクションの学習:触覚・力覚を考慮したロボット学習のサーベイ触覚・力覚学習2026/8/1
触覚・力覚センシングを統合したロボット学習手法を、マルチモーダルかつ多段階のシステム設計の観点から統一的な分類学TF-ARTを用いて整理し、今後の研究課題を考察したサーベイ論文。
- ゼロショットSim-to-Real転送を備えたマルチタスクブロック押し操作のための単一拡散ポリシーコントローラ操作学習/強化学習/Sim-to-Real2026/7/1
強化学習を用いて、複数の形状のブロックを押すマルチタスク操作を単一の拡散ポリシーで学習し、実世界へゼロショット転送できることを示した論文。
- VLESA: 人間活動監視のための視覚言語身体化安全エージェント安全性/行動予測2026/6/2
一人称視点映像から人間の活動を監視し、危険な行動を予測してリアルタイムに安全介入を行うフレームワークを提案。意図に応じて安全性が変わる行動を扱うため、目標条件付き安全Qフィルタを導入した。
- 適応学習:表現ベース強化学習によるマルチタスクスキル転移強化学習2026/6/1
スペクトルMDP分解を用いてタスク非依存のコアとタスク固有の調整に価値関数を構造化し、マルチタスク強化学習の効率的な知識共有と新タスクへの転移を実現するフレームワークRepMT-SACを提案した。
- モデルベース拡散サンプリングによるオフライン意思決定の予測制御拡散モデル/予測制御2025/12/1
拡散プランナと動力学拡散モデルを組み合わせ、サンプリング中に両者を交互更新することで、タスク意図を保ちつつ動的に実現可能な軌道を生成するMPDiffuserを提案。オフライン制御ベンチマークと実機四足ロボットで有効性を示した。
- 任意のデモンストレーションによるオフライン模倣学習:ダイナミクス表現の事前学習模倣学習2025/8/1
遷移ダイナミクスの分解からダイナミクス表現を事前学習し、限られた専門家データでもオフライン模倣学習を高精度化する手法を提案。非専門家データを再利用でき、MuJoCoや実機四足歩行で少数デモからの学習を実現。
- マルチステップ予測によるモデルベース模倣学習模倣学習2025/4/1
モデル予測制御に着想を得て、多段階の状態予測を取り入れたモデルベース模倣学習を提案し、分布シフトやノイズに頑健であることを示した。
- 拡散ポリシーのための効率的なオンライン強化学習強化学習2025/2/1
拡散ポリシーをオンライン強化学習で効率的に学習するため、損失関数を再重み付けしたReweighted Score Matchingを提案し、DPMDとSDACの2アルゴリズムを開発した。
- 肝臓フォローアップ診断のための自律型ロボット超音波システム:ファントムによるパイロット研究医療ロボティクス2024/5/1
CT画像と3D超音波の位置合わせおよび深層学習セグメンテーションを用いて、肝臓のフォローアップ超音波検査を自律的に行うロボットシステムを提案し、ファントム実験でその有効性を確認した。
- 表現学習によるSim-to-Realスキル転移と発見sim2real2024/4/1
MDPのスペクトル分解に基づくスキル表現をシミュレータから実機へ転移し、実世界データから新スキルを発見して性能を最大30.2%改善する手法を提案。
- MPC-Inspired Reinforcement Learning for Verifiable Model-Free Control2023/12/1
- Distributed Information-based Source Seeking2022/9/1
- Transferring Studies Across Embodiments: A Case Study in Confusion Detection2022/6/1