Yaran Chen
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HAM-VLN: 階層的エージェント記憶を活用したゼロショット視覚言語ナビゲーションナビゲーション2026/7/1
ロボットが未知環境で指示に従って移動する際、画像や地図の代わりにエージェント自身が書き込む永続的な世界グラフを記憶として使い、次の行動選択と同じLLM呼び出しで記憶も更新することで、長期的なナビゲーションの記憶・推論ボトルネックを解消した。追加のLLM呼び出しなしで文脈長を65%以上削減しつつ、複数のナビゲーションベンチマークで最高性能を達成した。
- 力覚対応残差DAggerと軌道編集によるインピーダンス制御下の精密挿入模倣学習2026/3/1
接触を伴う精密挿入タスクのための、力覚を考慮した人間参加型模倣学習フレームワークを提案。軌道編集による残差方策学習と力の不一致に基づく介入トリガーで、共変量シフトを抑えつつ専門家の常時監視を不要にした。
- TempoFit: 長期的視覚言語行動操作のためのプラグアンドプレイ層別時間KVメモリVLA/長期操作2026/3/1
事前学習済みの視覚言語行動(VLA)ポリシーに、追加学習なしで時間的記憶を注入するTempoFitを提案。層ごとのKVキャッシュと再帰バイアスにより、長期的な操作タスクの成功率を向上させる。
- RoboGPT-R1:強化学習によるロボットタスクプランニングの強化VLA2025/10/1
視覚言語モデルを教師あり微調整と強化学習の2段階で訓練し、長期的な操作タスクの計画能力を高める手法を提案。小型モデルながら大規模モデルを上回る性能を達成。
- ロボットSim2Realチャレンジにおける長期的ピックアンドプレースのためのSim-to-Real転移sim2real2025/3/1
軽量なノイズ耐性視覚認識と非線形性に頑健なサーボ系を組み合わせ、アルゴリズム変更なしでシミュレーションから実機への転移を実現し、ICRA 2024のRobotic Sim2Real Challengeで優勝した。
- GAPartManip:材質に依存しない関節物体操作のための大規模パーツ中心データセットマニピュレーション2024/11/1
透明な蓋や反射する取っ手など深度知覚が難しい家庭内の関節物体を操作するため、材質ランダム化とパーツ単位の操作姿勢注釈を備えた大規模データセットを構築し、頑健な操作を可能にするモジュール型フレームワークを提案した。
- PlanAgent: マルチモーダル大規模言語モデルによる閉ループ車両運動計画自動運転計画2024/6/1
マルチモーダルLLMを認知エージェントとして用い、BEV地図とテキスト記述から階層的推論でプランナコードを生成し、反省モジュールで評価する閉ループ車両運動計画システムを提案。nuPlanで評価。
- LLMによる物体親和性転移で物体ゴールナビゲーションを進化させるナビゲーション2024/3/1
LLMから得た意味知識と学習ベースの物体親和性を動的に融合し、未知環境での物体ゴールナビゲーションの汎化性能を高めるフレームワークLOATを提案した。
- RoboGPT: an intelligent agent of making embodied long-term decisions for daily instruction tasks2023/11/1
- ComSD: Balancing Behavioral Quality and Diversity in Unsupervised Skill Discovery2023/9/1
- Cross-domain Random Pre-training with Prototypes for Reinforcement Learning2023/2/11
- NeuronsGym: A Hybrid Framework and Benchmark for Robot Tasks with Sim2Real Policy Learning2023/2/1
- Lane Change Decision-making through Deep Reinforcement Learning with Rule-based Constraints2019/4/1