Jian Cheng
Institute of Automation, Chinese Academy of Sciences
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Mind-VLA: 指示認識型空間表現アライメントによる視覚言語行動モデルVLA2026/8/1
言語指示で指定された対象物体の3D幾何に焦点を当て、VLAモデルの表現をアライメントする手法を提案。LIBEROやCALVINで高精度を達成し、実ロボットの遮蔽タスクでも大幅な性能向上を示した。
- HAM-VLN: 階層的エージェント記憶を活用したゼロショット視覚言語ナビゲーションナビゲーション2026/7/1
ロボットが未知環境で指示に従って移動する際、画像や地図の代わりにエージェント自身が書き込む永続的な世界グラフを記憶として使い、次の行動選択と同じLLM呼び出しで記憶も更新することで、長期的なナビゲーションの記憶・推論ボトルネックを解消した。追加のLLM呼び出しなしで文脈長を65%以上削減しつつ、複数のナビゲーションベンチマークで最高性能を達成した。
- Uni-LaViRA: 言語・視覚・ロボット行動の翻訳による統合具現化ナビゲーションナビゲーション2026/5/1
ナビゲーションの意思決定構造を言語と視覚の行動出力に分解し、事前学習済みMLLMを活用してゼロショットで4つのタスクと4種類のロボットに適用する統合エージェントアーキテクチャを提案した。
- RoboNeuron: 身体性AIにおけるエージェント駆動型オーケストレーションのための中間層インフラVLA2025/12/1
LLMエージェントとロボットミドルウェア(ROS2)を接続する中間層を提案し、VLAバックエンドの変更をシステム再構築なしで可能にした。
- 身体性マニピュレーションのための効率的な視覚-言語-行動モデル:系統的サーベイVLA2025/10/1
視覚-言語-行動(VLA)モデルの計算・メモリ効率を改善する手法を、モデルアーキテクチャ、知覚特徴、行動生成、訓練・推論戦略の4次元で分類し、系統的にレビューしたサーベイ論文。
- クロスタスク方策ガイダンスによる効率的なマルチタスク強化学習マルチタスク強化学習2025/7/9
タスク間の類似性を活かし、習得済みタスクの方策が未習得タスクを明示的にガイドする枠組みを提案し、操作・歩行ベンチマークで性能を向上させた。
- 環境外乱下における海洋車両の操縦運動に対する物理-MLハイブリッドモデリングsim2real2024/11/1
不完全な物理モデルと特徴抽出付き残差ネットワークを組み合わせ、海流や波の周期的影響を考慮して船舶の操縦運動を高精度に長期予測する手法を提案した。
- 解釈可能な深層強化学習によるUCAVドッグファイトの機動決定強化学習/航空戦闘2024/7/1
UCAVのドッグファイトにおいて、深層強化学習で基本的な飛行機動を選択する階層型フレームワークを提案し、解釈性の向上と新戦術の創発を示した。
- We Choose to Go to Space: Agent-driven Human and Multi-Robot Collaboration in Microgravity2024/2/1
- Learning the policy for mixed electric platoon control of automated and human-driven vehicles at signalized intersection: a random search approach2022/6/1