Chuang Wang
AgiBot
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PRIMO: 人間動作追従に基づく事前情報活用型オドメトリ for ヒューマノイドロボット歩行2026/9/20
ヒューマノイドの自己受容感覚オドメトリにおいて、人間の動作をシミュレーションで追従させて訓練データを生成し、物理・対称性に基づく事前情報を組み込んだ推定器を提案。実機での誤差を大幅に削減した。
- OmniCalib:ヒューマノイドロボットのためのターゲット不要・タスク構造化自己校正自己校正2026/9/17
ロボット自身の動作と搭載センサのみを用い、腕・脚の関節ゼロ点やカメラ外部パラメータを校正ターゲットなしで推定する自己校正ワークフローを提案。
- HarnessVLN: エージェントハーネスによる訓練不要の具現化ナビゲーションの統合ナビゲーション2026/9/14
マルチモーダル大規模言語モデルを活用し、知覚・検証・回復・終了を統合ツールインターフェースで調整する訓練不要のゼロショット具現化ナビゲーション枠組みを提案し、複数ベンチマークで従来の訓練不要手法を上回った。
- 時間周波数幾何クロスアテンションによるチャンク型視覚言語行動モデルの改善VLA2026/9/9
行動チャンクを学習可能なウェーブレット変換で時間周波数トークンに分解し、内積とウェッジ積を融合したクロスアテンションで位相間の直交的な関係を捉える、VLAポリシー向けの追加モジュールを提案。
- 接触拘束に基づく人型ロボット下肢関節オフセット校正キャリブレーション2026/9/2
外部計測装置を使わず、内蔵エンコーダと骨盤IMUのみで、静的両足接地時の接触拘束を利用して下肢関節オフセットを校正する手法を提案。シミュレーションと実機で精度向上を確認した。
- FOCUS: 堅牢な人型プロプリオセプティブオドメトリのための足部観測信頼度歩行2026/9/2
二値の接触判定に頼らず、シミュレーションから学習した連続的な足部FK信頼度をEKFに統合し、人型ロボットのオドメトリ精度を向上させる手法を提案した。
- CoCoBench: 具現化マルチエージェントタスク計画のための協調調整ベンチマークマルチエージェント/ベンチマーク2026/8/28
マルチエージェントの協調失敗を細かく診断できるベンチマークCoCoBenchを提案し、897の検証済みインスタンスで4種類の協調構造を評価する。
- TemporalFlow-VLA: 物理的に基づいた実行履歴を学習する長期的ロボット操作VLA/操作2026/8/27
視覚言語行動モデルに物理的な時間的監督を導入し、多段階操作の実行履歴をコンパクトに学習する手法を提案。LIBEROやRoboTwinで高い成功率を達成し、長期的な操作で優位性を示した。
- V-Link: アクションDiTにおける失われた視覚表現の回復による視覚-言語-行動モデルの強化VLA2026/8/26
VLAモデルのアクション専門家が視覚特徴を十分に活用できない問題を解決するため、VLM内に空間・意味クエリを学習し、非対称経路でAction DiTに注入するV-Linkを提案。ベンチマークで成功率を大幅に向上させた。
- 多視点統一カメラ場:RGBのみの多カメラVLAポリシーのための幾何学的形状の行動指向表現VLA2026/8/1
多カメラ観測を利用するVLAモデルにおいて、視点間で一貫した行動指向の潜在場を形成する訓練時のみのフレームワークを提案し、深度復元と視点間対応を改善して操作成功率を大幅に向上させた。
- MANSION: 長期的タスクのための多階層言語から3Dシーン生成環境生成2026/3/1
建物全体の多階層3D環境を言語指示から生成するフレームワークを提案し、長期的なロボットタスクの評価基盤を提供する。
- WholeBodyVLA:全身移動操作のための統合潜在VLAVLA2025/12/1
低コストな自己視点動画から移動操作知識を学ぶ統合潜在VLAと、精密な移動指令を実行するRLポリシーを組み合わせ、ヒューマノイドの広域移動操作を実現した。
- 認知マニピュレーション:半構造環境での組立のための半教師あり視覚表現と教室から実機への強化学習マニピュレーション2024/6/1
スキルグラフで物体検出と微細操作を統合し、半教師あり学習と教室から実機への強化学習により、半構造環境でのギア組立を高精度に実現した。