Teli Ma
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MotionWAM: 実時間ヒューマノイド移動操作のための基盤ワールドアクションモデルヒューマノイド/移動操作2026/6/1
本論文は、ビデオワールドモデルの中間特徴を利用して、単一の行動空間で全身動作を予測する実時間ヒューマノイド移動操作モデルMotionWAMを提案し、実機で高い成功率を達成した。
- 知覚行動基盤モデル:人間の動作プリエントをロボット中心の地形に適応させるヒューマノイド制御2026/6/1
人間の動作データを基盤としたヒューマノイド制御モデルを、ロボットの周囲地形に適応させるフレームワークを提案。地形に合わせた参照動作を合成し、教師-学生学習で実ロボットに展開する。
- DiT4DiT: ビデオダイナミクスと行動の統合モデリングによる汎用ロボット制御VLA2026/3/1
ビデオ生成と行動予測を統合したエンドツーエンドのVideo-Actionモデルを提案し、シミュレーションと実機で高い成功率とサンプル効率を達成した。
- 生LiDAR点群から直接制御する人型ロボットの安全で快適な歩行ポリシー歩行2025/8/1
生のLiDAR点群を直接モータ指令に変換するエンドツーエンド歩行ポリシーを提案し、制約付きMDPと制御バリア関数を組み合わせて安全性を保証、快適性報酬で人間に配慮した動きを実現、実機へ転移した。
- GLOVER++:人間の行動からアフォーダンス学習を解き放ちロボットマニピュレーションへマニピュレーション2025/5/1
50万枚のアフォーダンス注釈付き大規模データセットHOVA-500Kを構築し、人間のデモからロボット操作へアフォーダンス知識を転移するグローバル・トゥ・ローカル学習フレームワークGLOVER++を提案した。
- 全方位知覚:動的環境における脚式移動のための全方向衝突回避歩行2025/5/1
生のLiDAR点群を直接処理して3D空間認識と全方向衝突回避を実現する脚式ロボットのエンドツーエンド移動ポリシーを提案し、高忠実度LiDARシミュレータで訓練して実環境でも検証した。
- 未見タスクへの汎化に挑む視覚-言語-行動マニピュレーションの限界探索VLA2025/5/1
VLAモデルのクロスタスク汎化を評価する新ベンチマークAGNOSTOSを提案し、文脈内デモンストレーションで未見タスクの行動を予測するX-ICM手法を導入した。
- GLOVER: タスク指向把持のための汎用オープン語彙アフォーダンス推論マニピュレーション2024/11/1
大規模言語モデルを微調整してRGB画像から把持可能な部位のアフォーダンスを推論し、実世界で高速・高精度にタスク指向把持を実現するフレームワークを提案。
- ロボット操作のための視覚事前学習における人間-ロボットドメインギャップの緩和マニピュレーション2024/6/1
人間とロボットのペア動画を用いたコントラスティブ学習で、人間の活動データで事前学習した視覚モデルをロボット領域に適応させ、操作タスクの成功率を向上させた研究。
- 言語指示に基づくマルチタスクロボット操作のための対照的模倣学習模倣学習2024/6/1
言語指示と視覚観察から多様な操作タスクを実行するエンドツーエンド模倣学習エージェントSigma-Agentを提案し、対照的学習とマルチビューTransformerで性能を向上させた。