Hong Li
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション触覚/ロボット学習模倣学習模倣学習/データ収集ヒューマノイド/移動操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PhysBrain 1.5:視覚言語モデルから物理基盤モデルへVLA2026/9/14
人間のインタラクション動画から身体動作を学習し、行動生成と未来状態予測を統合した8Bの物理基盤モデルを構築、28の身体理解ベンチマークでオープンソース最高性能を達成した。
- 物理カーネル:暗所マニピュレーションのための構造化視覚潜在表現マニピュレーション2026/9/4
短時間の照明下での書き込みで視覚潜在z0を符号化し、その後は画素入力なしで方策と開ループ動力学が接触の多いスキルを実行できることを示した研究。
- AetheRock: 力誘導型視覚触覚学習のための腕装着型ロボット教示システム触覚/ロボット学習2026/6/1
腕に装着する触覚・力覚センサ付きデバイスと、力と視覚で触覚学習を誘導するフレームワークを提案し、接触を伴う操作タスクのデータ収集と学習効率を向上させた。
- ヒューマン・アズ・ヒューマノイド:人間に合わせた身体を持つエゴ・エクソ人間ビデオからのゼロショット人型ロボット学習模倣学習2026/6/1
人間のデモ動画を高自由度ヒューマノイドのVLA学習に使えるように、身体・センシング・行動ラベルを揃えるフレームワークを提案し、実機で検証した。
- EgoGuide: 効率的なロボット不要のデモ収集と学習のための自己中心視点ガイド模倣学習/データ収集2026/6/1
手首と頭部の自己中心視点を同期記録し、オンラインの視覚・幾何学的品質ガイドを提供するデモ収集インターフェースを提案。さらに、視点変動に頑健なゲート付き自己中心残差ポリシーを導入し、データ効率と遮蔽耐性を向上させた。
- Cybo-Waiter: ヒューマノイド全身移動操作のための物理エージェントフレームワークヒューマノイド/移動操作2026/3/1
VLMプランを検証可能なタスクプログラムに変換し、3D幾何学的監視でループを閉じるヒューマノイドエージェントフレームワークを提案。移動と操作を統合し、長期的なタスク実行の堅牢性を向上させる。
- Research on Event Accumulator Settings for Event-Based SLAM2021/12/1