Anran Zhang
収録論文 7本 ・ フィジカルAI/ロボット学習
GUIエージェントロボット学習マニピュレーションVLA触覚
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HyMobileAgent: データと環境の共スケーリングによる高効率GUIエージェントGUIエージェント2026/7/16
モバイルGUIエージェントの性能を、モデル規模だけでなくデータと環境の両方をスケールさせる枠組みで向上させた。合成データ生成、知識パイプライン、大規模アクションデータ、リセット可能な訓練環境、計画・反省機構を統合している。
- ロボットの自己改善:人間のビデオからの力学モデルを用いてロボット学習2026/6/1
人間のビデオから学習した行動・力学・価値表現をロボットに転移し、失敗状態を修正するDGAC法を提案。7つの実世界操作タスクで成功率を40%から81%に向上させ、ロボットの自己改善を実証した。
- Actron3D: 動画から操作可能な神経関数を学習し、転移可能なロボットマニピュレーションを実現マニピュレーション2025/10/1
未キャリブレーションの単眼RGB人間動画2〜3本から、物体中心の神経アフォーダンス関数を学習し、6自由度マニピュレーションスキルを転移させるフレームワーク。
- GOPLA: 人間の配置の合成拡張による汎化可能な物体配置学習マニピュレーション2025/10/1
人間の配置デモを合成データで拡張し、MLLMと拡散プランナを組み合わせて、意味的・幾何的制約を考慮した汎用的な物体配置を学習する階層的フレームワーク。
- VidBot: 野生の2D人間動画から汎化可能な3D行動を学習し、ゼロショットロボットマニピュレーションを実現VLA2025/3/1
インターネット上の一人称RGB動画から3Dハンド軌跡を抽出し、粗から細へのアフォーダンス学習と拡散モデルでロボットのゼロショット操作を可能にするフレームワークを提案。
- 触覚・形態スキル:エネルギーベース制御とデータ駆動学習の融合触覚2024/8/1
力とインピーダンスの統合制御にデータ駆動学習を組み合わせ、エネルギー推定で安全性を確保しつつ未知の形状や表面へスキルをゼロショット転移できる枠組みを提案した。
- 視覚拡張統合力-インピーダンス制御による未知の剛体3D曲面の視触覚探索触覚2024/8/1
視覚と触覚を統合した力-インピーダンス制御により、未知の3D曲面形状を安全に探索する手法を提案し、ロボット実験で有効性を示した。