Haonan Duan
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAタスクスケジューリングマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OC-VLA++: 単眼幾何ガイドによるクロスビュー一貫性を用いた視点ロバストなロボット操作VLA2026/8/1
カメラ座標系での行動接地に加え、幾何学的に関連する視点ペアからの教師信号とクロスビュー行動等変性を導入し、限られたカメラ視点での未見視点への汎化性能を向上させた。
- 建設ロボットのタスクスケジューリングのためのハイブリッドLLMベース知的フレームワークタスクスケジューリング2026/5/1
大規模言語モデル(LLM)を用いて建設ロボットのタスクスケジューリングを最適化する知的フレームワークを提案。2つのLLMエージェント(生成と監督)を併用し、時間効率と資源利用のバランスを図る。
- ScaleADFG: スケーラブルなデータセットによるアフォーダンスベースの巧みな機能把持マニピュレーション2025/11/1
ロボットの大きな手でも日常物体を機能的に把持できるよう、アフォーダンスに基づく自動データセット構築と軽量な把持生成ネットワークを提案した研究。
- カメラ空間で行動を接地する観測中心の視覚-言語-行動ポリシーVLA2025/8/1
ロボットの手先姿勢をロボット基準座標系ではなくカメラ座標系で予測するOC-VLAを提案し、視点変化への汎化とタスク成功率を改善した。
- 視覚的身体脳:マルチモーダル大規模言語モデルに空間での知覚・思考・制御をVLA2025/6/1
マルチモーダルLLMをロボット制御に統合するVeBrainを提案し、テキストベースの制御信号を実機の動作ポリシーに変換するアダプタと大規模指示データセットで脚ロボットやアームの適応的な操作を実現した。
- Dita: 汎用視覚言語行動ポリシーのための拡散TransformerのスケーリングVLA2025/3/1
Transformerで連続行動列を直接ノイズ除去するマルチモーダル拡散フレームワークを提案し、多様なロボットデータを統合して長期的タスクや実環境適応を実現した。
- Progressive Transfer Learning for Dexterous In-Hand Manipulation with Multi-Fingered Anthropomorphic Hand2023/4/1