Daniel Dijkman
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- セルフノート:メモリ依存操作タスクのためのスクラッチパッド拡張VLAVLA2026/2/1
言語スクラッチパッドをVLAに導入し、空間・時間メモリを付与することで、メモリ依存の長期的操作タスクの汎化性能を向上させた研究。
- Vision-Language-Actionモデルのためのハイブリッド訓練VLA2025/10/1
思考連鎖(CoT)を学習しつつ推論時には省略可能にするハイブリッド訓練(HyT)を提案し、ロボット操作の性能を保ちながら推論速度を改善した。
- コードから行動へ:拡散VLMポリシーの階層的学習VLA2025/9/1
コード生成VLMと低レベル拡散ポリシーを組み合わせ、タスクをサブルーチンに分解して模倣・汎化する階層的枠組みを提案。
- 重要なものに注目:視覚言語行動モデルのための物体・エージェント中心トークン化VLA2025/9/1
物体とエージェントに注目したトークン化で視覚トークン数を大幅に削減し、VLAモデルの学習を高速化・高性能化する手法を提案。
- ClevrSkills: ロボティクスにおける構成的言語・視覚推論VLA2024/11/1
ロボット操作タスクの構成的推論を評価するベンチマークClevrSkillsを提案し、視覚言語モデルが低レベル技能を組み合わせた高レベルタスクに失敗することを示した。
- 効率的なロボットマニピュレーションのための情報駆動型アフォーダンス発見マニピュレーション2024/5/1
環境との相互作用を情報理論的に評価し、アフォーダンスの発見を加速する手法IDAを提案。シミュレーションと実機でデータ効率を大幅に改善し、把持や積み重ね、引き出し開けなどのアフォーダンスを効率的に学習できることを示した。
- Information-driven Affordance Discovery for Efficient Robotic Manipulation2023/8/1