Andrew Melnik
収録論文 15本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- QueST: 長期追跡におけるドリフト抑制のためのセマンティックモニタとしての永続クエリトラッキング2026/5/1
ビデオ内の点追跡をフレーム間対応ではなく、永続的なセマンティッククエリとして扱うことで、長期間の追跡で生じるドリフトを抑制する新しいフレームワークを提案した。
- LLMによる将来仮説の生成を用いた多段階ロボット操作における地平線認識探索操作2026/5/1
多段階ロボット操作において、LLMとビデオ拡散モデルを用いて短期的な未来ビデオを生成し、それを条件としてポリシーを学習することで、探索と適応を改善する手法を提案した。
- GRIM: 生成例を条件としたタスク指向把持マニピュレーション2025/6/1
動画生成モデルと検索・位置合わせ・転移パイプラインを組み合わせ、学習なしでタスクに適した把持を選ぶフレームワークGRIMを提案。
- 意味的デジタルツインによる言語モデルのロボット計画への接地VLA2025/6/1
意味的デジタルツインと大規模言語モデルを組み合わせ、自然言語指示を環境情報に基づいて行動計画に変換し、失敗時には再計画を行うロボットタスク実行フレームワークを提案した。
- STEVE-Audio: Minecraftエージェントの目標条件付けモダリティの拡張VLA2024/12/1
MinecraftエージェントSTEVE-1に音声を目標条件として与えられるよう拡張し、音声から潜在目標空間へのマッピングを学習した研究。
- SplatR: 3Dガウシアンスプラッティングと密特徴マッチングによる経験目標視覚再配置マニピュレーション2024/11/1
3Dガウシアンスプラッティングで目標状態を表現し、基盤モデルの密特徴マッチングで現在と目標の画像を比較することで、物体の再配置タスクを高精度に実現するフレームワークを提案。
- 3Dガウシアンスプラッティングを用いたデモンストレーションにおける物体と接触点の追跡模倣学習2024/11/1
動画デモから接触点と物体の動きを抽出し、3DガウシアンスプラッティングとFoundationPoseで追跡することで、対話型模倣学習を強化する手法を提案した。
- 家庭内でのオープンワールド移動マニピュレーションに向けて:NeurIPS 2023 HomeRobotオープン語彙移動マニピュレーションチャレンジからの教訓移動マニピュレーション2024/7/1
家庭環境で任意の物体を見つけて任意の場所に置くオープン語彙移動マニピュレーションのベンチマークを提案し、NeurIPS 2023コンペを実施。シミュレーションと実世界で評価し、成功チームに共通するエラー検出・回復と知覚・意思決定の統合の重要性を示した。
- 生成AIモデルによる物体目標ナビゲーションのための認知プランニングナビゲーション2024/4/1
LLMとLVLMを活用し、3Dモジュール式シーン表現を動的に刈り込むことで、未知環境での物体探索を効率化するナビゲーション手法を提案した。
- 自然言語をポリシーとして:LLMによる座標レベル身体制御のための推論VLA2024/3/1
タスクとシーンのテキスト記述からLLMが自然言語推論で座標レベルの制御コマンドを直接出力し、中間コードなしでロボットタスク計画を行う手法を提案・評価した。
- Language-Conditioned Semantic Search-Based Policy for Robotic Manipulation Tasks2023/12/1
- UniTeam: Open Vocabulary Mobile Manipulation Challenge2023/12/1
- Contrastive Language, Action, and State Pre-training for Robot Learning2023/4/1
- Towards robust and domain agnostic reinforcement learning competitions2021/6/1
- Solving Physics Puzzles by Reasoning about Paths2020/11/1