Hyemin Ahn
収録論文 11本 ・ フィジカルAI/ロボット学習
VLA/圧縮マニピュレーションモーションリターゲティング強化学習タスク計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚言語行動モデルのための学習型画像圧縮VLA/圧縮2026/6/15
VLAロボットの制御性能を保ちつつ帯域を節約するため、カメラ視点や空間領域ごとの重要度に応じてビットレートを適応配分する学習型画像圧縮フレームワークSPARCを提案した。
- 整頓スコア誘導モンテカルロ木探索による視覚的卓上整理マニピュレーション2025/2/1
RGB-Dカメラのみを用い、整頓度を評価する識別器とモンテカルロ木探索を組み合わせて、目標配置を明示せずに卓上の物体を整理する枠組みを提案し、シミュレーションで収集したTTUデータセットを公開した。
- 人体事前知識を活用したモーションリターゲティングのためのデータペアリング再定義モーションリターゲティング2024/9/1
ランダムなロボット姿勢を人体事前知識でフィルタリングして人間姿勢に変換し、高品質なペアデータを収集する手法と、それで学習する2段階モーションリターゲティングネットワークを提案。
- 踊るなら音楽と共に:非ヒューマノイドのためのダンス生成フレームワーク強化学習2024/5/1
人間のダンス動画から光学フローと音楽の関係を報酬モデルとして学習し、強化学習によって非ヒューマノイドエージェントが音楽に合わせて踊る動作を生成するフレームワークを提案した。
- 推論はLLMだけのものか?タスク計画における小型言語モデルの可能性タスク計画2024/4/1
LLMで生成した高レベル命令と低レベル行動ステップのデータセットCOSTを作成し、小型言語モデルGPT2をファインチューニングすると、特定ドメインのタスク計画でGPT3.5に匹敵する性能を示すことを明らかにした。
- A Unified Masked Autoencoder with Patchified Skeletons for Motion Synthesis2023/8/1
- Self-Supervised Motion Retargeting with Safety Guarantee2021/3/1
- Visually Grounding Language Instruction for History-Dependent Manipulation2020/12/1
- Generative Autoregressive Networks for 3D Dancing Move Synthesis from Music2019/11/1
- Interactive Text2Pickup Network for Natural Language based Human-Robot Collaboration2018/5/1
- Text2Action: Generative Adversarial Synthesis from Language to Action2017/10/1