Komei Sugiura
収録論文 35本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Flow as Flow: Modeling Robot Velocity Fields as Probability Velocity Fields for Flow-Based Object Manipulation2026/6/1
- HiFlow: Tokenization-Free Scale-Wise Autoregressive Policy Learning via Flow Matching2026/3/1
- LILAC: Language-Conditioned Object-Centric Optical Flow for Open-Loop Trajectory Generation2026/3/1
- AnoleVLA: Lightweight Vision-Language-Action Model with Deep State Space Models for Mobile Manipulation2026/3/1
- Affordance RAG: Hierarchical Multimodal Retrieval with Affordance-Aware Embodied Memory for Mobile Manipulation2025/12/1
- Pre-Manipulation Alignment Prediction with Parallel Deep State-Space and Transformer Models2025/9/1
- GENNAV: Polygon Mask Generation for Generalized Referring Navigable Regions2025/8/1
- Mobile Manipulation Instruction Generation from Multiple Images with Automatic Metric Enhancement2025/1/1
- Future Success Prediction in Open-Vocabulary Object Manipulation Tasks Based on End-Effector Trajectories2024/12/1
- Open-Vocabulary Mobile Manipulation Based on Double Relaxed Contrastive Learning with Dense Labeling2024/12/1
- Task Success Prediction for Open-Vocabulary Manipulation Based on Multi-Level Aligned Representations2024/10/1
- DM2RM: Dual-Mode Multimodal Ranking for Target Objects and Receptacles Based on Open-Vocabulary Instructions2024/8/1
- Object Segmentation from Open-Vocabulary Manipulation Instructions Based on Optimal Transport Polygon Matching with Multimodal Foundation Models2024/7/1
- Nearest Neighbor Future Captioning: Generating Descriptions for Possible Collisions in Object Placement Tasks2024/7/1
- Co-Scale Cross-Attentional Transformer for Rearrangement Target Detection2024/7/1
- Learning-To-Rank Approach for Identifying Everyday Objects Using a Physical-World Search Engine2023/12/1
- DialMAT: Dialogue-Enabled Transformer with Moment-Based Adversarial Training2023/11/1
- Fully Automated Task Management for Generation, Execution, and Evaluation: A Framework for Fetch-and-Carry Tasks with Natural Language Instructions in Continuous Space2023/11/1
- Multimodal Diffusion Segmentation Model for Object Segmentation from Manipulation Instructions2023/7/1
- Switching Head-Tail Funnel UNITER for Dual Referring Expression Comprehension with Fetch-and-Carry Tasks2023/7/1
- Prototypical Contrastive Transfer Learning for Multimodal Language Understanding2023/7/1
- Visual Explanation of Deep Q-Network for Robot Navigation by Fine-tuning Attention Branch2022/8/1
- Relational Future Captioning Model for Explaining Likely Collisions in Daily Tasks2022/7/1
- Moment-based Adversarial Training for Embodied Language Comprehension2022/4/1
- Target-dependent UNITER: A Transformer-Based Multimodal Language Comprehension Model for Domestic Service Robots2021/7/1
- Case Relation Transformer: A Crossmodal Language Generation Model for Fetching Instructions2021/7/1
- CrossMap Transformer: A Crossmodal Masked Path Transformer Using Double Back-Translation for Vision-and-Language Navigation2021/3/1
- Predicting and Attending to Damaging Collisions for Placing Everyday Objects in Photo-Realistic Simulations2021/2/1
- Alleviating the Burden of Labeling: Sentence Generation by Attention Branch Encoder-Decoder Network2020/7/1
- A Multimodal Target-Source Classifier with Attention Branches to Understand Ambiguous Instructions for Fetching Daily Objects2019/12/1
- Multimodal Attention Branch Network for Perspective-Free Sentence Generation2019/9/1
- Understanding Natural Language Instructions for Fetching Daily Objects Using GAN-Based Multimodal Target-Source Classification2019/6/1
- A Multimodal Classifier Generative Adversarial Network for Carry and Place Tasks from Ambiguous Language Instructions2018/6/1
- SuMo-SS: Submodular Optimization Sensor Scattering for Deploying Sensor Networks by Drones2018/6/1
- Grounded Language Understanding for Manipulation Instructions Using GAN-Based Classification2018/1/1