VAP

Official implementation of "Bring My Cup! Personalizing Vision-Language-Action Models with Visual Attentive Prompting" — a training-free method that enables frozen VLAs to manipulate user-specific objects among visually similar distractors.

// repository documentation