← all repositories

JindongGu/Awesome-Prompting-on-Vision-Language-Model

A survey paper and organized paper list covering prompt engineering techniques across three types of vision-language foundation models.

Awesome-Prompting-on-Vision-Language-Model
Not currently ranked — collecting fresh signals.
star history

This repository provides a comprehensive survey of prompt engineering research on vision-language models. It catalogs papers across three VLM categories: multimodal-to-text generation models (e.g., Flamingo), image-text matching models (e.g., CLIP), and text-to-image generation models (e.g., Stable Diffusion). The content is organized by topic and serves as a reference resource for researchers studying VLMs and prompting techniques.

Frequently asked

What is JindongGu/Awesome-Prompting-on-Vision-Language-Model?
A survey paper and organized paper list covering prompt engineering techniques across three types of vision-language foundation models.
Is Awesome-Prompting-on-Vision-Language-Model open source?
Yes — JindongGu/Awesome-Prompting-on-Vision-Language-Model is an open-source project tracked on heatdrop.
How popular is Awesome-Prompting-on-Vision-Language-Model?
JindongGu/Awesome-Prompting-on-Vision-Language-Model has 513 stars on GitHub.
Where can I find Awesome-Prompting-on-Vision-Language-Model?
JindongGu/Awesome-Prompting-on-Vision-Language-Model is on GitHub at https://github.com/JindongGu/Awesome-Prompting-on-Vision-Language-Model.

heatdrop uses Google Analytics to see which pages get read — nothing else. Your call. How we handle data.