Also known as: CLIP (Contrastive Language-Image Pretraining) · CLIP · Contrastive Language-Image Pretraining · Contrastive Language Image Pretraining (CLIP)
CLIP, или Contrastive Language-Image Pretraining, — модельный подход, изучающий связи между изображениями и описаниями на естественном языке. Он обеспечивает такие задачи, как сопоставление изображений и текста, zero-shot классификация изображений и мультимодальный retrieval.