> ML_ARCHITECTURE // CLIP-CONTRASTIVE-DUAL-ENCODER_v1.0
Contrastive Dual-Encoder (CLIP / OpenCLIP / SigLIP)
Görüntüleri ve metinleri simetrik çapraz entropi karşıtsal kaybı ile eğitilmiş paylaşılan normalleştirilmiş gömme uzayına yansıtan ikili kodlayıcı mimarisi; görsel arama ve metin-görüntü koşullandırmasının temelidir.
Multimodal Foundation Modelsimagetext
Tüm Mimarilere DönMimari Özeti ve Temel Özellikler
Görüntüleri ve metinleri simetrik çapraz entropi karşıtsal kaybı ile eğitilmiş paylaşılan normalleştirilmiş gömme uzayına yansıtan ikili kodlayıcı mimarisi; görsel arama ve metin-görüntü koşullandırmasının temelidir.
Uygulayıcı Kütüphaneler
Temel Literatür (Seminal Papers)
Learning Transferable Visual Models From Natural Language Supervision (CLIP)Alec Radford, Jong Wook Kim (2021) · International Conference on Machine Learning (ICML)
Mimari Kısıtlar ve Sınırlamalar
- Verimli yürütme için uyumlu derin öğrenme çerçevesi ve donanım hızlandırıcısı gerektirir.
