> ML_LITERATUR_v1.0
Araştırma Literatürü Atlası
Temel istatistiksel öğrenmeden modern akıl yürüten LLM'lere (DeepSeek-R1, Llama 3) uzanan 253 doğrulanmış literatür kaydı: doğrulanmış DOI, arXiv bağlantıları ve orijinal iki dilli sentezler.
Improving Language Understanding by Generative Pre-Training (GPT-1)
Soldan sağa özbağlanımlı dil modellemesinin güçlü genel temsiller oluşturduğunu belirleyen öncü OpenAI raporu.
Language Models are Unsupervised Multitask Learners (GPT-2)
GPT-2 ve WebText'i tanıtan, dil modellerinin ölçekte doğal olarak genel çok görevli öğreniciler haline geldiğini gösteren ufuk açıcı OpenAI raporu.
Language Models are Few-Shot Learners (GPT-3)
175 milyar parametreli GPT-3'ün yüzlerce farklı görevde dikkate değer bağlam içi az vuruşlu performans sergilediğini gösteren anıtsal NeurIPS makalesi.
Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer
T5'i ve C4 külliyatını tanıtan, NLP genelinde transfer öğrenimini standartlaştıran 140 sayfalık titiz ampirik kıyaslama çalışması.
LLaMA: Open and Efficient Foundation Language Models
Trilyonlarca belirteçle eğitilen 7B-65B modellerin tüketici donanımında GPT-3 ile rekabet edebileceğini kanıtlayan tarihi Meta makalesi.
FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness
Herhangi bir matematiksel yaklaşım olmadan dikkati 2-4 kat hızlandıran ve bellek ayak izini 10 kat azaltan çığır açıcı G/Ç duyarlı sistem makalesi.
Efficient Memory Management for Large Language Model Serving with PagedAttention
Anahtar-değer önbelleklerinin sanal bellek sayfalaması yoluyla LLM sunumundaki GPU bellek darboğazını çözen dönüm noktası niteliğinde SOSP sistem makalesi.
Training language models to follow instructions with human feedback
Hizalanmış 1.3B InstructGPT modelinin insanlar tarafından hizalanmamış 175B GPT-3'e tercih edildiğini göstererek konuşma yapay zekasını başlatan makale.
Training Compute-Optimal Large Language Models (Chinchilla)
Mevcut büyük modellerin ciddi şekilde eksik eğitildiğini ve parametrelerin ve belirteçlerin eşit ölçeklenmesinin hesaplama açısından optimal olduğunu kanıtlayan çalışma.
Very Deep Convolutional Networks for Large-Scale Image Recognition (VGG)
3x3 konvolüsyonların basit derin yığınlarının karmaşık filtrelere üstün geldiğini kanıtlayan VGG mimarisini kuran etkili ICLR makalesi.
Going Deeper with Convolutions (GoogLeNet / Inception)
AlexNet'e kıyasla 12 kat daha az parametreyle yüksek doğruluk elde eden çok ölçekli Inception modülünü sunan ödüllü CVPR 2015 mimarisi.
MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications
Uç ve akıllı telefon dağıtımı için derinlemesine ayrılabilir konvolüsyonları popülerleştiren MobileNets'i tanıtan temel mobil görüntü işleme makalesi.
EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks
Derinlik, genişlik ve çözünürlüğün bileşik ölçeklenmesinin mevcut CNN'leri 8 kat aşan EfficientNet modelleri ürettiğini gösteren ödüllü ICML makalesi.
You Only Look Once: Unified, Real-Time Object Detection (YOLO)
Standart GPU'larda saniyede 45 kare hızında çalışan ve bilgisayarlı görüyü dönüştüren gerçek zamanlı nesne tespiti paradigmasını oluşturan tarihi makale.
An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale (ViT)
Konvolüsyonel katmanları olmayan saf Transformer mimarilerinin ölçekte son teknoloji görsel sonuçlar elde ettiğini kanıtlayan devrim niteliğinde ICLR makalesi.
Swin Transformer: Hierarchical Vision Transformer using Shifted Windows
Kaydırılmış pencereli hiyerarşik işleme yoluyla vision transformer'larda doğrusal karmaşıklık elde eden Marr Ödüllü Swin Transformer makalesi.
Learning Transferable Visual Models From Natural Language Supervision (CLIP)
Hangi açıklamanın hangi görüntüyle eşleştiğini tahmin ederek sıfır eğitim örneğiyle ResNet-50 ImageNet doğruluğunu yakalayan çığır açıcı OpenAI makalesi.
Auto-Encoding Variational Bayes (VAE)
Stokastik gizil düğümler üzerinden geriye yayılıma izin veren yeniden parametreleme hilesini kuran Varyasyonel Otomatik Kodlayıcıları tanıtan temel ICLR makalesi.
