Skip to main content

> ML_LITERATUR_v1.0

Araştırma Literatürü Atlası

Temel istatistiksel öğrenmeden modern akıl yürüten LLM'lere (DeepSeek-R1, Llama 3) uzanan 253 doğrulanmış literatür kaydı: doğrulanmış DOI, arXiv bağlantıları ve orijinal iki dilli sentezler.

Toplam 253 Doğrulanmış Kayıt (Sayfa 3 / 15)Doğrulanmış Akademik Kanıtlar
Literatür Kaydı
2018 · OpenAIseminal-architecture

Improving Language Understanding by Generative Pre-Training (GPT-1)

Soldan sağa özbağlanımlı dil modellemesinin güçlü genel temsiller oluşturduğunu belirleyen öncü OpenAI raporu.

text generationtext classification
Literatür Kaydı
2019 · OpenAIseminal-architecture

Language Models are Unsupervised Multitask Learners (GPT-2)

GPT-2 ve WebText'i tanıtan, dil modellerinin ölçekte doğal olarak genel çok görevli öğreniciler haline geldiğini gösteren ufuk açıcı OpenAI raporu.

text generationzero shot classification
Literatür Kaydı
2020 · Advancesseminal-architecture

Language Models are Few-Shot Learners (GPT-3)

175 milyar parametreli GPT-3'ün yüzlerce farklı görevde dikkate değer bağlam içi az vuruşlu performans sergilediğini gösteren anıtsal NeurIPS makalesi.

text generationin context learningcode generation
Literatür Kaydı
2020 · Journalseminal-architecture

Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer

T5'i ve C4 külliyatını tanıtan, NLP genelinde transfer öğrenimini standartlaştıran 140 sayfalık titiz ampirik kıyaslama çalışması.

text to textsummarizationmachine translation
Literatür Kaydı
2023 · arXivseminal-architecture

LLaMA: Open and Efficient Foundation Language Models

Trilyonlarca belirteçle eğitilen 7B-65B modellerin tüketici donanımında GPT-3 ile rekabet edebileceğini kanıtlayan tarihi Meta makalesi.

text generationcode generation
Literatür Kaydı
2022 · Advanceshardware-compiler

FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness

Herhangi bir matematiksel yaklaşım olmadan dikkati 2-4 kat hızlandıran ve bellek ayak izini 10 kat azaltan çığır açıcı G/Ç duyarlı sistem makalesi.

text generationlong context inference
Literatür Kaydı
2023 · ACMsystems

Efficient Memory Management for Large Language Model Serving with PagedAttention

Anahtar-değer önbelleklerinin sanal bellek sayfalaması yoluyla LLM sunumundaki GPU bellek darboğazını çözen dönüm noktası niteliğinde SOSP sistem makalesi.

llm servingtext generation
Literatür Kaydı
2022 · Advancessafety-fairness

Training language models to follow instructions with human feedback

Hizalanmış 1.3B InstructGPT modelinin insanlar tarafından hizalanmamış 175B GPT-3'e tercih edildiğini göstererek konuşma yapay zekasını başlatan makale.

llm alignment rlhftext generation
Literatür Kaydı
2022 · Advancesfoundational

Training Compute-Optimal Large Language Models (Chinchilla)

Mevcut büyük modellerin ciddi şekilde eksik eğitildiğini ve parametrelerin ve belirteçlerin eşit ölçeklenmesinin hesaplama açısından optimal olduğunu kanıtlayan çalışma.

text generation
Literatür Kaydı
2014 · Internationalseminal-architecture

Very Deep Convolutional Networks for Large-Scale Image Recognition (VGG)

3x3 konvolüsyonların basit derin yığınlarının karmaşık filtrelere üstün geldiğini kanıtlayan VGG mimarisini kuran etkili ICLR makalesi.

image classificationfeature extractionneural style transfer
Literatür Kaydı
2015 · IEEEseminal-architecture

Going Deeper with Convolutions (GoogLeNet / Inception)

AlexNet'e kıyasla 12 kat daha az parametreyle yüksek doğruluk elde eden çok ölçekli Inception modülünü sunan ödüllü CVPR 2015 mimarisi.

image classificationobject detection
Literatür Kaydı
2017 · arXivseminal-architecture

MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications

Uç ve akıllı telefon dağıtımı için derinlemesine ayrılabilir konvolüsyonları popülerleştiren MobileNets'i tanıtan temel mobil görüntü işleme makalesi.

image classificationedge mobile inference
Literatür Kaydı
2019 · Internationalseminal-architecture

EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks

Derinlik, genişlik ve çözünürlüğün bileşik ölçeklenmesinin mevcut CNN'leri 8 kat aşan EfficientNet modelleri ürettiğini gösteren ödüllü ICML makalesi.

image classificationobject detection
Literatür Kaydı
2016 · IEEEseminal-architecture

You Only Look Once: Unified, Real-Time Object Detection (YOLO)

Standart GPU'larda saniyede 45 kare hızında çalışan ve bilgisayarlı görüyü dönüştüren gerçek zamanlı nesne tespiti paradigmasını oluşturan tarihi makale.

object detectionedge mobile inference
Literatür Kaydı
2020 · Internationalseminal-architecture

An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale (ViT)

Konvolüsyonel katmanları olmayan saf Transformer mimarilerinin ölçekte son teknoloji görsel sonuçlar elde ettiğini kanıtlayan devrim niteliğinde ICLR makalesi.

image classificationfeature extraction
Literatür Kaydı
2021 · IEEEseminal-architecture

Swin Transformer: Hierarchical Vision Transformer using Shifted Windows

Kaydırılmış pencereli hiyerarşik işleme yoluyla vision transformer'larda doğrusal karmaşıklık elde eden Marr Ödüllü Swin Transformer makalesi.

image classificationobject detectionimage segmentation
Literatür Kaydı
2021 · Internationalseminal-architecture

Learning Transferable Visual Models From Natural Language Supervision (CLIP)

Hangi açıklamanın hangi görüntüyle eşleştiğini tahmin ederek sıfır eğitim örneğiyle ResNet-50 ImageNet doğruluğunu yakalayan çığır açıcı OpenAI makalesi.

zero shot classificationimage text retrievalmultimodal alignment
Literatür Kaydı
2013 · Internationalfoundational

Auto-Encoding Variational Bayes (VAE)

Stokastik gizil düğümler üzerinden geriye yayılıma izin veren yeniden parametreleme hilesini kuran Varyasyonel Otomatik Kodlayıcıları tanıtan temel ICLR makalesi.

image generationdensity estimationrepresentation learning
Toplam 253 Literatür Kaydı arasından 37–54 gösteriliyor