> ML_LITERATUR_v1.0
Araştırma Literatürü Atlası
Temel istatistiksel öğrenmeden modern akıl yürüten LLM'lere (DeepSeek-R1, Llama 3) uzanan 253 doğrulanmış literatür kaydı: doğrulanmış DOI, arXiv bağlantıları ve orijinal iki dilli sentezler.
Generative Adversarial Nets (GAN)
Sentezi çekişmeli bir düello olarak formüle ederek üretici derin öğrenme çağını tetikleyen Üretici Çekişmeli Ağları tanıtan tarihi NeurIPS makalesi.
Deep Unsupervised Learning using Nonequilibrium Thermodynamics
Veri üretimini bir termodinamik difüzyon sürecini tersine çevirmek olarak tanımlayan difüzyon olasılıksal modellerini tanıtan vizyoner ICML makalesi.
Denoising Diffusion Probabilistic Models (DDPM)
Gürültü giderici difüzyon olasılıksal modellerinin GAN'ları yakalayan ve aşan yüksek görüntü sentez doğruluğu elde ettiğini gösteren dönüm noktası makale.
Score-Based Generative Modeling through Stochastic Differential Equations
Stokastik diferansiyel denklemler yoluyla üretici difüzyonu birleştiren, Olasılık Akışı ODE'lerini ve tahmin edici-düzeltici örnekleyicileri tanıtan teorik başyapıt.
High-Resolution Image Synthesis with Latent Diffusion Models (Stable Diffusion)
Sıkıştırılmış gizil uzaylarda difüzyon eğiterek hesaplama maliyetlerini düşüren ve son teknoloji metinden görüntüye sentez elde eden dönüm noktası CVPR makalesi.
Scalable Diffusion Models with Transformers (DiT)
Diffusion Transformers'ı (DiT) tanıtan ve Vision Transformer'ların hesaplama gücüyle öngörülebilir üretici doğruluğu ölçeklediğini kanıtlayan ICCV makalesi.
Q-learning
Markovyen ortamlarda off-policy zamansal fark güncellemelerinin optimal eylem-değer fonksiyonuna yakınsadığını kesin olarak kanıtlayan klasik makale.
Human-level control through deep reinforcement learning (Nature DQN)
Derin pekiştirmeli öğrenmenin doğrudan piksellerden insanla karşılaştırılabilir beceriyle video oyunlarında ustalaşabileceğini gösteren çığır açıcı DeepMind Nature makalesi.
Proximal Policy Optimization Algorithms (PPO)
Kırılgan politika gradyanı yöntemlerini sağlam ve uygulaması kolay kırpılmış vekil kayıpla değiştiren son derece etkili PPO makalesi.
Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor
Sürekli eylemli robotikte benzersiz örneklem verimliliği ve kararlılık elde eden Soft Actor-Critic'i (SAC) tanıtan makale.
Mastering the game of Go with deep neural networks and tree search (AlphaGo)
2.500 yıllık Go oyununda bir insan dünya şampiyonunu yenen ilk bilgisayar programı olan AlphaGo'yu açıklayan tarihi Nature kapak makalesi.
Direct Preference Optimization: Your Language Model Is Secretly a Reward Model (DPO)
RLHF'in pekiştirmeli öğrenme veya ayrı ödül modelleri olmadan doğrudan çapraz entropi optimizasyonu ile çözülebileceğini gösteren çığır açıcı makale.
Semi-Supervised Classification with Graph Convolutional Networks (GCN)
Spektral çizge teorisi ile sinir ağlarını birleştirerek modern çizge makine öğrenimini başlatan Çizge Konvolüsyonel Ağlarını tanıtan temel makale.
Graph Attention Networks (GAT)
Tekdüze izotropik mesaj iletimini öğrenilmiş anizotropik öz dikkat ile değiştiren Çizge Dikkat Ağlarını tanıtan etkili ICLR makalesi.
Inductive Representation Learning on Large Graphs (GraphSAGE)
Tam çizge işlemlerini komşuluk örneklemesi ile değiştirerek devasa çizgelerde tümevarımsal GNN'leri mümkün kılan çığır açıcı makale.
How Powerful are Graph Neural Networks? (Graph Isomorphism Network - GIN)
Standart GNN ifade gücünü teorik olarak sınırlandıran ve 1-Weisfeiler-Lehman testine denk gelen GIN'i tanıtan ICLR makalesi.
Time Series Analysis: Forecasting and Control
Yarım yüzyıl boyunca zaman serisi analizi alanını tanımlayan Box-Jenkins metodolojisini ve ARIMA modellemesini kuran anıtsal ders kitabı.
Forecasting at Scale (Prophet)
Uzman olmayan analistlerin ölçekte yüksek kaliteli operasyonel tahminler üretmesini sağlayan Meta Prophet'ı tanıtan son derece pratik makale.
