> ML_LITERATUR_v1.0
Araştırma Literatürü Atlası
Temel istatistiksel öğrenmeden modern akıl yürüten LLM'lere (DeepSeek-R1, Llama 3) uzanan 253 doğrulanmış literatür kaydı: doğrulanmış DOI, arXiv bağlantıları ve orijinal iki dilli sentezler.
RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control
Gerçek robotlarda beliren anlamsal akıl yürütmeyi ve sıfır vuruşlu fiziksel eylemlilik anlayışını gösteren VLA makalesi.
Completely Derandomized Self-Adaptation in Evolution Strategies (CMA-ES)
Zorlu, pürüzlü ve doğrusal olmayan kara kutu optimizasyonu için altın standart algoritma olan CMA-ES'i kuran dönüm noktası makale.
Xception: Deep Learning with Depthwise Separable Convolutions
François Chollet'nin Xception'ı yaratan ve derinlik bazında ayrılabilir evrişimleri mobil görü için standart yapı taşı yapan dönüm noktası CVPR makalesi.
MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications
Akıllı telefonlarda, dronlarda ve uç cihazlarda gerçek zamanlı bilgisayarlı görü çıkarımını sağlayan MobileNetV1 makalesi.
MobileNetV2: Inverted Residuals and Linear Bottlenecks
Mobil ve cihaz üzeri bilgisayarlı görü omurgalarında küresel endüstri standardı haline gelen MobileNetV2 makalesi.
A Simple Framework for Contrastive Learning of Visual Representations (SimCLR)
Karşıtsal InfoNCE optimizasyonu yoluyla kendi kendini denetleyen görsel temsil öğrenimini dönüştüren dönüm noktası SimCLR makalesi.
Momentum Contrast for Unsupervised Visual Representation Learning (MoCo)
Binlerce GPU bellek tahsisine ihtiyaç duymadan devasa negatif örnek sözlüklerini mümkün kılan MoCo Facebook CVPR makalesi.
Emerging Properties in Self-Supervised Vision Transformers (DINO)
Kendi kendini denetleyen ViT dikkat haritalarının herhangi bir insan etiketi olmadan nesne sınırlarını keşfettiğini kanıtlayan DINO ICCV makalesi.
DINOv2: Learning Robust Visual Features without Supervision
Tek gözlü derinlik tahmini, yoğun segmentasyon ve görüntü erişimi için temel görsel özellik omurgası olan DINOv2 makalesi.
Masked Autoencoders Are Scalable Vision Learners (MAE)
BERT tarzı maskeli otomatik kodlama paradigmasını ölçeklenebilir bilgisayarlı görü için baskın temel haline getiren dönüm noktası CVPR MAE makalesi.
Highly accurate protein structure prediction with AlphaFold (AlphaFold 2)
Biyolojideki 50 yıllık protein katlanması problemini çözerek 2024 Nobel Kimya Ödülü'nü kazanan tarihi Nature kapak makalesi.
Zero-Shot Text-to-Image Generation (DALL-E)
Çok modlu otoregresif modellemenin yaratıcı sıfır vuruşlu metinden görüntüye sentezi mümkün kıldığını kanıtlayan tarihi DALL-E makalesi.
Hierarchical Text-Conditional Image Generation with CLIP Latents (DALL-E 2 / unCLIP)
Fotogerçekçi metinden görüntüye üretim ve anlamsal görüntü varyasyonları için iki aşamalı CLIP örtük difüzyonunu kuran dönüm noktası OpenAI DALL-E 2 makalesi.
Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding (Imagen)
Metinden görüntüye sentezde büyük dil modellerinin belirleyici rolünü kanıtlayan Imagen ve DrawBench Google NeurIPS makalesi.
Video generation models as world simulators (Sora)
Uzay-zaman yamalı difüzyon transformer'larını sürekli video üretimi için ölçeklenebilir dünya simülatörleri olarak belirleyen OpenAI Sora teknik raporu.
SqueezeNet: AlexNet-level accuracy with 50x fewer parameters and <0.5MB model size
Düşük güçlü mikrodenetleyiciler ve FPGA'larda yüksek doğruluklu derin öğrenmeyi sağlayan mimari sıkıştırmayı kanıtlayan SqueezeNet makalesi.
ShuffleNet: An Extremely Efficient Convolutional Neural Network for Mobile Devices
Gömülü robotik ve cep telefonları için en üst düzey hız-doğruluk dengesini sunan dönüm noktası CVPR ShuffleNet makalesi.
Designing Network Design Spaces (RegNet)
Ölçeklenebilir, donanım dostu evrişimli mimariler için RegNet tasarım uzayı metodolojisini tanıtan CVPR 2020 En İyi Makale Ödüllü çalışma.
