Skip to main content

> MİMARİ KATALOĞU // 18 MODEL

18 Bulut Mimarisi ve Başabaş Noktaları

Sunucusuz sistemlerden bare-metal kolokasyona 54 olgunluk seviyesi ve detaylı birim maliyet basamakları.

SERVERLESSarch-fin-01

Serverless Event-Driven Web & REST API

Sıfır bakım gerektiren, dalgalı trafik için sıfır bekleme maliyetli API Gateway, Lambda ve DynamoDB On-Demand sunucusuz mimarisi.

Başabaş Eğrisi:Ayda 8 milyon isteğin altında en ekonomik model (~$120/ay). Ayda 25 milyon isteğin üzerine çıkıldığında Yönetilen Konteynerler (ECS Fargate) %40 daha ucuz hale gelir.
Prototip:$5 - $45 / mo
Canlı Üretim:$80 - $950 / mo
Yüksek Hacim:$950 - $3,800 / mo
SERVERLESSarch-fin-02

Serverless Asynchronous Event & Queue Processing

Amazon EventBridge, SQS FIFO kuyrukları ve toplu Lambda tüketicileri kullanan, hataya dayanıklı ayrık olay işleme boru hattı.

Başabaş Eğrisi:Ayda 50 milyon olaya kadar en uygun maliyet. 100 milyon olayın üzerinde EC2 üzerinde çalışan Kafka veya RabbitMQ maliyeti %65 düşürür.
Prototip:$10 - $60 / mo
Canlı Üretim:$60 - $550 / mo
Yüksek Hacim:$550 - $2,400 / mo
SERVERLESSarch-fin-03

Edge Serverless Full-Stack Web & Dynamic Routing

Cloudflare Workers, Pages ve uç KV/D1 veritabanları üzerinde çalışan, sıfır veri çıkış ücretli ultra düşük gecikmeli uç mimari.

Başabaş Eğrisi:Cloudflare Bandwidth Alliance ($0.00 çıkış ücreti) sayesinde küresel okuma ağırlıklı trafikte tüm ölçeklerde en ekonomik modeldir.
Prototip:$5 - $25 / mo
Canlı Üretim:$25 - $220 / mo
Yüksek Hacim:$220 - $1,800 / mo
CONTAINERIZEDarch-fin-04

Managed Container Microservices on AWS ECS Fargate

Sunucu yönetim yükünü ortadan kaldıran, saniye bazlı faturalandırmalı AWS ECS Fargate üzerinde yönetilen konteyner mikroservis mimarisi.

Başabaş Eğrisi:10 - 80 görev (task) çalıştıran iş yüklerinde idealdir. Sürekli 100 görevin üzerinde Karpenter ve Spot kullanan EKS maliyeti %45 azaltır.
Prototip:$85 - $260 / mo
Canlı Üretim:$450 - $2,200 / mo
Yüksek Hacim:$2,200 - $9,500 / mo
CONTAINERIZEDarch-fin-05

Google Cloud Run Managed Microservices Platform

Boştayken sıfıra inen ve yalnızca aktif istek işleme süresince ücretlendirme yapan yüksek esnekliğe sahip Google Cloud Run mimarisi.

Başabaş Eğrisi:Düzensiz veya yalnızca mesai saatlerinde yoğunlaşan trafikte son derece ekonomiktir. 7/24 kesintisiz yüksek kullanımda GKE Autopilot %30 daha ucuzdur.
Prototip:$15 - $90 / mo
Canlı Üretim:$180 - $1,400 / mo
Yüksek Hacim:$1,400 - $6,500 / mo
CONTAINERIZEDarch-fin-06

Azure Container Apps (ACA) Microservices Mesh

Kubernetes ve KEDA tabanlı, Dapr mikroservis yetenekleri sunan ve tüketim bazlı faturalandırılan Azure Container Apps mimarisi.

Başabaş Eğrisi:60 kopyaya (replica) kadar maliyet etkindir. Sürekli 60 kopyanın üzerinde spot düğüm havuzlu Azure Kubernetes Service (AKS) %35 daha ucuzdur.
Prototip:$40 - $180 / mo
Canlı Üretim:$250 - $1,600 / mo
Yüksek Hacim:$1,600 - $7,200 / mo
KUBERNETESarch-fin-07

High-Density Multi-Tenant AWS EKS with Karpenter & Graviton Spot

Karpenter anlık ölçeklendirme, ARM64 Graviton işlemciler ve agresif Spot düğüm paketleme kullanan en gelişmiş kurumsal EKS mimarisi.

Başabaş Eğrisi:50 vCPU üzerindeki iş yüklerinde maliyet şampiyonudur. Sürekli iş yüklerinde ECS Fargate veya standart bulut sunucularına göre %50 - %65 daha ucuzdur.
Prototip:$240 - $650 / mo
Canlı Üretim:$850 - $3,800 / mo
Yüksek Hacim:$3,800 - $24,000 / mo
KUBERNETESarch-fin-08

Google Kubernetes Engine (GKE) Autopilot Workload Architecture

Google'ın düğüm altyapısını yönettiği, yalnızca talep edilen pod kaynakları için fatura kesen ve otomatik kaynak optimize eden GKE Autopilot mimarisi.

Başabaş Eğrisi:Özel Kubernetes SRE ekibi bulunmayan şirketler için idealdir. SRE ekibi olan şirketlerde Spot GCE kullanan standart GKE %25 daha ucuzdur.
Prototip:$120 - $350 / mo
Canlı Üretim:$600 - $2,900 / mo
Yüksek Hacim:$2,900 - $16,000 / mo
KUBERNETESarch-fin-09

Cilium eBPF Hybrid Service Mesh & Private Cloud Topology

Kube-proxy yerine Cilium eBPF kullanan, iptables yükünü ve erişilebilirlik alanı veri transfer ücretlerini ortadan kaldıran yüksek performanslı ağ mimarisi.

Başabaş Eğrisi:Yüksek hacimli mikroservis yapılarında (ayda 50 TB üzeri doğu-batı trafiği) ağ maliyetini %40 - %70 oranında düşürür.
Prototip:$280 - $750 / mo
Canlı Üretim:$1,200 - $4,800 / mo
Yüksek Hacim:$4,800 - $28,000 / mo
STREAMINGarch-fin-10

High-Throughput Streaming: Kafka, Apache Flink & ClickHouse

NVMe diskli Kafka, Apache Flink ve ClickHouse sütunsal veritabanı kullanan, yüksek hacimli gerçek zamanlı analitik ve işlem izleme mimarisi.

Başabaş Eğrisi:Ayda 500 milyon olayın üzerindeki hacimlerde maliyet şampiyonudur. Kendi sunucunda ClickHouse çalıştırmak, gerçek zamanlı veri alımında Snowflake veya Databricks'e göre %80 daha ucuzdur.
Prototip:$350 - $1,100 / mo
Canlı Üretim:$1,800 - $6,500 / mo
Yüksek Hacim:$6,500 - $26,000 / mo
STREAMINGarch-fin-11

Serverless Data Lakehouse on Apache Iceberg & Athena

Apache Iceberg açık tablo formatı, AWS S3 ve sunucusuz sorgu motorları (Athena/DuckDB) kullanan sıfır küme yönetimli veri ambarı mimarisi.

Başabaş Eğrisi:Toplu analitik ve günlük 5.000 sorgunun altındaki BI sorgularında idealdir. Günde 20.000 sorgunun üzerinde ClickHouse veya StarRocks %60 daha ucuzdur.
Prototip:$25 - $150 / mo
Canlı Üretim:$250 - $1,800 / mo
Yüksek Hacim:$1,800 - $9,500 / mo
STREAMINGarch-fin-12

Change Data Capture (CDC) Pipeline: Debezium to Cloud Data Warehouses

Operasyonel veritabanı loglarını (WAL) Debezium ile okuyarak analitik depolara aktaran sürekli veri çoğaltma boru hattı.

Başabaş Eğrisi:Tablo satır sayısı günde 10 milyonu aştığında pahalı SaaS ETL araçlarına (Fivetran/Stitch) kıyasla ayda $3.000 - $15.000 tasarruf sağlayan en ekonomik çözümdür.
Prototip:$60 - $220 / mo
Canlı Üretim:$350 - $1,400 / mo
Yüksek Hacim:$1,400 - $5,800 / mo
GENAI_GPUarch-fin-13

Cost-Optimized LLM Inference Cluster: vLLM & Spot GPUs

vLLM PagedAttention, Ray küme otomatik ölçeklendiricisi ve spot GPU örnekleri kullanan, otomatik hata toleranslı yüksek verimli LLM sunum kümesi.

Başabaş Eğrisi:Günde 20 milyon token üzerindeki kullanımda maliyet şampiyonudur. 70B modelleri 4x A100/H100 Spot örneklerinde çalıştırmak OpenAI/Anthropic API fiyatlarına göre %60 daha ucuzdur.
Prototip:$450 - $1,800 / mo
Canlı Üretim:$2,800 - $11,500 / mo
Yüksek Hacim:$11,500 - $65,000 / mo
GENAI_GPUarch-fin-14

High-Throughput Vector Embedding Pipeline: GPU & CPU AVX-512

Yüksek hacimli veri yüklemeleri için GPU toplu çıkarımını, düşük gecikmeli tekil sorgular için CPU AVX-512 yedeklemesini birleştiren vektör gömme mimarisi.

Başabaş Eğrisi:Ayda 500 milyonun üzerinde vektör gömme üretildiğinde, kendi sunucunda çalıştırmak ~$800/ay tutarken ticari API'ler $10.000+/ay tutar (%92 tasarruf).
Prototip:$65 - $220 / mo
Canlı Üretim:$450 - $1,800 / mo
Yüksek Hacim:$1,800 - $7,500 / mo
GENAI_GPUarch-fin-15

Ultra-Low Latency Speculative Decoding Architecture

Hızlı ve hafif bir taslak model ile büyük hedef modeli birlikte çalıştırarak sıfır kalite kaybıyla 2.5 kat çıkarım hızlandırması sağlayan kurumsal çok katmanlı mimari.

Başabaş Eğrisi:Gecikme süresinin doğrudan kullanıcı bağlılığını ve GPU doluluk verimliliğini artırdığı yüksek eşzamanlı sohbet sistemlerinde maliyet etkindir.
Prototip:$1,200 - $3,500 / mo
Canlı Üretim:$6,500 - $22,000 / mo
Yüksek Hacim:$22,000 - $95,000 / mo
HYBRID_BARE_METALarch-fin-16

Hetzner Bare-Metal Workhorses with Cloudflare Edge Ingress

Ağır hesaplama ve veritabanı iş yüklerini Hetzner özel fiziksel sunucularında çalıştıran, Cloudflare CDN uç güvenliğiyle korunan yüksek performanslı hibrit mimari.

Başabaş Eğrisi:Sürekli yüksek işlem gücü (> 128 vCPU) veya yüksek veri çıkışı (> 20 TB/ay) olan yapılarda maliyet şampiyonudur. Hetzner fiziksel sunucuları eşdeğer AWS EC2 ve veri çıkış maliyetine göre %75 - %85 daha ucuzdur.
Prototip:$85 - $190 / mo
Canlı Üretim:$350 - $1,100 / mo
Yüksek Hacim:$1,800 - $8,500 / mo
HYBRID_BARE_METALarch-fin-17

Colocation High-Density NVMe Storage & Ceph Cluster

Taşıyıcı-bağımsız veri merkezinde kurumsal Supermicro donanımı üzerinde Ceph dağıtık nesne ve blok depolama çalıştıran petabayt ölçekli özel depolama mimarisi.

Başabaş Eğrisi:500 Terabayt üzerindeki veri büyüklüklerinde maliyet şampiyonudur. Birleşik maliyet $0.0035/GB-ay seviyesindedir (AWS S3 Standart $0.023/GB-ay maliyetine göre %85 tasarruf).
Prototip:$650 - $1,800 / mo
Canlı Üretim:$2,500 - $9,500 / mo
Yüksek Hacim:$9,500 - $38,000 / mo
HYBRID_BARE_METALarch-fin-18

Bare-Metal Database Repatriation: Enterprise PostgreSQL & Patroni

AWS RDS sanallaştırma yükünü devre dışı bırakan, NVMe RAID-10 diskli, Patroni otomatik yük devretmeli ve pgBouncer bağlantı havuzlu fiziksel PostgreSQL mimarisi.

Başabaş Eğrisi:Sürekli 15.000 üzeri yazma IOPS'u gerektiren veritabanlarında maliyet şampiyonudur. Ayda $5.000 - $25.000 tutarındaki AWS RDS IOPS ve sunucu ücretlerini ortadan kaldırır.
Prototip:$180 - $450 / mo
Canlı Üretim:$850 - $2,800 / mo
Yüksek Hacim:$2,800 - $9,500 / mo
Yapay Zekâ Özeti & Ajan İşletim Özeti
AEO / GEO / Perplexity Indexable

TinyCTO Bulut Ekonomisi ve FinOps Mimari Kanonu ('Bulut Faturası İncili'), bulut finansal yönetişimi için operasyonel bir mühendislik disiplini kurar. FinOps Foundation FOCUS 1.0 açık spesifikasyonuna dayanan kanon; 6 arketip altında 18 canlı bulut mimarisini, tespit sorguları ve CLI iyileştirme yönergeleri içeren 24 bulut israfı tipolojisini, malzeme listesi (BOM) hesaplayan belirleyici boyutlandırma sihirbazını, 10 kapsamlı çift dilli mühendislik kılavuzunu ve 26 araçlık karşılaştırma matrisini sunar.

FOCUS 1.0 Ontolojisi ve DağıtımAWS, GCP, Azure ve Bare Metal genelinde BilledCost, EffectiveCost ve ChargeSubcategory verilerini zorunlu 5 anahtarlı etiketlemeyle standartlaştıran 12 sütunlu şema.
18 Mimari ve Başabaş EğrileriSunucusuz, Konteynerler, Karpenter'lı Kubernetes, Akış, GenAI GPU'ları ve Kolokasyon genelinde matematiksel başabaş eğrilerine sahip 54 olgunluk yapılandırması.
24 Bulut İsrafı Tipolojisiİşlemci, Depolama, Ağ, Veritabanı, Yapay Zeka ve Gözlemlenebilirlik sızıntılarını hedefleyen tespit sorguları ve otomatik CLI iyileştirme komutları.
Belirleyici Boyutlandırma Sihirbazıİş hacmi, depolama ve veri çıkışını modelleyerek detaylı BOM listeleri, gerçekçi tasarruf oranları ve israf uyarıları üreten etkileşimli hesaplama motoru.

Bulut Mimarisi ve Başabaş Eğrileri Sıkça Sorulan Sorular

Sunucusuz Olay Güdümlü API (Lambda + DynamoDB) ayda 8 milyon isteğin altında neden en ekonomiktir ancak 25 milyonun üzerinde neden dezavantajlıdır?

Sunucusuz mimariler yalnızca çalışma süresi (GB-saniye) ve istek sayısı üzerinden faturalandırılır, bu da dalgalı trafikte sıfır bekleme maliyeti sağlar. Ancak sürekli yüksek hacimde (> 25M istek/ay), milyon istek başına ödenen prim, sabit saatlik ücretle binlerce eşzamanlı isteği karşılayabilen doğru boyutlandırılmış konteynerlerin (ECS Fargate veya Karpenter'lı Kubernetes) maliyetini aşar.

Yüksek Yoğunluklu EKS mimarisi nasıl %82 paketleme (bin-packing) verimliliğine ulaşır?

Karpenter'ın tam zamanında zamanlamasını Graviton ARM64 sunucu havuzları ve Vertical Pod Autoscaler (VPA) öneri motorlarıyla birleştirerek. Pod kaynak talepleri geliştirici tahminleri yerine geçmiş p95 kullanımına göre doğru boyutlandırılır ve Karpenter, bekleyen pod'ların bellek/CPU oranlarına tam uyan sunucu tiplerini seçerek atıl bellek kalmasını engeller.

Yönetilen akış servisleri (Amazon MSK / Confluent) ile kendi sunucunda çalışan ClickHouse / Kafka arasındaki başabaş noktası nedir?

Yönetilen akış servisleri yüksek operasyonel yönetim primi ve yüksek erişilebilirlik alanı veri transfer marjları uygular. Ayda 50 milyon olayın altında yönetilen servisler mühendislik zamanı kazandırır. Ancak ayda 500 milyon olayın üzerinde, S3 katmanlı depolama destekli Kafka ve NVMe üzerinde ClickHouse çalıştırmak, akış ve analitik depolama maliyetlerini %80'in üzerinde düşürerek ayda on binlerce dolar tasarruf sağlar.

Spekülatif Kod Çözme (Speculative Decoding) LLM çıkarım maliyetlerini nasıl 2.2 kat azaltır?

Büyük hedef LLM modelleri (örneğin Llama-3.1-70B), ardışık token üretiminde bellek bant genişliği darboğazına girer. Spekülatif kod çözme, ucuz donanımda çalışan hafif bir taslak modeli (Llama-3.2-1B) devreye sokarak adım başına 4-5 token önerir. Büyük model bu adayları tek bir paralel ileri geçişte doğrular; böylece sıfır doğruluk kaybıyla 2 ila 2.5 kat hızlanma sağlanır ve GPU aktif süresi yarı yarıya iner.

Hibrit Bare-Metal Egress Shield mimarisi bulut bant genişliği bağımlılığını nasıl önler?

Yüksek depolama, video akışı veya veri kopyalama iş yüklerini, Cloudflare veya AWS CloudFront önbelleklerine düşük gecikmeli sınırsız hatla bağlı bare-metal sunucularda (örneğin Hetzner) konumlandırarak. Sabit durum trafiği ücretsiz sınırsız bare-metal hattını kullanırken, genel bulut yalnızca elastik ve durumsuz ani yük patlamalarında tampon olarak devreye girer.

Veritabanı senkronizasyonunda tekrarlayan ETL toplu sorguları yerine neden Debezium CDC tercih edilir?

Periyodik toplu ETL işleri, birincil veritabanı CPU'sunu kilitleyen, okuma IOPS'unu patlatan ve aşırı büyük veritabanı sunucuları gerektiren ağır `SELECT *` taramaları çalıştırır. Debezium Change Data Capture ise veritabanı Write-Ahead Log (WAL) kütüğünü doğrudan depolama motoru düzeyinde sıfıra yakın CPU yüküyle okur ve operasyonel performansı düşürmeden değişiklikleri sürekli akışa dönüştürür.