Skip to main content

> ML_LITERATURE // ARMBRUST-2015-SPARK-SQL-RELATIONAL-DATA-PROCESSING-IN-SPARK_v1.0

Spark SQL: Relational Data Processing in Spark

Michael Armbrust, Reynold S. Xin, Cheng Lian, Yin Huai, Davies Liu, Joseph K. Bradley, Xiangrui Meng, Tomer Kaftan, Michael J. Franklin, Ali Ghodsi, Matei Zaharia · ACM SIGMOD International Conference on Management of Data (2015)

systems2015industry-standardnotAssessed

Temel Katkı (Principal Contribution)

İlişkisel ve yordamsal büyük veri hesaplamasını birleştiren Catalyst genişletilebilir sorgu optimize edicisini ve DataFrame API'sini tanıttı.

Operasyonel ve Mühendislik Uygunluğu

task-feature-engineering, task-data-processing için dağıtım seçimlerini ve mimari belirlemeyi doğrudan yönlendirir.

Temel Varsayımlar (Assumptions)

  • Değerlendirme alanları genelinde standart ampirik düzenlilik ve istatistiksel kararlılık geçerlidir

Kısıtlar ve Sınırlamalar (Limitations)

  • Performans özellikleri alan dağılımına ve hesaplama tahsisi parametrelerine bağlıdır

Bağlantılı Algoritmalar, Mimariler ve Kütüphaneler

İlgili Algoritmalar:
İlgili Mimariler:
Uygulayıcı Kütüphaneler: