> ML_LITERATURE // ARMBRUST-2015-SPARK-SQL-RELATIONAL-DATA-PROCESSING-IN-SPARK_v1.0
Spark SQL: Relational Data Processing in Spark
Michael Armbrust, Reynold S. Xin, Cheng Lian, Yin Huai, Davies Liu, Joseph K. Bradley, Xiangrui Meng, Tomer Kaftan, Michael J. Franklin, Ali Ghodsi, Matei Zaharia · ACM SIGMOD International Conference on Management of Data (2015)
systems2015industry-standardnotAssessed
Temel Katkı (Principal Contribution)
İlişkisel ve yordamsal büyük veri hesaplamasını birleştiren Catalyst genişletilebilir sorgu optimize edicisini ve DataFrame API'sini tanıttı.
Operasyonel ve Mühendislik Uygunluğu
task-feature-engineering, task-data-processing için dağıtım seçimlerini ve mimari belirlemeyi doğrudan yönlendirir.
Temel Varsayımlar (Assumptions)
- Değerlendirme alanları genelinde standart ampirik düzenlilik ve istatistiksel kararlılık geçerlidir
Kısıtlar ve Sınırlamalar (Limitations)
- Performans özellikleri alan dağılımına ve hesaplama tahsisi parametrelerine bağlıdır
Bağlantılı Algoritmalar, Mimariler ve Kütüphaneler
İlgili Algoritmalar:
İlgili Mimariler:
Uygulayıcı Kütüphaneler:
