Skip to main content

> ML_LITERATURE // OORD-2016-WAVENET-GENERATIVE-MODEL-RAW-AUDIO_v1.0

WaveNet: A Generative Model for Raw Audio

Aäron van den Oord, Sander Dieleman, Heiga Zen, Karen Simonyan, Oriol Vinyals, Alex Graves, Nal Kalchbrenner, Andrew Senior, Koray Kavukcuoglu · arXiv preprint (2016)

seminal-architecture2016industry-standardthirdPartyReproduced

Temel Katkı (Principal Contribution)

Üstel olarak büyüyen algılama alanlarına sahip otoregresif nedensel genişletilmiş evrişimler kullanarak saniyede 16.000 örnekte ham ses dalga formlarını modelledi.

Operasyonel ve Mühendislik Uygunluğu

Üretim sistemlerinde task-text-to-speech uygulaması için yetkili referans olarak hizmet eder.

Temel Varsayımlar (Assumptions)

  • Temel uzamsal-zamansal süreklilik ve alan dağılımsal kararlılığı geçerlidir

Kısıtlar ve Sınırlamalar (Limitations)

  • Performans ölçekleme ve hesaplama ayak izi algılama alanı derinliğine, dizi uzunluğuna ve çözünürlüğe bağlıdır

Bağlantılı Algoritmalar, Mimariler ve Kütüphaneler

İlgili Algoritmalar:
İlgili Mimariler:
Uygulayıcı Kütüphaneler: