> ML_STANDARD // DATASHEETS-FOR-DATASETS_v1.0
Veri Setleri İçin Veri Sayfaları Standardı
Communications of the ACM (CACM) / Data Provenance Initiative · International Industry Best Practice · active
documentation-practiceInternational Industry Best Practiceactive
Standart / Çerçeve Özeti
Veri seti dokümantasyonunu standartlaştıran kapsamlı soru formu: motivasyon, kompozisyon, toplama süreci, ön işleme, kullanım alanları, dağıtım ve bakım.
Temel Uyumluluk Gereksinimleri
- Motivasyon: Veri seti neden oluşturuldu ve kim tarafından finanse edildi?
- Kompozisyon: Örnekler neyi temsil ediyor ve gizli veya kişisel veri içeriyor mu?
- Toplama Süreci: Veriler nasıl toplandı, örneklendi ve yanlılık açısından nasıl doğrulandı?
- Ön İşleme ve Temizleme: Hangi dönüşümler veya tokenlaştırmalar gerçekleştirildi?
- Bakım: Veri setini kim güncelliyor ve hatalar nasıl gideriliyor?
Kapsam Dahilindeki Sektörler ve Görevler
Etkilenen Sektörler:
technologyresearchgovernment
Etkilenen Görevler:
data validation
TinyCTO, regülatif özetleri ve teknik mühendislik uyumunu yalnızca bilgilendirme amaçlı sağlar. Bu içerik resmi hukuki danışmanlık veya regülasyon uyumluluk sertifikası teşkil etmez.
