tReservoirSampling - 7.1

Sampling

author
Talend Documentation Team
EnrichVersion
7.1
EnrichProdName
Talend Big Data Platform
Talend Data Fabric
Talend Data Management Platform
Talend Data Services Platform
Talend MDM Platform
Talend Real-Time Big Data Platform
task
Création et développement > Systèmes tiers > Composants Data Quality > Composants d'échantillonnage
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants d'échantillonnage
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants d'échantillonnage
EnrichPlatform
Studio Talend

Ce composant extrait un échantillon de données aléatoires d'un ensemble de Big Data.

Le tReservoirSampling extrait un échantillon de l'ensemble de données d'entrée afin que les résultats du profiling de cet échantillon de données soient uniformes et homogènes par rapport à ceux du profiling de l'intégralité de l'ensemble de données.

Pour plus d'informations concernant les technologies supportées par Talend, consultez Composants Talend.