tDataShuffling - Cloud - 8.0

Confidentialité des données

Version
Cloud
8.0
Language
Français (France)
Product
Talend Big Data Platform
Talend Data Fabric
Talend Data Management Platform
Talend Data Services Platform
Talend MDM Platform
Talend Real-Time Big Data Platform
Module
Studio Talend
Content
Création et développement > Systèmes tiers > Composants Data Quality > Composants de protection des données sensibles
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de protection des données sensibles
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de protection des données sensibles

Ce composant mélange les données d'une table d'entrée afin de protéger les données tout en ayant un jeu de données fonctionnel. Les données restent utilisables, par exemple pour le test et l'apprentissage.

Le tDataShuffling remplace les valeurs originales par d'autres valeurs de la même colonne, d'une ligne différente.

Si vous définissez une ou plusieurs colonnes comme groupe de partitions, la table entière est divisée en un nombre donné de partitions. Ces partitions partagent les mêmes valeurs dans les colonnes partitionnées. Ensuite, le processus de mélange est appliqué indépendamment à chaque partition, puis toutes les partitions sont ensuite fusionnées en une table de sortie.

Si vous ne configurez pas les colonnes du groupe de partitions, le processus de mélange est appliqué à toute la table d'entrée.

En mode local, les versions 2.4.0 et supérieures d'Apache Spark sont supportées.

Ce composant n'est pas intégré par défaut à votre Studio Talend. Vous devez l'installer à l'aide du gestionnaire des fonctionnalités. Pour plus d'informations, consultez Installer les fonctionnalités à l'aide du Gestionnaire des fonctionnalités.

Pour plus de technologies supportées par Talend, consultez Composants Talend.

Selon le produit Talend que vous utilisez, ce composant peut être utilisé dans un framework de Jobs, dans plusieurs, ou dans tous les frameworks :

  • Standard : consultez Propriétés du tDataShuffling Standard.

    Le composant de ce framework est disponible dans Talend Data Management Platform, Talend Big Data Platform, Talend Real Time Big Data Platform, Talend Data Services Platform et dans Talend Data Fabric.

  • Spark Batch : consultez Propriétés du tDataShuffling pour Apache Spark Batch.

    Le composant de ce framework est disponible dans tous les produits Talend Platform avec Big Data et dans Talend Data Fabric.