Créer le Job - 7.0

Matching with machine learning

author
Talend Documentation Team
EnrichVersion
7.0
EnrichProdName
Talend Big Data Platform
Talend Data Fabric
Talend Data Management Platform
Talend Data Services Platform
Talend MDM Platform
Talend Real-Time Big Data Platform
task
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
EnrichPlatform
Studio Talend
Talend Data Stewardship

Procédure

  1. Déposez les composants suivants de la Palette dans l'espace de modélisation graphique : un tFileInputDelimited, un tMatchPairing, un tLogRow et deux tFileOutputDelimited.
  2. Reliez le tFileInputDelimited au tMatchPairing à l'aide d'un lien Main.
    Le tFileInputDelimited lit le fichier source et envoie les données au composant suivant.
  3. Reliez le tMatchPairing aux composants de sortie fichier à l'aide de liens Pairs et Unique rows et au tLogRow à l'aide d'un lien Exact duplicates.
    Le tMatchPairing pré-analyse les données, calcule les paires de doublons suspects, les lignes uniques et les doublons exacts, puis génère un modèle permettant d'appairer les données, à utiliser avec le tMatchPredict.