Créer le Job - 7.0

Matching with machine learning

Version
7.0
Language
Français (France)
Product
Talend Big Data Platform
Talend Data Fabric
Talend Data Management Platform
Talend Data Services Platform
Talend MDM Platform
Talend Real-Time Big Data Platform
Module
Studio Talend
Talend Data Stewardship
Content
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique

Procédure

  1. Déposez les composants suivants de la Palette dans l'espace de modélisation graphique : un tFileInputDelimited, un tMatchPairing, un tLogRow et deux tFileOutputDelimited.
  2. Reliez le tFileInputDelimited au tMatchPairing à l'aide d'un lien Main.
    Le tFileInputDelimited lit le fichier source et envoie les données au composant suivant.
  3. Reliez le tMatchPairing aux composants de sortie fichier à l'aide de liens Pairs et Unique rows et au tLogRow à l'aide d'un lien Exact duplicates.
    Le tMatchPairing pré-analyse les données, calcule les paires de doublons suspects, les lignes uniques et les doublons exacts, puis génère un modèle permettant d'appairer les données, à utiliser avec le tMatchPredict.