Configurer le Job - Cloud - 8.0

Rapprochement de données à l'aide des outils Talend

Version
Cloud
8.0
Language
Français
Product
Talend Big Data Platform
Talend Data Fabric
Talend Data Management Platform
Talend Data Services Platform
Talend MDM Platform
Talend Real-Time Big Data Platform
Module
Studio Talend
Content
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement de données
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement flou
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement de données
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement flou
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement de données
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement flou
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Last publication date
2024-02-07

Pourquoi et quand exécuter cette tâche

Dans ce scénario, vous avez déjà stocké le schéma d'entrée principal dans le Repository. Pour plus d'informations concernant le stockage des métadonnées de schéma dans la vue Repository, consultez Gestion des métadonnées dans le Studio Talend.

Procédure

  1. Dans la vue Repository, développez les nœuds Metadata - DB Connections où vous avez stocké les schémas d'entrée principaux.
  2. Déposez la table de base de données dans l'espace de modélisation graphique. La table d'entrée utilisée dans ce scénario est customer.
    Une boîte de dialogue s'ouvre et affiche une liste de composants.
  3. Sélectionnez le composant de base de données adéquat, tMysqlInput dans cet exemple et cliquez sur OK.
  4. Déposez deux composants tGenKey, deux tMatchGroup, un tMap et un tLogRow de la Palette dans l'espace de modélisation graphique.
  5. Reliez le composant d'entrée aux composants tGenKey et tMap à l'aide de liens Main.
  6. Dans les deux composants tMatchGroup, cochez les cases Output distance details dans la vue Advanced settings des deux composants avant de les relier.
    Cela ajoute la colonne MATCHING_DISTANCES dans le schéma de sortie de chaque tMatchGroup.
    Si les deux composants tMatchGroup sont déjà reliés, cochez d'abord la case Output distance details dans le second composant du flux du Job. Sinon, une erreur peut survenir.
  7. Reliez les deux tMatchGroup et le tLogRow à l'aide de liens Main.
  8. Si nécessaire, renommez les composants afin de mieux comprendre leur rôle au sein du Job.
    Pour plus d'informations concernant le nommage d'un composant, consultez Onglet View.