Configurer le composant d'entrée - 7.3

Rapprochement de données à l'aide des outils Talend

Version
7.3
Language
Français
Product
Talend Big Data Platform
Talend Data Fabric
Talend Data Management Platform
Talend Data Services Platform
Talend MDM Platform
Talend Real-Time Big Data Platform
Module
Studio Talend
Content
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement de données
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement flou
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement de données
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement flou
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement de données
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement flou
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Last publication date
2024-02-07

Procédure

  1. Double-cliquez sur le tFileInputDelimited pour ouvrir sa vue Basic settings dans l'onglet Component.

    Les données d'entrée à utiliser avec le tMatchModel sont les paires de données suspectes générées par le tMatchPairing, comme expliqué dans Calculer des paires suspectes et un échantillon suspect à partir des données source.

    Les données d'entrée à utiliser avec le tMatchModel sont les paires de données suspectes générées par le tMatchPairing. Pour un exemple de calcul de paires suspectes et d'échantillon suspect à partir des données source, consultez la documentation sur Talend Help Center (https://help.talend.com).

  2. Cliquez sur le bouton [...] à côté du champ Edit schema pour ouvrir une boîte de dialogue et ajoutez des colonnes au schéma d'entrée : Original_Id, Source, Site_name, Address, PAIR_ID, SCORE et LABEL.

    Le schéma d'entrée est le même que celui utilisé avec l'échantillon de paires suspectes généré par le tMatchPairing. La colonne LABEL contient le libellé manuellement paramétré sur tous les seconds enregistrement des paires.

    Pour des raisons de lisibilité, vous pouvez ignorer les colonnes PAIR_ID et SCORE.

  3. Cliquez sur OK dans la boîte de dialogue et acceptez la propagation des modifications lorsqu'elle vous est proposée.
  4. Dans le champ Folder/File, définissez le chemin d'accès au fichier d'entrée.
  5. Configurez les séparateurs de lignes et de champs dans les champs correspondants, puis les en-têtes et pieds de page, s'il y en a.

    Dans cet exemple, le nombre de lignes dans le champ Header doit être configuré à 1.