Configurer les composants - Cloud - 8.0

Rapprochement de données à l'aide des outils Talend

Version
Cloud
8.0
Language
Français
Product
Talend Big Data Platform
Talend Data Fabric
Talend Data Management Platform
Talend Data Services Platform
Talend MDM Platform
Talend Real-Time Big Data Platform
Module
Studio Talend
Content
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement de données
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement flou
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement de données
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement flou
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement de données
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement flou
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement utilisant l'apprentissage automatique
Last publication date
2024-02-07

Procédure

  1. Double-cliquez sur le composant tFileInputDelimited afin d'afficher sa vue Basic settings.
  2. Cliquez sur le bouton [...] près du champ File Name/Stream pour parcourir votre système jusqu'à votre fichier d'entrée.
  3. Définissez les lignes d'en-tête et de pied de page.
    Dans cet exemple, la première ligne du fichier d'entrée est la ligne d'en-tête.
  4. Cliquez sur Edit schema pour définir le schéma de ce composant.
    1. Cliquez sur le bouton [+] pour ajouter des colonnes. Dans cet exemple, le fichier d'entrée contient cinq colonnes : Id, FirstName, LastName, Age et City.
    2. Cliquez sur OK.
  5. Double-cliquez sur le tSortRow afin d'afficher sa vue Basic settings.
  6. Pour trier les entrées selon l'ordre alphabétique des noms, ajoutez deux lignes à la table Criteria en cliquant sur le bouton [+] :
    1. Sélectionnez les colonnes FirstName et LastName dans Schema column.
    2. Sélectionnez alpha comme type de tri.
    3. Sélectionnez asc comme ordre de tri.
  7. Double-cliquez sur le composant tUniqRow afin d'afficher sa vue Basic settings.
  8. Dans la zone Unique key, sélectionnez les colonnes sur lesquelles vous souhaitez effectuer le dédoublonnage.
    Dans cet exemple, les noms en doublon sont triés.
  9. Dans la vue Basic settings des composants tLogRow, sélectionnez l'option Table pour afficher les résultats d'exécution du Job sous forme de tableau.