Configurer les composants - 7.1

Standardization

author
Talend Documentation Team
EnrichVersion
7.1
EnrichProdName
Talend Big Data
Talend Big Data Platform
Talend Data Fabric
Talend Data Integration
Talend Data Management Platform
Talend Data Services Platform
Talend ESB
Talend MDM Platform
Talend Open Studio for Big Data
Talend Open Studio for Data Integration
Talend Open Studio for ESB
Talend Open Studio for MDM
Talend Real-Time Big Data Platform
task
Création et développement > Systèmes tiers > Composants Data Quality > Composants de standardisation
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de standardisation
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de standardisation
EnrichPlatform
Studio Talend

Procédure

  1. Double-cliquez sur le premier tFileInputDelimited pour ouvrir sa vue Basic settings.
  2. Parcourez votre système jusqu'au fichier d'entrée principal, contenant une liste des serveurs et de leur adresse IP :
    Server;IP
    Server1;057.010.010.010
    Server2;001.010.010.100
    Server3;057.030.030.030
    Server4;053.010.010.100
  3. Cliquez sur le bouton [...] à côté du champ Edit schema pour ouvrir la boîte de dialogue Schema et configurer le schéma d'entrée. Selon la structure du fichier d'entrée, le schéma se compose de deux colonnes, Server et IP, de type String. Cliquez ensuite sur OK pour fermer la boîte de dialogue.
  4. Dans le champ Header, saisissez le nombre de lignes d'en-tête à ignorer et laissez les autres champs tels qu'ils sont.
  5. Configurez de la même façon les propriétés du second tFileInputDelimited.
    Le fichier à utiliser en entrée pour le flux de référence liste, dans cet exemple, des intervalles d'adresses IP et le pays correspondant :
    StartIP;EndIP;Country
    001.000.000.000;001.255.255.255;USA
    002.006.190.056;002.006.190.063;UK
    011.000.000.000;011.255.255.255;USA
    057.000.000.000;057.255.255.255;France
    012.063.178.060;012.063.178.063;Canada
    053.000.000.000;053.255.255.255;Germany
    Le schéma du flux de référence doit posséder la structure suivante :
  6. Double-cliquez sur le composant tIntervalMatch pour ouvrir sa vue Basic settings.
  7. Dans la liste Search Column, sélectionnez le flux d'entrée principal contenant les valeurs à mettre en correspondance avec les intervalles de valeurs. Dans cet exemple, les adresses IP des serveurs doivent correspondre aux intervalles de valeurs du flux de référence.
  8. Dans la liste Column (LOOKUP), sélectionnez la colonne de référence contenant les valeurs à retourner. Dans cet exemple, il s'agit du nom des pays où se trouvent les serveurs.
  9. Configurez les colonnes de référence minimale et maximale correspondant aux limites de l'intervalle défini dans le schéma de référence, StartIP et EndIP, respectivement.