Procédure
-
Double-cliquez sur le
tFileInputDelimited pour ouvrir sa vue Basic settings dans l'onglet Component.
Les données d'entrée à utiliser avec le tMatchModel sont les paires de données suspectes générées par le tMatchPairing, comme expliqué dans Calcul de paires suspectes et d'un échantillon de paires suspectes à partir d'un jeu de données.
-
Cliquez sur le bouton [...] à côté du champ
Edit schema pour ouvrir une boîte de dialogue et
ajoutez des colonnes au schéma d'entrée : Original_Id,
Source, Site_name,
Address, PAIR_ID,
SCORE et LABEL.
Le schéma d'entrée est le même que celui utilisé avec l'échantillon de paires suspectes généré par le tMatchPairing. La colonne LABEL contient le libellé manuellement paramétré sur tous les seconds enregistrement des paires.
Pour des raisons de lisibilité, vous pouvez ignorer les colonnes PAIR_ID et SCORE.
- Cliquez sur OK dans la boîte de dialogue et acceptez la propagation des modifications lorsque cela vous est proposé.
- Dans le champ Folder/File, configurez le chemin vers le fichier d'entrée.
-
Configurez les séparateurs de lignes et de champs dans les champs
correspondants, puis paramétrez les en-têtes et pieds de page, s'il y en
a.
Dans cet exemple, le nombre de lignes dans le champ Header doit être configuré à 1.