Accéder au contenu principal

Principes de travail

Ce composant implémente l'algorithme MapReduce, selon les clés de blocs définies dans la table Blocking definition de la vue Basic settings.

Cette implémentation se fait de la façon suivante :

  1. Divise les lignes d'entrée en groupes d'une taille donnée.

  2. Implémente une classe Map créant un mapping entre chaque clé et une liste d'enregistrements.

  3. Mélange les enregistrements afin de regrouper ceux ayant la même clé.

  4. Applique, sur chaque clé, l'algorithme défini dans la table Key definition de la vue Basic settings.

    Ce composant lit les enregistrements, les compare aux enregistrements maître, regroupe les enregistrements similaires et classe les autres en tant qu'enregistrements maître.

  5. Le composant écrit en sortie les groupes d'enregistrements similaires avec leur ID de groupe, la taille de leur groupe, les distances et les scores de correspondance.

Cette page vous a-t-elle aidé ?

Si vous rencontrez des problèmes sur cette page ou dans son contenu – une faute de frappe, une étape manquante ou une erreur technique – dites-nous comment nous améliorer !