tMatchIndexPredict - 7.1

Continuous matching

author
Talend Documentation Team
EnrichVersion
7.1
EnrichProdName
Talend Big Data Platform
Talend Data Fabric
Talend Data Management Platform
Talend Data Services Platform
Talend MDM Platform
Talend Real-Time Big Data Platform
task
Création et développement > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Gouvernance de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
Qualité et préparation de données > Systèmes tiers > Composants Data Quality > Composants de rapprochement > Composants de rapprochement continu
EnrichPlatform
Studio Talend
Talend Data Stewardship

Ce composant compare un nouveau jeu de données à un jeu de données de référence indexé dans ElasticSearch à l'aide du tMatchIndex. Le tMatchIndexPredict écrit en sortie les enregistrements uniques et les doublons suspects dans des fichiers séparés.

Chaque enregistrement dans la sortie des doublons potentiels contient les champs des enregistrements source et les champs des enregistrements de référence correspondant potentiellement.

Pour plus d'informations concernant le tMatchIndex, consultez tMatchIndex.

Ce composant s'exécute avec Spark 2.0+ et ElasticSearch 5+.

Pour plus d'informations concernant les technologies supportées par Talend, consultez Composants Talend.