tMatchModel
Ce composant génère le modèle de rapprochement utilisé par le composant tMatchPredict pour prédire automatiquement les libellés pour les paires suspectes et de grouper les enregistrements qui correspondent au(x) libellé(s) configuré(s) dans les propriétés du composant.
Pour plus d'informations concernant les composants tMatchPairing et tMatchPredict, consultez le tMatchPairing et le tMatchPredict, respectivement.
Le tMatchModel lit l'échantillon de paires suspectes écrites en sortie par le tMatchPairing, après avoir libellé le second élément de chaque paire, puis analyse les données à l'aide de l'algorithme Random Forest et génère un modèle de rapprochement.
Vous pouvez utiliser les enregistrements suspects d'exemple dans une campagne Grouping définie dans Talend Data Stewardship avec tMatchModel.
En mode local, les versions 2.4.0 et supérieures d'Apache Spark sont supportées.
Ce composant n'est pas intégré par défaut à votre Studio Talend. Vous devez l'installer à l'aide du gestionnaire des fonctionnalités. Pour plus d'informations, consultez Installer les fonctionnalités à l'aide du Gestionnaire des fonctionnalités.