Propriétés du tUniqRow Standard
Ces propriétés sont utilisées pour configurer le tUniqRow s'exécutant dans le framework de Jobs Standard.
Le composant tUniqRow Standard appartient à la famille Qualité de données.
Le composant de ce framework est disponible dans tous les produits Talend.
Basic settings
| Propriétés | Description |
|---|---|
|
Schema et Edit schema |
|
|
Unique key |
Sélectionnez dans cette zone une ou plusieurs colonnes sur lesquelles le dédoublonnage sera effectué. - Cochez la case Key attribute afin d'effectuer le dédoublonnage sur toutes les colonnes. - Cochez la case Case sensitive afin de différencier les majuscules et les minuscules. |
Advanced settings
| Propriétés | Description |
|---|---|
|
Only once each duplicated key |
Cochez cette case si vous souhaitez envoyer uniquement les premières entrées en doublon des colonnes définies comme clé(s) vers le flux de sortie des doublons. |
|
Use of disk (suitable for processing large row set) |
Cochez cette case pour permettre la génération de fichiers temporaires sur le disque dur lors du traitement de données volumineuses. Cela permet d'éviter les échecs d'exécution liés à une surcharge de la mémoire. Quand cette case est cochée, vous devez également définir les éléments suivants : - Buffer size in memory : sélectionnez le nombre de lignes à mettre en mémoire tampon avant qu'un fichier temporaire ne soit généré sur le disque dur. - Directory for temp files : indiquez l'endroit où les fichiers temporaires doivent être enregistrés. Note InformationsAvertissement :
Assurez-vous de spécifier un répertoire existant pour les fichiers temporaires, sinon l'exécution du Job échouera. |
|
Ignore trailing zeros for BigDecimal |
Cochez cette case pour ignorer les zéros non nécessaires dans le traitement de données BigDecimal. |
|
Statistiques du tStatCatcher |
Cochez cette case pour collecter les métadonnées de traitement du Job au niveau du Job ainsi qu'au niveau de chaque composant. |
Variables globales
| Variables | Description |
|---|---|
|
Variables globales |
NB_UNIQUES : nombre de lignes uniques. Cette variable est une variable After et retourne un entier. NB_DUPLICATES : nombre de lignes en doublon. Cette variable est une variable After et retourne un entier. ERROR_MESSAGE : message d'erreur généré par le composant lorsqu'une erreur survient. Cette variable est une variable After et retourne une chaîne de caractères. Cette variable fonctionne uniquement si la case Die on error est décochée, lorsque le composant contient cette case. Une variable Flow fonctionne durant l'exécution d'un composant. Une variable After fonctionne après l'exécution d'un composant. Pour renseigner un champ ou une expression à l'aide d'une variable, appuyez sur les touches Ctrl+Espace pour accéder à la liste des variables. À partir de cette liste, vous pouvez choisir la variable que vous souhaitez utiliser. Pour plus d'informations concernant les variables, consultez Utiliser les contextes et les variables. |
Utilisation
| Conseils d'utilisation | Description |
|---|---|
|
Règle d'utilisation |
Ce composant est un composant intermédiaire puisqu'il sert à traiter un flux de données. Ainsi, il nécessite un composant d'entrée et un composant de sortie. |