Propriétés du tFileOutputDelimited Standard - 7.3

Delimited

EnrichVersion
Cloud
7.3
EnrichProdName
Talend Big Data
Talend Big Data Platform
Talend Data Fabric
Talend Data Integration
Talend Data Management Platform
Talend Data Services Platform
Talend ESB
Talend MDM Platform
Talend Open Studio for Big Data
Talend Open Studio for Data Integration
Talend Open Studio for ESB
Talend Real-Time Big Data Platform
EnrichPlatform
Studio Talend
task
Création et développement > Systèmes tiers > Composants File (Intégration) > Composants Delimited
Gouvernance de données > Systèmes tiers > Composants File (Intégration) > Composants Delimited
Qualité et préparation de données > Systèmes tiers > Composants File (Intégration) > Composants Delimited

Ces propriétés sont utilisées pour configurer le tFileOutputDelimited s'exécutant dans le framework de Jobs Standard.

Le composant tFileOutputDelimited Standard appartient à la famille Fichier.

Le composant de ce framework est disponible dans tous les produits Talend.

Basic settings

Property type

Peut être Built-In ou Repository.

 

Built-In : aucune propriété n'est stockée de manière centrale.

 

Repository : Sélectionnez le fichier dans lequel sont stockées les propriétés du composant.

Use Output Stream

Cochez la case pour traiter le flux de données qui vous intéresse. Une fois cochée, le champ Output Stream s'affiche et vous pouvez saisir le flux de données souhaité.

Le flux de données à traiter doit être ajouté au flux afin que ce composant récupère ces données via la variable représentative correspondante.

Cette variable peut être prédéfinie dans votre Studio ou fournie par le contexte ou les composants utilisés avec ce composant. Sinon, vous pouvez la définir manuellement et l'utiliser selon votre Job, par exemple à l'aide d'un tJava ou d'un tJavaFlex.

Afin d'éviter les désagréments de la saisie, vous pouvez sélectionner la variable qui vous intéresse dans la liste d'autocomplétion (Ctrl+Espace) afin de remplir le champ, si cette variable a été correctement définie.

Pour plus d'informations concernant l'utilisation d'un flux, consultez Lire les données d'un fichier distant en mode stream.

File Name

Nom ou chemin d'accès du fichier de sortie, et/ou variable à utiliser.

Ce champ est indisponible lorsque vous avez coché la case Use Output Stream.

Pour plus d'informations concernant l'utilisation et la définition de variables dans un Job, consultez le Guide utilisateur du Studio Talend .

Avertissement : Utilisez un chemin absolu (au lieu d'un chemin relatif) dans ce champ pour éviter des erreurs.

Row Separator

Saisissez le séparateur utilisé pour identifier la fin d'une ligne.

Field Separator

Saisissez un caractère, une chaîne de caractères ou une expression régulière pour séparer les champs des données transférées.

Append

Cochez cette option pour ajouter des nouvelles lignes à la fin du fichier.

Include Header

Cochez cette case pour inclure l'en-tête des colonnes dans le fichier.

Compress as zip file

Cochez cette case pour compresser en zip le fichier de sortie.

Schema et Edit schema

Un schéma est une description de lignes. Il définit le nombre de champs (colonnes) à traiter et à passer au composant suivant. Lorsque vous créez un Job Spark, évitez le mot réservé line lors du nommage des champs.

Modifiez le schéma en cliquant sur Edit Schema. Si le schéma est en mode Repository, trois options sont disponibles :

  • View schema : sélectionnez cette option afin de voir uniquement le schéma.

  • Change to built-in property : sélectionnez cette option pour passer le schéma en mode Built-In et effectuer des modifications locales.

  • Update repository connection : sélectionnez cette option afin de modifier le schéma stocké dans le référentiel et décider de propager ou non les modifications à tous les Jobs. Si vous souhaitez propager les modifications uniquement au Job courant, cliquez sur No et sélectionnez à nouveau la métadonnée du schéma dans la fenêtre Repository Content.

Ce composant offre la fonction de schéma dynamique. Cela vous permet de récupérer des colonnes inconnues de fichiers sources ou de copier des lots de colonnes d'une source sans avoir à mapper chaque colonne individuellement. Pour plus d'informations concernant les schémas dynamiques, consultez le Guide utilisateur du Studio Talend.

Cette fonctionnalité de schéma dynamique est conçue pour permettre de récupérer des colonnes inconnues d'une table. Il est recommandé de l'utiliser uniquement à cet effet et non pour créer des tables.

 

Built-in : le schéma est créé et conservé localement pour ce composant seulement.

 

Repository : le schéma existe déjà et est stocké dans le Repository. Ainsi, il peut être réutilisé dans des Jobs et projets.

Sync colonnes

Cliquez sur ce bouton pour synchroniser le schéma de sortie avec celui d'entrée. La fonction Sync ne s'affiche que lorsqu'une connexion de type Row est connectée au composant de sortie.

Advanced settings

Advanced separator (for number)

Cochez cette option pour modifier les séparateurs utilisés pour les nombres. Par défaut, le séparateur des milliers est une virgule (,) et le séparateur décimal est un point (.).

Thousands separator : définissez le séparateur utilisé pour les milliers.

Decimal separator : définissez le séparateur utilisé pour les décimaux.

CSV options

Cochez cette case afin de spécifier les paramètres CSV suivants :

  • Escape char : saisissez le caractère d'échappement entre guillemets doubles.

  • Text enclosure : saisissez le caractère avec lequel entourer le texte (un seul caractère) entre guillemets doubles. Par exemple, vous devez saisir """ lorsque le guillemet double (") est utilisé comme caractère pour entourer le texte.

Il est recommandé d'utiliser le caractère d'échappement standard : "\". Sinon, vous devriez utiliser le même caractère pour les paramètres Escape char et Text enclosure. Par exemple, si le caractère d'échappement est "\", le caractère d'entourage du texte peut être n'importe quel autre caractère. En revanche, si le caractère d'échappement est un caractère autre que "\", le caractère d'entourage du texte peut être n'importe quel autre caractère. Cependant, le caractère d'échappement sera modifié pour correspondre au caractère d'entourage du texte. Par exemple, si le caractère d'échappement est "#" et le caractère d'entourage du texte est "@", le caractère d'échappement sera modifié en "@", et pas "#".

Create directory if not exists

Cette case est cochée par défaut. Cette option permet de créer le dossier contenant le fichier délimité de sortie s'il n'existe pas déjà.

Split output in several files

Si le fichier délimité en sortie est volumineux, vous pouvez le scinder en plusieurs fichiers.

Rows in each output file : saisissez le nombre de lignes pour chaque fichier de sortie.

Custom the flush buffer size

Cochez cette case pour définir le nombre de lignes à écrire avant de vider le tampon.

Row Number : définissez le nombre de lignes à écrire.

Output in row mode

Cochez cette case pour assurer que l'action de vider le tampon se termine complètement (atomicité), afin que chaque ligne de données reste cohérente en tant qu'ensemble et que les lignes incomplètes de données ne soient jamais écrites dans un fichier.

Cette case est principalement utile lorsque vous utilisez ce composant en multithread.

Encoding

Sélectionnez l'encodage à partir de la liste ou sélectionnez Custom et définissez-le manuellement. Ce champ est obligatoire pour la manipulation des données de base de données. Les encodages supportés dépendent de la JVM que vous utilisez. Pour plus d'informations, consultez https://docs.oracle.com.

Don't generate empty file

Cochez cette case si vous ne souhaitez pas générer de fichier vide.

Throw an error if the file already exist

Cochez cette case pour retourner une exception si le fichier de sortie spécifié dans le champ File Name, dans l'onglet Basic settings existe déjà.

Décochez cette case pour écraser le fichier existant.

tStatCatcher Statistics

Cochez cette case pour collecter les métadonnées de traitement du Job au niveau du Job ainsi qu'au niveau de chaque composant.

Variables globales

Global Variables

NB_LINE : nombre de lignes lues par un composant d'entrée ou passées à un composant de sortie. Cette variable est une variable After et retourne un entier.

FILENAME : nom du fichier en cours de traitement. Cette variable est une variable Flow et retourne une chaîne de caractères.

ERROR_MESSAGE : message d'erreur généré par le composant lorsqu'une erreur survient. Cette variable est une variable After et retourne une chaîne de caractères. Cette variable fonctionne uniquement si la case Die on error est décochée, lorsque le composant contient cette case.

Une variable Flow fonctionne durant l'exécution d'un composant. Une variable After fonctionne après l'exécution d'un composant.

Pour renseigner un champ ou une expression à l'aide d'une variable, appuyez sur les touches Ctrl+Espace pour accéder à la liste des variables. À partir de cette liste, vous pouvez choisir la variable que vous souhaitez utiliser.

Pour plus d'informations concernant les variables, consultez le Guide utilisateur du Studio Talend .

Utilisation

Règle d'utilisation

Utilisez ce composant pour écrire un fichier délimité et séparer les champs à l'aide d'un séparateur.

Limitation

Du fait d'une incompatibilité de licence, un ou plusieurs Jar requis pour utiliser ce composant ne sont pas fournis. Vous pouvez installer les Jar manquants pour ce composant en cliquant sur le bouton Install dans l'onglet Component. Vous pouvez également trouver les Jar manquants et les ajouter dans l'onglet Modules de la perspective Integration de votre Studio. Pour plus d'informations, consultez la page Installation de modules externes.