Propriétés du tFileOutputDelimited Standard - Cloud - 8.0

Délimité

Version
Cloud
8.0
Language
Français
Product
Talend Big Data
Talend Big Data Platform
Talend Data Fabric
Talend Data Integration
Talend Data Management Platform
Talend Data Services Platform
Talend ESB
Talend MDM Platform
Talend Real-Time Big Data Platform
Module
Studio Talend
Content
Création et développement > Systèmes tiers > Composants File (Intégration) > Composants Delimited
Gouvernance de données > Systèmes tiers > Composants File (Intégration) > Composants Delimited
Qualité et préparation de données > Systèmes tiers > Composants File (Intégration) > Composants Delimited
Last publication date
2024-03-04

Ces propriétés sont utilisées pour configurer le tFileOutputDelimited s'exécutant dans le framework de Jobs Standard.

Le composant tFileOutputDelimited Standard appartient à la famille Fichier.

Le composant de ce framework est disponible dans tous les produits Talend.

Basic settings

Property type

Peut être Built-In ou Repository.

 

Built-In : aucune propriété n'est stockée de manière centrale.

 

Repository : Sélectionnez le fichier dans lequel sont stockées les propriétés du composant.

Use Output Stream

Cochez la case pour traiter le flux de données qui vous intéresse. Une fois cochée, le champ Output Stream s'affiche et vous pouvez saisir le flux de données souhaité.

Le flux de données à traiter doit être ajouté au flux afin que ce composant récupère ces données via la variable représentative correspondante.

Cette variable peut être prédéfinie dans le Studio Talend, ou fournie par le contexte ou les composants que vous utilisez avec ce composant. Sinon, vous pouvez la définir manuellement et l'utiliser en fonction de la conception du Job, par exemple avec un tJava ou un tJavaFlex.

Afin d'éviter les désagréments de la saisie, vous pouvez sélectionner la variable qui vous intéresse dans la liste d'autocomplétion (Ctrl+Espace) afin de remplir le champ, si cette variable a été correctement définie.

Pour plus d'informations concernant l'utilisation d'un flux, consultez Lire les données d'un fichier distant en mode stream.

File Name

Nom ou chemin d'accès du fichier de sortie, et/ou variable à utiliser.

Ce champ est indisponible lorsque vous avez coché la case Use Output Stream.

Pour plus d'informations concernant la définition et l'utilisation d'une variable dans un Job, consultez Utiliser les contextes et les variables.

Avertissement : Utilisez un chemin absolu (au lieu d'un chemin relatif) dans ce champ pour éviter des erreurs.

Row Separator

Saisissez le séparateur utilisé pour identifier la fin d'une ligne.

Field Separator

Saisissez un caractère ou une chaîne de caractères pour séparer les champs des données transférées.

Remarque : Lorsque l'option CSV options est sélectionnée dans la vue Advanced settings, le séparateur de champs peut n'être qu'un seul caractère. Dans ce cas, si vous saisissez plusieurs caractères dans ce champ, seul le premier sera considéré comme le séparateur de champs.

Append (Écrire à la suite)

Cochez cette option pour ajouter des nouvelles lignes à la fin du fichier.

Include Header

Cochez cette case pour inclure l'en-tête des colonnes dans le fichier.

Compress as zip file

Cochez cette case pour compresser en zip le fichier de sortie.

Schema et Edit schema

Un schéma est une description de lignes. Il définit le nombre de champs (colonnes) à traiter et à passer au composant suivant. Lorsque vous créez un Job Spark, évitez le mot réservé line lors du nommage des champs.

Créez le schéma en cliquant sur le bouton Edit Schema. Si le schéma est en mode Repository, trois options sont disponibles :

  • View schema : sélectionnez cette option afin de voir uniquement le schéma.

  • Change to built-in property : sélectionnez cette option pour passer le schéma en mode Built-In et effectuer des modifications locales.

  • Update repository connection : sélectionnez cette option afin de modifier le schéma stocké dans le référentiel et décider de propager ou non les modifications à tous les Jobs.

    Si vous souhaitez propager les modifications uniquement au Job courant, cliquez sur No et sélectionnez à nouveau la métadonnée du schéma dans la fenêtre Repository Content.

Ce composant offre la fonction de schéma dynamique. Cela vous permet de récupérer des colonnes inconnues de fichiers sources ou de copier des lots de colonnes d'une source sans avoir à mapper chaque colonne individuellement. Pour plus d'informations concernant les schémas dynamiques, consultez Schéma dynamique.

Cette fonctionnalité de schéma dynamique est conçue pour permettre de récupérer des colonnes inconnues d'une table. Il est recommandé de l'utiliser uniquement à cet effet et non pour créer des tables.

 

Built-in : le schéma est créé et conservé localement pour ce composant seulement.

 

Repository : le schéma existe déjà et est stocké dans le Repository. Ainsi, il peut être réutilisé dans des Jobs et projets.

Sync colonnes

Cliquez sur ce bouton pour synchroniser le schéma de sortie avec celui d'entrée. La fonction Sync ne s'affiche que lorsqu'une connexion de type Row est connectée au composant de sortie.

Advanced settings

Advanced separator (for number)

Cochez cette case pour modifier le séparateur utilisé pour les nombres. Par défaut, le séparateur des milliers est une virgule (,) et le séparateur décimal est un point (.).

Thousands separator : définissez le séparateur utilisé pour les milliers.

Decimal separator : définissez le séparateur utilisé pour les décimaux.

CSV options

Cochez cette case afin de spécifier les paramètres CSV suivants :

  • Escape char : saisissez le caractère d'échappement entre guillemets doubles.

  • Text enclosure : saisissez le caractère avec lequel entourer le texte (un seul caractère) entre guillemets doubles. Par exemple, vous devez saisir """ lorsque le guillemet double (") est utilisé comme caractère pour entourer le texte.

Il est recommandé d'utiliser le caractère d'échappement standard : "\". Sinon, vous devriez utiliser le même caractère pour les paramètres Escape char et Text enclosure. Par exemple, si le caractère d'échappement est "\", le caractère d'entourage du texte peut être n'importe quel autre caractère. En revanche, si le caractère d'échappement est un caractère autre que "\", le caractère d'entourage du texte peut être n'importe quel autre caractère. Cependant, le caractère d'échappement sera modifié pour correspondre au caractère d'entourage du texte. Par exemple, si le caractère d'échappement est "#" et le caractère d'entourage du texte est "@", le caractère d'échappement sera modifié en "@", et pas "#".

Create directory if not exists

Cette case est cochée par défaut. Cette option permet de créer le dossier contenant le fichier délimité de sortie s'il n'existe pas déjà.

Split output in several files

Si le fichier délimité en sortie est volumineux, vous pouvez le scinder en plusieurs fichiers.

Rows in each output file : saisissez le nombre de lignes pour chaque fichier de sortie.

Custom the flush buffer size

Cochez cette case pour définir le nombre de lignes à écrire avant de vider le tampon.

Row Number : définissez le nombre de lignes à écrire.

Output in row mode

Cochez cette case pour assurer que l'action de vider le tampon se termine complètement (atomicité), afin que chaque ligne de données reste cohérente en tant qu'ensemble et que les lignes incomplètes de données ne soient jamais écrites dans un fichier.

Cette case est principalement utile lorsque vous utilisez ce composant en multithread.

Encoding

Sélectionnez l'encodage à partir de la liste ou sélectionnez Custom et définissez-le manuellement. Ce champ est obligatoire pour la manipulation des données de base de données. Les encodages supportés dépendent de la JVM que vous utilisez. Pour plus d'informations, consultez https://docs.oracle.com.

Don't generate empty file

Cochez cette case si vous ne souhaitez pas générer de fichier vide.

Throw an error if the file already exist

Cochez cette case pour retourner une exception si le fichier de sortie spécifié dans le champ File Name, dans l'onglet Basic settings existe déjà.

Décochez cette case pour écraser le fichier existant.

tStatCatcher Statistics

Cochez cette case pour collecter les métadonnées de traitement du Job au niveau du Job ainsi qu'au niveau de chaque composant.

Variables globales

Variables globales

NB_LINE : nombre de lignes lues par un composant d'entrée ou passées à un composant de sortie. Cette variable est une variable After et retourne un entier.

FILE_NAME : nom du fichier traité. Cette variable est une variable Flow et retourne une chaîne de caractères.

ERROR_MESSAGE : message d'erreur généré par le composant lorsqu'une erreur survient. Cette variable est une variable After et retourne une chaîne de caractères. Cette variable fonctionne uniquement si la case Die on error est décochée, lorsque le composant contient cette case.

Une variable Flow fonctionne durant l'exécution d'un composant. Une variable After fonctionne après l'exécution d'un composant.

Pour renseigner un champ ou une expression à l'aide d'une variable, appuyez sur les touches Ctrl+Espace pour accéder à la liste des variables. À partir de cette liste, vous pouvez choisir la variable que vous souhaitez utiliser.

Pour plus d'informations concernant les variables, consultez Utiliser les contextes et les variables.

Utilisation

Règle d'utilisation

Utilisez ce composant pour écrire un fichier délimité et séparer les champs à l'aide d'un séparateur.

Ce composant ne supporte pas l'utilisation du tSetDynamicSchema.

Limitation

Du fait d'une incompatibilité de licence, un ou plusieurs Jar requis pour utiliser ce composant ne sont pas fournis. Vous pouvez installer les Jar manquants pour ce composant en cliquant sur le bouton Install dans l'onglet Component. Vous pouvez également trouver les JAR manquants et les ajouter dans l'onglet Modules de la perspective Integration de votre Studio Talend. Pour plus d'informations, consultez la page Installation de modules externes.