Skip to main content

Écriture fichier

Écrit le flux d'entrée en fichiers vers n'importe quelle connexion storage. Le format est choisi sur la brick : une même connexion peut servir plusieurs formats. Cette brick unifiée remplace les anciennes bricks CSV / JSON / Excel / Parquet / XML Export.

La brick consomme l'entrée in et n'a pas de port de sortie. La connexion se choisit dans le panneau de configuration, voir Créer une connexion.

Paramètres communs​

ParamètreTypeRequisDescription
connection_idStringOuiConnexion storage utilisée.
file_formatEnumOuicsv, json, excel, parquet, xml, flat (texte brut).
filenameStringOuiNom du fichier de sortie (défaut export).
overwrite_modeEnumNonoverwrite (écraser, défaut), append (compléter si existe), error (échouer si existe).
output_modeEnumNonsingle (un fichier, défaut), split_rows, split_size, split_column.

Découpage en plusieurs fichiers​

ModeParamètreDescription
split_rowssplit_rows (défaut 10 000)Un fichier par tranche de N lignes, suffixe _0001, _0002…
split_sizesplit_size_mb (défaut 100)Découpage par taille cible en Mo (approximé par nombre de lignes).
split_columnsplit_column_nameUn fichier par valeur distincte de la colonne, suffixée au nom.

Les options spécifiques au format s'affichent selon le file_format choisi ; détail par format ci-dessous.

CSV​

Écriture via DataFrame.to_csv.

ParamètreDéfautDescription
encodingutf-8utf-8, utf-16, latin1, iso-8859-1, cp1252, ascii.
delimiter,Séparateur : virgule, point-virgule, tabulation, pipe ou espace.
headertrueÉcrire la ligne d'en-têtes.
quotechar"Caractère de citation (" ou ').
decimal.Séparateur décimal (. ou ,).

JSON​

Écriture via DataFrame.to_json.

ParamètreDéfautDescription
encodingutf-8Encodage du fichier.
json_orientrecordsOrientation : records, index, columns, values, split, table.
json_linesfalseFormat JSON Lines (un objet par ligne).

Excel​

Écriture via DataFrame.to_excel (openpyxl, fichiers .xlsx).

ParamètreDéfautDescription
sheet_nameSheet1Nom de la feuille.
headertrueÉcrire la ligne d'en-têtes.

XML​

Écriture via DataFrame.to_xml.

ParamètreDéfautDescription
encodingutf-8Encodage du fichier.
xml_root_namerootNom de l'élément racine.
xml_row_namerowNom de l'élément par ligne.

Parquet​

Écriture via DataFrame.to_parquet (pyarrow). Aucun paramètre spécifique : le schéma est porté par le fichier.

Brut / texte plat​

Écrit une ligne de texte par ligne du flux, à partir de la première colonne du DataFrame.

ParamètreDéfautDescription
encodingutf-8Encodage du fichier.

En mode itération​

Placée en aval d'une Source fichier en mode itérer, la brick reprend automatiquement le nom du fichier source (en conservant l'extension configurée) : chaque fichier d'entrée produit son fichier de sortie homonyme.

tip

Combinez split_column avec une colonne métier (agence, pays, mois…) pour produire un fichier par valeur, par exemple export_FR.csv, export_DE.csv.