Passer au contenu principal
Administrator Guide
Dernière mise à jour : 2023-06-23
Convertir du texte en XML avec un fichier de schéma de texte

Convertir du texte en XML avec un fichier de schéma de texte

Créez un assemblage contenant une étape
textschema
. Procurez-vous l'échantillon de texte qui servira de base à votre schéma de texte.
L'étape
textschema
vous permet de convertir du texte au format XML à l'aide d'un schéma de texte. Pour développer un schéma de texte, vous devez connaître la structure des données que vous souhaitez transformer. Le processus est considérablement simplifié grâce à un petit échantillon de document contenant des données représentatives. Cette rubrique suppose que vous disposez d'un tel échantillon.
Vous pouvez utiliser l'étape
textschema
pour convertir un XML en texte ou pour transformer des fichiers délimités, mais dans la plupart des cas, il est plus simple d'utiliser l'étape
XTT
et l'étape
csv-to-xml
, respectivement.
  1. Dans la vue
    Propriétés
    de l'étape
    textschema
    , cliquez sur
    Create Text Schema File
    .
  2. Sélectionnez un dossier parent pour le fichier de schéma de texte et indiquez un nom de fichier. Si nécessaire, indiquez l'URI de l'espace de noms cible.
  3. Workday Studio ouvre Text Schema Editor et affiche le nouveau schéma de texte dans son
    arborescence
    .
  4. Coupez et collez votre exemple de texte dans la zone en haut à droite de l'éditeur de schéma de texte, en remplaçant
    initial-text
    .
    Pour retirer le retour de ligne de fin des fichiers d'entrée, ajoutez l'attribut suivant à l'élément de schéma racine :
    ts:eofStrip="
"
    .
  5. Commencez par décrire l'échantillon de texte. Sélectionnez le premier champ, faites un clic droit dessus et sélectionnez
    Create Field
    .
    Si vous n'avez pas d'échantillon de texte à convertir mais que vous connaissez sa structure, vous pouvez modifier directement la vue
    Source
    du schéma de texte.
  6. Sur la page
    Identité
    de l'assistant
    Create Field Wizard
    , indiquez une description de base du champ. Pour la tâche, tenez compte des éléments suivants :
    Option Description
    Nom
    Nom du champ.
    Occurrence
    Les options sont les suivantes :
    • Par défaut
       : le champ est obligatoire et n'apparaît qu'une seule fois.
    • Obligatoire
       : identique à la valeur par défaut.
    • Facultatif
       : le champ est facultatif et ne peut apparaître qu'une seule fois.
    • Multiple Optional
       : le champ est facultatif et peut apparaître plusieurs fois.
    • Multiple Required
       : le champ est obligatoire et peut apparaître plusieurs fois.
    Start Tag
    Expression rationnelle spécifiant le texte à l'origine de la génération d'un élément. Notez que le texte correspondant à cette expression ne fait pas partie de la valeur de sortie. Si vous voulez que le texte correspondant s'affiche dans la valeur de sortie, utilisez les
    ts:format
    option.
    End Tag
    Expression rationnelle spécifiant le texte qui marque la fin d'un élément. Notez que le texte correspondant à cette expression ne fait pas partie de la valeur de sortie. Si vous voulez que le texte correspondant s'affiche dans la valeur de sortie, utilisez les
    ts:format
    option.
    Tronquer
    Indique s'il faut tronquer les données en dépassement dans un champ de longueur fixe ou renvoyer une erreur. La valeur par défaut est
    true
    .
    Separator
    Expression rationnelle spécifiant un caractère qui sépare les champs répétés. Activé uniquement si vous sélectionnez l'option d'occurrence
    Multiple Optional
    ou
    Multiple Required
    .
    Omit
    Indique s'il faut omettre le champ de la sortie dans une transformation
    text-to-XML
    ou
    XML-to-text
    . Par défaut, il n'y a pas d'omission.
  7. Sur la page
    Delimit
    de l'assistant
    Create Field Wizard
    , décrivez le nombre de caractères de l'échantillon de texte qui représentent un champ :
    Option Description
    Format
    Expression rationnelle identifiant des modèles de texte valides pour un champ. Utilisez cette expression à la place de
    Start Tag
    et
    End Tag
    pour vous assurer que tout le texte correspondant s'affiche dans la sortie. Vous pouvez également l'utiliser lorsque vous traitez des valeurs multipliées afin de savoir clairement quand la fin de la séquence se produit.
    Longueur fixe
    Indique la longueur des champs de longueur fixe. Inclut les guillemets et les caractères d'échappement.
    Quoted
    Indique si les valeurs de chaîne sont traitées comme des chaînes entre guillemets. Les options sont les suivantes :
    • Par défaut
       :
    • always
       :
    • always-including-empty
       :
    • optional
       :
    • never
       :
    Remplissage
    Expression rationnelle identifiant tout texte de remplissage dans les champs de longueur fixe.
    Preferred Padding
    Indique la valeur à utiliser si l'expression
    Remplissage
    peut correspondre à plusieurs chaînes possibles.
    Aligner
    Indique l'alignement des champs de longueur fixe qui nécessitent un remplissage.
  8. Sur la page
    Interpret
    de l'assistant
    Create Field Wizard
    , décrivez le nombre de caractères de l'échantillon de texte qui représentent un champ :
    Option Description
    Type
    Type de données du champ.
    Valeur par défaut
    Une valeur par défaut pour le champ.
    Format de date
    Indique un modèle pour les dates ou les dates et heures. Prend en charge tous les modèles autorisés par Java.
    SimpleDateFormat
    .
    Date Language
    Indique la langue de la date à utiliser lors de l'interprétation de dates. Garantit que le nom est traité dans la langue appropriée lorsque le format de date utilise le nom des mois. La valeur par défaut est
    EN
    .
    Two Digit Year
    Indique une valeur pour interpréter les dates avec une année à deux chiffres. L'analyseur du schéma de texte interprète les dates avec une année à deux chiffres qui précèdent cette valeur comme se produisant dans le siècle en cours. Exemple : si vous saisissez
    18
    , l'analyseur interprète
    14
    en tant que
    2014
    et
    96
    en tant que
    1996
    .
    Format de nombre
    Indique un modèle pour les nombres. Prend en charge tous les modèles autorisés par Java.
    DecimalFormat
    .
    Séparateur décimal
    Indique le séparateur utilisé pour les nombres décimaux.
    Grouping Separator
    Indique le séparateur des milliers pour les nombres.
  9. Répétez les étapes 6 à 9 pour chaque champ de l'échantillon de texte, en ajoutant de nouveaux éléments dans l'
    arborescence
    . Lorsque vous avez créé toutes les définitions de champ obligatoires, supprimez les définitions restantes.
    Unparsed
    élément enfant.
  10. Pour encapsuler tous les éléments que vous avez créés dans un type complexe, sélectionnez-les, faites un clic droit dessus et sélectionnez
    Wrap Elements
    . Indiquez ensuite un nom et une valeur d'occurrence pour l'élément encapsuleur.
  11. Dans la vue
    Propriétés
    de l'élément encapsuleur, sélectionnez
    /n
    dans la liste déroulante
    End Tag
    .
  12. L'élément racine du schéma par défaut est nommé
    File
    . Dans l'onglet
    Schema
    de la vue
    Propriétés
    de l'élément, saisissez un nom plus explicite.
  13. Dans la vue
    Propriétés
    du périmètre supérieur
    schema
    L'
    élément racine
    a la valeur
    tns:File
    . Remplacer
    File
    avec le nom pertinent que vous avez sélectionné pour l'élément racine.
  14. Pour supprimer des espaces supplémentaires de la sortie générée, sélectionnez la vue
    Propriétés
    du périmètre supérieur.
    schema
    élément. Sélectionnez 
    +
    dans la liste déroulante
    Remplissage
    . Enregistrez le schéma.