Passer au contenu principal
Workday User Guide
Dernière mise à jour : 2023-11-03
Analyser des données externes dans un jeu de données

Analyser des données externes dans un jeu de données

  • Un jeu de données de base utilisant des données externes (depuis le téléchargement d'un fichier ou la connexion à un serveur) existe dans le catalogue de données.
  • Sécurité :
    • Domaine
      Prism Datasets: Create
      dans le domaine fonctionnel Prism Analytics lors de la création d'un jeu de données.
    • L'une des conditions de sécurité suivantes lors de la modification d'un jeu de données existant :
      • Domaine
        Prism Datasets: Manage
        dans le domaine fonctionnel Prism Analytics.
      • Autorisation
        Dataset Editor
        sur le jeu de données.
      • Autorisation
        Dataset Owner
        sur le jeu de données.
Lorsque vous importez des données externes dans un jeu de données de base, vous devez décrire les données source dans un format tabulaire. Pour cela, vous allez découvrir comment analyser les données.
Si vous débutez dans Workday, vous ne disposez pas des accès appropriés pour créer ou modifier des jeux de données de base.
Vos données doivent :
  • Être au format de fichier en texte brut.
  • Un enregistrement par ligne.
  • Avoir la même séquence de champs pour chaque enregistrement, séparées par un délimiteur commun (comme une virgule ou un tabulation).
Les enregistrements délimités sont séparés par des sauts de ligne et les champs d'une ligne sont séparés par un caractère spécial appelé le délimiteur (généralement une virgule ou un caractère de tabulation). Si le délimiteur existe aussi dans les valeurs de champ, il doit être échappement. Les jeux de données de base prennent en charge les échappements de caractère unique (comme la barre oblique inversée), ainsi que les valeurs de champ incluses entre guillemets doubles.
  1. Accédez à la tâche
    Modifier des transformations de jeu de données
    pour créer un jeu de données de base utilisant des données externes.
  2. Modifiez la phase Analyse.
    Pour la tâche, tenez compte des éléments suivants :
    Option Description
    Délimiteur de ligne
    Spécifie le caractère unique qui sépare les lignes (ou enregistrements) dans vos fichiers de données source.
    Dans la plupart des fichiers délimités, les lignes sont séparées par une nouvelle ligne, telle que le caractère de saut de ligne, le caractère de retour de chariot ou le retour de chariot plus le retour de ligne. Le flux de lignes est la nouvelle représentation de lignes standard dans les systèmes d'exploitation de type UNICE. D'autres systèmes d'exploitation (comme Windows) peuvent utiliser le retour chariot individuellement, ou le retour chariot plus un retour de ligne. Si vous sélectionnez
    N'importe quelle nouvelle ligne
    , Workday reconnaît n'importe laquelle de ces représentations d'une nouvelle ligne comme délimiteur de ligne.
    Délimiteur de champ
    Spécifie le caractère unique qui sépare les champs (ou colonnes) d'une ligne dans vos fichiers de données source. La virgule et la tabulation sont les délimiteurs de champ les plus courants.
    Noms de champ
    Indique le nom par défaut de chaque champ. Vous pouvez modifier les noms des champs dans la phase Analyser après avoir défini les options d'analyse.
    Les noms de champ doivent respecter les règles de validation de dénomination.
    Workday traite automatiquement la première ligne de chaque fichier source comme une ligne d'en-tête plutôt que comme une ligne de données. Si vous ne voulez pas utiliser la première ligne comme noms de vos champs, désélectionnez la case
    Noms des champs
    .
    Caractère d'échappement
    Spécifie le caractère unique utilisé pour échappement du
    Caractère de devis
    ou une autre instance du
    Caractère d'échappement
    lorsqu'un
    Caractère de devis
    est spécifié. Workday ne prend en compte un caractère d'échappement que s'il est associé à un autre caractère d'échappement.
    Si vos valeurs de données contiennent des caractères d'apostrophe, ces caractères doivent être doublés et la valeur entière du champ doit être jointe au
    caractère d'apostrophe
    . Si ce n'est pas le cas, Workday considère que la apostrophe désigne un nouveau champ.
    Pour les fichiers de valeurs séparées par des virgules (CSV), il est courant d'éviter les délimiteurs de champ en définissant la totalité de la valeur de champ entre guillemets. Si vos données source utilisent cette convention, vous devez indiquer un
    Caractère de guillemet
    .
    Caractère du guillemet
    Certains fichiers délimités utilisent le caractère d'apostrophe pour clôturer les valeurs de données individuelles. Le caractère d'apostrophe est généralement le caractère d'apostrophe ().
    "
    ).
    Si une valeur de champ contient un délimiteur de champ en tant que données, la valeur de champ doit être incluse dans le
    Caractère de guillemets
    , sinon Workday considère que le délimiteur de champ est un nouveau champ.
    Si une valeur de champ contient le caractère de guillemets en tant que données, la valeur de champ doit être incluse dans le
    Caractère de guillemets
    et elle doit être doublée, soit par le
    Caractère d'échappement
    , soit par un autre caractère de guillemets.
    Si une valeur de champ contient un délimiteur de ligne (comme un nouveau caractère de ligne) comme données, la valeur de champ doit être incluse dans le champ
    Caractère de devis
    et
    les valeurs de champ contiennent de nouvelles lignes
    doivent être sélectionnées.
    Supposons que vous avez une ligne contenant les trois valeurs de données suivantes :
    weekly special wine, beer, and soda "2 for 1" or 9.99 each
    Si le délimiteur de champ est une virgule, le caractère de guillemet est un guillemet double et le caractère d'échappement est une barre oblique, alors une ligne correctement formatée dans les données source ressemble à ceci :
    "weekly special","wine, beer, and soda","\"2 for 1\" or 9.99 each"
    Lignes à ignorer
    Spécifie le nombre de lignes au début du fichier à ignorer lors de la lecture du fichier source pendant la création et la publication du jeu de données. Pour utiliser cette option avec l'option
    De la première ligne de la table
    , assurez-vous que la ligne contenant les noms des champs est visible et correspond à la première ligne restante.
    Les valeurs de champ contiennent de nouvelles lignes
    Sélectionnez cette option si vos données source peuvent contenir de nouvelles lignes dans le cadre d'une valeur de champ.
    Lorsque cette option est activée, Workday lit les caractères de nouvelle ligne à l'intérieur de guillemets dans le cadre de la valeur de champ plutôt que comme délimiteur de ligne. Workday interprète tout caractère de délimiteur de ligne en dehors des guillemets comme un nouvel enregistrement.
    L'activation de cette option peut avoir une incidence sur la durée de publication d'un jeu de données si Workday lit des fichiers source très volumineux.
    Notez que des résultats inattendus peuvent s'afficher si vous activez cette option et que le fichier source contient des données incorrectes (par exemple, lorsqu'une valeur de champ comporte un caractère d'apostrophe ouvrante ou fermante, mais pas les deux). Vérifiez que vos données source sont bien créées lorsque vous utilisez cette option.
    Supprimer les caractères d'espace de début et de fin dans les champs de texte
    Cochez cette case si vous souhaitez supprimer les caractères d'espace blanc au début et à la fin des champs de texte.