Skip to main content
Workday User Guide
Laatst bijgewerkt: 2023-11-03
Externe gegevens in een gegevensset parseren

Externe gegevens in een gegevensset parseren

  • In de gegevenscatalogus bestaat al een basisgegevensset die externe gegevens gebruikt (door een bestand te uploaden of verbinding te maken met een server).
  • Beveiliging:
    • Prism-gegevenssets: maak
      een domein in het functionele gebied Prism Analytics wanneer u een gegevensset maakt.
    • Een van deze beveiligingsvereisten bij het bewerken van een bestaande gegevensset:
      • Prism-gegevenssets: beheer
        het domein in het functionele gebied Prism Analytics.
      • Machtiging
        Gegevensseteditor
        voor de gegevensset.
      • Machtiging
        Eigenaar gegevensset
        voor de gegevensset.
Wanneer u externe gegevens in een basisgegevensset opneemt, moet u de brongegevens in tabelindeling beschrijven. Dit doet u door te beschrijven hoe de gegevens moeten worden geparseerd.
Als Workday nieuw voor u is, hebt u geen toegang om basisgegevenssets te maken of te bewerken.
Uw gegevens moeten:
  • Bestandsindelingen zonder opmaak zijn.
  • Eén record per regel hebben.
  • Zorg voor dezelfde reeks velden voor elke record, gescheiden door een gemeenschappelijk scheidingsteken (zoals een komma of een tabblad).
Records met scheidingstekens worden van elkaar gescheiden door regeleinden en velden binnen een regel worden gescheiden door een speciaal teken, het scheidingsteken (meestal een komma of tab). Als het scheidingsteken ook in de veldwaarden voorkomt, moet het worden voorzien van een escapeteken. Basisgegevenssets ondersteunen enkelvoudige tekens (zoals een backslash) en veldwaarden tussen dubbele aanhalingstekens.
  1. Open de taak
    voor het bewerken van gegevenssettransformaties
    voor een basisgegevensset die externe gegevens gebruikt.
  2. Bewerk de parseringsfase.
    Houd rekening met het volgende wanneer u deze taak voltooit:
    Optie Omschrijving
    Rijscheidingsteken:
    Hiermee geeft u het enkele teken op dat rijen (of records) in uw brongegevensbestanden scheidt.
    In de meeste bestanden met scheidingstekens worden rijen gescheiden door een nieuwe regel, zoals het regelterugloopteken, het regelterugloopteken of het regelterugloopteken plus regelterugloop. Regelinvoer is de standaard nieuwe regelweergave op UNIX-achtige besturingssystemen. Andere besturingssystemen (zoals Windows) kunnen een afzonderlijke regelterugloop of een regelterugloop plus regelinvoer gebruiken. Als u
    'Willekeurige nieuwe regel'
    selecteert, wordt een van deze weergaven van een nieuwe regel in Workday als rijscheidingsteken herkend.
    Scheidingsteken voor veld
    Hiermee geeft u het enkele teken op dat de velden (of kolommen) van een rij in uw brongegevensbestanden scheidt. Komma's en tabs zijn de meest voorkomende veldscheidingstekens.
    Veldnamen
    Hiermee geeft u de standaardnaam van elk veld op. U kunt de veldnamen in de parseringsfase wijzigen nadat u klaar bent met het definiëren van de parseringsopties.
    Veldnamen moeten voldoen aan de validatieregels voor namen.
    In Workday wordt de eerste regel in elk bronbestand automatisch behandeld als een koprij in plaats van als een rij met gegevens. Als u de eerste regel niet als naam voor uw velden wilt gebruiken, schakelt u het selectievakje
    Veldnamen
    uit.
    Escape-teken
    Hiermee wordt het afzonderlijke teken opgegeven dat als escapeteken moet worden gebruikt voor het
    aanhalingsteken
    of een andere instance van het
    escapeteken
    als er een
    aanhalingsteken
    is opgegeven. Een escape-teken wordt alleen als gegevens gelezen als het met een ander escape-teken wordt gebruikt.
    Als uw gegevenswaarden aanhalingstekens als gegevens bevatten, moeten deze tekens een escapeteken bevatten en moet de volledige veldwaarde worden ingesloten tussen het
    offerteteken
    . Als dit niet het geval is, wordt ervan uitgegaan dat het aanhalingsteken een nieuw veld aangeeft.
    Voor bestanden met door komma's gescheiden waarden (CSV) is het gebruikelijk om veldscheidingstekens te omzeilen door de volledige veldwaarde tussen dubbele aanhalingstekens te plaatsen. Als uw brongegevens deze conventie gebruiken, moet u het
    offerteteken
    opgeven.
    Offerteteken
    Sommige bestanden met scheidingstekens gebruiken aanhalingstekens om afzonderlijke gegevenswaarden in te sluiten. Het aanhalingsteken is meestal het dubbele aanhalingsteken (
    "
    ).
    Als een veldwaarde een veldscheidingsteken als gegevens bevat, moet de veldwaarde worden ingesloten in het
    offerteteken
    . Anders wordt ervan uitgegaan dat het veldscheidingsteken een nieuw veld aanduidt.
    Als een veldwaarde het aanhalingsteken als gegevens bevat, moet de veldwaarde worden ingesloten in het
    aanhalingsteken
    en moet de waarde worden geëscaleerd met een
    escapeteken
    of een ander aanhalingsteken.
    Als een veldwaarde een rijscheidingsteken (zoals een nieuw regelteken) als gegevens bevat, moet de veldwaarde worden ingesloten in het
    offerteteken
    en
    moeten
    Veldwaarden die nieuwe regels bevatten
    worden geselecteerd.
    Stel dat u een rij hebt met deze drie gegevenswaarden:
    weekly special wine, beer, and soda "2 for 1" or 9.99 each
    Als het veldscheidingsteken een komma is, het aanhalingsteken een dubbel aanhalingsteken is en het escape-teken een backslash is, ziet een correct opgemaakte rij in de brongegevens er als volgt uit:
    "weekly special","wine, beer, and soda","\"2 for 1\" or 9.99 each"
    Te negeren rijen
    Hiermee geeft u het aantal regels aan het begin van het bestand op dat moet worden genegeerd bij het lezen van het bronbestand tijdens het maken en publiceren van de gegevensset. Als u deze optie wilt gebruiken met de optie
    Van eerste tabelrij
    , moet u ervoor zorgen dat de regel met de veldnamen zichtbaar is en de eerste resterende regel is.
    Veldwaarden bevatten nieuwe regels
    Schakel deze optie in als uw brongegevens mogelijk nieuwe regeltekens bevatten als onderdeel van een veldwaarde.
    Als deze optie is ingeschakeld, leest Workday de nieuwe regeltekens tussen aanhalingstekens als onderdeel van de veldwaarde in plaats van als rijscheidingsteken. Alle rijscheidingstekens buiten de aanhalingstekens worden in Workday geïnterpreteerd als een nieuwe record.
    Het inschakelen van deze optie kan van invloed zijn op de publicatietijd van een gegevensset als zeer grote bronbestanden worden gelezen.
    Houd er rekening mee dat u onverwachte resultaten kunt krijgen als u deze optie inschakelt en het bronbestand onjuiste gegevens bevat (bijvoorbeeld wanneer een veldwaarde een aanhalingsteken aan het begin of aan het einde heeft, maar niet beide). Zorg ervoor dat uw brongegevens goed zijn gevormd wanneer u deze optie gebruikt.
    Voorloop- en volgspaties in tekstvelden bijsnijden
    Schakel dit selectievakje in als u spaties aan het begin en einde van tekstvelden wilt verwijderen.