Passa al contenuto principale
Workday User Guide
Ultimo aggiornamento: 2023-11-03
Analizzare i dati esterni in un set di dati

Analizzare i dati esterni in un set di dati

  • Nel Catalogo dati esiste un set di dati di base che utilizza dati esterni (dal caricamento di un file o dalla connessione a un server).
  • Criteri di sicurezza:
    • Prism Datasets: Create
      dominio nell'area funzionale Prism Analytics durante la creazione di un set di dati.
    • Uno dei seguenti requisiti di sicurezza quando si modifica un set di dati esistente:
      • Dominio
        Prism Datasets: Manage
        nell'area funzionale Prism Analytics.
      • Autorizzazione
        Editor set di dati
        per il set di dati.
      • Autorizzazione
        di Proprietario del set di dati
        per il set di dati.
Quando si importano dati esterni in un set di dati di base, è necessario descrivere i dati di origine in un formato tabulare. A tale scopo, descrive come analizzare i dati.
I nuovi utenti di Workday non dispongono dell'accesso per creare o modificare i set di dati di base.
I dati devono:
  • Essere in formato di file di testo normale.
  • Avere un record per riga.
  • Avere la stessa sequenza di campi per ogni record separato da un delimitatore comune (ad esempio una virgola o una tabulazione).
I record delimitati sono separati da interruzioni di riga e i campi all'interno di una riga sono separati da un carattere speciale chiamato delimitatore (in genere una virgola o un carattere di tabulazione). Se il delimitatore esiste anche nei valori del campo, deve essere preceduto da caratteri di escape. I set di dati di base supportano l'escape di un solo carattere (ad esempio una barra rovesciata) e i valori dei campi racchiusi tra virgolette doppie.
  1. Accedere all'attività
    Modifica trasformazioni set di dati
    per un set di dati di base che utilizza dati esterni.
  2. Modificare la fase Analisi.
    L'attività contiene i seguenti elementi:
    Opzione Descrizione
    Delimitatore di riga
    Specifica il singolo carattere che separa le righe (o i record) nei file di dati di origine.
    Nella maggior parte dei file delimitati, le righe sono separate da una nuova riga, ad esempio il carattere di avanzamento riga, il carattere di ritorno a capo o il ritorno a capo più feed di riga. Il feed di riga è la nuova rappresentazione di riga standard nei sistemi operativi simili a UNIX. Altri sistemi operativi (come Windows) potrebbero utilizzare il ritorno a capo singolarmente o il ritorno a capo più l'avanzamento riga. Se si seleziona
    Qualsiasi nuova riga
    , il sistema riconosce una di queste rappresentazioni di una nuova riga come delimitatore di riga.
    Delimitatore di campo
    Specifica il singolo carattere che separa i campi (o le colonne) di una riga nei file di dati di origine. La virgola e la tabulazione sono i delimitatori di campo più comuni.
    Nomi campi
    Specifica il nome predefinito di ogni campo. È possibile modificare i nomi dei campi nella fase Analisi dopo aver definito le opzioni di analisi.
    I nomi dei campi devono seguire le regole di convalida della denominazione.
    Il sistema considera automaticamente la prima riga di ogni file di origine come una riga di intestazione anziché come una riga di dati. Se non si desidera utilizzare la prima riga come nome per i campi, deselezionare la casella di controllo
    Nomi campo
    .
    Carattere di escape
    Specifica il singolo carattere utilizzato per l'escape del
    Carattere di virgoletta
    o di un'altra istanza del
    Carattere di escape
    quando viene specificato un
    Carattere di virgoletta
    . Il sistema legge un carattere di escape come dati solo se è associato a un altro carattere di escape.
    Se i valori dei dati contengono caratteri di virgoletta come dati, è necessario utilizzare l'escape di tali caratteri e l'intero valore del campo deve essere racchiuso tra il
    Carattere di virgoletta
    . In caso contrario, il sistema presuppone che il carattere virgoletta indichi un nuovo campo.
    Per i file con valori separati da virgole (CSV), è prassi comune evitare i delimitatori di campo racchiudendo l'intero valore del campo tra virgolette doppie. Se i dati di origine utilizzano questa convenzione, è necessario specificare un
    Carattere preventivo
    .
    Carattere preventivo
    Alcuni file delimitati utilizzano il carattere virgoletta per racchiudere i singoli valori dei dati. Il carattere delle virgolette è in genere il carattere delle virgolette doppie (
    "
    ).
    Se il valore di un campo contiene un delimitatore di campo come dati, il valore del campo deve essere racchiuso tra il
    carattere virgoletta
    , altrimenti il sistema presuppone che il delimitatore di campo denoti un nuovo campo.
    Se un valore di campo contiene il carattere di virgoletta come dati, il valore del campo deve essere racchiuso tra il
    carattere di virgoletta
    e deve essere preceduto da un
    carattere di escape
    o da un altro carattere di virgoletta.
    Se un valore di campo contiene un delimitatore di riga (ad esempio un carattere di nuova riga) come dati, il valore del campo deve essere racchiuso tra il
    carattere del preventivo
    e
    i valori del campo contengono nuove righe
    devono essere selezionati.
    Si supponga di avere una riga con questi tre valori di dati:
    weekly special wine, beer, and soda "2 for 1" or 9.99 each
    Se il delimitatore di campo è una virgola, il carattere virgoletta è una virgoletta doppia e il carattere di escape è una barra rovesciata, una riga formattata correttamente nei dati di origine avrà il seguente aspetto:
    "weekly special","wine, beer, and soda","\"2 for 1\" or 9.99 each"
    Righe da ignorare
    Specifica il numero di righe all'inizio del file da ignorare durante la lettura del file di origine durante la creazione e la pubblicazione del set di dati. Per utilizzare questa opzione con l'opzione
    Da prima riga tabella
    , assicurarsi che la riga contenente i nomi dei campi sia visibile e sia la prima riga rimanente.
    I valori dei campi contengono nuove righe
    Selezionare questa opzione se i dati di origine possono contenere nuovi caratteri di riga come parte del valore di un campo.
    Se l'opzione è abilitata, il sistema legge i caratteri della nuova riga all'interno delle virgolette come parte del valore del campo anziché come delimitatore di riga. Il sistema interpreta qualsiasi carattere delimitatore di riga al di fuori delle virgolette come un nuovo record.
    L'abilitazione di questa opzione potrebbe influire sui tempi di pubblicazione di un set di dati se il sistema legge file di origine di grandi dimensioni.
    Si potrebbero ottenere risultati imprevisti se si abilita questa opzione e il file di origine contiene dati non corretti (ad esempio quando un valore di campo contiene un carattere di virgoletta di apertura o di chiusura, ma non entrambi). Quando si utilizza questa opzione, assicurarsi che i dati di origine siano ben formati.
    Tagliare gli spazi vuoti finali e iniziali nei campi di testo
    Selezionare questa casella di controllo se si desidera rimuovere gli spazi vuoti all'inizio e alla fine dei campi di testo.