Analizzare i dati esterni in un set di dati
- Nel Catalogo dati esiste un set di dati di base che utilizza dati esterni (dal caricamento di un file o dalla connessione a un server).
- Criteri di sicurezza:
- Prism Datasets: Createdominio nell'area funzionale Prism Analytics durante la creazione di un set di dati.
- Uno dei seguenti requisiti di sicurezza quando si modifica un set di dati esistente:
- DominioPrism Datasets: Managenell'area funzionale Prism Analytics.
- AutorizzazioneEditor set di datiper il set di dati.
- Autorizzazionedi Proprietario del set di datiper il set di dati.
Quando si importano dati esterni in un set di dati di base, è necessario descrivere i dati di origine in un formato tabulare. A tale scopo, descrive come analizzare i dati.
I nuovi utenti di Workday non dispongono dell'accesso per creare o modificare i set di dati di base.
I dati devono:
- Essere in formato di file di testo normale.
- Avere un record per riga.
- Avere la stessa sequenza di campi per ogni record separato da un delimitatore comune (ad esempio una virgola o una tabulazione).
I record delimitati sono separati da interruzioni di riga e i campi all'interno di una riga sono separati da un carattere speciale chiamato delimitatore (in genere una virgola o un carattere di tabulazione). Se il delimitatore esiste anche nei valori del campo, deve essere preceduto da caratteri di escape. I set di dati di base supportano l'escape di un solo carattere (ad esempio una barra rovesciata) e i valori dei campi racchiusi tra virgolette doppie.
- Accedere all'attivitàModifica trasformazioni set di datiper un set di dati di base che utilizza dati esterni.
- Modificare la fase Analisi.L'attività contiene i seguenti elementi:
Opzione Descrizione Delimitatore di rigaSpecifica il singolo carattere che separa le righe (o i record) nei file di dati di origine.Nella maggior parte dei file delimitati, le righe sono separate da una nuova riga, ad esempio il carattere di avanzamento riga, il carattere di ritorno a capo o il ritorno a capo più feed di riga. Il feed di riga è la nuova rappresentazione di riga standard nei sistemi operativi simili a UNIX. Altri sistemi operativi (come Windows) potrebbero utilizzare il ritorno a capo singolarmente o il ritorno a capo più l'avanzamento riga. Se si selezionaQualsiasi nuova riga, il sistema riconosce una di queste rappresentazioni di una nuova riga come delimitatore di riga.Delimitatore di campoSpecifica il singolo carattere che separa i campi (o le colonne) di una riga nei file di dati di origine. La virgola e la tabulazione sono i delimitatori di campo più comuni.Nomi campiSpecifica il nome predefinito di ogni campo. È possibile modificare i nomi dei campi nella fase Analisi dopo aver definito le opzioni di analisi.I nomi dei campi devono seguire le regole di convalida della denominazione.Il sistema considera automaticamente la prima riga di ogni file di origine come una riga di intestazione anziché come una riga di dati. Se non si desidera utilizzare la prima riga come nome per i campi, deselezionare la casella di controlloNomi campo.Carattere di escapeSpecifica il singolo carattere utilizzato per l'escape delCarattere di virgolettao di un'altra istanza delCarattere di escapequando viene specificato unCarattere di virgoletta. Il sistema legge un carattere di escape come dati solo se è associato a un altro carattere di escape.Se i valori dei dati contengono caratteri di virgoletta come dati, è necessario utilizzare l'escape di tali caratteri e l'intero valore del campo deve essere racchiuso tra ilCarattere di virgoletta. In caso contrario, il sistema presuppone che il carattere virgoletta indichi un nuovo campo.Per i file con valori separati da virgole (CSV), è prassi comune evitare i delimitatori di campo racchiudendo l'intero valore del campo tra virgolette doppie. Se i dati di origine utilizzano questa convenzione, è necessario specificare unCarattere preventivo.Carattere preventivoAlcuni file delimitati utilizzano il carattere virgoletta per racchiudere i singoli valori dei dati. Il carattere delle virgolette è in genere il carattere delle virgolette doppie (").Se il valore di un campo contiene un delimitatore di campo come dati, il valore del campo deve essere racchiuso tra ilcarattere virgoletta, altrimenti il sistema presuppone che il delimitatore di campo denoti un nuovo campo.Se un valore di campo contiene il carattere di virgoletta come dati, il valore del campo deve essere racchiuso tra ilcarattere di virgolettae deve essere preceduto da uncarattere di escapeo da un altro carattere di virgoletta.Se un valore di campo contiene un delimitatore di riga (ad esempio un carattere di nuova riga) come dati, il valore del campo deve essere racchiuso tra ilcarattere del preventivoei valori del campo contengono nuove righedevono essere selezionati.Si supponga di avere una riga con questi tre valori di dati:weekly special wine, beer, and soda "2 for 1" or 9.99 eachSe il delimitatore di campo è una virgola, il carattere virgoletta è una virgoletta doppia e il carattere di escape è una barra rovesciata, una riga formattata correttamente nei dati di origine avrà il seguente aspetto:"weekly special","wine, beer, and soda","\"2 for 1\" or 9.99 each"Righe da ignorareSpecifica il numero di righe all'inizio del file da ignorare durante la lettura del file di origine durante la creazione e la pubblicazione del set di dati. Per utilizzare questa opzione con l'opzioneDa prima riga tabella, assicurarsi che la riga contenente i nomi dei campi sia visibile e sia la prima riga rimanente.I valori dei campi contengono nuove righeSelezionare questa opzione se i dati di origine possono contenere nuovi caratteri di riga come parte del valore di un campo.Se l'opzione è abilitata, il sistema legge i caratteri della nuova riga all'interno delle virgolette come parte del valore del campo anziché come delimitatore di riga. Il sistema interpreta qualsiasi carattere delimitatore di riga al di fuori delle virgolette come un nuovo record.L'abilitazione di questa opzione potrebbe influire sui tempi di pubblicazione di un set di dati se il sistema legge file di origine di grandi dimensioni.Si potrebbero ottenere risultati imprevisti se si abilita questa opzione e il file di origine contiene dati non corretti (ad esempio quando un valore di campo contiene un carattere di virgoletta di apertura o di chiusura, ma non entrambi). Quando si utilizza questa opzione, assicurarsi che i dati di origine siano ben formati.Tagliare gli spazi vuoti finali e iniziali nei campi di testoSelezionare questa casella di controllo se si desidera rimuovere gli spazi vuoti all'inizio e alla fine dei campi di testo.