데이터세트의 외부 데이터 파싱
- 외부 데이터(파일 업로드 또는 서버에 연결)를 사용하는 기준 데이터세트가 데이터 카탈로그에 있습니다.
- 시큐리티:
- 데이터세트를 생성할 때 Prism Analytics 기능 영역의Prism Datasets: Create도메인
- 기존 데이터세트를 편집할 때 다음과 같은 시큐리티 요건 중 하나를 충족해야 합니다.
- Prism Analytics 기능 영역의Prism Datasets: Manage도메인
- 데이터세트에 대한데이터세트 편집자권한
- 데이터세트에 대한데이터세트 소유자권한
외부 데이터를 기본 데이터세트로 가져올 때 소스 데이터를 테이블 형식으로 설명해야 합니다. 데이터를 파싱하는 방법을 설명하면 됩니다.
Workday를 처음 사용하는 경우 기본 데이터세트를 생성하거나 편집할 수 없습니다.
데이터는 다음을 충족해야 합니다.
- 일반 텍스트 파일 형식이어야 합니다.
- 라인당 1개의 레코드가 있습니다.
- 공통 구분 기호(예: 쉼표 또는 탭)로 구분된 모든 레코드에 대해 동일한 필드 시퀀스를 사용합니다.
구분 기호로 구분된 레코드는 줄바꿈으로 구분되며, 줄 안의 필드는 구분 기호라는 특수 문자(일반적으로 쉼표 또는 탭 문자)로 구분됩니다. 구분 기호가 필드 값에도 있는 경우 구분 기호를 이스케이프해야 합니다. 기본 데이터세트는 단일 문자 이스케이프(예: 백슬래시)를 지원하며 필드 값을 큰따옴표로 묶습니다.
- 외부 데이터를 사용하여 기준 데이터세트의데이터세트 변환 편집태스크에 액세스합니다.
- 구문분석 단계를 편집합니다.다음을 고려하여 이 태스크를 완료합니다.
옵션 설명 행 구분 기호소스 데이터 파일에서 행(또는 레코드)을 구분하는 단일 문자를 지정합니다.대부분의 구분 기호로 구분된 파일에서 행은 개행 문자(예: 라인 피드 문자, 캐리지 리턴 문자 또는 캐리지 리턴 + 라인 피드)로 구분됩니다. 라인 피드는 Unix 계열 운영 체제에서 표준 줄 바꿈 표시입니다. 다른 운영 체제(예: Windows)에서는 캐리지 리턴을 개별적으로 사용하거나 캐리지 리턴과 라인 피드를 사용할 수 있습니다.'신규 라인 모두'를선택하면 Workday가 이러한 신규 라인 표시를 행 구분 기호로 인식합니다.필드 구분 기호소스 데이터 파일에서 행의 필드(또는 열)를 구분하는 단일 문자를 지정합니다. 쉼표와 탭은 가장 일반적인 필드 구분 기호입니다.필드명각 필드의 기본 이름을 지정합니다. 파싱 옵션 정의를 마친 후 파싱 단계에서 필드명을 변경할 수 있습니다.필드명은 명명 검증 규칙을 따라야 합니다.Workday는 자동으로 각 소스 파일의 첫 번째 라인을 데이터 행이 아닌 헤더 행으로 처리합니다. 첫 번째 라인을 필드명으로 사용하지 않으려면필드명확인란을 선택취소합니다.이스케이프 문자따옴표 문자가 지정된 경우따옴표 문자또는 다른이스케이프문자인스턴스를 이스케이프하는 데 사용되는 단일 문자를 지정합니다. Workday는 다른 이스케이프 문자로 이스케이프된 경우에만 이스케이프 문자를 데이터로 읽습니다.데이터 값에 데이터로 따옴표 문자가 포함된 경우 해당 문자를 이스케이프 처리하고 전체 필드 값을따옴표 문자로 묶어야 합니다. 그렇지 않은 경우 Workday는 따옴표 문자가 신규 필드를 나타내는 것으로 간주합니다.쉼표로 구분된 값(CSV) 파일의 경우, 전체 필드 값을 큰따옴표로 묶어 필드 구분 기호를 이스케이프하는 것이 일반적입니다. 소스 데이터에서 이 규칙을 사용하는 경우따옴표 문자를지정해야 합니다.견적 문자구분 기호로 구분된 일부 파일은 따옴표 문자를 사용하여 개별 데이터 값을 묶습니다. 따옴표 문자는 일반적으로 큰따옴표 문자(")필드 값에 데이터로 필드 구분 기호가 포함된 경우 필드 값을따옴표 문자로 묶어야 합니다. 그렇지 않으면 필드 구분 기호가 신규 필드를 나타내는 것으로 간주됩니다.필드 값에 데이터로 따옴표 문자가 포함된 경우, 필드 값을따옴표 문자로 묶어야 하며,이스케이프 문자또는 다른 따옴표 문자로 이스케이프되어야 합니다.필드 값에 행 구분 기호(예: 개행 문자)가 데이터로 포함된 경우, 필드 값을따옴표 문자로 묶어야하고필드 값에 개행 문자 포함을선택해야 합니다.다음 3가지 데이터 값이 포함된 행이 있다고 가정합니다.weekly special wine, beer, and soda "2 for 1" or 9.99 each필드 구분 기호가 쉼표이고, 따옴표 문자가 큰따옴표이며, 이스케이프 문자가 백슬래시인 경우 소스 데이터에서 올바른 형식의 행은 다음과 같이 표시됩니다."weekly special","wine, beer, and soda","\"2 for 1\" or 9.99 each"무시할 행데이터세트를 생성하고 게시하는 동안 소스 파일을 읽을 때 무시할 파일 시작 부분의 라인 수를 지정합니다. 이 옵션을테이블의 첫 번째 행에서옵션과 함께 사용하려면 필드명이 포함된 라인이 표시되고 나머지 첫 번째 라인인지 확인합니다.필드 값에 새 라인이 포함되어 있습니다.소스 데이터에 필드 값의 일부로 개행 문자가 포함될 수 있는 경우 이 옵션을 선택합니다.이 옵션을 활성화하면 Workday는 따옴표 문자 안의 줄 바꿈 문자를 행 구분 기호가 아닌 필드 값의 일부로 읽습니다. Workday는 따옴표 문자 외부의 모든 행 구분 기호 문자를 신규 레코드로 해석합니다.이 옵션을 활성화하면 Workday가 매우 큰 소스 파일을 읽는 경우 데이터세트 게시 시간에 영향을 미칠 수 있습니다.이 옵션을 활성화한 상태에서 소스 파일에 잘못된 형식의 데이터가 있는 경우(예: 필드 값에 여는 따옴표 문자 또는 닫는 따옴표 문자 중 하나만 포함된 경우) 예상치 못한 결과가 발생할 수 있습니다. 이 옵션을 사용할 때 소스 데이터가 올바른 형식인지 확인하십시오.텍스트 필드의 후행 및 선행 공백 문자 정리텍스트 필드의 시작과 끝에 있는 공백 문자를 제거하려면 이 확인란을 선택합니다.