Saltar al contenido principal
Administrator Guide
Última actualización: 2023-06-23
Conversión de texto a XML con un archivo de esquema de texto

Conversión de texto a XML con un archivo de esquema de texto

Cree un ensamblaje que contenga un paso
textschema
. Obtenga el texto de muestra que formará la base de su esquema de texto.
El paso
textchema
le permite convertir texto a XML mediante un esquema de texto. Para desarrollar un esquema de texto, debe conocer la estructura de los datos que desea transformar. Este proceso se simplifica considerablemente si tiene un pequeño documento de muestra que contiene datos representativos. En este tema se da por sentado que tiene una muestra de ese tipo.
Puede utilizar el paso
textchema
para convertir XML a texto o para transformar archivos delimitados, pero en la mayoría de los casos, es más sencillo utilizar el paso
XTT
y el paso
csv-to-xml
, respectivamente.
  1. En la vista
    Properties
    del paso
    textchema
    , haga clic en
    Create Text Schema File
    .
  2. Seleccione una carpeta principal para el archivo de esquema de texto y proporcione un nombre de archivo. Si es necesario, especifique el URI del espacio de nombre de destino.
  3. Studio abre el Editor de esquemas de texto y muestra el nuevo esquema de texto en su vista
    de árbol
    .
  4. Corte y pegue el texto de muestra en el área de la parte superior derecha del editor de esquemas de texto, en sustitución de
    initial-text
    .
    Para eliminar el salto de línea de finalización de los archivos de entrada, añada este atributo al elemento de esquema raíz:
    ts:eofStrip="
"
    .
  5. Comience describiendo el texto de muestra. Seleccione el primer campo, haga clic con el botón derecho y seleccione
    Create Field
    .
    Si no tiene ninguna muestra del texto que desea convertir, pero conoce su estructura, puede editar directamente la vista
    Source
    del esquema de texto.
  6. En la página
    Identity
    de
    Create Field Wizard
    , proporcione una descripción básica del campo. Mientras realiza la tarea, tenga en cuenta lo siguiente:
    Opción Descripción
    Nombre
    Un nombre para el campo
    Occurrence
    Las opciones son las siguientes:
    • Default
      : el campo es obligatorio y solo aparece una vez.
    • Required
      : igual que el valor por defecto.
    • Optional
      : el campo es opcional y solo puede aparecer una vez.
    • Multiple Optional
      : el campo es opcional y puede aparecer varias veces.
    • Multiple Required
      : el campo es obligatorio y puede aparecer varias veces.
    Start Tag
    Una expresión regular que especifica el texto que hace que se genere un elemento. Tenga en cuenta que el texto que coincide con esta expresión no forma parte del valor de salida. Si desea que el texto coincidente se muestre en el valor de salida, utilice la opción
    ts:format
    opción
    Etiqueta final
    Una expresión regular que especifica el texto que marca el final de un elemento. Tenga en cuenta que el texto que coincide con esta expresión no forma parte del valor de salida. Si desea que el texto coincidente se muestre en el valor de salida, utilice la opción
    ts:format
    opción
    Truncar
    Especifica si se deben truncar los datos desbordados en un campo de longitud fija o generar un error. El valor por defecto es
    true
    .
    Separador
    Una expresión regular que especifica un carácter que separa campos repetidos. Solo se activa si selecciona las opciones de aparición
    Multiple Optional
    o
    Multiple Required
    .
    Omit
    Especifica si se debe omitir el campo del resultado en una transformación
    text-to-XML
    o
    XML-to-text
    . El valor por defecto es que no se omita nada.
  7. En la página
    Delimit
    de
    Create Field Wizard
    , defina cuántos caracteres del texto de muestra representan un campo:
    Opción Descripción
    Formato
    Una expresión regular que identifica patrones de texto válidos para un campo. Utilice esta expresión como alternativa a
    Start Tag
    y
    End Tag
    para asegurarse de que todo el texto coincidente se muestre en el resultado. También puede utilizarlo a la hora de tratar con valores que aparecen varias veces para que quede claro cuándo se produce el final de la secuencia.
    Longitud fija
    Especifica la longitud de los campos de longitud fija. Incluye las comillas y los caracteres de escape.
    Quoted
    Indica si los valores de cadena se tratan como cadenas entre comillas. Las opciones son las siguientes:
    • Default
      :
    • always
      :
    • always-including-empty
      :
    • optional
      :
    • never
      :
    Relleno de secuencia
    Una expresión regular que identifica cualquier texto de relleno de secuencia en campos de longitud fija.
    Preferred Padding
    Especifica el valor que se utilizará si la expresión de
    Padding
    puede coincidir con más de una cadena.
    Alinear
    Especifica la alineación de los campos de longitud fija que requieren relleno de secuencia.
  8. En la página
    Interpret
    de
    Create Field Wizard
    , defina cuántos caracteres del texto de muestra representan un campo:
    Opción Descripción
    Tipo
    El tipo de datos del campo.
    Valor por defecto
    Un valor por defecto para el campo.
    Formato de fecha
    Especifica un patrón para fechas o fechas y horas. Admite cualquier patrón permitido por Java
    SimpleDateFormat
    .
    Idioma de fecha
    Especifica el idioma de la fecha que se utilizará al interpretar las fechas. Garantiza que el nombre se maneje en el idioma adecuado cuando el formato de fecha utiliza los nombres de meses. El valor por defecto es
    EN
    .
    Año de dos dígitos
    Especifica un valor para interpretar fechas con año de dos dígitos. El analizador de esquema de texto interpreta las fechas de año de 2 dígitos anteriores a ese valor como correspondientes al siglo actual. Ejemplo: si introduce
    18
    , el analizador interpreta
    14
    como
    2014
    y
    96
    como
    1996
    .
    Formato de número
    Especifica un patrón para los números. Admite cualquier patrón permitido por Java
    DecimalFormat
    .
    Separador decimal
    Especifica el separador que se utilizará para los números decimales.
    Grouping Separator
    Especifica el separador de agrupación de miles para los números.
  9. Repita los pasos 6 a 9 para cada campo del texto de muestra, añadiendo nuevos elementos en la vista
    de árbol
    . Cuando haya creado todas las definiciones de campo obligatorio, elimine las restantes.
    Unparsed
    elemento secundario
  10. Para empaquetar todos los elementos que ha creado en un tipo complejo, selecciónelos, haga clic con el botón derecho en ellos y seleccione
    Empaquetar elementos
    . A continuación, proporcione un nombre y un valor de aparición para el elemento empaquetador.
  11. En la vista
    Propiedades
    del elemento contenedor, seleccione
    /n
    en la lista desplegable
    Etiqueta de finalización
    .
  12. El elemento raíz de esquema por defecto se llama
    File
    . En la ficha
    Esquema
    de la vista
    Propiedades
    del elemento, proporcione un nombre más significativo.
  13. En la vista
    Propiedades
    del nivel superior
    schema
    , la propiedad
    Elemento raíz
    tiene el valor
    tns:File
    . Sustituir
    File
    con el nombre significativo que ha seleccionado para el elemento raíz.
  14. Para eliminar cualquier espacio adicional del resultado generado, seleccione la vista
    Propiedades
    del nivel superior
    schema
    elemento Seleccione
    +
    en la lista desplegable
    Relleno
    . Guarde el esquema.