Saltar al contenido principal

CSV INTERNACIONAL · CONVERSIÓN DE CODIFICACIÓN

Cómo convertir la codificación de un CSV para intercambiarlo entre sedes

Abrir Conversión de codificación/delimitador

Ejemplo de una oficina de Madrid que entrega un maestro de clientes de un ERP antiguo a un portal regional que exige UTF-8 con BOM. Primero se confirman ambos sistemas; el país o el idioma por sí solos no determinan la codificación.

Publicado:

Actualizado:

Herramienta relacionada: Convertir codificación y formato

Caso práctico: Madrid entrega clientes a un portal regional

El ERP de Gestión Peninsular S.L. documenta una salida Windows-1252 separada por punto y coma; el portal regional especifica UTF-8 con BOM y coma. Estas elecciones proceden de la documentación, no de una regla general sobre España o el país receptor.

  • Entrada: Windows-1252 y punto y coma
  • Salida: UTF-8 con BOM y coma
  • Importes en EUR y fechas DD/MM/AAAA sin reformatear los valores
Tabla de codificaciones de entrada y salida de LocaCSV
CodificaciónCSV de entradaCSV de salidaUso habitual y comprobaciones
UTF-8Detección automática o selección manualCon o sin BOMPrimera opción para nuevos intercambios multilingües; el requisito de BOM lo decide el receptor.
Windows-1252Selección manualCompatibleEjemplo habitual en sistemas occidentales antiguos; prueba €, tildes, ñ y comillas.
Shift_JIS (CP932)Detección automática o selección manualCompatibleEjemplo de sistemas japoneses antiguos; prueba los caracteres propios de CP932.
CP949Selección manualCompatibleEjemplo de sistemas coreanos antiguos; no equipares automáticamente EUC-KR con CP949.
Big5Selección manualCompatibleEjemplo de sistemas antiguos en chino tradicional; prueba los caracteres propios de la empresa.
GB18030Selección manualCompatibleEjemplo de sistemas antiguos en chino simplificado; no lo deduzcas de una etiqueta GBK. Los caracteres no representables detienen la conversión.
ISO-8859-1Selección manualCompatibleÚsala solo si un sistema antiguo exige Latin-1. A diferencia de Windows-1252, los bytes 0x80–0x9F son caracteres de control.
  • UTF-8

    CSV de entrada
    Detección automática o selección manual
    CSV de salida
    Con o sin BOM
    Uso habitual y comprobaciones
    Primera opción para nuevos intercambios multilingües; el requisito de BOM lo decide el receptor.
  • Windows-1252

    CSV de entrada
    Selección manual
    CSV de salida
    Compatible
    Uso habitual y comprobaciones
    Ejemplo habitual en sistemas occidentales antiguos; prueba €, tildes, ñ y comillas.
  • Shift_JIS (CP932)

    CSV de entrada
    Detección automática o selección manual
    CSV de salida
    Compatible
    Uso habitual y comprobaciones
    Ejemplo de sistemas japoneses antiguos; prueba los caracteres propios de CP932.
  • CP949

    CSV de entrada
    Selección manual
    CSV de salida
    Compatible
    Uso habitual y comprobaciones
    Ejemplo de sistemas coreanos antiguos; no equipares automáticamente EUC-KR con CP949.
  • Big5

    CSV de entrada
    Selección manual
    CSV de salida
    Compatible
    Uso habitual y comprobaciones
    Ejemplo de sistemas antiguos en chino tradicional; prueba los caracteres propios de la empresa.
  • GB18030

    CSV de entrada
    Selección manual
    CSV de salida
    Compatible
    Uso habitual y comprobaciones
    Ejemplo de sistemas antiguos en chino simplificado; no lo deduzcas de una etiqueta GBK. Los caracteres no representables detienen la conversión.
  • ISO-8859-1

    CSV de entrada
    Selección manual
    CSV de salida
    Compatible
    Uso habitual y comprobaciones
    Úsala solo si un sistema antiguo exige Latin-1. A diferencia de Windows-1252, los bytes 0x80–0x9F son caracteres de control.

Ejemplo del CSV de entrada

El texto siguiente está guardado en Windows-1252. Que se vea bien en un equipo no prueba su codificación; hay que consultar la exportación o analizar una muestra conocida.

clientes_erp_windows1252.csv
Código_cliente;Empresa;Contacto;Ciudad;Límite_EUR
000154;Logística Cañaveral S.L.;Ana García;Madrid;250000.00
000287;Distribució Mediterrània S.A.;Pau Soler;Barcelona;180500.50

Pasos para convertir la codificación en LocaCSV

  • Confirma con el administrador del origen la codificación y el delimitador, y pide al receptor su especificación de importación.
  • Abre “Conversión de codificación/delimitador” y selecciona un CSV de hasta 50 MiB.
  • Elige manualmente Windows-1252 como entrada; la detección automática solo admite UTF-8 y Shift_JIS.
  • Selecciona UTF-8 con BOM y coma como salida y ejecuta la conversión.
  • Descarga el resultado y pruébalo mediante “Desde texto/CSV” de Excel y en el portal receptor.
Convertir codificación y formato

Cómo verificar codificación, filas y campos

  • El número de filas y columnas coincide antes y después
  • García, Logística, Cañaveral y Mediterrània conservan los caracteres
  • El código 000154 mantiene los ceros iniciales
  • El archivo de prueba se importa correctamente en el sistema receptor real
  • Se registra la codificación y el delimitador de entrada y salida junto al resultado de la prueba

Ejemplo de la salida convertida

La conversión conserva el orden y los valores, cambia la codificación y, en este caso, el delimitador. Los campos que contienen una coma se entrecomillan correctamente como CSV.

clientes_portal_utf8_bom.csv
Codificación: UTF-8 con BOM
Delimitador: coma
Filas de datos: 2
Muestra: Ana García / Madrid / 000154

Errores habituales

  • Suponer Windows-1252 solo porque el archivo viene de España; el ERP podría exportar UTF-8.
  • Abrir con doble clic y guardar desde Excel, alterando ceros iniciales, fechas o codificación.
  • Elegir mal la entrada y convertir después, dejando el texto dañado en el nuevo archivo.
  • Entregar UTF-8 sin BOM cuando la aplicación de destino exige BOM.
  • Convertir a una codificación antigua que no representa todos los caracteres; LocaCSV detiene la salida.

Cuándo convertir una vez y cuándo automatizar

Las opciones disponibles no son una recomendación por país. La especificación de los sistemas de envío e importación tiene prioridad. Todas las celdas se procesan en el navegador.

  • Encaja: un CSV de hasta 50 MiB y una conversión entre codificaciones y delimitadores disponibles
  • Encaja: datos de clientes o pagos que no deben enviarse a una API externa
  • No encaja: UTF-16, EUC-JP, delimitadores personalizados o selección del salto de línea
  • No encaja: recuperar caracteres ya perdidos al guardar encima un archivo mal decodificado