← Guías

GUÍAS TOOLDAM

Por qué se rompe el texto coreano en un CSV

Si el programa que crea el CSV y el que lo abre suponen codificaciones distintas, el coreano puede aparecer corrupto.

Punto clave

CSV no siempre comunica claramente la codificación; diferencias entre programas pueden producir caracteres ilegibles.

La estructura CSV y la codificación son problemas distintos

Que las columnas estén separadas correctamente no determina cómo se interpretan los bytes. Leer UTF-8 con otro juego de caracteres puede producir texto corrupto.

Por qué UTF-8 puede abrirse distinto

Algunos programas usan el BOM o la codificación predeterminada del sistema para adivinar. El mismo CSV puede verse diferente en navegador, editor y hoja de cálculo.

No sobrescribas el original corrupto

Guardar el archivo ya roto puede alterar los bytes originales y dificultar la recuperación. Trabaja con una copia y prueba la codificación adecuada.

Ten en cuenta el entorno del destinatario

UTF-8 es habitual en la web, pero algunos programas empresariales exigen otra codificación. Si existe una regla de importación, síguela.