Guía CSV · Encoding

CSV con acentos raros o caracteres dañados

Si ves nombres con símbolos extraños, signos de pregunta o caracteres cambiados, probablemente el archivo se leyó con un encoding distinto al que fue creado.

¿Por qué pasa?

Los CSV no siempre declaran su codificación. Un archivo puede venir en UTF-8, UTF-8 con BOM o Windows-1252, y el sistema destino puede asumir otra cosa.

¿Cómo lo detecta Piojo Lab?

El analizador revisa bytes iniciales, señales de BOM y patrones típicos de texto mal decodificado sin enviar el archivo fuera del navegador.

Qué hacer antes de importar

El reporte te indica el encoding probable. Si la conversión es segura, la salida corregida conserva el texto legible y marca advertencias cuando hay pérdida potencial.

Cuándo no conviene automatizar

No todo texto raro puede reconstruirse automáticamente. Si el origen ya está dañado, conviene exportar de nuevo desde el sistema original.

Preguntas rápidas

¿Qué es UTF-8 con BOM?

Es una marca inicial que algunos programas agregan para declarar UTF-8.

¿Por qué se rompen los acentos?

Porque un programa lee el archivo con una codificación diferente.

Prueba el archivo antes de tocar tu sistema

Arrastra un CSV o TSV al analizador. El diagnóstico se ejecuta en tu navegador, las muestras se truncan y el reporte no incluye el nombre del archivo.

Abrir analizador local