ñ en vez de ñ y é en vez de é: cómo repararlo

¿Tu texto muestra ñ en vez de ñ, é en vez de é o ó en vez de ó? Es texto UTF-8 leído como Windows-1252, y las letras no se han perdido. Pega el texto arriba o suelta el archivo, y Mojibuster lo repara al momento.

Funciona con texto y con estos archivos:

  • CSV
  • TXT
  • JSON
  • XML
  • SRT
  • VTT
  • TSV
  • MD
  • HTML
  • SQL
  • LOG

Por ejemplo exportaciones de Excel, copias de bases de datos, subtítulos o código web.

Reparar

  1. Suelta un archivo o pega texto
  2. Se repara automáticamente
  3. Copia o descarga
o simplemente arrastra un archivo aquí
  • Sin subir archivos. Tus archivos se reparan directamente en tu navegador y nunca salen de tu dispositivo.

  • Servidores en la UE. Mojibuster funciona en un servidor en Finlandia (UE); se aplica el Reglamento General de Protección de Datos (RGPD). Texto del RGPD (EUR-Lex)

Por qué una letra con tilde se convierte en dos caracteres

En UTF-8, cada letra con tilde ocupa dos bytes: la ñ es C3 B1 y la é es C3 A9. Un programa que lee el archivo como Windows-1252 convierte cada byte en un carácter propio: C3 pasa a ser à y B1 pasa a ser ±. Por eso casi todos los caracteres raros empiezan por Ã, y el segundo carácter te dice qué letra era.

Una frase guardada en UTF-8 y leída como Windows-1252

Antes

El niño pidió información sobre la canción del año: ¿la escuchaste en ESPAÑA?

Después

El niño pidió información sobre la canción del año: ¿la escuchaste en ESPAÑA?

Los patrones más frecuentes en español

  • á → á, é → é, ó → ó, ú → ú
  • ñ → ñ, Ñ → Ñ, ü → ü (como en pingüino)
  • í se convierte en à más un guion invisible, así que a menudo solo ves paÃs en vez de país
  • É → É, Ó → Ó, Ú → Ú
  • ¿ → ¿, ¡ → ¡, € → €: más sobre comillas, apóstrofes y signos

La tabla completa está más abajo. Si los caracteres raros son más largos, como ñ, el texto se ha codificado dos veces: Mojibuster también lo repara, hasta tres niveles a la vez.

Mejor no reemplazar a mano

Podrías buscar ñ y reemplazarlo por ñ en Excel o en el editor. Eso solo funciona si conoces todos los casos: una à seguida de un espacio duro es una à dañada, la í deja a la vista solo una Ã, y una à también puede ser legítima, por ejemplo en un texto portugués en mayúsculas como SÃO PAULO. Mojibuster comprueba cada posición byte a byte y solo cambia lo que está claramente roto.

De dónde viene el problema

  • Excel abre un CSV en UTF-8 sin BOM como Windows-1252: así se abre correctamente.
  • Exportaciones CSV de tiendas online, bancos o programas de facturación se abren con la codificación equivocada: reparar CSV.
  • Bases de datos y webs entregan UTF-8 por una conexión latin1 o declaran un charset incorrecto: reparar caracteres UTF-8.
  • Subtítulos guardados en una codificación distinta de la que espera el reproductor: subtítulos con caracteres raros.
  • Correos y boletines declaran un juego de caracteres que no coincide con el texto.

Caracteres dañados habituales

Así suelen verse los caracteres dañados, y esto es lo que debería poner.
Dañado Correcto
ññ
ÑÑ
áá
éé
íí
óó
úú
üü
ÉÉ
ÓÓ
ÚÚ
¿¿
¡¡
€€
““
’’
––
……

Preguntas frecuentes

¿Se han perdido mis letras?

No. ñ todavía contiene exactamente los bytes de la ñ, y Mojibuster los convierte de vuelta. Los caracteres solo se pierden cuando un programa los ha sustituido por ? o �: más en signos de interrogación en vez de tildes.

¿Por qué veo una à sola o seguida de un espacio?

Suele ser una í o una à: su segundo byte es en Windows-1252 un guion invisible o un espacio duro. Si ese carácter se perdió o se convirtió en un espacio normal al copiar, la posición ya no es inequívoca y Mojibuster la deja como está.

¿Puedo reparar un archivo entero?

Sí. Suelta archivos CSV, TXT, JSON o SQL de hasta 100 MB en el recuadro de arriba. El archivo no sale de tu dispositivo.

Más guías