# Reparación de Mojibake (Detective de codificación)

Repara texto corrupto (mojibake) por decodificación errónea — invierte cadenas UTF-8/Latin-1, Windows-1252, GBK, Shift-JIS, Big5 y MacRoman. El modo auto prueba todo y elige lo más limpio.

> Página canónica: https://elysiatools.com/es/tools/mojibake-repair

- **Categoría:** Text Processing

- **Palabras clave:** mojibake, texto corrupto, reparar codificación, juego de caracteres

## Descripción general

El mojibake es el texto corrupto que aparece cuando los bytes se codificaron con una codificación pero se decodificaron con otra. Esta herramienta invierte la decodificación errónea y, en modo automático, prueba todas las cadenas comunes y puntúa cada candidato por la cantidad de texto limpio.

## Entradas

- **Texto corrupto** (textarea): Paste garbled text, e.g. cafÃ© or ä¸­æ–‡
- **Cadena de reparación** (select)

## Cuándo usarlo

- Cuando un texto UTF-8 aparece como «cafÃ©» en lugar de «café».
- Al corregir caracteres dañados después de exportar datos o importar contenido con otra codificación.
- Cuando no sabes qué codificación provocó el texto corrupto y quieres probar las cadenas disponibles automáticamente.

## Cómo funciona

- Pega el texto corrupto en el campo de entrada.
- Selecciona «Auto (probar todas)» o elige una cadena de reparación concreta.
- La herramienta invierte la decodificación incorrecta usando la cadena seleccionada.
- En modo automático, compara los candidatos y muestra el resultado con más texto limpio.

## Casos de uso

- Corregir nombres, textos y símbolos dañados en datos copiados desde aplicaciones con distinta configuración regional.
- Recuperar caracteres legibles en contenido web o textos exportados que muestran secuencias como «Ã©» o «â€™».
- Diagnosticar rápidamente qué cadena de codificación puede reparar una cadena de origen desconocido.

## Preguntas frecuentes

### ¿Qué es el mojibake?

Es texto corrupto causado por decodificar bytes con una codificación distinta de la original.

### ¿Qué debo introducir?

Pega en el campo «Texto corrupto» la cadena que contiene caracteres dañados.

### ¿Qué hace el modo automático?

Prueba las cadenas de codificación disponibles y selecciona el candidato con el texto más limpio.

### ¿Puedo elegir una codificación específica?

Sí. Puedes seleccionar una cadena concreta, como UTF-8 leído como Latin-1 o UTF-8 leído como Windows-1252.

### ¿Qué tipos de cadenas admite?

Admite cadenas con UTF-8, Latin-1, Windows-1252, GBK, Shift-JIS, Big5 y MacRoman.

## Herramientas relacionadas

- [Extractor de Caracteres Chinos](https://elysiatools.com/es/tools/chinese-character-extractor): Extrae todos los caracteres chinos del texto, filtrando signos de puntuación, letras inglesas, números y símbolos no chinos
- [Removedor de Caracteres BOM](https://elysiatools.com/es/tools/data-bom-remover): Eliminar caracteres BOM (Byte Order Mark) de contenido de texto y archivos. Perfecto para limpiar archivos de texto con problemas de codificación.
- [Markdown a Texto Plano](https://elysiatools.com/es/tools/markdown-to-plain-text): Convertir texto formateado Markdown a texto plano eliminando toda la sintaxis y formato Markdown
- [Evaluador de calidad de chunks RAG](https://elysiatools.com/es/tools/ai-rag-chunk-quality-scorer): Evalúa esquemas candidatos de división en chunks RAG para un documento en cuatro métricas — coherencia (límites limpios de frase/párrafo), cobertura (foco temático / concentración de términos clave), salud del solape de contexto y consistencia de tamaño — compara hasta tres esquemas y recomienda el mejor. Heurísticas offline, sin llamadas a modelo.
- [Extractor de tokens de tema ECharts](https://elysiatools.com/es/tools/echarts-theme-token-extractor): Extrae design tokens — colores, números, tamaños de fuente y cadenas — de un JSON de tema ECharts y expórtalos directamente a tu design system. Pega un objeto de tema (el que registras y pasas a echarts.init(dom, themeName)) y la herramienta recorre cada hoja, etiquetando cada color (con normalización opcional nombrado/rgb → hex), número de espaciado, tamaño de fuente y cadena, para luego emitir variables CSS limpias, una configuración theme.extend de Tailwind, tokens.json de Style Dictionary o variables SCSS. Tiende el puente entre un tema de visualización ECharts y los tokens de diseño Figma/CSS/Tailwind sin copiar cada valor a mano.
- [Extractor de Emojis](https://elysiatools.com/es/tools/emoji-extractor): Extrae todos los emojis Unicode del texto, o opcionalmente elimina emojis
- [Eliminador de Líneas Vacías](https://elysiatools.com/es/tools/empty-line-remover): Eliminar todas las líneas vacías del texto (líneas sin contenido)
- [Eliminador de Etiquetas HTML](https://elysiatools.com/es/tools/new-html-tag-stripper): Elimina etiquetas HTML del código y extrae contenido de texto limpio

## Ejemplos

- [Muestras de Convertidor Hex/Unicode](https://elysiatools.com/es/samples/text-hex-unicode-formats): Muestras de prueba para conversión de secuencias de escape hex y unicode
- [Muestras MP3 Sin Derechos de Autor](https://elysiatools.com/es/samples/mp3-samples): Colección de muestras de audio sin derechos de autor para pruebas y desarrollo, incluyendo sonidos de la naturaleza, música de meditación y audio ambiental
- [Ejemplos de Procesamiento de Imágenes Web Python](https://elysiatools.com/es/samples/web-image-processing-python): Ejemplos de procesamiento de imágenes Web Python usando PIL/Pillow incluyendo lectura, guardado, redimensionamiento y conversión de formato
- [Ejemplos de Procesamiento de Imágenes Android Java](https://elysiatools.com/es/samples/android-image-processing-java): Ejemplos de procesamiento de imágenes Android Java incluyendo lectura/escritura, escalado y conversión de formato
