1. Generación de datos para entrenamiento de IA
Ingeniero de Machine LearningContexto
Necesito crear un dataset de entrenamiento para un corrector ortográfico que reconozca errores comunes de escritura.
Problema
El modelo actual no detecta suficientes errores de transposición y sustitución de caracteres.
Cómo usarlo
Pego un corpus de texto limpio, configuro una tasa de error del 10% y selecciono 'transposition' y 'substitution'.
errorRate: 10, errorTypes: ['substitution', 'transposition'], preserveWords: trueResultado
Obtengo una versión corrompida del texto que sirve como entrada 'sucia' para entrenar el modelo de corrección.