1. Preparación de datos para Machine Learning
Científico de datosContexto
Un conjunto de datos contiene columnas de 'Edad' (0-100) y 'Salario' (20k-200k). Los modelos de aprendizaje automático se ven sesgados por la mayor magnitud del salario.
Problema
Las diferencias de escala impiden que el modelo converja correctamente.
Cómo usarlo
Subir el archivo CSV, seleccionar las columnas 'Edad' y 'Salario', y aplicar la estandarización Z-Score.
standardizationType: zscore, handleMissing: fill_meanResultado
Ambas columnas quedan centradas en 0 con una desviación de 1, permitiendo que el modelo trate ambas variables con la misma importancia relativa.