Calculadora de residuos - Regresión lineal
Pruebas de hipótesis e inferencia estadística
Esta herramienta calcula los residuos de un modelo de regresión lineal simple. Ingresa tus datos X e Y para obtener la recta de regresión y analizar los errores de predicción.
Calculadora de residuos - Regresión lineal
Pruebas de hipótesis e inferencia estadística
Acerca de la calculadora de residuos
Un residuo es la diferencia entre un valor observado y el valor predicho por un modelo estadístico. En el contexto de la regresión lineal simple, el residuo para la observación i se define como e_i = y_i − ŷ_i, donde y_i es el valor observado real y ŷ_i es el valor predicho por la recta de regresión de mínimos cuadrados ŷ = b₀ + b₁x.
El método de mínimos cuadrados ordinarios (OLS) encuentra la recta de regresión que minimiza la suma de cuadrados de los residuos (SSE = Σe_i²). Esta herramienta calcula la pendiente (b₁) y la intersección (b₀) usando las fórmulas estándar: b₁ = Σ(xᵢ − x̄)(yᵢ − ȳ) / Σ(xᵢ − x̄)² y b₀ = ȳ − b₁x̄.
El análisis de residuos es un paso fundamental en el diagnóstico de regresión. Después de ajustar un modelo, debes examinar los residuos para verificar los supuestos clave: linealidad (los residuos no deben mostrar un patrón sistemático al graficarse contra x), homocedasticidad (los residuos deben tener varianza aproximadamente constante), independencia (los residuos no deben estar autocorrelacionados) y normalidad (los residuos deben seguir una distribución aproximadamente normal).
Un gráfico de residuos — un diagrama de dispersión de residuos frente a valores predichos o frente a la variable independiente — es la principal herramienta de diagnóstico. Residuos dispersos aleatoriamente alrededor de cero, sin patrón, indican que el modelo lineal es مناسب. Patrones sistemáticos como una forma de U sugieren no linealidad, las formas de embudo indican heterocedasticidad y los agrupamientos sugieren la presencia de observaciones influyentes o valores atípicos.
El coeficiente de determinación R² mide cuánto de la varianza de y es explicado por x. R² va de 0 (el modelo no explica ninguna varianza) a 1 (ajuste perfecto). Se calcula como 1 − SSE/SST, donde SST = Σ(yᵢ − ȳ)².
Esta calculadora es ideal para estudiantes que aprenden regresión, analistas que hacen verificaciones rápidas de calidad de datos e investigadores que validan el ajuste del modelo antes de avanzar a modelos más complejos. Los resultados incluyen la ecuación de regresión completa, una tabla de residuos punto por punto, el SSE total y el valor de R² para una interpretación inmediata.
Ejemplos de cálculo de residuos
Estos ejemplos muestran cómo se calculan los residuos a partir de pares de datos X e Y.
| Datos X → Y | Recta de regresión | R² |
|---|---|---|
| X: 1,2,3,4,5 / Y: 2,4,5,4,5 | ŷ = 0.6x + 2.2 | R² = 0.60 |
| X: 1,2,3,4 / Y: 2,4,6,8 | ŷ = 2x + 0 | R² = 1.00 (ajuste perfecto) |
| X: 1,2,3,4,5 / Y: 5,3,4,2,1 | ŷ = -0.9x + 5.7 | R² = 0.81 |
Cómo usar esta calculadora
- Ingresa los valores independientes (X) en el primer campo de texto, separados por comas o espacios.
- Ingresa los valores observados (Y) correspondientes en el segundo campo, en el mismo orden que X.
- Haz clic en “Calcular” para ajustar la recta de regresión por mínimos cuadrados y calcular todos los residuos.
- Revisa la tabla de residuos para identificar observaciones que estén lejos de la recta de regresión.
- Revisa R² para evaluar qué tan bien se ajusta el modelo lineal a tus datos.
Preguntas frecuentes
¿Qué significa un residuo grande?
Un residuo grande indica que el valor observado está lejos de lo que predijo el modelo de regresión. Los residuos grandes pueden indicar valores atípicos, observaciones influyentes o que el modelo lineal no es el mejor ajuste para tus datos. Investiga esos puntos antes de sacar conclusiones.
¿Por qué los residuos suman cero en la regresión OLS?
Cuando la regresión OLS incluye un término constante, los residuos siempre suman exactamente cero. Es una propiedad matemática del estimador de mínimos cuadrados: la recta de regresión debe pasar por el punto (x̄, ȳ), lo que hace que las desviaciones positivas y negativas se compensen.
¿Cuál es la diferencia entre un residuo y un error?
Un error es la diferencia no observable entre un valor observado y la verdadera recta de regresión de la población. Un residuo es la diferencia observable entre un valor observado y la recta de regresión estimada. En la práctica, los residuos se usan para estimar y analizar errores.
¿Qué me dice R² sobre los residuos?
R² (coeficiente de determinación) es la proporción de la varianza total en Y explicada por el modelo de regresión lineal. Un R² alto significa que el modelo se ajusta bien y que los residuos son pequeños en relación con la variabilidad total de Y. Sin embargo, un R² alto por sí solo no garantiza que se cumplan los supuestos del modelo.
¿Cómo detecto heterocedasticidad en los residuos?
Grafica los residuos frente a los valores ajustados. Si la dispersión de los residuos aumenta o disminuye de forma sistemática con los valores ajustados (un patrón de embudo), hay heterocedasticidad. Pruebas formales como Breusch-Pagan o White pueden confirmarlo estadísticamente.
¿Esta calculadora maneja regresión lineal múltiple?
No, esta calculadora solo maneja regresión lineal simple con una variable independiente (X) y una dependiente (Y). Para regresión múltiple con dos o más predictores, usa software estadístico como R, Python (statsmodels), Excel o SPSS.
Herramientas relacionadas
Calculadora del índice de variación cualitativa
Calcula el índice de variación cualitativa desde frecuencias categóricas: IQV, pares observados y pares posibles al instante.
Calculadora de tamaño de muestra - fórmula de Cochran
Calcula el tamaño de muestra con la fórmula de Cochran. Ingresa el nivel de confianza, margen de error y proporción para obtener el mínimo necesario.
Calculadora de pagos de ruleta
Para ruleta americana y europea: introduce el tipo de apuesta y el importe para ver ganancia neta, pago total, cuota y probabilidad de ganar.
Calculadora de paradoja del falso positivo
Calcula la probabilidad real de tener una condición tras un resultado positivo. Introduce prevalencia, sensibilidad y especificidad.
Riesgo relativo: calculadora para cohortes
Calculadora de riesgo relativo para tablas 2×2: calcula la razón de riesgos, el intervalo de confianza del 95% y el riesgo atribuible.
Calculadora de valores atípicos con IQR
Calculadora de valores atípicos con el método IQR: introduce un conjunto de datos para detectar atípicos leves (1.5×IQR) o extremos (3×IQR) al instante.
Calculadora t de muestras pareadas - antes y después
Introduce dos grupos pareados y obtén enseguida el estadístico t, los grados de libertad, el valor p y el IC del 95%.
Calculadora de p-valor - pruebas Z, t, F y chi-cuadrado
Calcula el p-valor exacto y el veredicto de significancia para pruebas Z, t, F y chi-cuadrado al introducir el estadístico y los grados de libertad.