11.8
Dans un ensemble de données non corrélées, pour une valeur donnée de x, la valeur la mieux prédite de y est la moyenne.
Si les variables ont une corrélation linéaire, une valeur y peut être prédite en substituant la valeur x dans l’équation de régression.
La distance verticale entre la valeur y prédite et la moyenne de l’échantillon, la barre y, est connue sous le nom d’écart expliqué. La relation entre les deux variables peut expliquer cet écart.
La distance verticale entre le point de données et la valeur y prédite est connue sous le nom d’écart inexpliqué ou résiduel. La relation entre les variables ne peut pas expliquer cet écart ; Cela peut être dû au hasard seul ou à l’implication d’autres variables.
La somme des écarts inexpliqués et expliqués donne l’écart total.
En mettant les écarts au carré et en les additionnant pour tous les points de données, on obtient la quantité de variations inexpliquées, expliquées et totales.
Le rapport entre la variation expliquée et la variation totale est la valeur r carré, également connue sous le nom de coefficient de détermination. Il indique la proportion de la variation de la valeur y que la droite de régression peut expliquer.
Une caractéristique essentielle de tout ensemble de données est la variation. Dans certains ensembles, les valeurs sont concentrées très près de la mo…
Copyright © 2026 MyJoVE Corporation. Tous droits réservés.