11.8
W nieskorelowanym zbiorze danych dla danej wartości x najlepiej przewidywaną wartością y jest średnia.
Jeśli zmienne mają korelację liniową, wartość y można przewidzieć, podstawiając wartość x w równaniu regresji.
Odległość pionowa między przewidywaną wartością y a średnią próbki, y-bar, jest znana jako odchylenie wyjaśnione. Związek między tymi dwiema zmiennymi może wyjaśnić to odchylenie.
Odległość pionowa między punktem danych a przewidywaną wartością y jest znana jako niewyjaśnione odchylenie lub reszta. Zależność między zmiennymi nie może wyjaśnić tego odchylenia; Może to być spowodowane samym przypadkiem lub zaangażowaniem innych zmiennych.
Suma niewyjaśnionych i wyjaśnionych odchyleń daje odchylenie całkowite.
Podniesionie odchyleń do kwadratu i zsumowanie ich dla wszystkich punktów danych daje ilość niewyjaśnionych, wyjaśnionych i całkowitych zmian.
Stosunek wyjaśnionej zmienności do całkowitej zmienności to wartość r-kwadrat, znana również jako współczynnik determinacji. Wskazuje proporcję zmienności wartości y, którą może wyjaśnić linia regresji.
Ważną cechą każdego zestawu danych jest zmienność danych. W niektórych zbiorach danych wartości danych są skupione blisko średniej; w innych zbiorach…
Prawa autorskie © 2026 MyJoVE Corporation. Wszelkie prawa zastrzeżone.