11.8
В некоррелированном наборе данных для заданного значения x наилучшим прогнозируемым значением y является среднее.
Если переменные имеют линейную корреляцию, значение y можно предсказать, подставив значение x в уравнение регрессии.
Вертикальное расстояние между прогнозируемым значением y и средним значением выборки, y-бар, известно как объясненное отклонение. Взаимосвязь между двумя переменными может объяснить это отклонение.
Вертикальное расстояние между точкой данных и прогнозируемым значением y известно как необъяснимое отклонение или остаток. Связь между переменными не может объяснить это отклонение; Это может быть связано только со случайностью или с участием других переменных.
Сумма необъяснимых и объяснимых отклонений дает общее отклонение.
Возведение отклонений в квадрат и суммирование их для всех точек данных дает количество необъяснимых, объясненных и общих вариаций.
Отношение объясненного изменения к общему изменению является значением r-квадрат, также известным как коэффициент детерминации. Он указывает на долю вариации в значении y, которую может объяснить линия регрессии.
Важной характеристикой любого набора данных является его вариация. В некоторых наборах данных значения данных сконцентрированы близко к среднему значе…
© 2026 MyJoVE Corporation. Все права защищены.