4.11
La deviazione mediana assoluta è una misura della variabilità dei dati in un campione. È il valore assoluto della differenza media tra i valori dei da…
La deviazione assoluta media fornisce il valore assoluto della differenza media tra i valori dei dati e la media.
È calcolato come la somma delle deviazioni assolute dalla media divise per la dimensione del campione.
Ad esempio, tre studenti hanno tre, cinque e sette biscotti nei loro cestini per il pranzo. Le deviazioni nel numero di cookie dalla media di cinque cookie sono meno 2, zero e due.
Se si sommano queste deviazioni, i valori positivi e negativi si annullano a vicenda, dando una deviazione media zero, che non è utile. Se si sommano i valori assoluti, si ottiene invece un singolo valore diverso da zero.
Questo valore, diviso per la dimensione del campione, fornisce la deviazione assoluta media.
Il calcolo della deviazione media assoluta comporta un'operazione di modulo non algebrico, mentre la deviazione standard utilizza operazioni algebriche. Pertanto non è adatto per la statistica inferenziale.
È anche una statistica distorta, poiché la deviazione assoluta media calcolata di un campione non rappresenta adeguatamente la deviazione assoluta media della popolazione.
View the full transcript and gain access to JoVE Core videos
Q1: How is mean absolute deviation calculated from a dataset?
Mean absolute deviation is calculated by finding the average distance of data values from the mean. First, compute the sample mean. Then calculate the deviation for each value by subtracting the mean. Take absolute values of these deviations, sum them, and divide by the sample size. For example, with cupcake data of 10, 15, 8, 7, and 10, the mean is 10, absolute deviations sum to 10, yielding a mean absolute deviation of 2.
Q2: Why do we use absolute values when calculating mean absolute deviation?
Absolute values are used because positive and negative deviations cancel each other out when added together, resulting in zero. This zero value is unhelpful for measuring variability. By taking absolute values of all deviations before summing, we obtain a meaningful non-zero measure that accurately reflects the average distance of data points from the mean.
Q3: What is the difference between mean absolute deviation and standard deviation?
Mean absolute deviation uses a non-algebraic modulus operation to calculate variability, while calculating standard deviation uses algebraic operations. Because mean absolute deviation employs non-algebraic methods, it cannot be used in inferential statistics, which requires algebraic operations. Standard deviation is therefore preferred for statistical inference.
Q4: Is mean absolute deviation suitable for inferential statistics?
No, mean absolute deviation is not suitable for inferential statistics because it involves a non-algebraic modulus operation, while inferential statistics requires algebraic operations. Additionally, mean absolute deviation is a biased statistic—the calculated mean absolute deviation of a sample does not adequately represent the population mean absolute deviation.
Q5: What does it mean that mean absolute deviation is a biased statistic?
A biased statistic means the sample estimate does not accurately represent the population parameter. For mean absolute deviation, the value calculated from a sample does not adequately represent the true mean absolute deviation of the entire population. This bias limits its reliability for making population-level inferences or generalizations.
Q6: How does mean absolute deviation measure data variability?
Mean absolute deviation measures variability by quantifying the average distance of data points from the mean. It reflects how spread out values are in a dataset. A larger mean absolute deviation indicates greater variability, while a smaller value indicates data points cluster closer to the mean.
Q7: What are the main limitations of mean absolute deviation in statistical analysis?
Mean absolute deviation has two primary limitations: it cannot be used in inferential statistics due to its non-algebraic nature, and it is a biased statistic that does not reliably represent population parameters. These constraints make it less suitable than other measures for advanced statistical applications.