Статистические гипотезы

Дата: 21.05.2016

		

МИНИСТЕРСТВО
СЕЛЬСКОГО ХОЗЯЙСТВА И ПРОДОВОЛЬСТВИЯ РЕСПУБЛИКИ БЕЛАРУСЬ

БЕЛОРУССКИЙ
ГОСУДАРСТВЕННЫЙ АГРАРНЫЙ ТЕХНИЧЕСКИЙ УНИВЕРСИТЕТ

Контрольная
работа по предмету

Статистика

Подготовила студентка

3-го курса ФПУ 71зэи

№ зачетной книжки 507039

Боровик Марина
Александровна

Проверил______________________

Отметка о
зачете________________

«___»__________2008г.__________

Минск 2009

Задание 1.
Статистические гипотезы и методы их проверки

Статистическая
гипотеза представляет
собой некоторое предположение о законе распределения случайной величины или о
параметрах этого закона, формулируемое на основе выборки [3, 5, 11]. Примерами
статистических гипотез являются предположения: генеральная совокупность
распределена по экспоненциальному закону; математические ожидания двух
экспоненциально распределенных выборок равны друг другу. В первой из них
высказано предположение о виде закона распределения, а во второй – о параметрах
двух распределений. Гипотезы, в основе которых нет никаких допущений о
конкретном виде закона распределения, называют непараметрическими , в противном случае – параметрическими .

Гипотезу, утверждающую, что различие
между сравниваемыми характеристиками отсутствует, а наблюдаемые отклонения
объясняются лишь случайными колебаниями в выборках, на основании которых
производится сравнение, называют нулевой (основной)
гипотезой и обозначают Н 0.
Наряду с основной гипотезой рассматривают и альтернативную
(конкурирующую, противоречащую) ей гипотезу Н 1. И если нулевая
гипотеза будет отвергнута, то будет иметь место альтернативная гипотеза.

Различают простые и сложные гипотезы.
Гипотезу называют простой , если
она однозначно характеризует параметр распределения случайной величины.
Например, если l является параметром
экспоненциального распределения, то гипотеза Н 0
о равенстве l = 10
– простая гипотеза. Сложной называют
гипотезу, которая состоит из конечного или бесконечного множества простых
гипотез. Сложная гипотеза Н 0
о неравенстве l > 10
состоит из бесконечного множества простых гипотез Н 0 о равенстве l =b i, где b i – любое число, большее 10. Гипотеза Н 0 о том, что
математическое ожидание нормального распределения равно двум при неизвестной
дисперсии, тоже является сложной. Сложной гипотезой будет предположение о распределении
случайной величины Х по
нормальному закону, если не фиксируются конкретные значения математического
ожидания и дисперсии.

Проверка гипотезы основывается на
вычислении некоторой случайной величины – критерия, точное или приближенное
распределение которого известно. Обозначим эту величину через z , ее значение является функцией от
элементов выборки z = z ( x 1 , x 2 , …, x n). Процедура
проверки гипотезы предписывает каждому значению критерия одно из двух решений –
принять или отвергнуть гипотезу. Тем самым все выборочное пространство и
соответственно множество значений критерия делятся на два непересекающихся
подмножества S 0
и S 1. Если значение
критерия z попадает в область S 0, то гипотеза
принимается, а если в область S 1,
то гипотеза отклоняется. Множество S 0
называется областью принятия гипотезы или
областью допустимых значений , а множество S 1 – областью отклонения гипотезы или критической областью .
Выбор одной области однозначно определяет и другую область.

Принятие или отклонение гипотезы Н 0 по случайной выборке
соответствует истине с некоторой вероятностью и, соответственно, возможны два
рода ошибок. Ошибка первого рода возникает с вероятностью a
тогда, когда отвергается верная гипотеза Н 0
и принимается конкурирующая гипотеза Н 1.
Ошибка второго рода возникает с вероятностью b в том
случае, когда принимается неверная гипотеза
Н 0, в то время как справедлива конкурирующая гипотеза Н 1. Доверительная вероятность – это
вероятность не совершить ошибку первого рода и принять верную гипотезу Н 0. Вероятность
отвергнуть ложную гипотезу Н 0
называется мощностью критерия .
Следовательно, при проверке гипотезы возможны четыре варианта исходов, табл. 1.1.

Таблица 1.1.

Гипотеза Н 0

Решение Вероятность Примечание
Верна Принимается 1 — a Доверительная вероятность
Отвергается a Вероятность ошибки первого рода
Неверна Принимается b Вероятность ошибки второго рода
Отвергается 1 — b Мощность критерия

Например, когда некоторая несмещенная
оценка параметра q вычислена по выборке объема n , и эта оценка имеет плотность распределения f (q), рис. 1.1.

Статистические гипотезы

Рис. 1.1. Области принятия и
отклонения гипотезы

Предположим, что истинное значение
оцениваемого параметра равно Т .
Если рассматривать гипотезу Н 0
о равенстве q= Т ,
то насколько велико должно быть различие между q и Т , чтобы эту гипотезу отвергнуть.
Ответить на данный вопрос можно в статистическом смысле, рассматривая
вероятность достижения некоторой заданной разности между q
и Т на основе выборочного
распределения параметра q.

Целесообразно полагать одинаковыми
значения вероятности выхода параметра q за нижний и
верхний пределы интервала. Такое допущение во многих случаях позволяет
минимизировать доверительный интервал, т.е. повысить мощность критерия
проверки. Суммарная вероятность выхода параметра q за
пределы интервала с границами q1–a/2 и qa/2, составляет величину a . Эту
величину следует выбрать настолько малой, чтобы выход за пределы интервала был
маловероятен. Если оценка параметра попала в заданный интервал, то в таком
случае нет оснований подвергать сомнению проверяемую гипотезу, следовательно,
гипотезу равенства q= Т можно принять. Но если после получения выборки окажется,
что оценка выходит за установленные пределы, то в этом случае есть серьезные
основания отвергнуть гипотезу Н 0.
Отсюда следует, что вероятность допустить ошибку первого рода равна a (равна уровню значимости критерия).

Если предположить, например, что
истинное значение параметра в действительности равно Т + d ,
то согласно гипотезе Н 0
о равенстве q= Т –
вероятность того, что оценка параметра q попадет в
область принятия гипотезы, составит b, рис. 1.2.

Статистические гипотезы

Рис.1.2. Области принятия и
отклонения гипотезы

При заданном объеме выборки
вероятность совершения ошибки первого рода можно уменьшить, снижая уровень
значимости a. Однако при этом увеличивается
вероятность ошибки второго рода b (снижается мощность
критерия). Аналогичные рассуждения можно провести для случая, когда истинное
значение параметра равно Т – d .

Единственный способ уменьшить обе
вероятности состоит в увеличении объема выборки (плотность распределения оценки
параметра при этом становится более «узкой»). При выборе критической
области руководствуются правилом Неймана – Пирсона: следует так выбирать
критическую область, чтобы вероятность a была мала,
если гипотеза верна, и велика в противном случае. Однако выбор конкретного
значения a относительно произволен. Употребительные
значения лежат в пределах от 0,001 до 0,2. В целях упрощения ручных расчетов
составлены таблицы интервалов с границами q1–a/2
и qa/2 для типовых значений a и различных способов построения критерия.

При выборе уровня значимости
необходимо учитывать мощность критерия при альтернативной гипотезе. Иногда
большая мощность критерия оказывается существеннее малого уровня значимости, и
его значение выбирают относительно большим, например 0,2. Такой выбор оправдан,
если последствия ошибок второго рода более существенны, чем ошибок первого
рода. Например, если отвергнуто правильное решение «продолжить работу
пользователей с текущими паролями», то ошибка первого рода приведет к
некоторой задержке в нормальном функционировании системы, связанной со сменой
паролей. Если же принято решения не менять пароли, несмотря на опасность
несанкционированного доступа посторонних лиц к информации, то эта ошибка
повлечет более серьезные последствия.

В зависимости от сущности проверяемой
гипотезы и используемых мер расхождения оценки характеристики от ее
теоретического значения применяют различные критерии. К числу наиболее часто
применяемых критериев для проверки гипотез о законах распределения относят
критерии хи-квадрат Пирсона, Колмогорова, Мизеса, Вилкоксона, о значениях
параметров – критерии Фишера, Стьюдента.

 При проверке гипотез широкое
применение находит ряд теоретических законов распределения. Наиболее важным из
них является нормальное распределение. С ним связаны распределения хи-квадрат,
Стьюдента, Фишера, а также интеграл вероятностей. Для указанных законов функции
распределения аналитически не представимы. Значения функций определяются по
таблицам или с использованием стандартных процедур пакетов прикладных программ.
Указанные таблицы обычно построены в целях удобства проверки статистических
гипотез в ущерб теории распределений – они содержат не значения функций
распределения, а критические значения аргумента z (a).

Для односторонней критической области
z (a)= z 1–a, т.е. критическое значение аргумента z (a)
соответствует квантили z 1–a уровня 1–a, рис 1.3, так как

Статистические гипотезы .

Статистические гипотезы

Рис. 1.3. Односторонняя критическая
область

Для двусторонней критической области,
с уровнем значимости a, размер левой области a2, правой a1
(a1+a2= a ), рис. 1.4. Значения z (a2)
и z (a1)
связаны с квантилями распределения соотношениями

z (a1)= z 1–a1,
z (a2)=
z a2,

так как

Статистические гипотезы ,

Статистические гипотезы

Для симметричной функции плотности
распределения f ( z ) критическую область выбирают из
условия a1=a2=a/2 (обеспечивается наибольшая мощность критерия). В таком
случае левая и правая границы будут равны | z (a/2)|.

Статистические гипотезы

Рис. 1.4. Двусторонняя критическая
область

Нормальное
распределение

Этот вид распределения является
наиболее важным в связи с центральной предельной теоремой теории вероятностей:
распределение суммы независимых случайных величин стремится к нормальному с
увеличением их количества при произвольном законе распределения отдельных
слагаемых, если слагаемые обладают конечной дисперсией. Кроме того, А.М.
Ляпунов доказал, что распределение параметра стремится к нормальному, если на
параметр оказывает влияние большое количество факторов и ни один из них не
является превалирующим. Функция плотности нормального распределения

Статистические гипотезы

– унимодальная, симметричная, аргумент
х может принимать любые
действительные значения, рис. 1.5.

Статистические гипотезы

Рис. 1.5. Плотность нормального
распределения

Функция плотности нормального
распределения стандартизованной величины u имеет
вид

Статистические гипотезы .

Вычисление значений функции
распределения Ф( u ) для
стандартизованного неотрицательного аргумента u
( u >=0) можно
произвести с помощью полинома наилучшего приближения [9, стр. 694]

Ф( u )=
1– 0,5(1 + 0,196854 u + 0,115194 u 2 + 0,000344 u 3 + 0,019527 u 4) – 4

Такая аппроксимация обеспечивает
абсолютную ошибку не более 0,00025. Для вычисления Ф( u ) в области отрицательных значений
стандартизованного аргумента u ( u <0) следует воспользоваться свойством
симметрии нормального распределения

Ф( u )
= 1 – Ф(– u ).

Иногда в справочниках вместо значений
функции Ф( u ) приводят значения интеграла вероятностей (для u >0)

Статистические гипотезы ,                                                   u > 0

Интеграл вероятностей связан с
функцией нормального распределения стандартизованной величины u соотношением

Ф( u )
= 0,5 + F ( u ).

Распределение
хи-квадрат

Распределению хи-квадрат (c2-распределению) с k степенями свободы соответствует
распределение суммы

Статистические гипотезы

квадратов n стандартизованных
случайных величин ui , каждая из
которых распределена по нормальному закону, причем k из них независимы, n>=k .
Функция плотности распределения хи-квадрат с k
степенями свободы

Статистические гипотезы , x >= 0,

где х =c2,
Г( k/ 2) – гамма-функция.

Число степеней свободы k определяет количество независимых
слагаемых в выражении для c2. Функция
плотности при k , равном одному
или двум, – монотонная, а при k >2
– унимодальная, несимметричная, рис. 1.6.

Статистические гипотезы

Рис. 1.6. Плотность распределения
хи-квадрат

Математическое ожидание и дисперсия
величины c2 равны соответственно k и 2 k
. Распределение хи-квадрат является частным случаем более общего
гамма-распределения, а величина, равная корню квадратному из хи-квадрат с двумя
степенями свободы, подчиняется распределению Рэлея.

С увеличением числа степеней свободы
( k >30) распределение
хи-квадрат приближается к нормальному распределению с математическим ожиданием k и дисперсией 2 k . В таких случаях критическое значение

c2( k; a) » u 1–a( k , 2 k ),

где u 1–a( k , 2 k ) – квантиль
нормального распределения. Погрешность аппроксимации не превышает нескольких
процентов.

Распределение
Стьюдента

Распределение Стьюдента ( t -распределение, предложено в 1908 г. английским статистиком В. Госсетом, публиковавшим научные труды под псевдонимом Student)
характеризует распределение случайной величины

Статистические гипотезы

где u 0, u 1, …, u k взаимно независимые нормально
распределенные случайные величины с нулевым средним и конечной дисперсией.
Аргумент t не зависит от
дисперсии слагаемых. Функция плотности распределения Стьюдента

статистический гипотеза математический ожидание

Статистические гипотезы

Величина k характеризует количество степеней свободы. Плотность
распределения – унимодальная и симметричная функция, похожая на нормальное
распределение, рис. 1.7.

Статистические гипотезы

Рис. 1.7. Плотность распределения
Стьюдента

Область изменения аргумента t от минус до плюс бесконечности.
Математическое ожидание и дисперсия равны 0 и k /( k –2) соответственно, при k >2. По сравнению с нормальным распределение
Стьюдента более пологое, оно имеет меньшую дисперсию. Это отличие заметно при
небольших значениях k , что
следует учитывать при проверке статистических гипотез (критические значения
аргумента распределения Стьюдента превышают аналогичные показатели нормального
распределения). Таблицы распределения содержат значения для односторонней
(пределы интегрирования от r ( k ; a ) до бесконечности)

Статистические гипотезы

или двусторонней (пределы интегрирования от – r ( k ; a) до r ( k ; a))

Статистические гипотезы

критической области.

Распределение Стьюдента применяется
для описания ошибок выборки при k <30.
При k , превышающем 100, данное
распределение практически соответствует нормальному, для значений k из диапазона от 30 до 100 различия
между распределением Стьюдента и нормальным распределением составляют несколько
процентов. Поэтому относительно оценки ошибок малыми считаются выборки объемом
не более 30 единиц, большими – объемом более 100 единиц. При аппроксимации
распределения Стьюдента нормальным распределением для односторонней критической
области вероятность

Р { t > t ( k ;
a)} = u 1–a(0,
k /( k –2)),

где u 1–a(0, k /( k– 2))
– квантиль нормального распределения. Аналогичное соотношение можно составить и
для двусторонней критической области.

Распределение
Фишера

Распределению Р.А. Фишера ( F -распределению Фишера – Снедекора)
подчиняется случайная величина

х =[( y 1/ k 1)/( y 2/ k 2)],

равная отношению двух случайных величин у 1
и у 2, имеющих
хи-квадрат распределение с k 1
и k 2 степенями
свободы. Область изменения аргумента х от
0 до бесконечности. Плотность распределения

Статистические гипотезы .

В этом выражении k 1 обозначает
число степеней свободы величины y 1
с большей дисперсией, k 2
– число степеней свободы величины y 2
с меньшей дисперсией. Плотность распределения – унимодальная, несимметричная,
рис. 1.8.

Статистические гипотезы

Рис. 1.8. Плотность распределения
Фишера

Математическое ожидание случайной
величины х

m 1 = k 2
/( k 2–2) при k 2>2,

дисперсия

т 2 = [2 k 22( k 1 + k 2 –2)]/[ k 1( k 2 –2)2( k 2–4)] при k 2 > 4.

При k 1>30
и k 2>30 величина
х распределена приближенно
нормально:

с центром распределения ( k 1– k 2)/(2 k 1 k 2) и дисперсией
( k 1+ k 2)/(2 k 1 k 2).

Проверка гипотез о
законе распределения

Обычно сущность проверки гипотезы о
законе распределения ЭД заключается в следующем. Имеется выборка ЭД
фиксированного объема, выбран или известен вид закона распределения генеральной
совокупности. Необходимо оценить по этой выборке параметры закона, определить
степень согласованности ЭД и выбранного закона распределения, в котором
параметры заменены их оценками. Пока не будем касаться способов нахождения
оценок параметров распределения, а рассмотрим только вопрос проверки
согласованности распределений с использованием наиболее употребительных
критериев.

Критерий хи-квадрат К. Пирсона

Использование этого критерия основано
на применении такой меры (статистики) расхождения между теоретическим F ( x )
и эмпирическим распределением F п( x ), которая приближенно подчиняется
закону распределения c2. Гипотеза Н 0 о
согласованности распределений проверяется путем анализа распределения этой
статистики. Применение критерия требует построения статистического ряда.

Итак, пусть выборка представлена
статистическим рядом с количеством разрядов y.
Наблюдаемая частота попаданий в i -й
разряд n i. В соответствии
с теоретическим законом распределения ожидаемая частота попаданий в i -й разряд составляет F i. Разность
между наблюдаемой и ожидаемой частотой составит величину ( n i– F i). Для
нахождения общей степени расхождения между F ( x ) и F п( x ) необходимо подсчитать взвешенную сумму
квадратов разностей по всем разрядам статистического ряда

Статистические гипотезы .

Величина c2
при неограниченном увеличении n имеет
распределение хи-квадрат (асимптотически распределена как хи-квадрат). Это
распределение зависит от числа степеней свободы k , т.е. количества независимых значений слагаемых в
выражении (3.7). Число степеней свободы равно числу y минус число линейных
связей, наложенных на выборку. Одна связь существует в силу того, что любая
частота может быть вычислена по совокупности частот в оставшихся y–1 разрядах. Кроме того, если параметры распределения
неизвестны заранее, то имеется еще одно ограничение, обусловленное подгонкой
распределения к выборке. Если по выборке определяются f параметров
распределения, то число степеней свободы составит k= y–f–1 .

Очевидно, что чем меньше расхождение
между теоретическими и эмпирическими частотами, тем меньше величина критерия.
Область принятия гипотезы Н 0
определяется условием c2<c2( k;
a), где c2( k; a) –
критическая точка распределения хи-квадрат с уровнем значимости a. Вероятность ошибки первого рода равна a, вероятность ошибки второго рода четко определить нельзя,
потому что существует бесконечно большое множество различных способов
несовпадения распределений. Мощность критерия зависит от количества разрядов и
объема выборки. Критерий рекомендуется применять при n> 200, допускается применение при n> 40, именно при таких условиях
критерий состоятелен (как правило, отвергает неверную нулевую гипотезу).

Для нормального закона возможные
значения случайной величины лежат в диапазоне от минус до плюс бесконечности,
поэтому при расчетах оценок вероятностей крайний левый и крайний правый
интервалы расширяются до минус и плюс бесконечности соответственно. Вычислить
значения функции нормального распределения можно, воспользовавшись стандартными
функциями табличного процессора или полиномом наилучшего приближения.

Сумма взвешенных квадратов отклонения
c2=1,32. Число степеней свободы

k = 6–1–2=3,

так как уклонения связаны линейным соотношением

Статистические гипотезы ,

кроме того, на уклонения наложены еще две связи, ибо по выборке были
определены два параметра распределения. Критическое значение c2(3; 0,05)=7,815 определяется по табл.
П.3 приложения. Поскольку соблюдается условие c2<c2(3; 0,05), то полученный результат
нельзя считать значимым и гипотеза о нормальном распределении генеральной
совокупности не противоречит ЭД.

Критерий А.Н.
Колмогорова

Для применения критерия А.Н.
Колмогорова ЭД требуется представить в виде вариационного ряда (ЭД недопустимо
объединять в разряды). В качестве меры расхождения между теоретической F ( x )
и эмпирической F n( x ) функциями распределения непрерывной
случайной величины Х используется
модуль максимальной разности

Статистические гипотезы

А.Н. Колмогоров доказал, что какова
бы ни была функция распределения F ( x ) величины Х при неограниченном увеличении количества наблюдений n функция распределения случайной
величины

Статистические гипотезы

асимптотически приближается к функции распределения

Статистические гипотезы .

Иначе говоря, критерий А.Н.
Колмогорова характеризует вероятность того, что величина

Статистические гипотезы

не будет превосходить параметр l для любой теоретической функции распределения. Уровень значимости
a выбирается из условия

Статистические гипотезы ,

в силу предположения, что почти невозможно получить это равенство, когда
существует соответствие между функциями F ( x ) и F n( x ). Критерий А.Н. Колмогорова позволяет
проверить согласованность распределений по малым выборкам, он проще критерия
хи-квадрат, поэтому его часто применяют на практике. Но требуется учитывать два
обстоятельства.

1. В соответствии с условиями его
применения необходимо пользоваться следующим соотношением

Статистические гипотезы

где

Статистические гипотезы .

2. Условия применения критерия
предусматривают, что теоретическая функция распределения известна полностью –
известны вид функции и значения ее параметров. На практике параметры обычно
неизвестны и оцениваются по ЭД. Но критерий не учитывает уменьшение числа
степеней свободы при оценке параметров распределения по исходной выборке. Это
приводит к завышению значения вероятности соблюдения нулевой гипотезы, т.е.
повышается риск принять в качестве правдоподобной гипотезу, которая плохо
согласуется с ЭД (повышается вероятность совершить ошибку второго рода). В
качестве меры противодействия такому выводу следует увеличить уровень
значимости a, приняв его равным 0,1 – 0,2, что
приведет к уменьшению зоны допустимых отклонений.

Критерий Р. Мизеса

В качестве меры различия
теоретической функции распределения F ( x ) и эмпирической F n( x ) по критерию Мизеса (критерию w2) выступает средний квадрат отклонений
по всем значениям аргумента x

Статистические гипотезы (3.9)

Статистика критерия

Статистические гипотезы (3.10)

При неограниченном увеличении n существует предельное распределение
статистики n w n 2. Задав
значение вероятности a можно определить критические значения n w n 2(a). Проверка гипотезы о законе распределения осуществляется
обычным образом: если фактическое значение n w n 2
окажется больше критического или равно ему, то согласно критерию Мизеса с
уровнем значимости a гипотеза Н О
о том, что закон распределения генеральной совокупности соответствует F ( x ),
должна быть отвергнута.

Достоинством критерия Мизеса является
быстрая сходимость к предельному закону, для этого достаточно не менее 40
наблюдений в области часто используемых на практике больших значений n w n (а не несколько сот, как для критерия
хи-квадрат).

Сопоставляя возможности различных
критериев, необходимо отметить следующие особенности. Критерий Пирсона устойчив
к отдельным случайным ошибкам в ЭД. Однако его применение требует группирования
данных по интервалам, выбор которых относительно произволен и подвержен
противоречивым рекомендациям. Критерий Колмогорова слабо чувствителен к виду
закона распределения и подвержен влиянию помех в исходной выборке, но прост в
применении. Критерий Мизеса имеет ряд общих свойств с критерием Колмогорова:
оба основаны непосредственно на результатах наблюдения и не требуют построения
статистического ряда, что повышает объективность выводов; оба не учитывают
уменьшение числа степеней свободы при определении параметров распределения по
выборке, а это ведет к риску принятия ошибочной гипотезы. Их предпочтительно
применять в тех случаях, когда параметры закона распределения известны априори,
например, при проверке датчиков случайных чисел.

При проверке гипотез о законе
распределения следует помнить, что слишком хорошее совпадение с выбранным
законом распределения может быть обусловлено некачественным экспериментом
(«подчистка» ЭД) или предвзятой предварительной обработкой результатов
(некоторые результаты отбрасываются или округляются).

Выбор критерия проверки гипотезы
относительно произволен. Разные критерии могут давать различные выводы о
справедливости гипотезы, окончательное заключение в таком случае принимается на
основе неформальных соображений. Точно также нет однозначных рекомендаций по
выбору уровня значимости.

Рассмотренный подход к проверке
гипотез, основанный на применении специальных таблиц критических точек
распределения, сложился в эпоху «ручной» обработки ЭД, когда наличие
таких таблиц существенно снижало трудоемкость вычислений. В настоящее время
математические пакеты включают процедуры вычисления стандартных функций
распределений, что позволяет отказаться от использования таблиц, но может
потребовать изменения правил проверки. Например, соблюдению гипотезы Н 0 соответствует
такое значение функции распределения критерия, которое не превышает значение
доверительной вероятности 1–a (оценка статистики
критерия соответствует доверительному интервалу). В частности, для примера 3.1
значение статистики критерия хи-квадрат равно 1,318. А значение функции
распределения хи-квадрат для этого значения аргумента при трех степенях свободы
составляет 0,275, что меньше доверительной вероятности 0,95. Следовательно, нет
оснований отвергать нулевую гипотезу.

Задание 2

Задача. Рассчитайте
среднее арифметическое и среднее квадратическое отклонения и коэффициенты
вариации. Объясните их содержание.

п/п

Сумма

денежной

выручки,

 у.е.

Стоимость основных производственных

 фондоф,

тыс. у.е.

Оборотные

фонды,

тыс. у.е.

Численность

работников,

чел.

Площадь

сельхоз-

угодий,

га

Энерге-

тические

мощности,

л.с.

Покупка

кормов,

ц

Услуги сельхоз-

химии,

тыс. у.е.

Услуги агропром-техники, тыс.

 у.е.

1 2 3 4 5 6 7 8 9
1 1310 1544 288 38 510 480 25
2 1262 1562 322 37 430 410 30 6
3 1092 498 304 36 354 342 30 6
4 1074 536 330 30 350 340 35 5
5 1144 586 354 28 390 370 20 5
6 1206 464 318 32 414 390 15 4 5
7 1302 626 370 40 510 400 6 5
8 1414 608 340 42 520 426 8 5
9 1546 646 388 40 530 430 10
10 1506 644 374 44 532 440 15 15
11 1454 716 410 43 520 410 20 14 4
12 1522 704 424 37 560 504 13 4
13 1636 674 390 42 606 640 10
14 1644 652 396 41 610 710 30 8
15 1686 598 384 44 620 678 5 5
16 1614 570 348 45 630 540 15 10 5
17 1636 516 306 50 636 550 25 10 6
18 1574 474 290 60 600 614 20 15 6
19 1546 458 286 55 570 600 10 5 8
20 1484 424 310 54 554 410 10 4 8
21 976 406 272 33 320 374 30 4
ИТОГО 29628 13906 7204 871 10766 10058 330 151 73
Ср. арифм. отклон 1410,86 662,19 343,1 41,5 512,7 478,9 15,7 7,2 3,5

Ср. квадр.

откл.

294,5 302,2 45,2 8,0 96,3 110,7 8,4 3,7 1,9
Vx, % 20,9 45,6 13,2 19,3 18,8 23,1 53,5 51,4 54,3

1. Среднее арифметическое
отклонение рассчитываем по формуле:

Статистические гипотезы ,

где Х – значение варианта
показателя; n – число хозяйств или опытов.

Например:

Х = 29628\21=1410,86 и
т.д.

Значения средних
арифметических отклонений представлены в таблице.

2. Среднее квадратическое
отклонение рассчитываем по формуле:

σ2x = ∑(xi — x¯)2

σ2x = (1310-1410,86)2 +(1262-1410,86)2
+(1092-1410,86)2 +(1074-1410,86)2 +(1144-1410,86)2 +(1206-1410,86)2
+(1302-1410,86)2 +(1414-1410,86)2 +

(1546-1410,86)2
+(1506-1410,86)2 +(1454-1410,86)2 +(1522-1410,86)2 +

(1636-1410,86)2
+(1644-1410,86)2 +(1686-1410,86)2 +(1614-1410,86)2 +

(1636-1410,86)2
+(1574-1410,86)2 +(1546-1410,86)2 +(1484-1410,86)2 +

(976-1410,86)2 \21 =
86711,3

σx = 294,5

Таким образом, сумма
денежной выручки в среднем отклоняется в сторону увеличения средней
арифметической и в сторону ее уменьшения на 294,5 тыс. у. е.

σ2x = (1544-662,19)2 + (1562-662,19)2 +(498-662,19)2
+(536-662,19)2 +

 + (586-662,19)2 +(464-662,19)2
+(626-662,19)2 +(608-662,19)2 +

 +(646-662,19)2 +(644-662,19)2
+(716-662,19)2 +(704-662,19)2 +

 +(674-662,19)2 +(652-662,19)2
+(598-662,19)2 +(570-662,19)2 +

 +(516-662,19)2 +(474-662,19)2
+(458-662,19)2 +(424-662,19)2 +

 +(406-662,19)2
/21=91352,7

σx = 302,2

Стоимость основных
производственных фондов в среднем отклоняется в сторону увеличения средней
арифметической и в сторону ее уменьшения на 302,2 тыс. у. е.

σ2x = (288343,1)2 +( — 322-343,1)2 +(304-343,1)2
+(330-343,1)2 +(354-343,1)2 +(318-343,1)2 +(370-343,1)2 +(340-343,1)2 +(388-343,1)2
+(374-343,1)2 + (410-343,1)2 +(424-343,1)2 +(390-343,1)2 +(396-343,1)2 +(384-343,1)2
+ (348-343,1)2 +(306-343,1)2 +(290-343,1)2 +(286-343,1)2 +(310-343,1)2 + (272-343,1)2
/21 = 2045,6

σx = 45,2

Оборотные фонды в среднем
отклоняется в сторону увеличения средней арифметической и в сторону ее
уменьшения на 45,2 тыс. у. е.

σ2x = (38-41,5)2 + (37-41,5)2 + (36-41,5)2
+ (30-41,5)2 + (28-41,5)2 + (32-41,5)2 + (40-41,5)2 + (42-41,5)2 + (40-41,5)2 +
(44-41,5)2 + (43-41,5)2 + (37-41,5)2 + (42-41,5)2 + (41-41,5)2 + (44-41,5)2 + (45-41,5)2
+ (50-41,5)2 + (60-41,5)2 + (55-41,5)2 + (54-41,5)2 + (33-41,5)2 /21= 64,05

σx = 8,0

Численность работников в
среднем отклоняется в сторону увеличения средней арифметической и в сторону ее
уменьшения на 8,0 чел.

σ2x = (510-512,7)2 +(430-512,7)2 +(354-512,7)2
+(350-512,7)2 +(390-512,7)2 +(414-512,7)2 +(510-512,7)2 +(520-512,7)2 +(530-512,7)2
+(532-512,7)2 + (520-512,7)2 +(560-512,7)2 +(606-512,7)2 +(610-512,7)2 +(620-512,7)2
+ (630-512,7)2 +(636-512,7)2 +(600-512,7)2 +(570-512,7)2 +(554-512,7)2 + (320-512,7)2
/21= 9272,12

σx = 96,3

Площадь сельхозугодий в
среднем отклоняется в сторону увеличения средней арифметической и в сторону ее
уменьшения на 96,3 га.

 σ2x = (480-478,9)2 +(410-478,9)2 +(342-478,9)2
+(340-478,9)2 +(370-478,9)2 + (390-478,9)2 +(400-478,9)2 +(426-478,9)2 +(430-478,9)2
+(440-478,9)2 + (410-478,9)2 +(504-478,9)2 +(640-478,9)2 +(710-478,9)2 +(678-478,9)2
+ (540-478,9)2 +(550-478,9)2 +(614-478,9)2 +(600-478,9)2 +(410-478,9)2 + (374-478,9)2
/21=12252,81

σx = 110,7

Энергетические мощности в
среднем отклоняется в сторону увеличения средней арифметической и в сторону ее
уменьшения на 110,7 л.с.

σ2x = (25-15,7)2 +(30-15,7)2 +(30-15,7)2
+(35-15,7)2 +(20-15,7)2 +(15-15,7)2 + (15-15,7)2 +(20-15,7)2 +(30-15,7)2 +(15-15,7)2
+(25-15,7)2 +(20-15,7)2 + (10-15,7)2 +(10-15,7)2 +(30-15,7)2 /21= 70,7

σx = 8,4

Покупка кормов в среднем
отклоняется в сторону увеличения средней арифметической и в сторону ее
уменьшения на 8,4 ц.

σ2x = (5-7,2)2 +(5-7,2)2 +(4-7,2)2
+(6-7,2)2 +(8-7,2)2 +(10-7,2)2 +(15-7,2)2 +(14-7,2)2 +(13-7,2)2 +(10-7,2)2 +(8-7,2)2
+(5-7,2)2 +(10-7,2)2 +(10-7,2)2 +(15-7,2)2 +(5-7,2)2 +(4-7,2)2 +(4-7,2)2
/21=13,6

σx = 3,7

Услуги сельхозхимии в
среднем отклоняется в сторону увеличения средней арифметической и в сторону ее
уменьшения на 3,7 тыс. у.е.

σ2x = (6-3,5)2 +(6-3,5)2 +(5-3,5)2 +(5-3,5)2
+(5-3,5)2 +(4-3,5)2 +(4-3,5)2 +(5-3,5)2 + (5-3,5)2 +(6-3,5)2 +(6-3,5)2 +(8-3,5)2
+(8-3,5)2 /21=3,7

σx = 1,9

Услуги агропромтехники в
среднем отклоняются в сторону увеличения средней арифметической и в сторону ее
уменьшения на 1,9 тыс. у.е.

3. Коэффициент вариации Vx , отражает среднюю колеблемость
показателя и рассчитывается по формуле:

Vx = (σx\ х)
·100.

В нашем случае Vx = (294,5\1410,86)·100 = 20,9%.

Vx = (302,2\662,19)·100 = 45,6%.

Vx = (45,2\343,1)·100 = 13,2%.

Vx = (8,0\41,5)·100 = 19,3%.

Vx = (96,3\512,7)·100 = 18,8%.

Vx = (110,7\478,9)·100 = 23,1%.

Vx = (8,4\15,7)·100 = 53,5%.

Vx = (3,7\7,2)·100 = 51,4%.

Vx = (1,9\3,5)·100 = 54,3%.

Задание 3

На основе приведенных
ниже данных рассчитайте индивидуальные и общие индексы.

Количественные и качественные
показатели производства продукции

п/п

Виды продукции Количество, ц Цена за 1 ц, у.е. Индивидуальные индексы

V0

базисный период

V1

текущий год

C0

базисный период

C1

текущий год

Физического объема Цен
1 Овощи 502 546 128 152 1,09 1,19
2 Фрукты 696 686 112 123 0,99 1,10
3 Молоко 206 172 218 209 0,83 0,96
4 Говядина 298 282 142 158 0,95 1,11

1. Индивидуальные индексы
рассчитываем по формулам:

In =W1 /W0 ,

где W1 ,W0 — значение показателя соответственно в отчетном и базисном
году.

Соответственно: In =V1 /V0 , In =C1 /C0 ,

In овощи = 546/502=1,09 , In овощи = 152/128=1,19 ,

In фрукты = 686/696=0,99, In фрукты = 123/112=1,10 ,

In молоко = 172/206=0,83, In молоко = 209/218=0,96,

 In говядина = 282/298=1,11, In говядина = 158/142=1,11 .

2. Общие индексы
стоимости всей продукции вычисляем по формуле :

Ic= ∑V1C1/ ∑V0C0

Ic=∑ V1C1/ ∑V0C0 = 546*152+686*123+172*209+282*158 /
502*128+696*112+206*218+298*142= 247874/229432=1,080 или 108 %.

Индекс показывает, что стоимость
всей продукции увеличилась в отчетном периоде по сравнению с базисным, на 8%.

Общий индекс физического
объема продукции вычисляем по формуле:

Iv= ∑V1C0/ ∑V0C0

Iv= ∑V1C0/ ∑V0C0 = 546*128+686*112+172*218+282*142 /
502*128+696*112+206*218+298*142= 224260/229432= 0,977 или 97,7%

Индекс показывает, что
объем производства продукции в отчетном периоде по сравнению с базисным снизился
на 2,3%.

Список литературы

1. Громыко Г.Л. Статистика. – М.:
Изд-во МГУ им. Ломоносова, 1981.

2. Гусарев В.М. Теория статистики. –
М.: ЮНИТИ, 1998.

3. Елисеева И.И., Юзбашев. Общая
теория статистики: учеб. для вузов. – М.: Финансы и статистика, 1995.

4. Ефимов М.Р., Петров Е.В., Румянцев
В.Н. Общая теория статистики: Учебник для вузов. – М.: Инфра-М, 1996.

5. Национальное счетоводство: учебник
для вузов / Под ред. Г.Д.Кулагиной. – М.: Финансы и статистика, 1997.

6. Общая теория статистики:
Статистическая методология в коммерческой деятельности: учебник для вузов / Под
ред. А.С. Спирина и О.Е.Башиной. – М.: Финансы и статистика, 1994.

7. Социальная статистика: учебник для
вузов / Под ред. И.И.Елисеевой. – М.: Финансы и статистика, 1997.

8. Статистика: Курс лекций для вузов
/ Под ред. В.Г.Ионина. – М.: ИНФРА-М, 1996.

9. Экономическая статистика: Учебник
/ Под ред. Ю.Н.Иванова. – М.: ИНФРА-М, 1998.

10. Статистика. Раздел 1 «Общая
теория статистики и математическая статистика». Курс лекций. / Сост.:
Мизина Е.В. – Донецк: ДонГТУ, 2001.

Метки:
Автор: 

Опубликовать комментарий