Контрольная работа по "Статистики". 8
Введение
В современном обществе статистика стала
одним из важнейших инструментов управления
народным хозяйством. Она собирает информацию,
характеризующую развитие экономики страны,
культуры и жизненного уровня народа.
С помощью статистической методологии
вся полученная информация обобщается,
анализируется и в результате дает возможность
увидеть стройную систему взаимосвязей
в экономике, яркую картину и динамику
развития, позволяет делать международные
сопоставления.
Современную статистическую науку невозможно
представить без применения графиков.
Они стали средством научного обобщения.
Выразительность, доходчивость, лаконичность,
универсальность, обозримость графических
изображений сделали их незаменимыми
в исследовательской работе и в международных
сравнениях и сопоставления социально-экономических
явлений.
Значение графического метода в анализе и обобщении данных велико. Графическое изображение прежде всего позволяет осуществить контроль достоверности статистических показателей, так как, представленные на графике, они более ярко показывают имеющиеся неточности, связанные либо с наличием ошибок наблюдения, либо с сущностью изучаемого явления. С помощью графического изображения возможны изучение закономерностей развития явления, установление существующих взаимосвязей. Простое сопоставление данных не всегда дает возможность уловить наличие причинных зависимостей, в то же время их графическое изображение способствует выявлению причинных связей, в особенности в случаях установления первоначальных гипотез, подлежащих затем дальнейшей разработке. Графики также широко используются для изучения структуры влияний, их изменения во времени и размещения в пространстве. В них более выразительно проявляются сравниваемые характеристики и отчетливо видны основные тенденции развития и взаимосвязи, присущие изучаемому явлению или процессу.
По результатам 80 пусков ракет определены расстояния (в км) до точек падения. Результаты оформлены в следующуюю статистическую совокупность:
50,26 |
50,30 |
50,29 |
50,41 |
50,35 |
50,31 |
50,42 |
50,37 |
50,34 |
50,44 |
50,36 |
50,33 |
50,30 |
50,34 |
50,38 |
50,39 |
50,35 |
50,35 |
50,29 |
50,35 |
50,41 |
50,43 |
50,30 |
50,32 |
50,38 |
50,44 |
50,40 |
50,33 |
50,37 |
50,34 |
50,36 |
50,30 |
50,33 |
50,31 |
50,37 |
50,33 |
50,36 |
50,32 |
50,34 |
50,31 |
50,36 |
50,34 |
50,32 |
50,28 |
50,41 |
50,38 |
50,42 |
50,33 |
50,30 |
50,39 |
50,34 |
50,39 |
50,32 |
50,35 |
50,34 |
50,34 |
50,33 |
50,37 |
50,35 |
50,28 |
50,27 |
50,35 |
|
50,34 |
50,33 |
50,36 |
50,44 |
50,35 |
50,31 |
|
50,33 |
50,30 |
50,31 |
50,36 |
50,37 |
50,34 |
|
50,40 |
50,36 |
50,32 |
50,43 |
50,37 |
50,40 |
- Построить по этим данным интервальный вариационный ряд случайной величины X с равными интервалами и начертить гистограмму.
Результаты
Полученные в
результате n опытов наблюдаемые
значения x1, x2 xn представляют
собой выборку из всей совокупности значений,
которые может принимать интересующая
нас величина Х. Принято говорить,
что мы имеем дело с набором значений,
соответствующим некоторой выборке из
генеральной совокупности. Рассматриваемая
выборка должна обладать свойством репрезентативности
(представительности), то есть быть такой,
чтобы по ее данным можно было получить
правильное представление об всей генеральной
совокупности в целом. Будет рассматриваемая
выборка репрезентативной или нет – это
зависит от способа отбора.
При большом числе наблюдений (n ≥ 20) выборка
перестает быть удобной формой записи
– она становится слишком громоздкой
и мало наглядной. Поэтому первичные данные
(выборка) нуждаются в обработке, которая
всегда начинается с их группировки.
Построение интервального
Интервальный вариационный ряд
Номер интервала |
1 |
2 |
… |
j |
… |
(q<n) |
Границы интервала (aj-1;aj) |
(a0;a1) |
(a1;a2) |
… |
(aj-1;aj) |
… |
(aq-1;aq) |
Средняя точка интервала |
a1 |
a2 |
aj |
aq | ||
Частота интервала mj |
m1 |
m2 |
… |
mj |
… |
mq |
Относительная частота wj |
w1 |
w2 |
… |
wj |
… |
wq |
Шкала интервалов непрерывного признака A = (а0, a1, …, aj, …aq) характеризуется следующими вычисляемыми параметрами:
- наибольшее (xmax) и наименьшее (xmin) значения признака;
- оптимальное значение величины интервала h, которое позволяет выявить характерные особенности (закономерности) рассматриваемого явления при минимальном количестве интервалов q, (q<n);
- величина a0 - начало (нижняя граница) первого интервала;
- величина aj - конец (верхняя граница) j-го интервала, которая одновременно определяет начало (j+1)-го интервала.
Наибольшему (xmax) и наименьшему (xmin) значениям признака в ранжированном "по возрастанию значения" ряде соответствуют значения первого и последнего элементов ряда "Значения признака".
- Определение среди имеющихся наблюдений минимального хmin и максимального хmax значений признака. В данном примере это будут хmin = 50,26 и хmax = 50,44
- Определение размаха варьирования признака R = хmax – х min = 0,18
Определение числа групп k=1+3,32 lg n, k= 1+3,32*lg80=7,32
Где, k- число групп;
n - численность, совокупность.
Так как число групп целое, следовательно рекомендуется построить 8 групп.
4. Определение длины интервала по формуле
Стерджеса
,
где n – объем выборки. h=0,18/8=0,0225 |
5. Определение граничных значений интервалов (аi – bi). За нижнюю границу первого интервала рекомендуется брать величину, равную
а1 = хmin – h/2.
Верхняя граница первого интервала b1 = a1 + h. Тогда, если bi – верхняя граница i-го интервала (причем аi+1 = bi), то b 2 = a2 + h, b3 = a3 + h и т.д. Построение интервалов
продолжается до тех пор, пока начало следующего
по порядку интервала не будет равно или
больше хmax.
ai |
bi | |||||||
50,248 |
50,272 | |||||||
50,272 |
50,297 | |||||||
50,297 |
50,321 | |||||||
50,321 |
50,346 | |||||||
50,346 |
50,371 | |||||||
50,371 |
50,395 | |||||||
50,395 |
50,420 | |||||||
50,420 |
50,444 | |||||||
|
|
||||||||
Номер интервала |
левые |
правые |
середина интервала xi |
интервальная Частота |
Интегральная часность pj | |||
1 |
50,248 |
50,272 |
50,260 |
1 |
0,01 | |||
2 |
50,272 |
50,297 |
50,285 |
4 |
0,06 | |||
3 |
50,297 |
50,321 |
50,309 |
16 |
0,27 | |||
4 |
50,321 |
50,346 |
50,334 |
18 |
0,49 | |||
5 |
50,346 |
50,371 |
50,358 |
21 |
0,76 | |||
6 |
50,371 |
50,395 |
50,383 |
6 |
0,84 | |||
7 |
50,395 |
50,420 |
50,407 |
6 |
0,91 | |||
8 |
50,420 |
50,444 |
50,432 |
7 |
1,00 | |||
Еще |
80 |
1,00 | ||||||
Далее построим гистограмму
- Найти эмпирическую функцию распределения и построить её функцию
Эмпирической функцией распределения (функцией распределения выборки) называют функцию F*(x), определяющую для каждого значения х относительную частоту события Х
F*(x)=nх/n
где nх – число вариант, меньшее х, n – объем выборки
Таким образом, для того, чтобы найти, например F*(x2), надо число вариант, меньшее x2, разделить на объем выборки n: F*(x2)=nх2/n
В отличие от эмпирической
функции распределения выборки,
интегральную функцию F(x) распределения
генеральной совокупности
1. Значения эмпирической функции принадлежат отрезку [0;1]
2. F*(x) - неубывающая функция
3. Если х1 – наименьшая варианта, то F*(x)=0 при х≤х1; если хk – наибольшая варианта, то F*(x)=1 при х>хk.
Итак, эмпирическая функция
распределения выборки служит
для оценки теоретической
Варианты xi |
50,26 |
50,28 |
50,31 |
50,33 |
50,36 |
50,38 |
50,41 |
50,44 |
Частоты ni |
1 |
4 |
16 |
18 |
21 |
6 |
6 |
7 |
Объем выборки равен 80. Наименьшая варианта равна 50,26 следовательно F*(x)=0 при x ≤50,26. Значение х1= 50,26 наблюдалось 1 раз, следовательно, F*(x)=1/80=0.0125 х2=50,28 наблюдались 1+4=5 раз, следовательно, F*(x)=5/80=0.0625 при х3=50,31 наблюдались 1+4+16=21 раз следовательно, F*(x)=21/80=0.2625 , при х4=50,33 наблюдались 1+4+16+18=39 раз следовательно, F*(x)=39/80=0.4875, при х5=50,36 наблюдались 1+4+16+18+21=60 раз следовательно, F*(x)=60/80=0. 75 , при х6=50,38 наблюдались 1+4+16+18+21+6=66 раз следовательно, F*(x)=66/80=0.825, при х7=50,41 наблюдались 1+4+16+18+21+6+7=73 раза следовательно, F*(x)=73/80=0.9125. Так как х=50,44 – наибольшая варианта, то F*(x)=1 при x>50,44.
Искомая эмпирическая функция:
График эмпирической функции
- Вычислить среднее арифметическое выборки, выборочную дисперсию, выборочное среднее квадратичное отклонение, коэффициент вариации, размах вариации, начальные и центральные моменты до третьего порядка включительно, величину ассиметрии и экцесс, ошибки асимметрии и экцесса.
Для вычисления выборочных характеристик воспользуемся программой «Описательная статистика», выбрав соответствующий пункт меню надстройки «Анализ данных» пакета Microsoft Excel. В результате работы программы «Описательная статистика» получены значения выборочных характеристик результатов 80 пусков ракет, занесены в таблицу.
расстояния до точек падения | |
Среднее |
50,3495 |
Стандартная ошибка |
0,004689404 |
Медиана |
50,345 |
Мода |
50,34 |
Стандартное отклонение |
0,041943301 |
Дисперсия выборки |
0,001759241 |
Эксцесс |
-0,314348103 |
Асимметричность |
0,319955071 |
Интервал |
0,18 |
Минимум |
50,26 |
Максимум |
50,44 |
Сумма |
4027,96 |
Счет |
80 |
Выборочной средней называют среднее арифметическое значение признака выборочной совокупности. Если все значения признака выборки различны, то
Замечание: Если выборка представлена интервальным вариационным рядом, то за xi принимают середины частичных интервалов.
Выборочной дисперсией называют среднее арифметическое квадратов отклонения наблюдаемых значений признака от их среднего значения.
Из формулы исправленной выборочной дисперсии легко вычислить выборочную дисперсию.
С учетом поправки Шеппарда
Выборочным средним квадратическим отклонением называют квадратный корень из выборочной дисперсии:
С учетом поправки Шеппарда
Коэффициент вариации называетс
Коэффициент вариации
используется и как показатель
однородности выборочных
Размах вариации определяется как абсолютная величина разности между максимальными и минимальными значениями (вариантами) признака:
Размах вариации показывает только крайние отклонения признака и не отражает отдельных отклонений всех вариантов в ряду. Он характеризует пределы изменения варьирующего признака и зависим от колебаний двух крайних вариантов и абсолютно не связан с частотами в вариационном ряду, т. е. с характером распределения, что придает этой величине, случайный характер. Для анализа вариации нужен показатель, который отражает все колебания вариационного признака и даёт общую характеристику. Простейший показатель такого вида - среднее линейное отклонение.
Начальным моментом k-го порядка hk называется число, определяемое выражением
Центральный момент k-го порядка mk определяется из выражения
Справедливы следующие формулы,
выражающие центральные выборочные моменты
различных порядков через начальные:
Найдем исправленную выборочную асимметрию, из ее формулы легко вычислить выборочную асимметрию.
Следовательно выборочная асимметрия равна:
Найдем исправленный выборочный эксцесс, с помощью него легко вычислить выборочный эксцесс:
Следовательно выборочный эксцесс равен:
- Используя критерии -Пирсона по данному вариационному ряду при уровне значимости , проверить гипотезу о том, что случайная величина Х распределена по нормальному закону. Построить гистограмму эмпирического распределения и соответствующую нормальную кривую.
Проверку гипотезы нормального закона распределения вероятности выполняем при помощи критерия согласия Пирсона, т.к. n>50. Расчеты производим в табличной форме . Весь массив эксперементальных данныз разделяем на интервалы таким образом, чтобы в каждом интервале было не менее пяти независимых значений.
j |
интервал Sj-1-Sj |
lj |
tj |
Ф(tj) |
Pj |
lj-nPj |
lj-nPj/n*Pj | |
1 |
2 |
3 |
4 |
5 |
6 |
7 |
8 | |
1 |
-∞-----------50,297 |
4 |
-1,3712 |
-0,4319 |
0,0681 |
-1,45 |
0,293 | |
2 |
50,297 |
50,321 |
16 |
-1,2619 |
-0,3749 |
0,0570 |
1,44 |
0,667 |
3 |
50,321 |
50,346 |
18 |
-0,6905 |
-0,2910 |
0,0839 |
1,29 |
0,864 |
4 |
50,346 |
50,371 |
21 |
-0,0952 |
-0,1808 |
0,1102 |
2,18 |
0,829 |
5 |
50,371 |
50,395 |
6 |
0,5 |
-0,0478 |
0,1330 |
-1,64 |
0,542 |
6 |
50,395 |
50,420 |
6 |
1,07143 |
0,2123 |
0,2601 |
-1,81 |
0,129 |
7 |
50,420 |
7 |
+∞ |
0,5 |
0,1011 |
-1,09 |
0,112 | |
Границы доверительного интервала определяем по формуле, приняв Коэффициент Стьюдента P(S)=95%
По формуле (9) определяем, на сколько и в какую сторону отстает от средненго арифметического значения правая граница j-го интервала
Вероятность попадания отдельного независимого значения в j-й интервал определяется интервалом вероятности – функцией Лапласа. Табличные значения функции вносим в пятую графу таблицы.
По формуле определяем теоретическую вероятность попадания в j-й интервал отдельного независимого значения результата измерения, подчиняющегося нормальному закону распределения вероятности.
В 7 и 8 графах таблицы 4 производятся вспомогательные вычисления, при этом для удобства вычислений, формула преобразована:
Просуммировав все значения
8 графы, получаем
с определенным числом свободы f=8,
Определяем ганичные значения , Следовательно условие выполняется, тогда гипотеза о подчинении результата измерения нормальному закону распределения вероятности принимается, и доверительная погрешность определяется по формуле
При этом результат измерения можно записать в виде
- Для исследования зависимости объема производства (Y) от основных фондов (X) получены статистические данные по 65 предприятиям за год.
Y |
X, тыс.руб. | ||||||
32-52 |
52-72 |
72-92 |
92-112 |
112-132 |
132-152 |
152-172 | |
48-68 |
5 |
||||||
68-88 |
2 |
3 |
4 |
||||
88-108 |
2 |
7 |
6 |
||||
108-128 |
3 |
8 |
4 |
||||
128-148 |
1 |
1 |
5 |
3 |
|||
148-168 |
5 |
||||||
168-188 |
4 | ||||||
188-208 |
2 | ||||||
А) вычислить групповые средние и построить корреляционные поля;
Y |
X, тыс.руб. |
||||||||||
сред |
32-52 |
52-72 |
72-92 |
92-112 |
112-132 |
132-152 |
152-172 | ||||
42 |
62 |
82 |
102 |
122 |
142 |
162 |
|||||
48-68 |
58 |
5 |
210 |
5 |
42 | ||||||
68-88 |
78 |
2 |
3 |
4 |
598 |
9 |
66,44 | ||||
88-108 |
98 |
2 |
7 |
6 |
1310 |
15 |
87,33 | ||||
108-128 |
118 |
3 |
8 |
4 |
1550 |
15 |
103,3 | ||||
128-148 |
138 |
1 |
1 |
5 |
3 |
1220 |
10 |
122 | |||
148-168 |
158 |
5 |
710 |
5 |
142 | ||||||
168-188 |
178 |
4 |
648 |
4 |
162 | ||||||
188-208 |
198 |
2 |
324 |
2 |
162 | ||||||
446 |
430 |
1490 |
1670 |
1162 |
1204 |
1108 |
|||||
7 |
5 |
15 |
15 |
9 |
8 |
6 |
65 |
||||
63,71 |
86 |
99,33 |
111,33 |
129,11 |
150,5 |
184,67 |
|||||
Условные средние посчитаны по формулам :
;
|
58 |
78 |
98 |
118 |
138 |
158 |
178 |
198 |
|
42 |
66,44 |
87,33 |
103,3 |
122 |
142 |
162 |
162 |
|
42 |
62 |
82 |
102 |
122 |
142 |
162 |
162 |
|
63,71 |
86 |
99,33 |
111,3 |
129,11 |
150,5 |
184,67 |
184,67 |
Рис. Корреляционные поля
Рис. Регрессия X на Y
Рис. Регрессия Y на X
Коэффициент корреляции посчитаем с помощью функции Excel КОРРЕЛ по регрессии Y на X:
Коэффициент корреляции близок к 1, значит, между основными фондами и объемом производства существует тесная прямая связь.
Коэффициент детерминации: =0,9952. Вариация объема производства на 99,52 % объясняется вариацией основных фондов.
Уравнение регрессии Y на X выведено с помощью табличного процессора Excel на рисунке:
Посчитаем среднюю абсолютную процентную ошибку
|
|
|
|
|
|
42 |
58 |
56,128 |
-1,872 |
-0,0061 |
0,00614 |
62 |
78 |
78,374 |
0,374 |
0,00117 |
0,00117 |
82 |
98 |
99,954 |
1,954 |
0,0059 |
0,0059 |
102 |
118 |
121,2 |
3,2 |
0,00932 |
0,00932 |
122 |
138 |
134,557 |
-3,443 |
-0,0099 |
0,0099 |
142 |
158 |
156,248 |
-1,752 |
-0,0049 |
0,00486 |
162 |
178 |
179,606 |
1,606 |
0,00428 |
0,00428 |
162 |
198 |
198,519 |
0,519 |
0,00135 |
0,00135 |
0,00144 |

- Контрольная работа по "Статистические показатели"
- Контрольная работа по «Статистический анализ нечисловой информации»
- Контрольная работа по "Статистической математике"
- Контрольная работа по "Стилистике английского языка"
- Контрольная работа по "Стилистике русского языка"
- Контрольная работа по "Стратегический и инновационный менеджмент"
- Контрольная работа по «Стратегический маркетинг»
- Контрольная работа по "Статистики"
- Контрольная работа по "Статистики"
- Контрольная работа по "Статистики"
- Контрольная работа по "Статистики"
- Контрольная работа по "Статистики"
- Контрольная работа по "Статистики"
- Контрольная работа по "Статистики"