Добавил:
Опубликованный материал нарушает ваши авторские права? Сообщите нам.
Вуз: Предмет: Файл:

Статистика. Учебное пособие

.pdf
Скачиваний:
0
Добавлен:
15.08.2026
Размер:
972 Кб
Скачать

ровки, тем, как правило, больше может быть образовано групп. Ограничением здесь является наполняемость групп элементами изучаемой совокупности.

Чем больше образовано групп, тем точнее будет воспроизведен характер исследуемого объекта. Однако слишком большое число групп затрудняет выявление закономерностей при исследовании социально-экономических явлений и процессов. Поэтому в каждом конкретном случае при определении числа групп следует исходить не только из степени вариации признака, но и из особенностей объекта, цели и задач исследования.

Определение числа групп можно осуществить и математическим путем с использованием формулы Стерджесса:

n =1 + 3,322 ×lg N ,

где п - число групп;

N - число единиц совокупности.

При вычислении числа групп с использованием данной формулы получаем следующие соотношения:

N

15-24

25-44

45-89

90-179

180-359

360-719

п

5

6

7

8

9

10

Недостаток формулы Стерджесса состоит в ,томчто ее применение дает хорошие результаты, только если совокупность состоит из большого числа единиц. При определении числа групп данным методом существует большая вероятность получения «пустых» или малочисленных групп. «Пустыми» называются группы, которые не содержат ни одной единицы совокупности.

После того как определено число групп, следует решить задачу определения интервалов группировки.

На третьем этапеустанавливаются границы интервалов группировки, а именно значения варьирующего признака, лежащие в пределах определенной группы. Каждый интервал имеет свою длину (ширину), верхнюю и нижнюю границы или хотя бы одну из них.

Нижней границей интервала называется наименьшее значение признака в интервале. Верхней границей интервала

51

называется наибольшее значение признака в интервале. Нижней границей первого интервала берется, как правило, наименьшее значение признака в совокупности единиц наблюдения. Верхняя граница последнего интервала не может быть меньше наибольшего значения признака в совокупности единиц наблюдения.

Шириной интервала называется разность между верхней и нижней границами. Интервалы группировки в зависимости от их ширины бывают равные и неравные. Последние делятся на прогрессивно возрастающие, прогрессивно убывающие, произвольные и специализированные. Если вариация признака проявляется в сравнительно узких границах и распределение носит равномерный характер, то строят группировку сравными интервалами. Ширина равного интервала (h)определяется по формуле:

h = R = xmax - xmin ,

n n

где хmах, хmin- максимальное и минимальное значения признака в совокупности; п- число групп.

Полученную величину округляют, и она будет являться шагом интервала.

Существуют следующие правила определения шага интервала:

-если рассчитанная ширина интервала представляет собой величину, которая имеет один знак до запятой(например, 0,76; 1,491; 5,63), то в этом случае полученные значения целесообразно округлить до десятых и использовать их в качестве шага интервала. В приведенном выше примере это будут соответственно значения: 0,8; 1,5; 5,6;

-если рассчитанная ширина интервала имеет две значащие цифры до запятой и несколько после запятой(например, 26,78), то это значение целесообразно округлить до целого числа (до 27);

-в случае, когда рассчитанная ширина интервала представляет собой трехзначное число, то эту величину следует округлить до ближайшего числа, кратного 10. Например, 678 следует округлить до 680.

Если размах вариации признака в совокупности велик и значения признака варьируют неравномерно, то надо использо-

вать группировку с неравными интервалами.

52

Применение неравных интервалов обусловлено спецификой и особенностями изучаемого социально-экономического явления или процесса, когда в первых группах небольшая разница в показателях имеет большое значение, а в последних группах эта разница существенного значения не имеет. Например, при построении группировки страховых компаний по численности работающих, которая варьирует от 30 до 1010 чел., нецелесообразно рассматривать равные интервалы, так как при этом учитываются как малые, так и крупнейшие страховые компании. Поэтому следует образовывать неравные интервалы: 30-200, 200-540, 5401050, т.е. величина каждого последующего интервала больше предыдущего на 170 чел. и увеличивается в арифметической прогрессии.

Решение вопроса о выборе равных или неравных интервалов зависит от числа единиц совокупности, попавших в каждую выделенную группу, т.е. от степени заполнения интервалов.

Интервалы групп могут бытьзакрытыми, когда указаны нижняя и верхняя границы (как в приведенном выше примере), и открытыми, когда указана лишь одна из границ (первый или последний интервалы, величина которых принимается равной величине смежных с ними интервалов). Во втором случае, чтобы показать, что работник с заработной платой, равной, например, верхней границе интервала, включается в последнюю группу, ее следует обозначить «200 и выше». И наоборот, чтобы показать, что значение, равное верхней границе интервала, не входит в данную группу, последнюю группу нужно обозначить«свыше 200». Подобные функции выполняют слова«до», «менее» и «более».

На четвертом этапе для каждой группировки устанавливают показатели или их систему, которыми должны характеризоваться выделенные группы. На данном этапе формируется система показателей, при помощи которой исследуемая группировка единиц наблюдения будет проанализирована, и сделаны выводы о характере и особенностях изучаемого явления или процесса.

Все сказанное выше относится к группировкам, которые производятся на основе анализа первичного статистического материала. Но иногда приходится пользоваться уже имеющимися

53

группировками, которые не удовлетворяют требованиям анализа. Например, имеющиеся группировки могут быть несопоставимы из-за различного числа выделенных групп или неодинаковых границ интервалов. Для приведения таких группировок к сопоставимому виду в целях их дальнейшего сравнительного анализа используется метод вторичной группировки, являющейся особым видом группировки.

Вторичная группировка — образование новых групп на основе ранее осуществленной группировки.

Получение новых групп возможно двумя способами перегруппировки:

1) объединение первоначальных интервалов (путем их укрупнения);

2)долевая перегруппировка (на основе закрепления за каждой группой определенной доли единиц совокупности).

Использование вторичной группировки для приведения двух группировок с различными интервалами к единому виду рассмотрим на примере распределения акционеров двух районов области по размеру дивидендов на одну акцию (табл. 8).

Таблица 8

Группировка акционеров по размеру выплаты дивидендов на одну акцию

 

Первый район

 

Второй район

Размер

Число акционеров,

Размер

Число акционеров,

в % от их общего

в % от их общего

дивидендов, р.

дивидендов, р.

количества

количества

10

- 40

18

10

- 60

10

40

- 80

12

60 - 120

20

80 - 120

40

120

- 200

40

120

- 160

25

200

- 300

30

160

- 200

5

 

-

-

Итого

100

Итого

100

Приведенные данные не позволяют сравнить акционеров двух районов по размеру дивидендов на одну акцию, так как в этих районах различное число групп акционеров, и, кроме того, различны величины интервалов. Необходимо все интервалы привести к сопоставимому виду. За основу возьмем структуру распределения акционеров второго района(как наиболее крупную). Следовательно, по первому району нужно произвести вторичную группировку или перегруппировку акционеров, образо-

54

вав такое же число групп и с теми же интервалами, как и во втором районе. В результате перегруппировки получаем сопоставимые данные, характеризующие распределение акционеров (табл. 9).

Таблица 9

Вторичная группировка акционеров по размеру дивидендов на одну акцию

Группы акционеров по раз-

Удельный вес акцио-

 

неров группы, %

Расчет

группы

меру дивидендов на акцию,

 

р.

Второй

Первый

 

 

район

район

 

 

 

 

1

10-60

10

24

18 + 0,5 · 12 = 24

2

60 - 120

20

46

0,5 · 12 + 40 = 46

3

120 - 200

40

30

25 + 5 = 30

4

200 - 300

30

-

-

 

Итого

100

100

100

Анализ сопоставимых данных вторичной группировки позволяет сделать вывод о том, что акционеры второго района имеют более высокий размер дивидендов: 120 и более рублей на одну акцию выплачивают 70%акционеров этого района, а в первом районе — только 30% акционеров).

4.4. Статистические ряды распределения

После определения группировочного признака и границ групп строится ряд распределения.

Статистический ряд распределения представляет собой упорядоченное распределение единиц изучаемой совокупности на группы по определенному варьирующему признаку. Он характеризует состав (структуру) изучаемого явления, позволяет судить об однородности совокупности, закономерности распределения и границах варьирования единиц совокупности.

Ряды распределения, построенные по атрибутивным признакам (в порядке возрастания или убывания наблюдаемых значений), называются атрибутивными. Примером атрибутивных рядов могут служить распределения населения по полу, занятости, национальности, профессии и т.д.

Ряды распределения, построенные по количественному признаку, называются вариационными. Например, распределе-

55

ние населения по возрасту, рабочих — по стажу работы, заработной плате и т.д.Вариационные ряды распределения состоят из двух элементов: вариантов и частот.

Числовые значения количественного признака в вариационном ряду распределения называютсявариантами. Они могут быть положительными и отрицательными, абсолютными и относительными. Так, при группировке предприятий по результатам хозяйственной деятельности варианты могут быть положительными (прибыль) и отрицательными (убыток) числами.

Частоты это числа, показывающие, как часто встречаются те или иные варианты в ряду распределения. Сумма всех частот называется объемом совокупности и определяет число элементов всей совокупности.

Вариационные ряды в зависимости от характера вариации подразделяются на дискретные и интервальные. Дискретные вариационные ряды основаны на дискретных(прерывных) признаках, имеющих только целые значения(например, тарифный разряд рабочих, число детей в семье), на дискретных признаках, представленных в вице интервалов. Интервальные ряды основаны на непрерывных признаках (принимающих любые значения, в том числе и дробные).

При наличии достаточно большого количества вариантов значений признака первичный ряд является трудно обозримым и непосредственное рассмотрение его не дает представления о распределении единиц по значению признака в совокупности. Поэтому первым шагом в упорядочении первичного ряда является его ранжирование, т.е. расположение всех вариантов в возрастающем (или убывающем) порядке. Например, стаж работы (в годах) 22 рабочих бригады характеризуется следующими данными:

2, 4, 5, 5, 6,6, 5, 6, 6, 7, 7, 8, 8, 9, 10, 11, 4, 3, 3, 4, 4, 5.

Проранжируем исходные значения:

2, 3, 3, 4, 4, 4, 4, 5, 5, 5, 5, 6, 6, 6, 6, 7, 7, 8, 8, 9, 10, 11.

При рассмотрении первичных данных можно видеть, что одинаковые варианты признака у отдельных единиц повторяются (здесь и далееf- частота повторений, п- объем изучаемой совокупности).

56

Способы построения дискретных и интервальных рядов различны. Для построения дискретного ряда с небольшим числом вариантов выписываются все встречающиеся варианты значений признака, обозначаемые через хi, а затем подсчитывается частота повторения каждого варианта fi. Ряд распределения принято оформлять в виде таблицы, состоящей из двух колонок (или строк), в одной из которых приводятся варианты, а в другой — частоты.

Для построения ряда распределения непрерывно изменяющихся признаков либо дискретных, представленных в виде интервалов «от — до», необходимо установить оптимальное число групп (интервалов), на которое следует разбить все единицы изучаемой совокупности.

При группировке внутри однокачественной совокупности появляется возможность применения равных интервалов, число которых зависит от вариации признака в совокупности и количества обследованных единиц.

Проиллюстрируем построение интервального вариационного ряда по данным приведенного выше примера распределения рабочих по стажу работы.

Для нашего примера, согласно формулы Стерджесса при N=22 число групп п=5. Зная число групп, определим величину интервала по формуле:

h = 12 - 2 = 2 . 5

В результате получим следующий ряд распределения рабочих по стажу работы:

х

2 - 4 4 - 6 6 - 8 8 - 10 10 - 12

f

3

8

6

3

2

Как видно из данного распределения, основная масса рабочих имеет стаж работы от 4 до 8 лет.

57

ГЛАВА 5. СТАТИСТИЧЕСКИЕ ТАБЛИЦЫ И ГРАФИКИ

5.1. Статистические таблицы

Статистические таблицы - это наиболее рациональная форма представления результатов статистической сводки и группировки. Значение статистических таблиц состоит в том, что они позволяют охватить материалы статистической сводки в целом. Статистическая таблица, по существу, является системой мыслей об исследуемом объекте, излагаемых цифрами на основе определенного порядка в расположении систематизированной информации.

В экономической и управленческой работе, связанной с коммерческой деятельностью, статистические таблицы применяются очень часто. Поэтому необходимо научиться правильно их составлять и анализировать.

По внешнему виду статистическая таблица представляет собой ряд пересекающихся горизонтальных и вертикальных линий, образующих по горизонтали строки, а по вертикали - графы (столбцы, колонки), которые в совокупности составляют «скелет» таблицы.

Таблица, состоящая из строк и граф, которые еще не заполнены цифрами, называется макетом таблицы рис. 3. Каждая статистическая таблица имеет подлежащее и сказуемое.

Название таблицы

Наименование

 

Наименование сказуемого

нумерация

подлежащего

 

 

Заголовки сказуемого

А

 

1

 

2

 

3

4

граф

Боковые

 

 

 

 

 

 

 

строки

заголовки

 

 

 

 

 

 

 

подлежащего

 

 

 

 

 

 

 

итоговая

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

строка

Графы

 

 

 

 

 

 

итоговая

 

Рис. 3. Макет таблицы

 

графа

 

 

 

 

 

58

Подлежащее таблицы - это объект изучения(название района, города, предприятия).

Сказуемое - это система показателей, которыми характеризуется объект изучения, т.е. подлежащее таблицы. Обычно подлежащее располагается слева в виде наименования горизонтальных строк, а сказуемое - справа в виде наименования вертикальных граф. В таблице могут быть подведены итоги по графам и строкам.

Обязательная часть таблицызаголовок, показывающий, о чем идет речь в таблице, к какому месту и времени она относится.

В зависимости от построения подлежащего, таблицы делятся на три вида: простые, групповые и комбинационные. Простые таблицы получили большое распространение во многих экономических разработках. Простыми таблицами называются такие, в подлежащем которых нет группировок, а дается лишь перечень единиц совокупности (перечневые таблицы), административных районов (территориальные таблицы) или периодов времени (хронологические таблицы).

Рассмотрим пример простой таблицы, в подлежащем которой содержатся перечисления единиц изучаемой совокупности

(табл. 10).

Продажа некоторых продуктов питания

Таблица 10

 

продовольственными магазинами города

 

Товарные группы

Продано, тыс. т

2021 г.

 

2022 г.

 

 

Мясо и птица

12,80

 

13,90

Колбасные изделия

14,00

 

13,90

Рыба

2,00

 

2,40

Молоко и молочные продукты

8,83

 

8,78

Сведения о простой таблице применяют для оценки изменения какого-либо явления во времени. Для этого в подлежащем таблицы приводятся периоды времени или даты, а в сказуемом - ряд показателей.

Хронологическую таблицу можно составлять за любые по величине отрезки времени или на моменты, отстоящие друг от друга по времени на различную длину.

59

Таблицы, в подлежащем которых приводится перечень территорий (районов, областей и т.п), называются перечневыми территориальными.

Довольно часто применяются территориально- хронологические таблицы, в которых сказуемое также содержит показатели по годам, кварталам и т.д., а подлежащее - показатели по районам, областям (табл. 11).

Таблица 11

Процент женщин в общей численности рабочих и служащих

Район

 

 

Год

 

2010

2011

 

2012

2013

 

 

Омский

 

 

 

 

 

Полтавский

 

 

 

 

 

Кармиловский

 

 

 

 

 

Итого

 

 

 

 

 

Наличие такого сочетания в построении простых таблиц усиливает их информационные возможности. И все же этот вид таблиц в основном носит описательный характер.

Групповые статистические таблицы дают более информа-

тивный материал для анализа изучаемых явлений, благодаря образованным в их подлежащем группам по существенному признаку или выявлению связи между рядом показателей. Примером может служить табл.12, в которой представлена группировка

промышленных предприятий по численности работающих (в % к итогу).

 

 

 

Таблица 12

Группировка промышленных предприятий

по численности работающих

 

Группы предприятий по средне-

Число пред-

Валовая

Среднесписочная

годовой численности

приятий

продукция

численность

работающих, чел.

 

 

рабочих

до 500

46,4

7,5

9,2

500 — 1000

23,5

13,6

13,3

1000 — 3000

21,2

31,5

29,5

3000 — 5000

4,3

13,4

13,2

5000 — 10000

2,8

13,6

13,7

10000 и выше

1,8

20,4

21,1

Подлежащим табл. 12 являются группы заводов по численности работающих. Показатели, характеризующие эти группы,

60

Соседние файлы в предмете [НЕСОРТИРОВАННОЕ]