Шмойлова_Теория статистики. Московская финансовопромышленная академия
Скачать 1.4 Mb.
|
Глава 3. Статистическая сводка и группировка 3.1. Задачи сводки и ее содержание Важнейшим этапом исследования социально-экономических явлений и процессов является систематизация первичных данных и получение на этой основе сводной характеристики всего объекта при помощи обобщающих показателей, что достигается путем сводки и группировки первичного статистического материала. Сводка - это научная обработка первичных данных с целью получения обобщенных характеристик изучаемого социально- экономического явления по ряду существенных для него признаков с целью выявления типичных черт и закономерностей, присущих изучаемому явлению в целом. По глубине и точности обработки материала различают сводку простую и сложную. Простая сводка - это операция по подсчету общих итогов по совокупности единиц наблюдения и оформление этого материала в статистических таблицах. Сложная сводка - это комплекс последовательных операций, включающих группировку полученных при наблюдении материалов, составление системы показателей для характеристики типичных групп и подгрупп изучаемой совокупности явлений, подсчет числа единиц и итогов по каждой группе и подгруппе, и по всему объекту и представление результатов в виде статистических таблиц. Проведение сводки включает следующие этапы: − выбор группировочного признака; − определение порядка формирования групп; − разработка системы статистических показателей для характеристики групп и объекта в целом; − разработка макетов статистических таблиц для представления результатов сводки. По форме обработки материала сводка бывает: − централизованная, когда весь первичный материал поступает в одну организацию, подвергается в ней обработке от начала до конца; − децентрализованная, когда отчеты предприятий сводятся статистическими органами субъектов РФ, а полученные итоги поступают в Госкомстат РФ и там определяются итоговые показатели в целом по народному хозяйству страны. 3.2. Виды статистических группировок Группировкой называется разбиение общей совокупности единиц объекта наблюдения по одному или нескольким существенным признакам на однородные группы, различающиеся между собой в количественном и качественном отношении и позволяющие выделить социально-экономические типы, изучить структуру совокупности и проанализировать связи между отдельными признаками. Группировки являются важнейшим статистическим методом обобщения статистических данных, основой для правильного исчисления статистических показателей. С помощью метода группировок решаются следующие задачи: • выделение социально-экономических типов явлений; • изучение структуры явления и структурных сдвигов, происходящих в нем; • выявление взаимосвязи и взаимозависимости между явлениями. В соответствии с познавательными задачами, решаемыми в ходе построения статистических группировок, различают следующие их виды: типологические, структурные, аналитические. Типологическая группировка - это разбиение разнородной совокупности единиц наблюдения на отдельные качественно однородные группы и выявление на этой основе социально- экономических типов явлений. При построении группировки этого вида основное внимание должно быть уделено идентификации типов и выбору группировочного признака. Решение вопроса об основании группировки должно осуществляться на основе анализа сущности изучаемого социально-экономического явления. Структурной называется группировка, которая предназначена для изучения состава однородной совокупности по какому-либо варьирующему признаку, а также структуры и структурных сдвигов, происходящих в нем. Группировка, выявляющая взаимосвязи между изучаемыми явлениями и признаками, их характеризующими, называется аналитической группировкой. В статистике при изучении связей социально-экономических явлений признаки необходимо делить на факторные и результативные. Факторными называются признаки, под воздействием которых изменяются другие результативные признаки. Взаимосвязь проявляется в том, что с возрастанием или убыванием значения факторного признака систематически возрастает или убывает значение признака результативного и наоборот. Особенностями построения аналитической группировки являются: • единицы статистической совокупности группируются по факторному признаку; • каждая выделенная группа характеризуется средними величинами результативного признака. По способу построения группировки бывают простые и комбинационные. Простой называется группировка, в которой группы образованы только по одному признаку. Комбинационной называется группировка, в которой разбиение совокупности на группы производится по двум и более признакам, взятым в сочетании (комбинации). Сначала группы формируются по одному признаку, затем группы делятся на подгруппы по другому признаку, а эти в свою очередь делятся по третьему и так далее. Таким образом, комбинационные группировки дают возможность изучить единицы совокупности одновременно по нескольким взаимосвязанным признакам. При построении комбинационной группировки возникает вопрос о последовательности разбиения единиц объекта по признакам. Как правило, рекомендуется сначала производить группировку по атрибутивным признакам, значения которых имеют ярко выраженные качественные различия. 3.3. Принципы построения статистических группировок и классификаций Построение статистических группировок осуществляется по следующим этапам: 1. Определение группировочного признака. 2. Определение числа групп. 3. Расчет ширины интервала группировки. 4. Определение признаков, которые в комбинации друг с другом будут характеризовать каждую выделенную группу. Построение группировки начинается с определения группировочного признака. Группировочным признаком называется признак, по которому проводится разбиение единиц совокупности на отдельные группы. От правильного выбора группировочного признака зависят выводы статистического исследования. В качестве основания группировки необходимо использовать существенные, теоретически обоснованные признаки. В основание группировки могут быть положены как количественные, так и качественные признаки. Количественные признаки - это признаки, которые имеют числовое выражение (объем выпускаемой продукции, возраст человека, доход сотрудника фирмы и т. д.). Качественные признаки отражают состояние единицы совокупности (пол, отраслевая принадлежность предприятия, форма собственности фирмы и т. д.). После того, как определено основание группировки следует решить вопрос о количестве групп, на которые необходимо разбить исследуемую совокупность единиц наблюдения. Число групп зависит от задач исследования и вида показателя, положенного в основание группировки, объема изучаемой совокупности и степени вариации признака. Вид показателя особенно существенен при анализе качественных признаков. Так, например, группировка сотрудников фирмы по полу учитывает только две градации: «мужской» и «женский». В случае группировки единиц наблюдения по количественному признаку особое внимание необходимо обратить на число единиц исследуемого объекта, объем совокупности и степень колеблемости группировочного признака. При небольшом объеме совокупности (n<50) не следует образовывать большого количества групп, так как группы будут включать недостаточное число единиц объекта. Показатели, рассчитанные для таких групп, не будут представительными и не позволят получить адекватную характеристику исследуемого явления. Часто группировка по количественному признаку имеет задачу отразить распределение единиц совокупности по этому признаку. В этом случае количество групп зависит, в первую очередь, от степени колеблемости группировочного признака: чем больше его колеблемость, тем больше можно образовать групп. Поэтому при определении числа групп необходимо принять во внимание размах вариации признака (R), который позволяет оценить вариацию признака между крайними значениями признака – максимальным (Xmax) и минимальным (Xmin) и определяется по следующей формуле: R=хmax-хmin Чем больше размах вариации признака, положенного в основание группировки, тем, как правило, может быть образовано большее число групп. При этом может возникнуть проблема получения пустых групп, т.е. групп, не содержащих ни одной единицы наблюдения. Построение большого числа групп позволит, с одной стороны, точнее воспроизвести характер исследуемого объекта. Однако, с другой стороны, слишком большое число групп затрудняет выявление закономерностей при исследовании социально-экономических явлений и процессов. Поэтому в каждом конкретном случае при определении числа групп следует исходить не только из степени колеблемости признака, но и из особенностей объекта и показателей, его характеризующих а также цели исследования. Определение числа групп можно осуществить несколькими способами. Формально-математический способ предполагает использование формулы Стерджесса: n = 1 + 3,322 × lg N, (3.1) где n - число групп N - число единиц совокупности. Согласно этой формуле выбор числа групп зависит только от объема изучаемой совокупности. Применение данной формулы дает хорошие результаты в том случае, если совокупность состоит из большого числа единиц наблюдения (n>50). Другой способ определения числа групп основан на применении показателя среднего квадратического отклонения ( σ). Если величина интервала равна 0,5 σ, то совокупность разбивается на 12 групп, а когда величина интервала равна 2/3 σ и σ, то совокупность делится, собственно, на 9 и 6 групп. Однако, при определении групп данными методами существует большая вероятность получения «пустых» или малочисленных групп, характеристики изучаемого явления на основе которых будут недостаточно типичными для выделенной группы и изучаемой совокупности в целом. Когда определено число групп, то следует определить интервалы группировки. Интервал - это значения варьирующего признака, лежащие в определенных границах. Каждый интервал имеет верхнюю и нижнюю границы или одну из них. Нижней границей интервала называется наименьшее значение признака в интервале. Верхней границей интервала называется наибольшее значение признака в интервале. Величина интервала представляет собой разность между верхней и нижней границами интервала. Интервалы группировки бывают: • равные и неравные; • открытые и закрытые. В зависимости от величины интервалы группировки бывают: равные и неравные. В свою очередь неравные интервалы подразделяются на прогрессивно возрастающие, прогрессивно убывающие, произвольные и специализированные. Равные интервалы применяются в случае, если изменение количественного признака внутри изучаемой совокупности единиц наблюдения происходит равномерно и его вариация проявляется в сравнительно узких границах. Ширина равного интервала определяется по следующейформуле: h R n x x n = = − max min (3.2) где хmax, xmin - максимальное и минимальное значения признака в совокупности; n -число групп. Если максимальные или минимальные значения сильно отличаются от смежных с ними значений вариантов в упорядоченном ряду значений группировочного признака, то для определения величины интервала следует использовать не максимальное или минимальное значения, а значения, несколько превышающие минимум, и несколько меньше, чем максимум. Полученную по формуле (3.2) величину округляют и она будет являться шириной интервала. Существуют следующие правила определения ширины интервала. Если величина интервала, рассчитанная по формуле (3.2) представляет собой величину, которая имеет один знак до запятой (например: 0,67; 1,487; 3,82), то в этом случае полученные значения целесообразно округлить до десятых и их использовать в качестве ширины интервала. В приведенном выше примере это будут соответственно значения: 0,7; 1,5; 3,8. Если рассчитанная величина интервала имеет две значащие цифры до запятой и несколько после запятой (например 14,876), то это значение необходимо округлить до целого числа (до 15). В случае, когда рассчитанная величина интервала представляет собой трехзначное, четырехзначное и так далее число, то эту величину следует округлить до ближайшего числа, кратного 100 или 50. Например, 652 следует округлить до 650 или до 700. Если размах вариации признака в совокупности велик и значения признака варьируют неравномерно, то надо использовать группировку с неравными интервалами. Неравные интервалы могут быть получены в процессе объединения пустых, не содержащих ни одной единицы совокупности, равных интервалов. Это происходит в том случае, если после построения равных интервалов по изучаемому признаку образуются группы, содержащие мало или не содержащие вообще ни одной единицы, т.е. группы, не отражающие определенных типов изучаемого явления по признаку. В этом случае возникает необходимость в увеличении интервалов группировки. Также неравные интервалы могут быть прогрессивно возрастающие или прогрессивно убывающие в арифметической или геометрической прогрессии. Величина интервалов, изменяющихся в арифметической и геометрической прогрессии определяются следующим образом: hi+1 = hi + a, а в геометрической прогрессии: hi+1 = hi × q, где а - константа: для прогрессивно-возрастающих интервалов имеет знак «+«, а при прогрессивно-убывающих - знак «-«. q - константа: для прогрессивно – возрастающих – больше «1»; для прогрессивно-убывающих – меньше «1». Применение неравных интервалов обусловлено тем, что в первых группах небольшая разница в показателях имеет большое значение, а в последних группах эта разница не существенна. Например, при построении группировки строительных компаний города по показателю численности работающих, который варьирует от 500 человек до 3500 человек, нецелесообразно рассматривать равные интервалы, т. к. учитываются как малые, так и крупнейшие строительные фирмы города. Поэтому следует образовывать неравные интервалы: 500-1000, 1000-2000, 2000-3500, т. е. величина каждого последующего интервала больше предыдущего на 500 человек и увеличивается в арифметической прогрессии. Выбор исследователя в построении равных или неравных интервалов зависит от степени заполнения каждой выделенной группы, т.е. от числа единиц в них. Если величина интервала существенна и содержит большое число единиц совокупности, то эти интервалы необходимо дробить, а в противном случае – объединять. Интервалы группировок могут быть закрытыми и открытыми. Закрытыми называются интервалы, у которых имеются обе границы: верхняя и нижняя границы. Открытые - это интервалы, у которых указана только одна граница: как правило, верхняя - у первого интервала и нижняя - у последнего. Например, группы страховых компаний по числу работающих в них сотрудников (чел.): до 50, 50-100, 100-150, 150 и более. Применение открытых интервалов целесообразно в тех случаях, когда в совокупности встречается незначительное число единиц наблюдения с очень малыми или очень большими значениями вариантов, которые резко, в несколько раз, отличаются от всех остальных значений изучаемого признака. При группировке единиц совокупности по количественному признаку границы интервалов могут быть обозначены по-разному, в зависимости от того, непрерывный или дискретный признак положен в основание группировки. Если основанием группировки служит непрерывный признак (например, группы строительных фирм по объему строительно- монтажных работ, выполненных собственными силами (тыс. руб.): 1200-1400, 1400-1600, 1600-1800, 1800-2000), то одно и то же значение признака выступает и верхней и нижней границами двух смежных интервалов. В данном случае объем работ 1400 тыс. руб. составляет верхнюю границу первого интервала и нижнюю границу второго, 1600 тыс. руб. - соответственно второго и третьего и т. д.,т. е. верхняя граница i - го интервала равна нижней границе (i+1) - го интервала. При таком обозначении границ может возникнуть вопрос, в какую группу включать единицы наблюдения, значения признака у которых совпадают с границами интервалов. Например, во вторую или третью группу должна войти строительная фирма с объемом строительно- монтажных работ 1600 тыс. рублей? Если верхняя граница формируется по принципу «исключительно», то фирма должна быть отнесена к третьей группе, в противном случае - ко второй. Для того, чтобы правильно отнести к той или иной группе единицу совокупности, значение признака которой совпадает с границами интервалов, можно ориентироваться на открытые интервалы (по нашему примеру группы строительных фирм по объему строительно-монтажных работ преобразуются в следующие: до 1400, 1400-1600, 1600-1800, 1800 и более). В данном случае, вопрос отнесения отдельных единиц совокупности, значения которых являются граничными, к той или иной группе решается на основе анализа последнего открытого интервала. Возможны два случая обозначения последнего открытого интервала: 1).1800 тыс. руб. и более; 2). более 1800 тыс. руб. В первом случае, строительные фирмы с объемом строительно-монтажных работ 1600 тыс. руб. попадут в третью группу; во втором случае - во вторую группу. Если в основании группировки лежит дискретный признак, то нижняя граница i-го интервала равна верхней границе i-1-го интервала, увеличенной на 1. Например, группы строительных фирм по числу занятого персонала (чел.) будут иметь вид: 100-150, 151-200, 201-300. При определении границ интервалов статистических группировок иногда исходят из того, что изменение количественного признака приводит к появлению нового качества. В этом случае граница интервала устанавливается там, где происходит переход от одного качества к другому. Строя такую группировку, следует дифференцированно устанавливать границы интервалов для разных отраслей народного хозяйства. Это достигается путем использования группировок со специализированными интервалами. Специализированные интервалы - это такие интервалы, которые применяются для выделения из совокупности одних и тех же типов по одному и тому же признаку для явлений, находящихся в различных условиях. При изучении социально-экономических явлений на макроуровне часто применяют группировки, интервалы которых не будут ни прогрессивно возрастающими, ни прогрессивно убывающими. Такие интервалы называются произвольными и, как правило, используются при группировке предприятий, например, по уровню рентабельности. Пример. Произведем группировку совокупности, включающей 30 банков Российской Федерации (на 01.01.04 г.): Номер банка Капитал, млн. руб. Рабочие активы, млн. руб. Уставный фонд, млн. руб. 1 207,7 2,48 1,14 2 200,3 2,40 1,10 3 190,2 2,28 1,05 4 323,0 3,88 1,88 5 247,1 2,96 1,36 6 177,7 2,12 0,97 7 242,5 2,90 1,33 8 182,9 2,18 0,99 9 315,6 3,78 1,73 10 183,2 2,20 1,01 11 320,2 3,84 1,76 12 207,3 2,48 1,14 13 181,0 2,17 0,99 14 172,4 2,06 0,94 15 234,3 2,81 1,29 16 189,5 2,27 1,04 17 187,8 2,24 1,03 18 166,9 1,99 0,91 19 157,7 1,88 0,86 20 168,3 2,02 0,93 21 224,4 2,69 1,23 22 166,5 1,99 0,91 23 198,5 2,38 1,09 24 240,4 2,88 1,32 25 229,3 2,75 1,26 26 175,2 2,10 0,96 27 156,8 1,87 0,86 28 160,1 1,92 0,88 29 178,7 2,14 0,98 30 171,6 2,05 0,94 В качестве группировочного признака возьмем капитал банка. Образуем четыре группы банков с равными интервалами. Величину интервала определим по формуле: 8 , 41 4 0 , 156 0 , 323 min max = − = − = n X X h Обозначим границы групп: 1-я группа – 156,0-197,8 2-я группа – 197,8-239,6 3-я группа – 239,6-281,4 4-я группа – 281,4-323,2 После того как определен группировочный признак - капитал, задано число групп - 4 и образованы сами группы, необходимо отобрать показатели, которые характеризуют группы и определить их величины по каждой группе. Показатели, характеризующие банки, разносятся по четырем указанным группам и подсчитываются групповые итоги. Результаты группировки заносятся в таблицу и определяются общие итоги по совокупности единиц наблюдения по каждому показателю. Таблица 3.1. Группировка коммерческих банков по величине капитала Группы банков по величине капитала, млн. руб. Число банков Капитал, млн. руб. Активы, млн. руб. Работающие активы, млн. руб. А 1 2 3 4 156,0-197,8 197,8-239,6 239,6-281,4 281,4-323,2 17 7 3 3 2966,5 1501,8 730,0 958,8 35,48 17,99 8,74 11,5 16,25 8,25 4,01 5,37 Итого 30 6157,1 73,71 33,88 Структурная группировка коммерческих банков на основе данных таблицы 3.1 будет иметь вид: Таблица 3.2. Группировка коммерческих банков по величине капитала (в %% к итогу) Группы банков по величине капитала, млн. руб. Число банков Капитал Активы Работающие активы 156,0-197,8 197,8-239,6 239,6-281,4 281,4-323,2 56,7 23,3 10,0 10,0 48,2 24,4 11,9 15,5 48,1 24,4 11,9 15,6 48,0 24,3 11,8 15,9 Итого 100,0 100,0 100,0 100,0 Из таблицы 3.2 видно, что в основном преобладают малые банки – 56,7%, на долю которых приходится 48,2% всего капитала. Более конкретный анализ взаимосвязи показателей можно сделать на основе аналитической группировки. Таблица 3.3. Группировка коммерческих банков по величине капитала Капитал, млн.руб. Активы, млн. руб. Работающие активы, млн.руб. Группы банков по величине капитала, млн. руб. Число банков всего в среднем на один банк всего в среднем на один банк всего в среднем на один банк 156,0-197,8 17 2966,5 174,5 35,48 2,09 16,25 0,96 197,8-239,6 7 1501,8 214,5 17,99 2,57 8,25 1,18 239,6-281,4 3 730,0 243,3 8,74 2,91 4,01 1,34 281,4-323,2 3 958,8 319,6 11,5 3,83 5,37 1,79 Итого 30 6157,1 205,2 73,71 2,46 33,88 1,13 Величина капитала, все активы банка и работающие активы прямо зависят между собой, и чем крупнее банк, тем эффективнее управление работающими активами. Мы рассмотрели примеры группировок по одному признаку. Однако в ряде случаев для решения поставленных задач такая группировка является недостаточной. В этих случаях переходят к группировке исследуемой совокупности по двум и более существенным признакам во взаимосвязи (комбинационной группировке). Произведем группировку данных коммерческих банков по двум признакам: величине капитала и работающим активам. Каждую группу и подгруппу охарактеризуем следующими показателями: число коммерческих банков, капитал, работающие активы. Таблица 3.4. Группировка коммерческих банков по величине капитала и работающим активам Номер группы Группы банков по величине капитала, млн. руб. Подгруппы по величине работающих активов, млн. руб. Число бан- ков Капи- тал, млн. руб. Работа- ющие активы, млн. руб. 1 2 3 4 5 6 156,0-197,8 0,86-1,37 1,37-1,88 17 - 2966,5 - 16,25 - 1 Итого 17 2966,5 16,25 197,8-239,6 0,86-1,37 1,37-1,88 7 - 1501,8 - 8,25 - 2 Итого 7 1501,8 8,25 239,6-281,4 0,86-1,37 1,37-1,88 3 - 730,0 - 4,01 - 3 Итого 3 730,0 4,01 281,4-323,2 0,86-1,37 1,37-1,88 - 3 - 958,8 - 5,37 4 Итого 3 958,8 5,37 Всего по подгруппам 0,86-1,37 1,37-1,88 27 3 5198,3 958,8 28,51 5,37 5 Всего 30 6157,1 33,88 От группировок следует отличать классификацию. Классификацией называется систематизированное распределение явлений и объектов на определенные группы, классы, разряды на основании их сходства и различия. Отличительными чертами классификаций является: • в их основе лежит качественный признак; • классификации стандартны и устанавливаются органами государственной и международной статистики; • классификации устойчивы, так как остаются неизменными в течение длительного периода времени. Ряды распределения представляют собой простейшую группировку, в которой каждая выделенная группа характеризуется только частотой. В зависимости от признака, положенного в основу образования ряда распределения, различают атрибутивные и вариационные ряды распределения. Атрибутивными называют ряды распределения, построенные по качественным признакам, то есть признакам, характеризующим состояние изучаемого явления и не имеющим числового выражения. Атрибутивные ряды распределения характеризуют состав совокупности по тем или иным существенным признакам. Взятые за несколько периодов, эти данные позволяют исследовать изменение структуры. Вариационными рядами называют ряды распределения, построенные по количественному признаку, т.е. признаку, имеющему числовое выражение у отдельных единиц совокупности. Вариационный ряд состоит из двух элементов: вариантов и частот. Вариантами называются отдельные значения признака, которые он принимает в вариационном ряду, то есть конкретное значение варьирующего признака. Частотами называются численности отдельных вариант или каждой группы вариационного ряда. Частоты показывают, как часто встречаются те или иные значения признака в изучаемой совокупности. Сумма всех частот определяет численность всей совокупности, ее объем. Частостями называются частоты, выраженные в долях единицы или в процентах к итогу. Соответственно сумма частостей равна 1 или 100%. В зависимости от характера вариации признака различают дискретные и интервальные вариационные ряды. Дискретный вариационный ряд - это ряд распределения в котором группы составлены по признаку, изменяющемуся прерывно, т.е. через определенное число единиц и характеризуют распределение единиц совокупности по дискретному признаку, принимающему только целые значения. Например, группы студентов по баллу в сессию по предмету: 5,4,3,2. Интервальный вариационный ряд распределения – это ряд распределения, в котором группировочный признак, составляющий основание группировки, может принимать в интервале любые значения, отличающиеся друг от друга на сколь угодную малую величину. Построение интервальных вариационных рядов целесообразно прежде всего при непрерывной вариации признака, а также если дискретная вариация признака проявляется в широких пределах, то есть число вариантов дискретного признака достаточно велико. Правила построения рядов распределения аналогичны правилам построения группировки. Анализ рядов распределения наглядно можно проводить на основе их графического изображения. Для этой цели строят полигон, гистограмму, огиву и кумуляту распределения. Полигон используется при изображении дискретных вариационных рядов. Для его построения в прямоугольной системе координат по оси абсцисс в одинаковом масштабе откладываются ранжированные значения варьирующего признака, а по оси ординат наносится шкала для выражения величины частот. Полученные на пересечении оси абсцисс (х) и оси ординат (у) точки соединяются прямыми линиями, в результате чего получают ломаную линию, называемую полигоном частот. Иногда для замыкания полигона предлагается крайние точки (слева и справа на ломаной линии) соединить с точками на оси абсцисс, в результате чего получается многоугольник. Гистограмма применяется для изображения интервального вариационного ряда. При построении гистограммы на оси абсцисс откладываются величины интервалов, а частоты изображаются прямоугольниками, построенным на соответствующих интервалах. Высота столбиков должна быть пропорциональна частотам. В результате получается график, на котором ряд распределения изображен в виде смежных друг с другом столбиков. Гистограмма может быть преобразована в полигон распределения, если середины верхних сторон прямоугольников соединить прямыми линиями. При построении гистограммы распределения вариационного ряда с неравными интервалами по оси ординат наносят не частоты, а плотность распределения признака в соответствующих интервалах. Это необходимо сделать для устранения влияния величины интервала на распределение интервала и получения возможности сравнивать частоты. Плотность распределения - это частота, рассчитанная на единицу ширины интервала, то есть, сколько единиц в каждой группе приходится на единицу величины интервала. Для графического изображения вариационных рядов может использоваться кумулятивная кривая. При помощи кумуляты изображается ряд накопленных частот. Накопленные частоты определяются путем последовательного суммирования частот по группам. Накопленные частоты показывают, сколько единиц совокупности имеют значения признака не больше, чем рассматриваемое значение. При построении кумуляты интервального вариационного ряда по оси абсцисс (х) откладываются варианты ряда, а по оси ординат (у) накопленные частоты, которые наносят на поле графика в виде перпендикуляров к оси абсцисс в верхних границах интервалов. Затем эти перпендикуляры соединяют и получают ломаную линию, то есть кумуляту. Если при графическом изображении вариационного ряда в виде кумуляты оси х и у поменять местами, то получим огиву. 3.4. Сравнимость статистических группировок. Вторичная группировка Группировки, построенные за один и тот же период времени, но для разных объектов или, наоборот, для одного объекта, но за два разных периода времени могут оказаться несопоставимыми из-за различного числа выделенных групп или неодинаковости границ интервалов. Вторичная группировка, или перегруппировка сгруппированных данных применяется для лучшей характеристики изучаемого явления (в случае, когда первоначальная группировка не позволяет четко выявить характер распределения единиц совокупности), либо для приведения к сопоставимому виду группировок с целью проведения сравнительного анализа. Вторичная группировка - операция по образованию новых групп на основе ранее осуществленной группировки. Применяют два способа образования новых групп. Первым, наиболее простым и распространенным способом является изменение (чаще укрупнение) первоначальных интервалов. Второй способ получил название долевой перегруппировки и состоит в образовании новых групп на основе закрепления за каждой группой определенной доли единиц совокупности. Проиллюстрируем методику вторичной группировки на следующем примере. Пример: Распределение сотрудников предприятия по уровню дохода Группы работающих по уровню доходов, тыс.руб. Число работающих, чел. До 4 4-10 10-18 18-30 30-40 40 и более 16 20 44 74 37 9 Итого 200 Произведем перегруппировку данных, образовав новые группы с интервалами до 5, 5 - 10, 10 - 20, 20 - 30, свыше 30 тыс. руб. В первую новую группу войдет полностью первая группа сотрудников и часть второй группы. Чтобы образовать группу до 5 тыс. руб., необходимо от интервала второй группы взять 1,0 тыс. руб. Величина интервала этой группы составляет 6,0 тыс. руб. Следовательно, необходимо взять от нее 1/6 (1,0:6,0) часть. Аналогичную же часть во вновь образуемую первую группу надо взять и от численности работающих, то есть 20 1 6 3 × = чел. Тогда в первой группе будет работающих: 16 + 3 = 19 чел. Вторую новую группу образуют работающие второй группы за вычетом отнесенных к первой, то есть 20 - 3 = 17 чел. Во вновь образованную третью группу войдут все сотрудники третьей группы и часть сотрудников четвертой. Для определения этой части от интервала 18 - 30 (ширина интервала равна 12) нужно добавить к предыдущему 2,0 (чтобы верхняя граница интервала была равна 2,0 тыс. руб.). Следовательно, необходимо взять часть интервала, равную [2:12 = 1:6]. В этой группе 74 человека, значит надо взять 74 ×(1:6) = 12 чел. В новую третью группу войдут 44 +12 = 56 чел. Во вновь образованную четвертую группу войдут 74 - 12 = 62 чел., оставшихся от прежней четвертой группы. Пятую вновь образованную группу составят работающие пятой и шестой прежних групп: 37 +9 = 46 чел. В результате получим следующие новые группы: Группы работающих по уровню доходов, руб. Число работающих до 5 5-10 10-20 20-30 свыше 30 19 17 56 62 46 Итого 200 3.5. Статистическая таблица и ее элементы Результаты сводки и группировки материалов статистического наблюдения, как правило, представляются в виде таблиц. Таблица является наиболее рациональной, наглядной и компактной формой представления статистического материала. Однако, не всякая таблица является статистической. Таблица умножения, опросный лист социологического обследования и так далее, могут носить табличную форму, но еще не являются статистическими таблицами. Статистической называется таблица, которая содержит сводную числовую характеристику исследуемой совокупности по одному или нескольким существенным признакам, взаимосвязанным логикой экономического анализа. Основные элементы статистической таблицы, составляющие как бы ее остов (основу), показаны на схеме 2.1. Табличной называется такая форма расположения числовой информации, при которой число располагается на пересечении четко сформулированного заголовка по вертикальному столбцу, называемому графой, и названия по соответствующей горизонтальной полосе - строке. Таким образом, внешне таблица представляет собой пересечение граф и строк, которые формируют остов таблицы. Статистическая таблица содержит три вида заголовков: общий, верхние и боковые. Общий заголовок отражает содержание всей таблицы (к какому месту и времени она относится), располагается над макетом таблицы по центру и является внешним заголовком. Верхние заголовки характеризуют содержание граф (заголовки сказуемого), а боковые (заголовки подлежащего) - строк. Они являются внутренними заголовками. Остов таблицы, заполненный заголовками, образует макет таблицы; если на пересечении граф и строк записать цифры, то получается полная статистическая таблица. Название таблицы (общий заголовок) Cодержание строк А 1 2 3 4 5 Наименование строк (боковые заголовки) Итоговая строка Итоговая графа Наименование граф (верхние заголовки) *) Примечания к таблице. Схема 3.1. Остов (основа) статистической таблицы Цифровой материал может быть представлен абсолютными (численность населения РФ), относительными (индексы цен на продовольственные товары) и средними (среднемесячный доход сотрудника коммерческого банка) величинами. Таблицы могут сопровождаться примечанием, используемым с целью пояснения, в случае необходимости, заголовков, методики расчета некоторых показателей, источников информации и так далее. По логическому содержанию таблица представляет собой «статистическое предложение», основными элементами которого являются подлежащее и сказуемое. Подлежащим статистической таблицы называется объект, который характеризуется цифрами. Это может быть одна или несколько совокупностей, отдельные единицы совокупности в порядке их перечня или сгруппированные по каким-либо признакам, территориальные единицы и так далее. Обычно подлежащее таблицы дается в левой части, в наименовании строк. Сказуемое статистической таблицы образует система показателей, которыми характеризуется объект изучения, то есть подлежащее таблицы. Сказуемое формирует верхние заголовки и составляет содержание граф с логически последовательным расположением показателей слева направо. Расположение подлежащего и сказуемого в отдельных случаях может меняться местами для более полного и лучшего способа прочтения и анализа исходной информации об исследуемой совокупности. 3.6. Виды статистических таблиц В практике экономико-статистического анализа используются различные виды статистических таблиц. В зависимости от структуры подлежащего, от группировки единиц в нем, различают статистические таблицы простые и сложные, а последние, в свою очередь, подразделяются на групповые и комбинационные. Простой называется такая таблица, в подлежащем которой дается перечень каких-либо объектов или территориальных единиц. Простые таблицы различают монографические и перечневые. Монографические таблицы характеризуют не всю совокупность единиц изучаемого объекта, а только одну какую-либо группу из нее, выделенную по определенному признаку (табл. 3.5). Таблица 3.5. Ввод в действие зданий жилого назначения в Российской Федерации в 2003 г. Число зданий, ед. Общий строительный объем зданий млн. куб.м. Общая площадь зданий, млн. кв.м. А 1 2 3 Введено в действие зданий жилого назначения 119727 150,1 40,5 Перестроив подлежащее таблицы 3.5, таким образом, чтобы были показаны все введенные в действие здания, то есть, показав каждую единицу совокупности, получаем перечневую таблицу (см. табл. 3.6.). Таким образом, простыми перечневыми таблицами называются таблицы, подлежащее которых содержит перечень единиц изучаемого объекта. Таблица 3.6. Ввод в действие зданий в Российской Федерации в 2003 г. Номер здания Общий строительный объем, куб.м. Общая площадь, кв.м. A 2 3 1 2 … … … … … … … … … … Всего … … Простые таблицы не дают возможности выявить социально- экономические типы изучаемых явлений, их структуру, а также взаимосвязи и взаимозависимости между характеризующими их признаками. Эти задачи более полно могут быть решены с помощью сложных - групповых и, особенно, комбинационных таблиц. Групповыми называются статистические таблицы, подлежащее которых содержит группировку единиц совокупности по одному количественному или атрибутивному признаку. Простейшим видом групповых таблиц являются ряды распределения. Групповая таблица может быть более сложной, если в сказуемом дополнительно приводятся ряд показателей, характеризующих группы подлежащего. Такие таблицы часто используются в целях сопоставления обобщающих показателей по группам. Таблица 3.7. Распределение населения Российской Федерации по возрастным группам в 2002 г. (на начало года) Группы населения по возрасту, лет Численность населения, тыс. чел. Численность населения, в % к итогу 1 2 3 0-4 6306 4,4 5-9 7123 4,9 10-14 10825 7,5 15-19 12208 8,5 20-24 10901 7,6 25-29 10422 7,2 30-34 9534 6,6 35-39 10588 7,4 40-44 12595 8,7 45-49 11625 8,1 50-54 9832 6,8 55-59 4841 3,4 60-64 8625 6,0 65-69 5974 4,2 70 и более 12555 8,7 Итого 143954 100,0 Таблица 3.7. отражает количественное распределение населения Российской Федерации по возрасту. Таким образом, групповые таблицы позволяют выявить и охарактеризовать социально-экономические типы явлений, их структуру в зависимости только от одного признака. Комбинационными называются статистические таблицы, подлежащее которых содержит группировку единиц совокупности одновременно по двум и более признакам: каждая из групп, построенная по одному признаку, разбивается, в свою очередь, на подгруппы по какому-либо другому признаку и так далее. Таблица 3.8. Группировка предприятий пищевой промышленности одного из регионов Российской Федерации по величине прибыли и численности промышленно-производственного персонала в 2003 г. Группы предприятий по величине прибыли, млн. руб. Группы предприятий по численности промышленно-производственного персонала (чел.) Число предприятий 1 2 3 50-100 200-250 250-300 300-350 3 4 8 Итого по группе - 15 100-150 200-250 250-300 300-350 1 2 2 Итого по группе - 5 Итого по подгруппам 200-250 250-300 300-350 4 6 10 Всего 20 Подлежащим в таблице являются группы предприятий по величине прибыли и численности промышленно-производственного персонала. Комбинационные таблицы позволяют характеризовать типические группы, выделенные по нескольким признакам и связь между ними. Последовательность разбиения единиц совокупности на однородные группы по признакам определяется либо важностью одного из них в их комбинации, либо порядком их изучения. В сказуемом статистической таблицы, как уже говорилось, приводятся показатели, которые являются характеристикой изучаемого объекта. По структурному строению сказуемого различают статистические таблицы с простой и сложной его разработкой. При простой разработке сказуемого, показатель, определяющий его, не подразделяется на подгруппы и итоговые значения получаются путем простого суммирования значений по каждому признаку отдельно, независимо друг от друга. Примером простой разработки сказуемого может служить следующий фрагмент статистической таблицы: Таблица 3.9. Распределение строительных организаций различных форм собственности по объему работ, выполненных по договорам строительного подряда в 2003 г. в том числе по формам собственности Строитель- ные органи- зации Объем работ, выполненных по договорам строительного подряда - всего госу- дарст- венная муни- ци- пальная частная смешан- ная российс- кая прочие После заполнения данного фрагмента таблицы получается подробная характеристика строительных организаций по структуре объема работ по формам собственности. По каждой строительной организации можно получить информацию об объеме работ, выполненных по договорам строительного подряда, как в целом, так и в разрезе форм собственности. Сложная разработка сказуемого предполагает деление признака, формирующего его, на подгруппы: в том числе На льготных условиях По цене определенной Госкомимуществом Предп- риятия Приобре- тено акций (всего) привиле- гированные типа А обыкно- венные привиле- гированные типа А обыкновенные При этом получается более полная и подробная характеристика объекта. Здесь оба признака сказуемого (ценовой и видовой) тесно связаны друг с другом. Можно проанализировать не только количество приобретенных акций по видам и условиям приобретения их сотрудниками приватизированных предприятий, но и определить число привилегированных и обыкновенных акций, приобретенных на разных ценовых условиях. То есть, при сложной разработке сказуемого явление или объект могут быть охарактеризованы различной комбинацией признаков, формирующих их. Исследователь при построении статистических таблиц должен руководствоваться оптимальным соотношением показателей сказуемого. 3.7. Основные правила построения и анализа статистических таблиц Статистические таблицы, как средство наглядного и компактного представления цифровой информации, должны быть статистически правильно оформлены. Основными приемами, определяющими технику формирования статистических таблиц, являются следующие: 1. Таблица должна быть компактной и содержать только те данные, которые непосредственно отражают исследуемое явление в статике и динамике и необходимы для познания его сущности. Цифровой материал необходимо излагать таким образом, чтобы при анализе таблицы сущность явления раскрывалась чтением строк слева направо и сверху вниз; 2. Заголовок таблицы и названия граф и строк должны быть четкими, краткими, лаконичными, представлять собой законченное целое, органично вписывающееся в содержание текста. В названии таблицы должны найти отражение объект, признак, время и место совершения события. Например: «Курс доллара США на торгах ММВБ на 01.01.2004 г.» Названия таблицы, граф и строк пишутся полностью, без сокращений. 3. Информация, располагаемая в столбцах (графах) таблицы, завершается итоговой строкой. Существуют различные способы соединения слагаемых граф с их итогом: • строка «Итого» или «Всего» завершает статистическую таблицу; • итоговая строка располагается первой строкой таблицы и соединяется с совокупностью ее слагаемых словами «В том числе». 4. Если названия отдельных граф повторяются между собой, содержат повторяющиеся термины или несут единую смысловую нагрузку, то необходимо им присвоить объединяющий заголовок. 5. Графы и строки полезно нумеровать. Графы слева, заполненные названием строк, принято обозначать заглавными буквами алфавита (А), (В) и так далее, а все последующие графы - номерами в порядке возрастания. 6. Взаимосвязанные данные, характеризующие одну из сторон анализируемого явления (например, число коммерческих банков и удельный вес коммерческих банков (в % к итогу) и т.д.), целесообразно располагать в соседних друг с другом графах. 7. Графы и строки должны содержать единицы измерения, соответствующие поставленным в подлежащем и сказуемом показателям. При этом используются общепринятые сокращения единиц измерения (чел., руб., кВт/ч и так далее). 8. Числа целесообразно, по возможности, округлять. Округление чисел в пределах одной и той же графы или строки следует проводить с одинаковой степенью точности (до целого знака или до десятого и так далее). Если все числа одной и той же графы или строки даны с одним десятичным знаком, а одно из чисел имеет точно два знака после запятой, то числа с одним знаком после запятой следует дополнять нулем, тем самым подчеркнув их одинаковую точность. 9. Отсутствие данных об анализируемом социально- экономическом явлении может быть обусловлено различными причинами и это по-разному отмечается: а) если данная позиция (на пересечении соответствующих графы и строки) вообще не подлежит заполнению, то ставится знак «Х»; б) если по какой-либо причине отсутствуют сведения, то ставится многоточие «...» или «нет свед.»; в) если явление отсутствует полностью, то клетка заполняется тире (-); г) для отображения очень малых чисел используют обозначения (0,0) или (0,00). 10. В случае необходимости дополнительной информации - разъяснений к таблице, могут даваться примечания. Соблюдение приведенных правил построения и оформления статистических таблиц делает их основным средством представления, обработки и обобщения статистической информации о состоянии и развитии анализируемых социально-экономических явлений. Анализу статистических таблиц предшествует этап ознакомления - чтения их. «Чтение» предполагает, что исследователь, прочитав слова и числа таблицы, усвоил ее содержание в целом, сформулировал первые суждения об объекте, уяснил назначение таблицы, дал оценку явлению или процессу, описанному в таблице. Анализ предполагает реализацию двух его направлений - структурного и содержательного. Структурный анализ предполагает анализ строения таблицы и характеристику представленных в ней: • совокупности и единиц наблюдения, формирующих ее; • признаков и их комбинации, формирующих подлежащее и сказуемое таблицы; • признаков - количественные или атрибутивные; • соотношение признаков подлежащего с показателями сказуемого; • вида таблицы - простая или сложная, а последняя - групповая или комбинационная; • решаемых задач - анализ структуры, типов явлений или их взаимосвязей. Содержательный анализ предполагает изучение внутреннего содержания таблицы: анализ отдельных групп подлежащего по соответствующим признакам сказуемого; выявление соотношений и пропорций между группами явлений по одному и разным признакам; сравнительный анализ и формулировка выводов по отдельным группам и по всей совокупности в целом, установление закономерностей и определение резервов развития изучаемого объекта. Прежде чем приступить к анализу числовой информации, необходимо проверить ее достоверность и научную обоснованность, источники ее получения. Должна быть произведена проверка данных: логическая (например, абсурдно, если численность работающих на фирме составила 115,1 чел.) и счетная - выборочный расчет отдельных значений признаков по группе, либо итоговых значений. Анализ отдельных признаков и групп необходимо начинать с изучения абсолютных величин, затем - связанных с ними относительных величин. Анализ таблиц может быть дополнен расчетными средними величинами, графиками, диаграммами и т.д., если этого требуют задачи исследования. Анализ данных таблиц производится по каждому признаку в отдельности, а затем в логико-экономическом сочетании признаков. Соблюдение правил и последовательности работы со статистическими таблицами позволит исследователю осуществить научно-обоснованный экономико-статистический анализ объектов и процессов. |