Вопрос 3. Понятие ошибки выборки

Задача выборочного наблюдения - дать верное представление о сводных показателях всей совокупности факторов на основе некоторой их части, подвергнутой обследованию, т.е. определение характеристик генеральной совокупности по выборочным данным. Чаще других при выборочном наблюдении исследуется либо среднее значение того или иного признака у единиц совокупности (например, средняя урожайность, средняя заработная плата и т.д.), либо доля единиц обладающих тем или иным признаком, т.е. удельный вес определённых единиц в совокупности (например, доля орошаемых земель, доля отдельных пород деревьев в лесном массиве и т.д.).

Поскольку речь идёт о варьирующих признаках и изучают не всю совокупность единиц, а только их часть, то можно заранее сказать, что сводные показатели по этим признакам у части единиц совокупности почти никогда не будут абсолютно совпадать со сводными показателями всей статистической совокупности. Выборочные показатели, как правило, не совпадают с соответствующими показателями генеральной совокупности, а несколько отличаются от них в одну или другую сторону, т.е. при выборочном наблюдении всегда могут возникнуть ошибки, которые можно подразделить на ошибки регистрации и ошибки репрезентативности.

Ошибки регистрации при выборочном наблюдении, как и при сплошном, могут возникнуть по разным причинам: и по вине того, кто проводит наблюдение, и по вине отвечающего на те или иные вопросы, и от способа наблюдения. Но если тщательно провести подготовку кадров и продумать организацию проведения наблюдения, то в силу ограниченности выборочной совокупности (по сравнению с генеральной совокупностью) ошибки регистрации можно свести к минимуму или, во всяком случае, уменьшить их по сравнению с ошибками регистрации сплошного наблюдения.

Ошибка репрезентативности (представительства) свойственна лишь выборочному наблюдению и представляет собой величину возможных расхождений между показателями выборочной и генеральной совокупности.

Ошибки репрезентативности в свою очередь могут иметь случайный характер и систематический.

Систематическая ошибка - это ошибка, тенденциозно искажающая величину исследуемого признака в сторону её увеличения или уменьшения. Возникает она главным образом в результате нарушения случайности отбора.

Случайная ошибка - это ошибка, имеющая одинаковую величину вероятности в сторону уменьшения или увеличения изучаемого показателя; это ошибка, появление которой возможно в результате сущности содержания самого выборочного (не сплошного) наблюдения, в силу того, что исследуется часть, а не вся статистическая совокупность.

Определение величины случайных ошибок репрезентативности и является одной из главных задач теории выборочного метода. Их фиксирование позволяет судить о точности выборки, о возможности распространения выборочных характеристик на генеральную совокупность.

Случайные ошибки выборки определяются по формулам, разработанным на основе теории вероятностей и носят вероятностный характер.

Итак, поскольку изучаемая статистическая совокупность состоит из единиц с варьирующими признаками, то состав выборочной совокупности может в той или иной мере отличаться от состава генеральной совокупности.

Объективно возникающее расхождение между характеристиками выборочной и генеральной совокупности называется ошибкой выборки. Она зависит от ряда факторов:

· степени вариации изучаемого признака,

· численности выборки,

· методов отбора единиц из генеральной совокупности в выборочную

· принятого уровня достоверности результата исследования.

Возможные расхождения между характеристиками выборочной и генеральной совокупности измеряются средней ошибкой выборки μ. Эта величина при соблюдении принципа случайного отбора зависит прежде всего от объема выборки n и от степени колеблемости признака: чем больше n и чем меньше вариация признака (следовательно, и значение s²), тем меньше величина средней ошибки выборки m.

В математической статистике, которая лежит в основе всех расчётов показателей выборочных совокупностей, доказывается, что значения средней ошибки выборки определяются по формуле:

где:

m- средняя ошибка выборки;

s²генеральная дисперсия;

n - численность единиц выборочной совокупности.

Использование данной формулы предполагает, что известна генеральная дисперсия. Но при проведении выборочных исследований эти показатели, как правило, неизвестны. Применение выборочного метода как раз и предполагает определение характеристик генеральной совокупности.

На практике для определения средней ошибки выборки обычно используются дисперсии выборочной совокупности. Эта замена основана на том, что при соблюдении принципа случайного отбора дисперсия достаточно большого объёма выборки стремиться отобразить дисперсию в генеральной совокупности.

В математической статистике доказано следующее соотношение между дисперсиями в генеральной и выборочной совокупностях:

Из приведённой формулы видно, что дисперсия выборочной совокупности меньше дисперсии в генеральной совокупности на величину определяемую отношением:

Если n достаточно велико, то данное отношение близко к единице.

Например, при n = 100 оно равно 1,01, а при n = 500 оно равно 1,002. Поэтому с определённой долей погрешности формулу расчёта средней ошибки выборки можно представить в следующем виде.

Однако следует иметь в виду, что данная формула применяется для определения средней ошибки выборки лишь при повторном отборе. Поскольку при бесповторном отборе численность генеральной совокупности N в ходе выборки сокращается, то в формулу для расчёта n средней ошибки выборки включают дополнительный множитель. Формула средней ошибки выборки принимает следующий вид:

Для практики выборочных обследований важно, что средняя ошибка выборки применяется для установления предела отклонений характеристик выборки из соответствующих показателей генеральной совокупности. Лишь с определённой степенью вероятности можно утверждать, что эти отклонения не превысят величины t*μ, которая в статистике называется предельной ошибкой выборки. При Р= 0,683 t = 1

Предельная ошибка выборки связана со средней ошибкой выборки μ отношением:

При этом t как коэффициент кратности средней ошибки выборки зависит от вероятности, с которой гарантируется величина предельной ошибки выборки. Обычно в практике экономических исследований применяют следующие значения t: при Р= 0,9545 t = 2, при Р= 0,9973 t = 3

Вопрос 3. Понятие ошибки выборки

Поиск по сайту