Районированная выборка

Материал из Википедии — свободной энциклопедии
Перейти к: навигация, поиск

В математической статистике, районированная выборка (другое название – стратифицированная выборка) – метод семплирования из генеральной совокупности, который позволяет улучшить точность статистических результатов при разбиении всего пространства событий на несколько областей-страт и независимой работе с этими стратами. Например, в каждой страте можно применять свою собственную выборку по значимости.

Пример[править | править вики-текст]

Предположим, что нам нужно оценить среднее число голосов, поданных за каждого кандидата на выборах. Предположим, что в стране 3 города: в городе А живёт 1 миллион заводских рабочих, в городе Б живёт 2 миллиона офисных работников, а в городе В живёт 3 миллиона пенсионеров. Мы можем выбрать получение случайной выборки размером в 60 голосов со всей популяции, но есть некоторая вероятность, что случайная выборка окажется плохо сбалансирована по этим городам и, следовательно, будет необъективна, вызывая значительную погрешность в оценке. Взамен этого, если мы выберем использовать простую случайную выборку в 10, 20 и 30 голосов из городов А, Б и В соответственно, мы можем получить меньшую погрешность в оценке при том же общем размере выборки.

Стратегии районированной выборки[править | править вики-текст]

Преимущества перед другими методами семплирования[править | править вики-текст]

Недостатки[править | править вики-текст]

См. также[править | править вики-текст]

Литература[править | править вики-текст]

  • Särndal, Carl-Erik; et al. (2003). "Stratified Sampling". Model Assisted Survey Sampling. New York: Springer. pp. 100–109. ISBN 0-387-40620-4.