Добавил:

Upload Опубликованный материал нарушает ваши авторские права? Сообщите нам.

Вуз:

Российский государственный аграрный университет МСХА им. Тимирязева

Предмет:

[НЕСОРТИРОВАННОЕ]

Файл:

kontrol_po_ekonometr.doc

Скачиваний:

145

Добавлен:

19.09.2019

Размер:

17.55 Mб

Скачать

☆

<<< < Предыдущая 19 20 21 22 23 24 25 26 27 28 29 3031 / 8131 32 33 34 35 36 37 38 39 40 41 42 43 > Следующая >>>

5.2.4. Частные f- тесты

Достоверность уравнения множественной регрессии в целом, как и парной, оценивается с помощью критерия Фишера

(5.2.16)

где

W_общ.=п×σ_у ² ; W_регр.= W_общ×R² ; ; W_ост..= W_общ×(1-R²)= W_общ.- W_регр

Оценивается также значимость не только уравнения в целом, но и фактора, дополнительно включенного в регрессионную модель. Необходимость такой оценки связана с тем, что не каждый фактор, вошедший в модель, может существенно увеличивать долю объясненной вариации результативного признака. Мерой для оценки включения фактора в модель служит частный критерий Фишера. Частный F - критерий построен на сравнении прироста факторной дисперсии, обусловленного влиянием дополнительно включенного фактора с остаточной дисперсией на одну степень свободы по регрессионной модели, включающей полный набор факторов

(5.2.17)

Так как прирост факторной суммы квадратов отклонений обусловлен дополнительным включением в модель одного исследуемого фактора, то число степеней свободы для него равно df_x₁= 1. Для остаточного объема вариации число степеней свободы df_ост = n-m-1. Соотношение числа степеней свободы приведено в формуле частного F-критерия в виде дроби .

Дисперсионный анализ такой модели отличается от анализа, проводимого нами ранее. Источник вариации «регрессия» раскладывается здесь на две составляющие:

1) обусловленная влиянием фактора х1;

2) обусловленная дополнительным включением в модель фактора х2. Соответственно для двухфакторной линейной регрессии число степеней свободы для регрессии, равное двум, также раскладывается на число степеней свободы для каждого фактора, то есть 1 для фактора х1 и 1 для фактора х2.

Сумма квадратов за счет регрессии W_регр распадается здесь на две суммы. Сумма квадратов, обусловленная включением в модель фактора х1 (W_регр
х1), определяется в предположении, что построено лишь парное уравнение регрессии у_х1=а + вх₁. Эта величина может быть определена следующим образом W_регрх1= r_ух1²× W_общ. Сумму квадратов, обусловленную дополнительным включением фактора х2, после того, как в модель включен фактор х1, определим как разность суммы квадратов за счет регрессии по двум факторам и за счет регрессии только фактора х1. Далее по известным нам формулам определяется дисперсии на одну степень свободы и критерии Фишера. Если величина частного критерия Фишера оказывается меньше табличного, то включение в модель такого фактора нецелесообразно.

5.2.5. Предпосылки мнк.

При оценке параметров уравнения регрессии мы применяем метод наименьших квадратов (МНК). В модели у =  + ₁х + ₂р + е, случайная составляющая (е) представляет собой «необъясненную или ненаблюдаемую величину». После того, как произведено решение модели, то есть дана оценка параметрам, мы можем определить величину остатков в каждом конкретном случае как разность между фактическими и теоретическими значениями результативного признака е_i=y_i- . Поскольку это не есть реальные остатки, то мы их считаем лишь выборочной реализацией неизвестного остатка заданного уравнения. При изменении спецификации модели, добавления в нее новых наблюдений, выборочные оценки остатков могут меняться, поэтому в задачу регрессионного анализа входит не только построение самой модели, но и исследование случайных отклонений, то есть остаточных величин.

В предыдущих разделах мы останавливались на формально-математических проверках статистической достоверности коэффициентов регрессии и корреляции с помощью Т-критерия Стьюдента и критерия Фишера. При использовании этих критериев делаются предположения относительно поведения остатков: предполагают, что 1) остатки представляют собой независимые случайные величины и их среднее значение равно нулю; 2) остатки имеют постоянную дисперсию и подчиняются закону нормального распределения.

Пока мы не построим модель, остатки определены быть не могут, и поэтому мы не можем проверить, обладают ли они этими свойствами или нет. Таким образом, проверяя статистическую достоверность параметров связи, мы опираемся всего лишь на непроверенные предпосылки о распределении случайной составляющей уравнения регрессии. Но после построения уравнения регрессии мы уже можем определить остатки и проверить у них наличие тех свойств, которые предполагались вначале.

С чем связана необходимость проверки таких свойств? Связано это с тем, что выборочные оценки параметров регрессии должны отвечать определенным критериям. Они должны быть несмещенными, состоятельными и эффективными. Эти свойства оценок, полученных по МНК, имеют важное практическое значение в использование результатов регрессии и корреляции.

Несмещенные оценки означают, что математическое ожидание остатков равно нулю. Следовательно, при большом числе выборочных оценок коэффициента регрессии в найденный параметр по результатам одной выборки можно рассматривать как среднее значение из большого числа несмещенных оценок.

Оценки считаются эффективными, если они характеризуются меньшей дисперсией (то есть мы имеем минимальную вариацию выборочных оценок).

Оценки считаются состоятельными, если их точность увеличивается с увеличением объема выборки.

Условия, необходимые для получения несмещенных, состоятельных и эффективных оценок, представляют собой предпосылки МНК, соблюдение которых желательно для получения достоверных результатов регрессии.

Предпосылки МНК:

случайный характер остатков;
гомоскедастичность – дисперсия остатков одинакова для всех значений фактора;
отсутствие автокорреляции остатков (то есть остатки распределены независимо друг от друга);
остатки подчиняются нормальному закону распределения.

В тех случаях, когда эти предпосылки выполняются, оценки, полученные по МНК, будут обладать вышеназванными свойствами, если же некоторые предпосылки не выполняются, то необходимо корректировать модель.

Итак, проверяем случайный характер остатков. С этой целью строится график зависимости остатков от теоретических значений результативного признака (рис.5.2.1.)

Если на графике получена горизонтальная полоса, то остатки представляют собой случайные величины и МНК оправдан.

Возможны иные случаи (рис.5.2.2):

а) – остатки носят систематический характер, то есть отрицательные значения соответствуют низким значениям расчетных «у», а положительные – высоким;

б) – преобладание положительных остатков над отрицательными. В этих случаях необходимо применять либо другую функцию, либо вводить дополнительную информацию и заново строить уравнение регрессии до тех пор, пока остатки не будут случайными величинами.

Вторая предпосылка МНК требует, чтобы дисперсия остатков была гомоскедастичной. Это значит, что для каждого значения фактора остатки имеют одинаковую дисперсию. Если это условие не соблюдается, то имеет место гетероскедастичность. Наличие гомо- или гетероскедастичности можно видеть по графику зависимости остатков от теоретических значений результативного признака (рис. 5.2.3.):

а) большая дисперсия остатков для больших значений «у» (гетероскедастичность);

б) большая дисперсия остатков для средних значений «у» (гетероскедастичность);

в) – большая дисперсия для меньших значений результата (гетероскедастичность);

г) – равная дисперсия (гомоскедастичность).

Наличие гетероскедастичности приводит к смещенным оценкам коэффициентов регрессии, а также уменьшает их эффективность. В частности, становится затруднительным использование формулы стандартной ошибки коэффициента регрессии, которая предполагает единую дисперсию остатков.

Для множественной регрессии данный вид графиков является наиболее приемлемым визуальным способом изучения гомо- или гетероскедастичности. Однако, чтобы убедиться в наличии этих качеств, обычно не ограничиваются визуальной проверкой гетероскедастичности, а проводят также ее количественное подтверждение. При малом объеме выборки, что характерно для эконометрических исследований для этих целей используется метод Гольдфельда –Квандта, который включает в себя следующие шаги:

Упорядочение наблюдений по мере возрастания фактора х.
Исключение из наблюдений нескольких центральных наблюдений (С). При этом должно выполняться условие, что (N – С)/2 должно быть больше р – число параметров в модели.
Распределение оставшихся наблюдений на две равные группы с малыми и большими значениями факторного признака.
Решение уравнения регрессии для каждой группы (имеем два уравнения).
Определение остаточной суммы квадратов отклонений для каждой группы и определение их отношения (отношение большей к меньшей).
Сравнение этого отношения с табличным значением критерия Фишера (d f = n - C – 2p/2). Если это отношение меньше табличного значения F- критерия, то мы имеем гомоскедастичные остатки. Чем больше это отношение превышает табличное, тем больше нарушена предпосылка о равенстве дисперсий остаточных величин.

Следующая предпосылка МНК – это отсутствие автокорреляции остатков. Это означает, что остатки распределены независимо друг от друга. Автокорреляция – это наличие тесной корреляционной зависимости между остатками текущих и предшествующих наблюдений, если наблюдения упорядочены по фактору х. Автокорреляционная зависимость определяется по линейному коэффициенту корреляции между текущими и предшествующими наблюдениями (более подробно с этой проблемой мы ознакомимся в теме «Моделирование рядов динамики»). Отсутствие автокорреляции остатков обеспечивает состоятельность и эффективность оценок коэффициентов регрессии.

Соответствие распределение остатков нормальному закону распределения можно проверить с помощью критерия Пирсона как критерия согласия (изучалось в курсе «Математическая статистика»).

При несоблюдении основных предпосылок МНК приходится корректировать модель, изменяя ее спецификацию, добавлять или исключать некоторые факторы, преобразовывать исходные данные. В частности, при нарушении гомоскедастичности и наличии автокорреляции остатков рекомендуется традиционный МНК, который проводится по исходным данным, заменять обобщенным методом наименьших квадратов, который проводится по преобразованным данным.

Вопросы для повторения:

Какова связь коэффициентов раздельной (частной) детерминации с множественной детерминацией?
В каких случаях индекс множественной корреляции равен линейному коэффициенту множественной корреляции?
С какой целью определяется скорректированный коэффициент множественной корреляции?
Чем отличается частный коэффициент корреляции от полного коэффициента корреляции?
Каково назначение частной корреляции при построении модели множественной регрессии?
Чем отличается дисперсионный анализ парной регрессионной модели от дисперсионного анализа множественной модели?
Что такое частный F-тест? Раскройте его назначение и сущность.
Раскройте понятия «несмещенности, состоятельности и эффективности» выборочных оценок параметров регрессии.
Перечислите предпосылки МНК.
С какой целью в множественной регрессии используется графический анализ остатков?
Раскройте назначение и сущность метода Гольдфельда – Квандта.

Резюме по модульной единице 5.2.

Рассмотрев понятия и способы оценки множественной и частной корреляции, а также предпосылки МНК, мы понимаем теперь, что только многофакторные модели с достаточно высокой детерминацией и надежными коэффициентами регрессии позволяют применять эти методы и в анализе, и в прогнозе.

<<< < Предыдущая 19 20 21 22 23 24 25 26 27 28 29 3031 / 8131 32 33 34 35 36 37 38 39 40 41 42 43 > Следующая >>>

Соседние файлы в предмете [НЕСОРТИРОВАННОЕ]

#
03.12.20182.23 Mб145Kniga_po_otsenke_kachestva_i_klassif_zemel_2004....doc
#
24.03.20158.65 Mб30Kolbovsky_E_Yu_Landshaftnoe_planirovanie_2008.pdf
#
24.03.2015243.45 Кб15Kolotov 13 gruppa.docx
#
07.12.2018222.21 Кб5KOnjunktiv 1 (1).doc
#
22.07.2019160.26 Кб2KOnjunktiv_1_1.doc
#
19.09.201917.55 Mб145kontrol_po_ekonometr.doc
#
24.03.2015155.14 Кб24Kontr_rab_dlya_zaochnikov_-_uch_-fin.doc
#
09.11.201923.4 Mб22korovkin_o_a_anatomiya_i_morfologiya_vysshih_ra...rtf
#
08.03.201688.69 Кб256kratkiy_kursBIORAZNOOBRAZIE.docx
#
24.03.20151.01 Mб54kursach_organizatsia.doc
#
16.04.201954.08 Кб5kursach_po_srede.docx