Студопедия — Порядок выполнения работы. Для выполнения работы используется файл Кластерный анализ.xls.
Студопедия Главная Случайная страница Обратная связь

Разделы: Автомобили Астрономия Биология География Дом и сад Другие языки Другое Информатика История Культура Литература Логика Математика Медицина Металлургия Механика Образование Охрана труда Педагогика Политика Право Психология Религия Риторика Социология Спорт Строительство Технология Туризм Физика Философия Финансы Химия Черчение Экология Экономика Электроника

Порядок выполнения работы. Для выполнения работы используется файл Кластерный анализ.xls.






Для выполнения работы используется файл Кластерный анализ.xls.

На Лист2 этой книги находятся данными о 78 объектах РФ (6 показателей).

На Лист1 реализован метод цепочечной кластеризации и производятся сами расчеты. Здесь же указан список объектов, которые необходимо разбить на группы.

Таблица 7.1

N п/п N по списку Объект X1 X2
    Кировская обл.    
    Нижегородская обл.   2045,3
    Оренбургская обл.   1774,4
    Пензенская обл.   1440,5
    Республика Башкортостан   2339,7
    Республика Бурятия   1765,2
    Республика Дагестан    
    Республика Ингушетия   1008,2
    Республика Марий Эл   1052,3
    Республика Мордовия   1497,7
    Республика Татарстан   2362,4
    Удмуртская Республика    
    Ульяновская обл.   1558,9
    Чувашская Республика   1326,2

 

Для имеющихся 14 объектов необходимо провести двумерную кластеризацию по двум первым показателям (Численность населения (тыс. чел.) и Средний доход на душу населения (руб/мес)). Эти показатели отражаются на имеющейся на этом же листе точечной диаграмме.

Для получения цепочки расстояний достаточно щелкнуть по кнопке «Расчет». В результате будут получены следующие результаты.

Таблица 7.2

 

    E F G H
           
    N Расстояния Номер1 Номер2
      1,580785941    
      4,172284936    
      5,684705731    
      10,00815363    
      13,21538863    
      9,05471484    
      14,89015946    
      7,960007134    
      16,191226    
      18,44375842    
      39,5504765    
      11,1579027    
      8,939773259    

 

Для 14 объектов получена цепочка, состоящая из 13 расстояний.

 

Процедура выделения кластеров производится следующим образом:

– просмотр начинается с первого расстояния. Оно сравнивается со вторым и третьим расстояниями. Все они пока одного порядка. Но четвертое расстояние подозрительно велико по сравнению с первыми тремя.

– для объективного принятия решения о «подозрительности» четвертого расстояния используется технология выявления промахов в ряду наблюдений (см. работу «Случайные величины»).

При этом для расстояний 1 – 4 вычисляются среднее и дисперсия и на их основе V-критерий.

Для этого:

- в ячейку B24 вводится формула =СРЗНАЧ(F11:F14);

- в ячейку B25 вводится формула =ДИСПРА(F11:F14);

- в ячейку B26 вводится формула =ABS(B24-F14)/(3/4*B25)^(1/2).

 

В результате получено следующее:

  A B
  Среднее 5,36148256
  Дисперсия 9,350970798
  V-критерий 1,754619489

 

Далее необходимо сравнить вычисленный критерий с табличным. При уровне значимости, равном 0,05, для четырех измерений этот критерий равен 1,69. Таким образом, вычисленное значение критерия больше табличного. Поэтому делается вывод о том, что проверяемое значение (10,00815363), действительно является промахом, т.е. резко отличается от остальных значений.

 

В табл. 7.2 эти строки выделены.

Применительно к рассматриваемой теме это означает, что данное расстояние (между 12 и 13 объектами) действительно является границей между кластерами.

В результате:

к первому кластеру можно отнести объекты входящий в перечень до этого расстояния – объекты 1, 4, 13 и 14.

Аналогично должны быть рассмотрены оставшиеся расстояния.

Для этого:

– просмотр начинается с 5 расстояния. Очевидно, что расстояния 5 – 10 одного порядка. А расстояние 11 «подозрительно» большое.

Для его проверки выполним аналогичные вычисления:

- в ячейку C24 вводится формула =СРЗНАЧ(F15:F21);

- в ячейку C25 вводится формула =ДИСПРА(F15:F21);

- в ячейку C26 вводится формула =ABS(C24-F21)/(6/7*C25)^(1/2).

Результат вычислений:

 

  A B C
  Среднее 5,36148256 17,043676
  Дисперсия 9,350970798 96,410418
  V-критерий 1,754619489 2,4758548

 

Вычисленное значение V-критерия также больше табличного (V=2,09 для семи измерений и уровня значимости, равного 0,05. Поэтому делаем вывод о том, что расстояние 11 является границей между кластерами и ко второму кластеру следует отнести объекты 12, 10, 6, 9, 8, 3 и 7.

Для оставшихся объектов (2, 5 и 11) проверку можно не производить и их можно отнести к третьему кластеру.

На рис. 7.5 приведены визуализированные результаты кластеризации (исходная диаграмма построена в Excel, а кластеры обведены вручную в Paint).

 

Рис.7.5. Визуализация результатов кластеризации

 







Дата добавления: 2015-08-12; просмотров: 425. Нарушение авторских прав; Мы поможем в написании вашей работы!



Функция спроса населения на данный товар Функция спроса населения на данный товар: Qd=7-Р. Функция предложения: Qs= -5+2Р,где...

Аальтернативная стоимость. Кривая производственных возможностей В экономике Буридании есть 100 ед. труда с производительностью 4 м ткани или 2 кг мяса...

Вычисление основной дактилоскопической формулы Вычислением основной дактоформулы обычно занимается следователь. Для этого все десять пальцев разбиваются на пять пар...

Расчетные и графические задания Равновесный объем - это объем, определяемый равенством спроса и предложения...

Ганглиоблокаторы. Классификация. Механизм действия. Фармакодинамика. Применение.Побочные эфффекты Никотинчувствительные холинорецепторы (н-холинорецепторы) в основном локализованы на постсинаптических мембранах в синапсах скелетной мускулатуры...

Шов первичный, первично отсроченный, вторичный (показания) В зависимости от времени и условий наложения выделяют швы: 1) первичные...

Предпосылки, условия и движущие силы психического развития Предпосылки –это факторы. Факторы психического развития –это ведущие детерминанты развития чел. К ним относят: среду...

Патристика и схоластика как этап в средневековой философии Основной задачей теологии является толкование Священного писания, доказательство существования Бога и формулировка догматов Церкви...

Основные симптомы при заболеваниях органов кровообращения При болезнях органов кровообращения больные могут предъявлять различные жалобы: боли в области сердца и за грудиной, одышка, сердцебиение, перебои в сердце, удушье, отеки, цианоз головная боль, увеличение печени, слабость...

Вопрос 1. Коллективные средства защиты: вентиляция, освещение, защита от шума и вибрации Коллективные средства защиты: вентиляция, освещение, защита от шума и вибрации К коллективным средствам защиты относятся: вентиляция, отопление, освещение, защита от шума и вибрации...

Studopedia.info - Студопедия - 2014-2024 год . (0.011 сек.) русская версия | украинская версия