русс | укр

Языки программирования

ПаскальСиАссемблерJavaMatlabPhpHtmlJavaScriptCSSC#DelphiТурбо Пролог

Компьютерные сетиСистемное программное обеспечениеИнформационные технологииПрограммирование

Все о программировании


Linux Unix Алгоритмические языки Аналоговые и гибридные вычислительные устройства Архитектура микроконтроллеров Введение в разработку распределенных информационных систем Введение в численные методы Дискретная математика Информационное обслуживание пользователей Информация и моделирование в управлении производством Компьютерная графика Математическое и компьютерное моделирование Моделирование Нейрокомпьютеры Проектирование программ диагностики компьютерных систем и сетей Проектирование системных программ Системы счисления Теория статистики Теория оптимизации Уроки AutoCAD 3D Уроки базы данных Access Уроки Orcad Цифровые автоматы Шпаргалки по компьютеру Шпаргалки по программированию Экспертные системы Элементы теории информации

Метод К-средних


Дата добавления: 2015-08-31; просмотров: 749; Нарушение авторских прав


Данный метод кластеризации существенно отличается от таких агломеративных методов, как Объединение (древовидная кластеризация) и Двувходовое объединение. Предположим, что уже имеются гипотезы относительно числа кластеров (по наблюдениям или по переменным). Можно «указать» системе образовать ровно три кластера так, чтобы они были настолько различны, насколько это возможно. Это именно тот тип задач, которые решает алгоритм метода К-средних. В общем случае метод К-средних строит, ровно К-различных кластеров, расположенных на довольно больших расстояниях друг от друга.

В примере с акцентуациями характера (см. Двувходовое объединение),психолог-исследователь может предполагать, что исследуемые подростки в основном попадают в три различные категории ((1) тенденция к акцентуации, (2) есть признаки акцентуации, (3) акцентуация ярко выражена). Далее он может попытаться узнать, будет ли подтверждена его гипотеза численно, то есть, действительно ли кластерный анализ посредством метода К-средних даст три кластера, как и предполагалось? Если это так, то средние различных мер физических параметров для каждого кластера будут давать количественный способ представления гипотез исследователя (например, подростки в кластере 1 будут иметь высокий параметр (1), меньший параметр (2) и т.д.).

Вычисление с помощью метода К-средних. С вычислительной точки зрения метод К-средних можно рассматривать, как дисперсионный анализ «наоборот». Программа начинает с К-случайно выбранных кластеров, а затем изменяет принадлежность объектов к ним, чтобы: а) минимизировать изменчивость внутри кластеров, и б) максимизировать изменчивость между кластерами. Данный способ аналогичен методу дисперсионный анализ (ANOVA) «наоборот» в том смысле, что критерий значимости в дисперсионном анализе сравнивает межгрупповую изменчивость с внутригрупповой при проверке гипотезы о том, что средние в группах отличаются друг от друга. В кластеризации методом К-средних программа перемещает объекты (т.е. наблюдения) из одних групп (кластеров) в другие для того, чтобы получить наиболее значимый результат при проведении дисперсионного анализа (ANOVA).



Интерпретация результатов. Обычно, когда результаты кластерного анализа методом К-средних получены, можно рассчитать средние для каждого кластера по каждому измерению, чтобы оценить, насколько кластеры различаются друг от друга. В идеале нужно получить сильно различающиеся средние для большинства, если не для всех измерений, используемых в анализе. Значения F-статистики, полученные для каждого измерения, являются другим индикатором того, насколько хорошо соответствующее измерение дискриминирует кластеры.



<== предыдущая лекция | следующая лекция ==>
Меры расстояния | Билет № 1


Карта сайта Карта сайта укр


Уроки php mysql Программирование

Онлайн система счисления Калькулятор онлайн обычный Инженерный калькулятор онлайн Замена русских букв на английские для вебмастеров Замена русских букв на английские

Аппаратное и программное обеспечение Графика и компьютерная сфера Интегрированная геоинформационная система Интернет Компьютер Комплектующие компьютера Лекции Методы и средства измерений неэлектрических величин Обслуживание компьютерных и периферийных устройств Операционные системы Параллельное программирование Проектирование электронных средств Периферийные устройства Полезные ресурсы для программистов Программы для программистов Статьи для программистов Cтруктура и организация данных


 


Не нашли то, что искали? Google вам в помощь!

 
 

© life-prog.ru При использовании материалов прямая ссылка на сайт обязательна.

Генерация страницы за: 0.005 сек.