Математические модели в естественнонаучном образовании. Том II - страница 5
Первый метод, который рассматриваем, называется методом среднего расстояния или, более формально, невзвешенным парно-групповым методом с арифметическими средними (UPGMA). Этот метод создает корневое дерево и предполагает наличие молекулярных часов. Самый простой способ понять алгоритм – это ознакомиться с примером его использования.
По приведенной выше таблицы данных выберем два ближайших таксона,
Рисунок 5.6. UPGMA; шаг 1.
Затем объединяем
Таблица 5.3. Расстояния между групп; UPGMA, Шаг 1
.425 .575
.50
Теперь просто повторяем процесс, используя расстояния в таблице 5.3. Поскольку ближайшими таксонами и/или группами в новой таблице являются
Рисунок 5.7. UPGMA; шаг 2.
Ребро
Снова объединив таксоны, формируем группу
Рисунок 5.8. UPGMA; шаг 3.
Как и подозревали, дерево, которое построили для имеющихся данных, не совсем соответствует этим данным. Расстояние на дереве от
Если бы было больше таксонов, то пришлось бы сделать больше шагов для завершения процесса UPGMA, но не было бы никаких принципиально новых действий. На каждом шаге объединяем два ближайших таксона или группы вместе, всегда размещая их на равных расстояниях от общего предка. Затем сворачиваем объединенные таксоны в группу, используя усреднение для вычисления расстояния от этой группы до таксонов и групп, которые еще предстоит объединить. Один момент, с которым следует быть особенно осторожным, заключается в том, что при вычислении расстояний между двумя группами нужно усреднить все расстояния от членов одной группы до членов другой – если одна группа имеет
Обратите внимание, что предположение о молекулярных часах неявно присутствовала в UPGMA. В примере, когда поместили