Посты для тега : ‘advancedclassify’

Идея ядерных методов

Посмотрите, что получится, если применить линейный классификатор к набору данных, подобному изображенному на рис. 9.7. Где окажутся средние точки каждого класса? В точности в одном и том же месте! Хотя и вам, и мне ясно, что все точки внутри круга – крестики, а вне него – кружки, линейный классификатор не в состоянии различить эти классы.

Читать далее »

Категориальные свойства

Набор данных для подбора пар содержит как числовые, так и дискретные данные. Некоторые классификаторы, например деревья решений, справляются с данными обоих видов без предварительной обработки, но классификаторы, рассматриваемые далее в этой статье, умеют работать только с числовыми данными. Поэтому нужно каким-то образом преобразовать дискретные данные в числовые.

Читать далее »

Масштабирование данных

Когда для сравнения использовался только возраст, нам было достаточно исходных данных, по которым вычислялись средние и расстояния; ведь сравнивать переменные, обозначающие одно и то же, вполне допустимо. Однако теперь мы ввели несколько новых переменных, которые с возрастом несравнимы, так как принимают гораздо меньшие значения. Разное отношение к детям (возможные значения 1 и -1, максимальное расстояние […]

Читать далее »

Простая линейная классификация

Этот классификатор будет совсем простым, но послужит неплохой основой для дальнейшей работы. Он ищет среднее по всем данным в каждом классе и строит точку, представляющую центр этого класса. Новые точки классифицируются по близости к имеющимся центрам. Нам потребуется функция, которая вычисляет среднюю точку класса. В данном случае есть всего два класса, соответствующие 0 и 1. […]

Читать далее »

Более сложные способы классификации: ядерные методы и машины опорных векторов

В предыдущих статьях мы рассмотрели несколько классификаторов: деревья решений, байесовские классификаторы и нейронные сети. Сейчас мы ознакомимся с линейными классификаторами и ядерными методами, и это послужит прелюдией к одному из самых продвинутых методов классификации, который все еще является предметов активных исследований, – машинам опорных векторов (Support Vector Machines – SVM).

Читать далее »
 
Rambler's Top100