Модели и платформы ИИ

Быстрое руководство по пониманию алгоритма KNN

mm
Добавьте Unite.AI в избранные источники в Google

С бизнес-миром, агрессивно принимающим Data Science, оно стало одной из наиболее востребованных областей. Мы объясняем, что такое алгоритм K-ближайших соседей и как он работает.

Что такое алгоритм KNN?

Алгоритм K-ближайших соседей (или KNN) является одним из наиболее используемых алгоритмов обучения благодаря своей простоте. KNN или алгоритм K-ближайших соседей является алгоритмом обучения с учителем, который работает на принципе, что каждый точка данных, падающая рядом с другой, принадлежит одному и тому же классу. Основное предположение здесь заключается в том, что вещи, которые находятся рядом друг с другом, похожи друг на друга. В основном, алгоритм KNN используется из-за его простоты интерпретации и низкого времени расчета.

KNN широко используется для задач классификации и регрессии в машинном обучении. Некоторые примеры KNN – алгоритмы, используемые электронными торговыми платформами для рекомендации похожих продуктов.

Давайте рассмотрим пример:

На данном изображении у нас есть два класса данных. Класс А представляет квадраты, а класс Б представляет треугольники.

Задача состоит в том, чтобы присвоить новую точку данных одному из двух классов с помощью алгоритма KNN

Первый шаг – определить значение ‘K’, которое обозначает количество ближайших соседей.

Если значение ‘k’ равно 6, оно будет искать 6 ближайших соседей к этой точке данных, если значение ‘k’ равно 5, оно будет искать 5 ближайших соседей к этой точке данных.

Давайте рассмотрим ‘K’ = 4, что означает, что алгоритм будет учитывать четыре ближайших соседа, которые находятся ближе всего к точке данных.

Теперь, при ‘K’ = 4, мы видим один треугольник и два квадрата как ближайших соседей. Следовательно, новая точка данных на основе ‘K’ = 4 будет присвоена классу А.

Где использовать KNN?

KNN используется как в задачах классификации, так и в задачах регрессии. Однако, когда он применяется в промышленных целях, в основном он используется в классификации, поскольку он хорошо справляется со всеми параметрами, оцениваемыми при определении применимости метода.

  1. Прогностическая сила
  2. Время расчета
  3. Легкость интерпретации вывода

Как он используется в повседневных проблемах?

Несмотря на свою простоту, KNN работает намного лучше, чем другие мощные классификаторы, и используется в таких местах, как экономическое прогнозирование, сжатие данных, распознавание видео, распознавание изображений, обнаружение рукописного текста и распознавание речи.

Некоторые основные применения алгоритма KNN

Алгоритм KNN используется в банковской системе для прогнозирования, подходит ли человек для одобрения кредита или нет, прогнозируя, имеет ли он похожие черты с дефолтером. KNN также помогает в расчете кредитных рейтингов физических лиц, сравнивая их с людьми, имеющими похожие черты.

Компании, использующие KNN

Большинство электронных торговых и развлекательных компаний, таких как Amazon (AMZN ) или Netflix (NFLX ), используют KNN при рекомендации продуктов для покупки или фильмов/шоу для просмотра.

Как они вообще делают эти рекомендации? Ну, эти компании собирают данные о поведении пользователей, такие как предыдущие продукты, которые вы покупали или фильмы/шоу, которые вы смотрели на их сайте, и применяют KNN.

Компании вводят ваши доступные данные о клиентах и сравнивают их с другими клиентами, которые покупали похожие продукты или смотрели похожие фильмы.

Продукты и фильмы затем рекомендуются вам, в зависимости от того, как алгоритм классифицирует эту точку данных.

Преимущества и недостатки KNN

Преимущества KNN

  • Быстрый расчет
  • Простой алгоритм – для интерпретации
  • Универсальный – полезен для классификации и регрессии
  • Высокая точность
  • Нет предположений о данных – нет необходимости делать дополнительные предположения или строить модель.

Недостатки KNN

  • Точность зависит от качества данных
  • Прогнозирование становится медленным с большими данными
  • Не подходит для больших наборов данных
  • Необходимо хранить все обучающие данные, поэтому требует много памяти
  • Это может быть вычислительно дорогим, поскольку хранит все обучающие данные

В этом блоге мы попытались объяснить алгоритм K-NN, который широко используется для классификации. Мы обсудили базовый подход за KNN, как он работает, и его преимущества и недостатки.

Алгоритм KNN является одним из самых простых алгоритмов и может давать очень агрессивные результаты. Алгоритмы KNN можно использовать как для задач классификации, так и для задач регрессии.

Сотрудник Data Scientist с более чем 8-летним опытом профессиональной деятельности в IT-индустрии. Компетентен в области Data Science и цифрового маркетинга. Экспертиза в профессионально исследованном техническом контенте.