AI-modellen en platforms
Een snelle gids voor het begrijpen van een KNN-algoritme
Met de zakenwereld die agressief Data Science aan het adopteren is, is het een van de meest gewilde gebieden geworden. We leggen uit wat een K-nearest neighbor-algoritme is en hoe het werkt.
Wat is KNN-algoritme?
K-Nearest Neighbors-algoritme (of KNN) is een van de meest gebruikte leer-algoritmes vanwege zijn eenvoud. KNN of K-nearest neighbor-algoritme is een supervised learning-algoritme dat werkt op het principe dat elk datapunt dat dicht bij elkaar ligt, in dezelfde klasse valt. De basisveronderstelling hier is dat dingen die dicht bij elkaar liggen, op elkaar lijken. Meestal wordt KNN-algoritme gebruikt vanwege zijn eenvoudige interpretatie en lage berekenings tijd.
KNN wordt breed gebruikt voor classificatie- en regressieproblemen in machine learning. Een paar voorbeelden van KNN zijn algoritmes die door e-commerce portals worden gebruikt om vergelijkbare producten aan te bevelen.
Laten we een voorbeeld bekijken:
In de gegeven afbeelding hebben we twee klassen van gegevens. Klasse A vertegenwoordigt vierkanten en Klasse B vertegenwoordigt driehoeken.
Het probleem is om een nieuwe invoer datapunt toe te wijzen aan een van de twee klassen met behulp van het KNN-algoritme
De eerste stap is om de waarde van ‘K’ te definiëren, wat staat voor het aantal dichtstbijzijnde buren.

Als de waarde van “k” 6 is, zal het zoeken naar 6 dichtstbijzijnde buren van dat datapunt, als de waarde van “k” 5 is, zal het zoeken naar 5 dichtstbijzijnde buren van dat datapunt.
Laten we ‘K’ = 4 overwegen, wat betekent dat het algoritme de vier buren zal overwegen die het dichtst bij het datapunt liggen.
Nu, bij ‘K’ = 4, kan één driehoek en twee vierkanten worden gezien als de dichtstbijzijnde buren. Dus, het nieuwe datapunt op basis van ‘K’ = 4, zou worden toegewezen aan Klasse A.

Waar wordt KNN gebruikt?
KNN wordt gebruikt in zowel classificatie- als regressievoorspellingsproblemen. Echter, wanneer het voor industriële doeleinden wordt toegepast, wordt het meestal gebruikt in classificatie, aangezien het goed presteert op alle parameters die worden geëvalueerd bij het bepalen van de bruikbaarheid van een techniek.
- Voorbeeldkracht
- Berekenings tijd
- Gemakkelijkheid om de uitvoer te interpreteren
Hoe wordt het gebruikt in dagelijkse problemen?
Ondanks zijn eenvoud, werkt KNN beter dan andere krachtige classificatoren en wordt het gebruikt op plaatsen zoals economische voorspelling, gegevenscompressie, videorecognitie, beeldherkenning, handschriftherkenning en spraakherkenning.
Enkele belangrijke toepassingen van het KNN-algoritme
Het KNN-algoritme wordt gebruikt in het bankwezen om te voorspellen of een persoon in aanmerking komt voor een lening door te voorspellen of hij of zij vergelijkbare kenmerken heeft met een wanbetaler. KNN helpt ook bij het berekenen van de kredietwaardigheid van individuen door deze te vergelijken met personen met vergelijkbare kenmerken.
Bedrijven die KNN gebruiken
De meeste e-commerce- en entertainmentbedrijven zoals Amazon (AMZN ) of Netflix (NFLX ) gebruiken KNN wanneer ze producten aanbevelen om te kopen of films/series te kijken.
Hoe doen ze deze aanbevelingen? Nou, deze bedrijven verzamelen gegevens over het gedrag van gebruikers, zoals eerder gekochte producten of bekeken films op hun website, en passen KNN toe.
De bedrijven voeren uw beschikbare klantgegevens in en vergelijken deze met andere klanten die soortgelijke producten hebben gekocht of soortgelijke films hebben bekeken.
De producten en films worden dan aan u aanbevolen, afhankelijk van hoe het algoritme de datapunt classificeert.
Voordelen en nadelen van KNN
Voordelen van KNN
- Snel berekenen
- Eenvoudig algoritme – om te interpreteren
- Veelzijdig – nuttig voor classificatie en regressie
- Hoge nauwkeurigheid
- Geen aannamen over gegevens – geen noodzaak om aanvullende aannamen te doen, of een model te bouwen.
Nadelen van KNN
- Nauwkeurigheid hangt af van de kwaliteit van de gegevens
- Voorspelling wordt langzaam met grote gegevens
- Is niet relevant voor grote gegevenssets
- Er is behoefte om alle trainingsgegevens op te slaan, waardoor het veel geheugen vereist
- Het kan computationeel duur zijn, omdat het alle trainingsgegevens opslaat
In deze blog hebben we geprobeerd het K-NN-algoritme uit te leggen, dat breed wordt gebruikt voor classificatie. We hebben de basisaanpak achter KNN besproken, hoe het werkt, en zijn voordelen en nadelen.
KNN-algoritme is een van de eenvoudigste algoritmes en kan zeer agressieve resultaten geven. KNN-algoritmes kunnen zowel voor classificatie- als regressieproblemen worden gebruikt.












