Grundlagen der KI
Was ist Deep Learning?
Deep Learning ist eines der einflussreichsten und am schnellsten wachsenden Felder in der kÞnstlichen Intelligenz. Es kann jedoch schwierig sein, ein intuitives VerstÃĪndnis von Deep Learning zu erlangen, da der Begriff Deep Learning eine Vielzahl von verschiedenen Algorithmen und Techniken umfasst. Deep Learning ist auch eine Teildisziplin des maschinellen Lernens im Allgemeinen, daher ist es wichtig, zu verstehen, was maschineller Lernen ist, um Deep Learning zu verstehen.
Was ist Machine Learning?
Deep Learning ist eine Erweiterung einiger Konzepte, die aus dem maschinellen Lernen stammen, daher erklÃĪren wir zunÃĪchst, was maschineller Lernen ist.
Maschineller Lernen ist eine Methode, um Computern bestimmte Aufgaben auszufÞhren, ohne jeden Algorithmus, der zur AusfÞhrung dieser Aufgaben verwendet wird, explizit zu programmieren. Es gibt viele verschiedene maschinelle Lernalgorithmen, aber einer der am hÃĪufigsten verwendeten Algorithmen ist ein Multilayer-Perzeptron. Ein Multilayer-Perzeptron wird auch als neuronales Netzwerk bezeichnet und besteht aus einer Reihe von miteinander verbundenen Knoten/Neuronen. Es gibt drei verschiedene Schichten in einem Multilayer-Perzeptron: die Eingabeschicht, die versteckte Schicht und die Ausgabeschicht.
Die Eingabeschicht nimmt die Daten in das Netzwerk auf, wo sie von den Knoten in der mittleren/versteckten Schicht manipuliert werden. Die Knoten in der versteckten Schicht sind mathematische Funktionen, die die Daten aus der Eingabeschicht manipulieren kÃķnnen, um relevante Muster aus den Eingabedaten zu extrahieren. So âlerntâ das neuronale Netzwerk. Neuronale Netze erhalten ihren Namen von der Tatsache, dass sie von der Struktur und Funktion des menschlichen Gehirns inspiriert sind.
Die Verbindungen zwischen den Knoten im Netzwerk haben Werte, die als Gewichte bezeichnet werden. Diese Werte sind im Wesentlichen Annahmen darÞber, wie die Daten in einer Schicht mit den Daten in der nÃĪchsten Schicht zusammenhÃĪngen. Wenn das Netzwerk trainiert wird, werden die Gewichte angepasst, und das Ziel ist, dass die Gewichte/Annahmen Þber die Daten letztendlich auf Werte konvergieren, die die bedeutungsvollen Muster in den Daten genau darstellen.
Aktivierungsfunktionen sind in den Knoten des Netzwerks vorhanden, und diese Aktivierungsfunktionen transformieren die Daten auf nicht-lineare Weise, sodass das Netzwerk komplexe Darstellungen der Daten erlernen kann. Aktivierungsfunktionen multiplizieren die Eingabewerte mit den Gewichtswerten und addieren einen Bias-Term.
Was ist Deep Learning?
Deep Learning ist der Begriff, der maschinellen Lernalgorithmen gegeben wird, die viele Multilayer-Perzeptrone zusammenfÞgen, sodass es nicht nur eine versteckte Schicht gibt, sondern viele versteckte Schichten. Je âtieferâ das Deep-Learning-Netzwerk ist, desto komplexere Muster kann das Netzwerk erlernen.
Die tiefen Netzwerke, die aus Neuronen bestehen, werden manchmal als vollstÃĪndig verbundene Netze oder vollstÃĪndig verbundene Schichten bezeichnet, was darauf hinweist, dass ein gegebenes Neuron eine Verbindung zu allen umgebenden Neuronen aufweist. VollstÃĪndig verbundene Netze kÃķnnen mit anderen maschinellen Lernalgorithmen kombiniert werden, um verschiedene Deep-Learning-Architekturen zu erstellen.
Unterschiedliche Arten von Deep Learning
Es gibt eine Vielzahl von Deep-Learning-Architekturen, die von Forschern und Ingenieuren verwendet werden, und jede dieser Architekturen hat ihren eigenen Spezialfall.
Convolutional Neural Networks
Convolutional Neural Networks, oder CNNs, sind die neuronale Netzwerkarchitektur, die hÃĪufig bei der Erstellung von Computer-Vision-Systemen verwendet wird. Die Struktur von Convolutional Neural Networks ermÃķglicht es ihnen, Bilddaten zu interpretieren und in Zahlen umzuwandeln, die ein vollstÃĪndig verbundenes Netzwerk interpretieren kann. Ein CNN hat vier Hauptkomponenten:
- Convolutional-Schichten
- Subsampling-/Pooling-Schichten
- Aktivierungsfunktionen
- VollstÃĪndig verbundene Schichten
Die Convolutional-Schichten nehmen die Bilder als Eingaben in das Netzwerk auf, analysieren die Bilder und erhalten die Werte der Pixel. Subsampling oder Pooling ist der Prozess, bei dem die Bildwerte umgewandelt/reduziert werden, um die Darstellung der Bilder zu vereinfachen und die Empfindlichkeit der Bildfilter gegenÞber Rauschen zu verringern. Die Aktivierungsfunktionen steuern, wie die Daten von einer Schicht zur nÃĪchsten Schicht flieÃen, und die vollstÃĪndig verbundenen Schichten analysieren die Werte, die die Bilder darstellen, und erlernen die Muster, die in diesen Werten enthalten sind.
RNNs/LSTMs
Recurrent Neural Networks, oder RNNs, sind beliebt fÞr Aufgaben, bei denen die Reihenfolge der Daten wichtig ist, bei denen das Netzwerk eine Sequenz von Daten erlernen muss. RNNs werden hÃĪufig auf Probleme wie die natÞrliche Sprachverarbeitung angewendet, da die Reihenfolge der WÃķrter wichtig ist, wenn die Bedeutung eines Satzes entschlÞsselt wird. Der ârekurrenteâ Teil des Begriffs Recurrent Neural Network kommt von der Tatsache, dass die Ausgabe fÞr ein bestimmtes Element in einer Sequenz von der vorherigen Berechnung sowie der aktuellen Berechnung abhÃĪngt. Im Gegensatz zu anderen Formen von Deep-Learning-Netzwerken haben RNNs âErinnerungenâ, und die Informationen, die bei den verschiedenen Zeitpunkten in der Sequenz berechnet werden, werden verwendet, um die endgÞltigen Werte zu berechnen.
Es gibt mehrere Arten von RNNs, darunter bidirektionale RNNs, die zukÞnftige Elemente in der Sequenz berÞcksichtigen, zusÃĪtzlich zu den vorherigen Elementen, wenn sie den Wert eines Elements berechnen. Eine andere Art von RNN ist ein Long Short-Term Memory, oder LSTM, Netzwerk. LSTMs sind Arten von RNNs, die lange Ketten von Daten verarbeiten kÃķnnen. RegulÃĪre RNNs kÃķnnen Opfer des sogenannten âexplodierenden Gradientenproblemsâ werden. Dieses Problem tritt auf, wenn die Kette der Eingabedaten sehr lang wird, aber LSTMs haben Techniken, um dieses Problem zu bekÃĪmpfen.
Autoencoders
Die meisten der bisher erwÃĪhnten Deep-Learning-Architekturen werden auf Þberwachte Lernalgorithmen angewendet, anstatt auf unÞberwachte Lernalgorithmen. Autoencoders kÃķnnen unÞberwachte Daten in ein Þberwachtes Format umwandeln, sodass neuronale Netze auf das Problem angewendet werden kÃķnnen.
Autoencoders werden hÃĪufig verwendet, um Anomalien in DatensÃĪtzen zu erkennen, ein Beispiel fÞr unÞberwachtes Lernen, da die Natur der Anomalie nicht bekannt ist. Ein Beispiel fÞr die Anomalieerkennung ist die BetrugsbekÃĪmpfung fÞr Finanzinstitute. In diesem Kontext besteht der Zweck eines Autoencoders darin, eine Grundlinie von regelmÃĪÃigen Mustern in den Daten zu bestimmen und Anomalien oder AusreiÃer zu identifizieren.
Die Struktur eines Autoencoders ist oft symmetrisch, mit versteckten Schichten, die so angeordnet sind, dass die Ausgabe des Netzwerks der Eingabe ÃĪhnelt. Die vier Arten von Autoencodern, die hÃĪufig verwendet werden, sind:
- RegulÃĪre/Autoencoders
- Multilayer-Encoder
- Convolutional-Encoder
- Regularisierte Encoder
RegulÃĪre/Autoencoders sind einfach neuronale Netze mit einer einzigen versteckten Schicht, wÃĪhrend Multilayer-Autoencoders tiefe Netze mit mehr als einer versteckten Schicht sind. Convolutional-Autoencoders verwenden Convolutional-Schichten anstelle von oder zusÃĪtzlich zu vollstÃĪndig verbundenen Schichten. Regularisierte Autoencoders verwenden eine bestimmte Art von Verlustfunktion, die es dem neuronalen Netzwerk ermÃķglicht, komplexere Funktionen auszufÞhren, Funktionen, die Þber das bloÃe Kopieren von Eingaben in Ausgaben hinausgehen.
Generative Adversarial Networks
Generative Adversarial Networks (GANs) sind tatsÃĪchlich mehrere Deep-Learning-Netzwerke anstelle eines einzigen Netzwerks. Zwei Deep-Learning-Modelle werden gleichzeitig trainiert, und ihre Ausgaben werden an das andere Netzwerk gesendet. Die Netzwerke sind in Konkurrenz zueinander, und da sie Zugang zu den Ausgaben des anderen Netzwerks haben, lernen sie beide von diesen Daten und verbessern sich. Die beiden Netzwerke spielen im Wesentlichen ein Spiel von FÃĪlschung und Erkennung, bei dem das generative Modell versucht, neue Instanzen zu erstellen, die das Detektionsmodell/den Diskriminator tÃĪuschen. GANs sind im Bereich der Computer-Vision beliebt geworden.
Deep-Learning-Zusammenfassung
Deep Learning erweitert die Prinzipien von neuronalen Netzen, um komplexe Modelle zu erstellen, die komplexe Muster erlernen und diese Muster auf zukÞnftige DatensÃĪtze verallgemeinern kÃķnnen. Convolutional Neural Networks werden verwendet, um Bilder zu interpretieren, wÃĪhrend RNNs/LSTMs verwendet werden, um sequenzielle Daten zu interpretieren. Autoencoders kÃķnnen unÞberwachte Lernalgorithmen in Þberwachte Lernalgorithmen umwandeln. SchlieÃlich sind GANs mehrere Netzwerke, die gegeneinander ausgetragen werden, und sie sind besonders nÞtzlich fÞr Computer-Vision-Aufgaben.












