KI-Modelle und Plattformen
Googles KI lehrt Roboter, indem sie Hunde beobachtet, wie sie sich bewegen
Even einige der fortschrittlichsten Roboter von heute bewegen sich noch immer auf somewhat holprige, ruckartige Weise. Um Roboter dazu zu bringen, sich auf mehr lebensechte, flüssige Weise zu bewegen, haben Forscher bei Google (GOOGL ) ein KI-System entwickelt, das in der Lage ist, von den Bewegungen realer Tiere zu lernen. Das Google-Forschungsteam veröffentlichte eine Vorabveröffentlichung, in der ihre Herangehensweise detailliert beschrieben wurde. In dem Paper und einem begleitenden Blogbeitrag beschreibt das Forschungsteam die zugrunde liegende Logik des Systems. Die Autoren des Papers glauben, dass die Ausstattung von Robotern mit natürlicheren Bewegungen dazu beitragen könnte, sie bei realen Aufgaben zu unterstützen, die präzise Bewegungen erfordern, wie zum Beispiel das Transportieren von Gegenständen zwischen verschiedenen Ebenen eines Gebäudes.
Wie VentureBeat berichtete, nutzte das Forschungsteam Verstärkendes Lernen, um ihre Roboter zu trainieren. Die Forscher begannen damit, Clips von realen Tieren zu sammeln, die sich bewegten, und verwendeten Verstärkendes Lernen (RL), um die Roboter dazu zu bringen, die Bewegungen der Tiere in den Video-Clips nachzuahmen. In diesem Fall trainierten die Forscher die Roboter mit Clips von einem Hund, der in einem Physik-Simulator entworfen wurde, und wiesen einen vierbeinigen Unitree Laikago-Roboter an, die Bewegungen des Hundes nachzuahmen. Nachdem der Roboter trainiert worden war, war er in der Lage, komplexe Bewegungen wie Hüpfen, Drehen und schnelles Gehen mit einer Geschwindigkeit von etwa 4,2 Kilometern pro Stunde auszuführen.
Die Trainingsdaten bestanden aus etwa 200 Millionen Proben von Hunden in Bewegung, die in einem Physik-Simulator verfolgt wurden. Die verschiedenen Bewegungen wurden dann durch Belohnungsfunktionen und Richtlinien geführt, die die Agenten erlernten. Nachdem die Richtlinien in der Simulation erstellt worden waren, wurden sie in die reale Welt übertragen, indem eine Technik namens latente Raum-Anpassung verwendet wurde. Da die Physik-Simulatoren, die zum Trainieren der Roboter verwendet wurden, nur bestimmte Aspekte der realen Bewegung approximieren konnten, wendeten die Forscher zufällig verschiedene Störungen in der Simulation an, um den Betrieb unter verschiedenen Bedingungen zu simulieren.
Laut dem Forschungsteam konnten sie die Simulationsrichtlinien auf die realen Roboter anwenden, indem sie nur acht Minuten an Daten sammelten, die aus 50 verschiedenen Versuchen stammten. Die Forscher konnten demonstrieren, dass die realen Roboter in der Lage waren, eine Vielzahl von verschiedenen, spezifischen Bewegungen wie Trab, Drehen, Hüpfen und Schreiten nachzuahmen. Sie konnten sogar Animationen nachahmen, die von Animationskünstlern erstellt wurden, wie zum Beispiel eine Kombination aus Hüpfen und Drehen.
Die Forscher fassen die Ergebnisse in dem Paper wie folgt zusammen:
„Wir zeigen, dass durch die Nutzung von Referenzbewegungsdaten ein einzelner lernbasierter Ansatz in der Lage ist, automatisch Steuerungen für eine vielfältige Reihe von Verhaltensweisen für vierbeinige Roboter zu synthetisieren. Durch die Einbeziehung von stichprobenEffizienten Domänen-Adaptationstechniken in den Trainingsprozess kann unser System adaptive Richtlinien in der Simulation lernen, die dann schnell für die reale Einsetzung adaptiert werden können.“
Die Steuerungsrichtlinien, die während des Verstärkenden Lernens verwendet wurden, hatten ihre Einschränkungen. Aufgrund der durch die Hardware und Algorithmen auferlegten Einschränkungen gab es einige Dinge, die die Roboter einfach nicht tun konnten. Sie konnten zum Beispiel nicht rennen oder große Sprünge machen. Die gelernten Richtlinien zeigten auch nicht so viel Stabilität wie die von Hand entworfenen Bewegungen. Das Forschungsteam möchte die Arbeit weiterentwickeln, indem es die Steuerungen robuster und in der Lage macht, von verschiedenen Arten von Daten zu lernen. Idealerweise werden zukünftige Versionen des Frameworks in der Lage sein, von Video-Daten zu lernen.










