Μοντέλα και πλατφόρμες AI

Τεχνική Μηχανικής Όρασης Προβλέπει Ανθρώπινη Συμπεριφορά από Βίντεο

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Μια νέα τεχνική μηχανικής όρασης που αναπτύχθηκε από ερευνητές του Columbia Engineering μπορεί να προβλέψει την ανθρώπινη συμπεριφορά από βίντεο. Η νέα τεχνική δίνει στους υπολογιστές μια ενστικτώδη αίσθηση, επιτρέποντάς τους να προβλέπουν τι θα συμβεί επόμενο χρησιμοποιώντας υψηλότερου επιπέδου συσχετίσεις μεταξύ ανθρώπων, ζώων και αντικειμένων.

Ο Carl Vondrick είναι βοηθός καθηγητής πληροφορικής στο Columbia. Ο Vondrick διηύθυνε τη μελέτη, η οποία παρουσιάστηκε στις 24 Ιουνίου στη Διεθνή Συνέδριο για την Αναγνώριση Προτύπων και Μηχανική Όραση.

“Ο αλγόριθμος μας είναι ένα βήμα προς την κατεύθυνση των μηχανών να κάνουν καλύτερες προβλέψεις για την ανθρώπινη συμπεριφορά και έτσι να συντονίσουν καλύτερα τις ενέργειές τους με τις δικές μας”, είπε ο Vondrick. “Τα αποτελέσματά μας ανοίγουν πολλές δυνατότητες για συνεργασία ανθρώπου-ρομπότ, αυτόνομες οχήματα και βοηθητική τεχνολογία.”

Η νέα μέθοδος είναι η πιο ακριβής της κατηγορίας της μέχρι σήμερα για την πρόβλεψη των ενεργειών βίντεο beberapa λεπτά στο μέλλον. Το σύστημα πρώτα ανάλυσε χιλιάδες ώρες ταινιών, αθλητικών αγώνων και εκπομπών πριν προβλέψει εκατοντάδες δραστηριότητες, όπως χειραψία και γροθιά.

Εάν το σύστημα δεν μπορεί να προβλέψει μια συγκεκριμένη ενέργεια, βρίσκει μια υψηλότερου επιπέδου έννοια που τις συνδέει, όπως η λέξη “χαιρετισμός”.

Προηγούμενες Προσπάθειες

Οι προηγούμενες προσπάθειες για προβλέψεις με τη χρήση μηχανικής μάθησης συνήθως επικεντρώνονταν στην πρόβλεψη μιας ενέργειας κάθε φορά, με τους αλγόριθμους να αποφασίζουν να ταξινομήσουν την ενέργεια, για παράδειγμα, ως αγκαλιά, χειραψία, γροθιά ή μη-ενέργεια. Ωστόσο, η υψηλή αβεβαιότητα σημαίνει ότι τα περισσότερα μοντέλα μηχανικής μάθησης δεν μπορούν να βρουν κοινότητες μεταξύ των πιθανών επιλογών.

Η ομάδα περιελάμβανε τους διδάκτορες του Columbia Engineering Didac Suris και Ruoshi Liu, και το ζευγάρι έβλεπε το πρόβλημα της μακροπρόθεσμης πρόβλεψης με немного διαφορετικό τρόπο.

Ο Suris είναι συν-πρωτότυπος συγγραφέας του εγγράφου.

“Δεν είναι όλα στο μέλλον προβλέψιμα”, είπε ο Suris. “Όταν ένα άτομο δεν μπορεί να προβλέψει ακριβώς τι θα συμβεί, παίζει ασφαλής και προβλέπει σε υψηλότερο επίπεδο αφαίρεσης. Ο αλγόριθμος μας είναι ο πρώτος που μαθαίνει αυτή την ικανότητα να συλλογιστεί αφηρημένα για μελλοντικά γεγονότα.”

https://www.youtube.com/watch?v=b1riFCPiqN4

Ανάπτυξη του Νέου Συστήματος

Οι Suris και Liu βασίστηκαν σε ασυνήθιστες γεωμετρίες για την ανάπτυξη μοντέλων AI που οργανώνουν υψηλές έννοιες και προβλέπουν την ανθρώπινη συμπεριφορά στο μέλλον.

Η Aude Oliva, η οποία δεν συμμετείχε στη μελέτη, είναι ανώτερη ερευνήτρια στο Massachusetts Institute of Technology και συν-διευθύντρια του MIT-IBM Watson AI Lab.

“Η πρόβλεψη είναι η βάση της ανθρώπινης νοημοσύνης”, είπε η Oliva. “Οι μηχανές κάνουν λάθη που οι άνθρωποι δεν θα κάνανε ποτέ, επειδή τους λείπει η ικανότητά μας να συλλογιστούμε αφηρημένα. Αυτό το έργο είναι ένα κρίσιμο βήμα προς την γέφυρα αυτού του τεχνολογικού χάσματος.”

Οι ερευνητές ανέπτυξαν ένα μαθηματικό πλαίσιο που επιτρέπει στους υπολογιστές να οργανώνουν τα γεγονότα με βάση το πόσο προβλέψιμα είναι στο μέλλον. Για παράδειγμα, το νέο σύστημα μαθαίνει πώς να ταξινομήσει δραστηριότητες όπως το κολύμπι και το τρέξιμο ως δικές τους, αντί να τις θεωρεί απλώς ως άσκηση. Το σύστημα είναι επίσης σε θέση να λαμβάνει υπόψη την αβεβαιότητα, η οποία οδηγεί σε πιο συγκεκριμένες ενέργειες.

Σύμφωνα με τον Liu, συν-πρωτότυπο συγγραφέα του εγγράφου, η νέα τεχνική θα μπορούσε να βοηθήσει τους υπολογιστές να λαμβάνουν πιο συνειδητές αποφάσεις αντί για προ-προγραμματισμένες ενέργειες και είναι κρίσιμη για την οικοδόμηση της εμπιστοσύνης μεταξύ ανθρώπων και υπολογιστών.

“Η εμπιστοσύνη προέρχεται από το αίσθημα ότι ο ρομπότ πραγματικά καταλαβαίνει τους ανθρώπους”, εξηγεί. “Εάν οι μηχανές μπορούν να καταλάβουν και να προβλέψουν τις συμπεριφορές μας, οι υπολογιστές θα είναι σε θέση να βοηθούν ανθρώπους σε καθημερινές δραστηριότητες.”

Η ομάδα θα επιδιώξει να επιβεβαιώσει ότι η τεχνική λειτουργεί στον πραγματικό κόσμο και θα μπορούσε να αναπτυχθεί για ασφάλεια, υγεία και ασφάλεια.

“Η ανθρώπινη συμπεριφορά είναι συχνά απροσδόκητη”, λέει ο Vondrick. “Οι αλγόριθμοί μας επιτρέπουν στους υπολογιστές να προβλέπουν καλύτερα τι θα κάνουν οι άνθρωποι επόμενο.”

Ο Alex McFarland είναι δημοσιογράφος και συγγραφέας του AI που εξερευνά τις τελευταίες εξελίξεις στην τεχνητή νοημοσύνη. Έχει συνεργαστεί με πολλές startups και εκδόσεις του AI σε όλο τον κόσμο.