एआई मॉडल और प्लेटफ़ॉर्म

कंप्यूटर विजन तकनीक वीडियो से मानव व्यवहार की भविष्यवाणी करती है

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

कोलंबिया इंजीनियरिंग के शोधकर्ताओं द्वारा विकसित एक नई कंप्यूटर विजन तकनीक वीडियो से मानव व्यवहार की भविष्यवाणी कर सकती है। नई तकनीक मशीनों को एक सहज ज्ञान देती है जो उन्हें उच्च-स्तरीय संघों के बीच लोगों, जानवरों और वस्तुओं का उपयोग करके आगे क्या होगा इसकी भविष्यवाणी करने में सक्षम बनाती है।

कार्ल वोंड्रिक कोलंबिया में कंप्यूटर विज्ञान के सहायक प्रोफेसर हैं। वोंड्रिक ने अध्ययन का निर्देशन किया, जिसे 24 जून को कंप्यूटर विजन और पैटर्न रिकग्निशन के अंतर्राष्ट्रीय सम्मेलन में प्रस्तुत किया गया था।

“हमारा अल्गोरिदम मशीनों को मानव व्यवहार के बारे में बेहतर भविष्यवाणी करने और इस प्रकार अपने क्रियाओं को हमारे साथ बेहतर समन्वय करने की दिशा में एक कदम है,” वोंड्रिक ने कहा। “हमारे परिणाम मानव-रोबोट सहयोग, स्वायत्त वाहनों और सहायक प्रौद्योगिकी के लिए कई संभावनाओं को खोलते हैं।”

यह नई विधि अपनी तरह की सबसे सटीक है जो वीडियो एक्शन इवेंट्स की भविष्यवाणी के लिए कई मिनट आगे तक जाती है। सिस्टम ने पहले फिल्मों, खेल खेलों और शो के हजारों घंटों का विश्लेषण किया और फिर सैकड़ों गतिविधियों की भविष्यवाणी की, जैसे कि हाथ मिलाना और मुक्का मारना।

यदि सिस्टम एक विशिष्ट क्रिया की भविष्यवाणी नहीं कर सकता है, तो यह एक उच्च-स्तरीय अवधारणा को ढूंढता है जो उन्हें जोड़ता है, जैसे कि “ग्रीटिंग” शब्द।

पिछले प्रयास

पिछले प्रयासों में पredictive मशीन लर्निंग आमतौर पर एक समय में एक क्रिया की भविष्यवाणी पर केंद्रित थे, जिसमें अल्गोरिदम ने क्रिया को वर्गीकृत करने का निर्णय लिया, जैसे कि एक गले मिलने, हाथ मिलाने, उच्च-पांच या गैर-क्रिया के रूप में। हालांकि, उच्च अनिश्चितता का अर्थ है कि अधिकांश मशीन लर्निंग मॉडल संभावित विकल्पों के बीच सामान्यता नहीं पा सकते हैं।

टीम में कोलंबिया इंजीनियरिंग के पीएचडी छात्र डिडैक सुरिस और रुओशी लियू शामिल थे, और जोड़ी ने लंबी दूरी की भविष्यवाणी समस्या को थोड़ा अलग तरीके से देखा।

सुरिस पेपर के सह-लीड लेखक हैं।

“भविष्य में सब कुछ अनुमानित नहीं है,” सुरिस ने कहा। “जब एक व्यक्ति ठीक से नहीं जानता कि आगे क्या होगा, तो वे सुरक्षित खेलते हैं और एक उच्च स्तर की अभिव्यक्ति पर भविष्यवाणी करते हैं। हमारा अल्गोरिदम पहला है जो भविष्य की घटनाओं के बारे में सabstractly कारण बनाने की क्षमता सीखता है।”

https://www.youtube.com/watch?v=b1riFCPiqN4

नया सिस्टम विकसित करना

सुरिस और लियू ने मानव व्यवहार की भविष्यवाणी के लिए एआई मॉडल विकसित करने के लिए असामान्य ज्यामिति पर भरोसा किया।

ऑडे ओलिवा जो अध्ययन में शामिल नहीं थे, मैसाचुसेट्स इंस्टीट्यूट ऑफ टेक्नोलॉजी में वरिष्ठ शोध वैज्ञानिक हैं और एमआईटी-आईबीएम वाटसन एआई लैब के सह-nिदेशक हैं।

“भविष्यवाणी मानव बुद्धिमत्ता का आधार है,” ओलिवा ने कहा। “मशीनें ऐसी गलतियाँ करती हैं जो मनुष्य कभी नहीं करेंगे क्योंकि उन्हें हमारी तरह सabstractly कारण बनाने की क्षमता की कमी है। यह काम इस तकनीकी अंतर को पाटने की दिशा में एक महत्वपूर्ण कदम है।”

शोधकर्ताओं ने एक गणितीय ढांचा विकसित किया जो मशीनों को भविष्य में उनकी भविष्यवाणी के आधार पर घटनाओं को व्यवस्थित करने में सक्षम बनाता है। उदाहरण के लिए, नई प्रणाली सीखती है कि कैसे गतिविधियों जैसे तैरने और दौड़ने को अपने आप में वर्गीकृत किया जाए, न कि केवल व्यायाम के रूप में। प्रणाली अनिश्चितता के लिए भी खाता है, जो अधिक विशिष्ट क्रियाओं की ओर ले जाता है।

लियू के अनुसार, जो पेपर के सह-लीड लेखक हैं, नई तकनीक से कंप्यूटरों को निर्धारित क्रियाओं के बजाय सूक्ष्म निर्णय लेने में मदद मिल सकती है, और यह मानव-कंप्यूटर विश्वास के निर्माण के लिए महत्वपूर्ण है।

“विश्वास तब आता है जब यह महसूस होता है कि रोबोट वास्तव में लोगों को समझता है,” वह समझाता है। “यदि मशीनें हमारे व्यवहार को समझ और पूर्वानुमान लगा सकती हैं, तो कंप्यूटर दैनिक गतिविधि में लोगों की मदद कर पाएंगे।”

टीम अब तकनीक को वास्तविक दुनिया में काम करने के लिए सत्यापित करने का लक्ष्य रखती है, और यह सुरक्षा, स्वास्थ्य और सुरक्षा के लिए तैनात किया जा सकता है।

“मानव व्यवहार अक्सर आश्चर्यजनक होता है,” वोंड्रिक कहते हैं। “हमारे अल्गोरिदम मशीनों को यह अनुमान लगाने में सक्षम बनाते हैं कि वे आगे क्या करने जा रहे हैं।”

एलेक्स मैकफारलैंड एक एआई पत्रकार और लेखक हैं जो कृत्रिम बुद्धिमत्ता में नवीनतम विकासों का अन्वेषण कर रहे हैं। उन्होंने विश्वभर के कई एआई स्टार्टअप्स और प्रकाशनों के साथ सहयोग किया है।