फंडिंग

शेंगशु टेक्नोलॉजी ने मल्टीमॉडल एआई सीमाओं को आगे बढ़ाने के लिए 86 मिलियन डॉलर से अधिक की श्रृंखला ए+ फंडिंग जुटाई

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

शेंगशु टेक्नोलॉजी ने श्रृंखला ए+ फंडिंग राउंड पूरा किया है, जो आरएमबी 600 मिलियन (लगभग $86 मिलियन अमेरिकी डॉलर) से अधिक है, जो कंपनी के लिए एक बड़ा मील का पत्थर है क्योंकि यह डिजिटल और भौतिक-विश्व अनुप्रयोगों दोनों के लिए अपने मल्टीमॉडल फाउंडेशन मॉडल को बढ़ाती है। इस दौर का नेतृत्व ज़ोंगगुआनकुन साइंस सिटी और लिंक-एक्स कैपिटल ने किया था, जिसमें वंडरशेयर, विज़ुअल चाइना ग्रुप और टीआरएस की रणनीतिक भागीदारी थी। कई मौजूदा निवेशकों ने भी अपनी प्रतिबद्धता बढ़ा दी, जो शेंगशु की तकनीकी दिशा और व्यावसायिक प्रगति में निरंतर विश्वास को दर्शाता है।

नई पूंजी ऐसे समय में आती है जब मल्टीमॉडल एआई सिस्टम प्रयोगात्मक उपकरणों से वास्तविक-विश्व उत्पादन के लिए बुनियादी ढांचे की ओर बढ़ रहे हैं। शेंगशु की траजेक्टरी उस बदलाव को दर्शाती है, जिसमें अनुसंधान सफलताएं तेजी से तैनात उत्पादों में अनुवादित हो रही हैं जो उद्योगों में उपयोग की जा रही हैं।

प्रारंभिक अनुसंधान से व्यावसायिक-ग्रेड मॉडल तक

शेंगशु टेक्नोलॉजी वैश्विक स्तर पर मल्टीमॉडल जनरेटिव एल्गोरिदम पर ध्यान केंद्रित करने वाली पहली टीमों में से एक थी। 2022 में, कंपनी ने यू-वीआईटी आर्किटेक्चर पेश किया, जिसने मॉडल के लिए एक तकनीकी आधार स्थापित करने में मदद की जो पाठ, छवि, और वीडियो के पार तर्क कर सकते हैं। इस अनुसंधान-पहले दृष्टिकोण ने 2024 के मध्य में विडू के लॉन्च के लिए मंच तैयार किया।

विडू ने रेफरेंस-टू-वीडियो क्षमता के साथ बाजार में प्रवेश किया, जो पारंपरिक पाठ-से-वीडियो या छवि-से-वीडियो पीढ़ी से परे था। प्रत्येक फ्रेम को एक अलग आउटपुट के रूप में मानने के बजाय, प्रणाली को दृश्यों में बहु-एंटिटी संगतता को बनाए रखने के लिए डिज़ाइन किया गया था, जो व्यावसायिक वीडियो पीढ़ी में एक लंबे समय से चली आ रही चुनौती का समाधान करता है। लॉन्च के बाद से, शेंगशु ने तेजी से प्रतिक्रिया दी, जिसमें लगातार सुधार किए गए संस्करण जारी किए गए जिन्होंने सेमेंटिक समझ, गति स्थिरता, दृश्य संगतता, और अनुमान गति में सुधार किया।

सबसे हाल का रिलीज, विडू क्यू3, कहानी सुनाने पर जानबूझकर ध्यान केंद्रित करता है। मॉडल 16 सेकंड तक के सिंक्रोनाइज्ड ऑडियो-वीडियो पीढ़ी का समर्थन करता है, मूल 1080पी आउटपुट, सटीक शॉट ट्रांज़िशन, बहुभाषी पाठ रेंडरिंग, और बहुभाषी आउटपुट। ये क्षमताएं प्रणाली को उत्पादन कार्य प्रवाह के करीब लाती हैं, छोटे प्रयोगात्मक क्लिप के बजाय।

प्रदर्शन, गति, और खुली नवाचार

आउटपुट गुणवत्ता के अलावा, शेंगशु ने प्रतिस्पर्धी विभेदक के रूप में दक्षता पर जोर दिया है। 2025 के अंत में, कंपनी ने अपने टुर्बोडिफ्यूजन फ्रेमवर्क को ओपन-सोर्स किया, जिससे वीडियो पीढ़ी विलंबता में काफी कमी आई। इस फ्रेमवर्क के साथ, एक पांच-सेकंड वीडियो एक हाई-एंड जीपीयू पर दो सेकंड से कम समय में उत्पन्न किया जा सकता है, जो पहले के दृष्टिकोण की तुलना में क्रमिक लाभ प्रदान करता है।

यह गति पर ध्यान केंद्रित करना केवल एक तकनीकी बेंचमार्क नहीं है। कम विलंबता और कम्प्यूटे आवश्यकताएं सीधे मल्टीमॉडल मॉडल को बड़े पैमाने पर तैनात करने की व्यावहारिकता को प्रभावित करती हैं, विशेष रूप से इंटरैक्टिव अनुप्रयोगों और रीयल-टाइम रचनात्मक उपकरणों के लिए। उच्च-गुणवत्ता वाले वीडियो को उत्पन्न करने के लिए आवश्यक समय और लागत को कम करके, शेंगशु मल्टीमॉडल एआई को पेशेवर वातावरण में दैनिक उपयोग के करीब ला रहा है।

रचनात्मक और उद्यम बाजारों में विस्तार

शेंगशु ने विडू के आसपास एक व्यापक उत्पाद पारिस्थितिकी तंत्र बनाया है, जिसमें प्रबंधित सेवाएं, सास ऑफरिंग्स, अनुप्रयोग, और एजेंट-आधारित उपकरण शामिल हैं। ये उत्पाद अब 200 से अधिक देशों और क्षेत्रों में रचनाकारों, स्टूडियो, और उद्यमों को सेवा प्रदान करते हैं। 2025 में, कंपनी ने उपयोगकर्ताओं और राजस्व में दस गुना वृद्धि की सूचना दी, जो अपनाने में तेजी का संकेत देता है।

फिल्म और मनोरंजन में, विडू एनिमेशन, शॉर्ट-फॉर्म उत्पादन, और फीचर वर्कफ्लो में उपयोग किया जाता है, जिसमें सामग्री मालिकों, टूल प्रदाताओं, और उत्पादन स्टूडियो के साथ जुड़ाव है। साथ ही, इंटरनेट प्लेटफ़ॉर्म और स्मार्ट हार्डवेयर कंपनियां विपणन संपत्ति निर्माण, इंटरैक्टिव सामग्री, और उत्पाद नवाचार के लिए प्रौद्योगिकी का उपयोग कर रही हैं।

विज्ञापन और गेमिंग नए क्षेत्रों के रूप में उभरे हैं। ब्रांड और एजेंसियां विडू का उपयोग वीडियो उत्पादन को अभियानों के लिए बढ़ाने के लिए करते हैं, जबकि गेम डेवलपर्स विज्ञापन सामग्री और दृश्य पीढ़ी के लिए इसका उपयोग करते हैं। अंतरराष्ट्रीय स्तर पर, प्लेटफ़ॉर्म रचनात्मक उपकरण विकासकों और उद्यम उपयोगकर्ताओं के बीच ध्यान प्राप्त कर रहा है, जिसमें शिक्षा, प्रसारण, और सांस्कृतिक पर्यटन में अनुप्रयोग हैं।

मल्टीमॉडल एआई के व्यापक निहितार्थ

मल्टीमॉडल फाउंडेशन मॉडल की प्रगति का वीडियो निर्माण से परे व्यापक निहितार्थ है। पाठ, छवि, ऑडियो, और गति को एकीकृत करके, ये मॉडल मशीनों को संदर्भ को मानवीय धारणा की तरह व्याख्या करने में सक्षम बनाते हैं। उद्योगों के लिए, इसका अर्थ है तेजी से उत्पादन चक्र, उच्च-गुणवत्ता वाली सामग्री के लिए प्रवेश के लिए कम बाधाएं, और सॉफ्टवेयर और मानवों के बीच नए रूपों की बातचीत।

साथ ही, मल्टीमॉडल एआई के परिपक्व होने से प्रामाणिकता, बौद्धिक संपदा, और जिम्मेदार तैनाती के आसपास महत्वपूर्ण प्रश्न उठते हैं। जैसे ही उत्पन्न वीडियो अधिक वास्तविक होता जाता है, डिजिटल मीडिया में विश्वास बनाए रखने के लिए तकनीकी सुरक्षा उपाय और शासन ढांचे आवश्यक होंगे।

आगे देखते हुए, मल्टीमॉडल मॉडल न केवल डिजिटल कार्य प्रवाह में बल्कि भौतिक-विश्व प्रणालियों में भी भूमिका निभाएंगे, जिसमें रोबोटिक्स और सिमुलेशन से लेकर स्मार्ट वातावरण तक शामिल हैं। शेंगशु टेक्नोलॉजी के नवीनतम फंडिंग राउंड इस संक्रमण में भाग लेने के लिए इसे स्थिति में लाता है, क्योंकि मल्टीमॉडल एआई रचनात्मक नवाचार से अगली पीढ़ी की उत्पादकता की आधारभूत परत में बदल जाता है।

एंटोनी एक दूरदर्शी नेता और यूनाइट.एआई के संस्थापक भागीदार हैं, जो कि एआई और रोबोटिक्स के भविष्य को आकार देने और बढ़ावा देने के लिए एक अटूट जुनून से प्रेरित हैं। एक连续 उद्यमी, वह मानता है कि एआई समाज के लिए उतना ही विघटनकारी होगा जितना कि बिजली, और अक्सर विघटनकारी प्रौद्योगिकियों और एजीआई की संभावना के बारे में उत्साहित होता है।

एक भविष्यवाणी के रूप में, वह इन नवाचारों के बारे में जानने के लिए समर्पित है कि वे हमारी दुनिया को कैसे आकार देंगे। इसके अलावा, वह सिक्योरिटीज़.io के संस्थापक हैं, जो एक मंच है जो भविष्य को फिर से परिभाषित करने और पूरे क्षेत्रों को पुनः आकार देने वाली नवीनतम प्रौद्योगिकियों में निवेश पर केंद्रित है।