Twelve Labs, एक स्टार्टअप बिल्डिंग आर्टिफिशियल इंटेलिजेंस जी भाषा मॉडेल्स मजकूर समजतात त्याप्रमाणे व्हिडिओ समजू शकते, AI ची पुढची सीमा शब्दांऐवजी गतिमान आहे असे म्हणत मालिका B निधी फेरीत $100 दशलक्ष जमा केले आहेत.
कंपनीने 1 जुलै 2026 रोजी आपल्या ब्लॉगवर निधीची घोषणा केली. या फेरीचे नेतृत्व NEA आणि NAVER व्हेंचर्सने केले होते, ज्यामध्ये Amazon सोबत Radical Ventures, Korea Investment Partners, Index Ventures, Quadrille Capital आणि Red Bull Ventures यांचा सहभाग होता. विस्तीर्ण AI उद्योग कव्हरेज उद्यम भांडवल कोठे प्रवाहित होत आहे याचा मागोवा घेण्यासाठी, हा करार गुंतवणूकदारांच्या वाढत्या विश्वासाला अधोरेखित करतो की व्हिडिओ हा पुढचा प्रमुख डेटा प्रकार AI चा मास्टर असणे आवश्यक आहे.
'जग मजकूरात घडत नाही'
सह-संस्थापक आणि मुख्य कार्यकारी जे ली यांनी कंपनीचे ध्येय अगदी स्पष्टपणे मांडले. "पाच वर्षांपूर्वी, आम्ही एका साध्या निरीक्षणाने सुरुवात केली: जग मजकूरात घडत नाही. ते गतीने घडते," त्यांनी घोषणेमध्ये लिहिले.
ब्लूमबर्ग न्यूजला दिलेल्या मुलाखतीत, लीने या कल्पनेचा विस्तार केला आणि असा युक्तिवाद केला की व्हिडिओ "जगाबद्दल जाणून घेण्यासाठी मानव म्हणून आपल्याला प्राप्त होणारा सर्वात समान सिग्नल डेटा आहे." त्यांनी त्या क्षणी प्रबळ AI आर्किटेक्चरशी तुलना केली, "ते अगदी नवीन फ्रंटियर मॉडेल्स जसे की फेबल 5 आणि मिथॉस, जे अजूनही भाषा मॉडेल आहेत त्यापेक्षा वेगळे आहे."
एआय सध्या कसे कार्य करते यामधील अंतरावर युक्तिवाद आहे. एआय विकासाच्या शेवटच्या दशकात, लीने लिहिले, "मजकूर प्रोग्राम करण्यायोग्य बनविला," परंतु व्हिडिओला अद्याप समान उपचार मिळालेले नाहीत. त्याने जगातील व्हिडिओचे वर्णन "मशिनसाठी बहुतेक गडद पदार्थ" असे केले आहे, संग्रहणात बसून, ड्रोनवर आणि सॅटेलाइट फीडमध्ये, तरीही "फाइलनावे, फोल्डर्स, मथळे, प्रतिलेख आणि मानवी मेमरी द्वारे" मोठ्या प्रमाणात प्रवेश केला जातो.
एजंटद्वारे व्हिडिओ वापरण्यायोग्य बनवणे
बारा लॅबचे सांगितलेले उद्दिष्ट हे अंतर बंद करणे आहे. "व्हिडिओचा प्रत्येक सेकंद एजंट्सद्वारे संबोधित करण्यायोग्य, शोधण्यायोग्य आणि वापरण्यायोग्य बनवणे हे आमचे ध्येय आहे," लीने AI एजंट्सच्या वाढीकडे लक्ष वेधले, मागणीचे प्रमुख चालक म्हणून तर्क आणि कारवाई करू शकणाऱ्या स्वायत्त प्रणालीकडे लक्ष वेधले.
जर भाषा मॉडेलने दस्तऐवज शोधण्यायोग्य बनवले आणि कोड जनरेटरने सॉफ्टवेअर तयार करणे अधिक जलद केले, तर व्हिडिओ-समजणारे मॉडेल रेकॉर्ड केलेल्या व्हिडिओचे प्रचंड आणि मोठ्या प्रमाणावर न वापरलेले संग्रह स्वयंचलित सिस्टमसाठी प्रवेशयोग्य बनवू शकते. ज्यामध्ये मीडिया, सुरक्षा, स्वायत्त वाहने आणि एंटरप्राइझमध्ये अनुप्रयोग आहेत, कोणतेही क्षेत्र जेथे व्हिडिओ प्रवाहात काय चालले आहे हे समजून घेण्यावर निर्णय अवलंबून असतात.
गर्दीचा पण वेगळा वर्ग
बारा लॅब्स एक कोनाडा व्यापतात जी AI मधील सर्वात दृश्यमान दोन श्रेणींमध्ये बसते. एका बाजूला व्हिडिओ जनरेटर, साधने आहेत जी मजकूर प्रॉम्प्टमधून नवीन व्हिडिओ तयार करतात. दुसरीकडे मजकूरावर प्रक्रिया करणारे मोठे भाषा मॉडेल आहेत. ट्वेल्व्ह लॅब्ज व्हिडिओ समजून घेण्यावर, विद्यमान व्हिडिओचा अर्थ लावण्यावर केंद्रित आहे जेणेकरून मशीन ते शोधू शकतील, त्याचा सारांश करू शकतील आणि त्यावर कार्य करू शकतील.
PYMNTS ने नमूद केले की व्हिडिओ जनरेटर AI सहचर, संभाषणात्मक शोध आणि प्रॉम्प्ट-आधारित कोडिंग साधनांसह AI च्या आसपास तयार झालेल्या ग्राहक सॉफ्टवेअर श्रेणींच्या नवीन पिढीचा भाग आहेत. ट्वेल्व्ह लॅबचा दृष्टीकोन त्या ट्रेंडच्या पुरवठ्याच्या बाजूस लक्ष्य करतो, अंतर्निहित मॉडेल तयार करतो जे एजंट्स आणि त्याच्या वर तयार केल्या जाणाऱ्या ऍप्लिकेशन्ससाठी व्हिडिओ प्रथम-श्रेणीचा डेटा प्रकार बनवू शकतात.
गुंतवणूकदार व्हिडिओ AI ला का पाठीशी घालत आहेत
राउंडमधील बॅकर्सचे रोस्टर धोरणात्मक स्वारस्य व्हिडिओ AI आदेशांकडे निर्देश करते. कंपनीचा AWS क्लाउड विभाग हा AI पायाभूत सुविधांचा एक प्रमुख प्रदाता आणि व्हिडिओ आणि मीडिया सेवांमध्ये स्वतःची गुंतवणूक असल्यामुळे Amazon चा सहभाग लक्षणीय आहे. दक्षिण कोरियाच्या इंटरनेट दिग्गज कंपनीची गुंतवणूक शाखा NAVER Ventures आणि Radical Ventures, AI वर लक्ष केंद्रित करणारी फर्म, या श्रेणीमध्ये जागतिक स्वारस्य दर्शवते.
ही फेरी 2026 च्या मध्यापर्यंत एआय फंडिंगमधील एक व्यापक नमुना देखील प्रतिबिंबित करते, जिथे गुंतवणूकदार मजकूराच्या पलीकडे डेटा पद्धतींचा पाठपुरावा करणाऱ्या स्टार्टअप्सकडे भांडवल निर्देशित करतात. मजकूर-आधारित मॉडेल्सने लक्ष आणि गुंतवणुकीचा सिंहाचा वाटा आत्मसात केला आहे, तर व्हिडिओ आणि इतर प्रकारचे समृद्ध, वास्तविक-जगातील डेटा हे पुढील क्षेत्र म्हणून पाहिले जाते जेथे अर्थपूर्ण प्रगती आणि परतावा मिळू शकतो.
निधी काय सक्षम करते
बारा लॅबने विशिष्ट खर्च योजनांचा तपशील दिला नाही, परंतु वाढीचे प्रमाण, एका फेरीत $100 दशलक्ष, गणना, प्रतिभा आणि मॉडेल विकासामध्ये महत्त्वपूर्ण गुंतवणूक सुचवते. व्हिडिओ-समजून घेणाऱ्या मॉडेल्सचे प्रशिक्षण हे प्रशिक्षण मजकूर मॉडेलपेक्षा संगणकीयदृष्ट्या अधिक मागणी आहे, व्हिडिओ फायलींचा आकार पाहता, ज्यामुळे प्रगतीची किंमत वाढते.
लीसाठी, पैज अशी आहे की मोबदला त्या किंमतीला न्याय देतो. त्याने म्हटल्याप्रमाणे, "वास्तविकतेचा सर्वात श्रीमंत रेकॉर्ड अजूनही आधुनिक एआय सिस्टम वापरत असलेल्या सिमेंटिक लेयरच्या बाहेर आहे." ट्वेल्व्ह लॅब्सचे नवीन फंडिंग हे एक पैज आहे की त्या लेयरमध्ये व्हिडिओ आणणे हे आगामी वर्षांच्या परिभाषित AI प्रगतींपैकी एक असेल.
स्रोत: PYMNTS, Bloomberg News, Twelve Labs कंपनी ब्लॉग.
---
एआयच्या पुढे राहानवीनतम AI बातम्या, विश्लेषण आणि यश मिळवा — सर्व एकाच ठिकाणी.
अधिक AI बातम्या वाचा →

