Twelve Labs، مصنوعی ذہانت کی تعمیر کا ایک سٹارٹ اپ جو زبان کے ماڈلز کے متن کو سمجھنے کے طریقے سے ویڈیو کو سمجھ سکتا ہے، نے سیریز B کے فنڈنگ ​​راؤنڈ میں $100 ملین اکٹھے کیے ہیں کیونکہ یہ شرط لگاتا ہے کہ AI کا اگلا محاذ الفاظ کی بجائے حرکت میں ہے۔

کمپنی نے 1 جولائی 2026 کو اپنے بلاگ پر فنڈنگ ​​کا اعلان کیا۔ اس راؤنڈ کی قیادت NEA اور NAVER وینچرز نے کی، جس میں Amazon کی جانب سے Radical Ventures، Korea Investment Partners، Index Ventures، Quadrille Capital، اور Red Bull Ventures نے شرکت کی۔ وسیع تر AI انڈسٹری کوریج ٹریکنگ کے لیے جہاں وینچر کیپٹل بہہ رہا ہے، ڈیل سرمایہ کاروں کے درمیان بڑھتے ہوئے یقین کی نشاندہی کرتی ہے کہ ویڈیو اگلی بڑی ڈیٹا قسم ہے جس میں AI کو مہارت حاصل کرنی چاہیے۔

'دنیا متن میں نہیں ہوتی'

شریک بانی اور چیف ایگزیکٹو جے لی نے کمپنی کے مشن کو سخت الفاظ میں تیار کیا۔ "پانچ سال پہلے، ہم نے ایک سادہ مشاہدے کے ساتھ آغاز کیا: دنیا متن میں نہیں ہوتی، یہ حرکت میں ہوتی ہے،" انہوں نے اعلان میں لکھا۔

بلومبرگ نیوز کے ساتھ ایک انٹرویو میں، لی نے اس خیال کو بڑھاتے ہوئے کہا کہ ویڈیو "سب سے ملتا جلتا سگنل ڈیٹا ہے جو ہمیں بطور انسان دنیا کے بارے میں جاننے کے لیے ملتا ہے۔" اس نے اس لمحے کے غالب AI فن تعمیر کے ساتھ اس کا مقابلہ کیا، یہ نوٹ کرتے ہوئے کہ "یہ جدید ترین فرنٹیئر ماڈلز جیسے کہ Fable 5 اور Mythos سے مختلف ہے، جو اب بھی زبان کے ماڈل ہیں۔"

دلیل اس خلا پر منحصر ہے کہ فی الحال AI کیسے کام کرتا ہے۔ AI کی ترقی کی آخری دہائی، لی نے لکھا، "ٹیکسٹ کو قابل پروگرام بنایا،" لیکن ویڈیو کو ابھی تک وہی سلوک نہیں ملا ہے۔ اس نے دنیا کی ویڈیو کو "مشینوں کے لیے زیادہ تر تاریک مادے" کے طور پر بیان کیا، آرکائیوز میں بیٹھے ہوئے، ڈرونز پر، اور سیٹلائٹ فیڈز میں، اب بھی بڑے پیمانے پر "فائل ناموں، فولڈرز، کیپشنز، ٹرانسکرپٹس، اور انسانی میموری کے ذریعے" تک رسائی حاصل کی جاتی ہے۔

ایجنٹوں کے ذریعہ ویڈیو کو قابل استعمال بنانا

بارہ لیبز کا بیان کردہ مقصد اس خلا کو ختم کرنا ہے۔ "ہمارا مقصد ویڈیو کے ہر سیکنڈ کو ایجنٹوں کے ذریعہ قابل شناخت، تلاش کے قابل اور قابل استعمال بنانا ہے،" لی نے لکھا، AI ایجنٹوں کے عروج کی طرف اشارہ کرتے ہوئے، خود مختار نظام جو استدلال کرسکتے ہیں اور کارروائی کرسکتے ہیں، مطالبہ کے کلیدی ڈرائیور کے طور پر۔

اگر لینگویج ماڈلز نے دستاویزات کو تلاش کے قابل بنایا اور کوڈ جنریٹر نے سافٹ ویئر بنانے میں تیز تر بنایا، تو ویڈیو کو سمجھنے والا ماڈل ریکارڈ شدہ ویڈیو کے بہت زیادہ اور بڑے پیمانے پر غیر استعمال شدہ آرکائیو کو خودکار نظاموں تک قابل رسائی بنا سکتا ہے۔ اس میں میڈیا، سیکیورٹی، خود مختار گاڑیاں، اور انٹرپرائز میں ایپلی کیشنز ہیں، کوئی بھی فیلڈ جہاں فیصلے ویڈیو اسٹریم کے اندر کیا ہو رہا ہے اس کو سمجھنے پر منحصر ہوتے ہیں۔

ایک ہجوم لیکن الگ زمرہ

بارہ لیبز ایک جگہ پر قابض ہیں جو AI میں سب سے زیادہ نظر آنے والے دو زمروں کے درمیان بیٹھی ہے۔ ایک طرف ویڈیو جنریٹر، ٹولز ہیں جو ٹیکسٹ پرامپٹس سے نئی ویڈیو بناتے ہیں۔ دوسری طرف بڑے زبان کے ماڈل ہیں جو متن پر کارروائی کرتے ہیں۔ بارہ لیبز کی توجہ ویڈیو کو سمجھنے، موجودہ ویڈیو کی تشریح پر مرکوز ہے تاکہ مشینیں اسے تلاش کر سکیں، اس کا خلاصہ کر سکیں اور اس پر عمل کر سکیں۔

PYMNTS نے نوٹ کیا کہ ویڈیو جنریٹر صارفین کے سافٹ ویئر کیٹیگریز کی ایک نئی نسل کا حصہ رہے ہیں جو AI کے ارد گرد تشکیل پاتے ہیں، اس کے ساتھ ساتھ AI ساتھیوں، بات چیت کی تلاش، اور فوری بنیاد پر کوڈنگ ٹولز بھی شامل ہیں۔ بارہ لیبز کا نقطہ نظر اس رجحان کے سپلائی سائیڈ کو نشانہ بناتا ہے، ان بنیادی ماڈلز کی تعمیر کرتا ہے جو ویڈیو کو ایجنٹوں اور اس کے اوپر بنائے جانے والے ایپلیکیشنز کے لیے ایک فرسٹ کلاس ڈیٹا ٹائپ بنا سکتے ہیں۔

کیوں سرمایہ کار ویڈیو AI کی حمایت کر رہے ہیں۔

راؤنڈ میں پشت پناہی کرنے والوں کا روسٹر اسٹریٹجک دلچسپی والی ویڈیو AI کمانڈز کی طرف اشارہ کرتا ہے۔ ایمیزون کی شرکت قابل ذکر ہے کیونکہ کمپنی کا AWS کلاؤڈ ڈویژن AI انفراسٹرکچر کا ایک بڑا فراہم کنندہ ہے اور ویڈیو اور میڈیا سروسز میں اس کی اپنی سرمایہ کاری ہے۔ NAVER Ventures، جنوبی کوریا کی انٹرنیٹ کمپنی کی سرمایہ کاری کی شاخ، اور AI پر توجہ مرکوز کرنے والی فرم Radical Ventures، اس زمرے میں عالمی دلچسپی کا اشارہ دیتے ہیں۔

راؤنڈ 2026 کے وسط تک AI فنڈنگ ​​میں ایک وسیع پیٹرن کی بھی عکاسی کرتا ہے، جہاں سرمایہ کار ٹیکسٹ سے ہٹ کر ڈیٹا کے طریقوں کی پیروی کرنے والے اسٹارٹ اپس کی طرف سرمایہ کی ہدایت کر رہے ہیں۔ اگرچہ ٹیکسٹ پر مبنی ماڈلز نے توجہ اور سرمایہ کاری کا بڑا حصہ جذب کر لیا ہے، ویڈیو اور امیر، حقیقی دنیا کے اعداد و شمار کی دیگر اقسام کو اگلے میدان کے طور پر دیکھا جاتا ہے جہاں بامعنی کامیابیاں اور واپسی مل سکتی ہے۔

فنڈنگ کیا قابل بناتی ہے۔

بارہ لیبز نے اخراجات کے مخصوص منصوبوں کی تفصیل نہیں دی، لیکن اضافے کا پیمانہ، ایک ہی دور میں $100 ملین، کمپیوٹ، ٹیلنٹ، اور ماڈل کی ترقی میں اہم سرمایہ کاری کی تجویز کرتا ہے۔ ویڈیو کو سمجھنے والے ماڈلز کو تربیت دینا ٹیکسٹ ماڈلز کی تربیت سے کہیں زیادہ کمپیوٹیشنل طور پر مطالبہ کرتا ہے، ویڈیو فائلوں کے سراسر سائز کو دیکھتے ہوئے، جو ترقی کی لاگت کو بڑھاتا ہے۔

لی کے لیے، شرط یہ ہے کہ ادائیگی اس لاگت کو درست ثابت کرتی ہے۔ جیسا کہ اس نے کہا، "حقیقت کا سب سے امیر ریکارڈ اب بھی بڑی حد تک سیمنٹک پرت سے باہر ہے جسے جدید AI سسٹم استعمال کرتے ہیں۔" بارہ لیبز کی نئی فنڈنگ ​​ایک شرط ہے کہ اس پرت کے اندر ویڈیو لانا آنے والے سالوں کی AI پیشرفت میں سے ایک ہوگا۔

ذرائع: PYMNTS، بلومبرگ نیوز، Twelve Labs کمپنی بلاگ۔

---

AI سے آگے رہیں

تازہ ترین AI خبریں، تجزیہ اور کامیابیاں حاصل کریں — سب ایک جگہ پر۔

مزید AI خبریں پڑھیں →