Twelve Labs, একটি স্টার্টআপ বিল্ডিং কৃত্রিম বুদ্ধিমত্তা যা ভিডিও বুঝতে পারে যেভাবে ভাষা মডেলগুলি পাঠ্য বোঝে, একটি সিরিজ B তহবিল রাউন্ডে $100 মিলিয়ন সংগ্রহ করেছে কারণ এটি বাজি ধরেছে যে AI এর পরবর্তী সীমানা শব্দের পরিবর্তে গতিশীল।
কোম্পানিটি 1 জুলাই, 2026-এ তার ব্লগে তহবিল ঘোষণা করেছিল। রাউন্ডটি NEA এবং NAVER ভেঞ্চারস দ্বারা পরিচালিত হয়েছিল, যার সাথে অ্যামাজন থেকে র্যাডিক্যাল ভেঞ্চারস, কোরিয়া ইনভেস্টমেন্ট পার্টনারস, ইনডেক্স ভেঞ্চারস, কোয়াড্রিল ক্যাপিটাল এবং রেড বুল ভেঞ্চারস অংশগ্রহণ করেছিল। বৃহত্তর AI শিল্প কভারেজ ট্র্যাকিংয়ের জন্য যেখানে ভেঞ্চার ক্যাপিটাল প্রবাহিত হচ্ছে, চুক্তিটি বিনিয়োগকারীদের মধ্যে একটি ক্রমবর্ধমান প্রত্যয়কে তুলে ধরে যে ভিডিওটি হল পরবর্তী প্রধান ডেটা টাইপ AI-কে অবশ্যই আয়ত্ত করতে হবে।
'পৃথিবী পাঠে ঘটে না'
সহ-প্রতিষ্ঠাতা এবং প্রধান নির্বাহী জে লি কোম্পানির মিশনকে কঠোর পরিভাষায় তৈরি করেছেন। "পাঁচ বছর আগে, আমরা একটি সাধারণ পর্যবেক্ষণ দিয়ে শুরু করেছিলাম: পৃথিবী পাঠ্যে ঘটে না। এটি গতিতে ঘটে," তিনি ঘোষণায় লিখেছেন।
ব্লুমবার্গ নিউজের সাথে একটি সাক্ষাত্কারে, লি ধারণাটি প্রসারিত করেছিলেন, যুক্তি দিয়েছিলেন যে ভিডিওটি "বিশ্ব সম্পর্কে জানার জন্য মানুষ হিসাবে আমরা প্রাপ্ত সবচেয়ে অনুরূপ সংকেত ডেটা।" তিনি এই মুহূর্তের প্রভাবশালী AI স্থাপত্যের সাথে এর বিপরীতে উল্লেখ করেছেন যে "এটি এমনকি সর্বশেষ ফ্রন্টিয়ার মডেল যেমন Fable 5 এবং Mythos থেকে ভিন্ন, যা এখনও ভাষার মডেল।"
যুক্তিটি AI বর্তমানে কীভাবে কাজ করে তার একটি ফাঁকের উপর নির্ভর করে। AI বিকাশের শেষ দশকে, লি লিখেছিলেন, "টেক্সট প্রোগ্রামযোগ্য করে তুলেছে," কিন্তু ভিডিও এখনও একই আচরণ পায়নি। তিনি বিশ্বের ভিডিওটিকে "মেশিনের জন্য বেশিরভাগ অন্ধকার পদার্থ," আর্কাইভে বসে, ড্রোনগুলিতে এবং স্যাটেলাইট ফিডে, এখনও "ফাইল নাম, ফোল্ডার, ক্যাপশন, প্রতিলিপি এবং মানুষের মেমরির মাধ্যমে" ব্যাপকভাবে অ্যাক্সেস করা হয়েছে বলে বর্ণনা করেছেন৷
এজেন্টদের দ্বারা ভিডিও ব্যবহারযোগ্য করা
দ্বাদশ ল্যাবসের বিবৃত লক্ষ্য হল সেই ফাঁকটি বন্ধ করা। "আমাদের লক্ষ্য হল ভিডিওর প্রতিটি সেকেন্ডকে এজেন্টদের দ্বারা অ্যাড্রেসযোগ্য, অনুসন্ধানযোগ্য এবং ব্যবহারযোগ্য করা," লি লিখেছেন, এআই এজেন্টের উত্থানের দিকে ইঙ্গিত করে, স্বায়ত্তশাসিত সিস্টেম যা যুক্তি দিতে পারে এবং পদক্ষেপ নিতে পারে, চাহিদার মূল চালক হিসাবে।
যদি ভাষার মডেলগুলি নথিগুলিকে অনুসন্ধানযোগ্য করে তোলে এবং কোড জেনারেটরগুলি সফ্টওয়্যার তৈরির জন্য দ্রুততর করে তোলে, তাহলে একটি ভিডিও-বোঝার মডেল রেকর্ড করা ভিডিওর বিশাল এবং ব্যাপকভাবে অপ্রয়োজনীয় সংরক্ষণাগারকে স্বয়ংক্রিয় সিস্টেমে অ্যাক্সেসযোগ্য করে তুলতে পারে। এটি মিডিয়া, নিরাপত্তা, স্বায়ত্তশাসিত যানবাহন এবং এন্টারপ্রাইজ জুড়ে অ্যাপ্লিকেশন রয়েছে, যে কোনও ক্ষেত্রে যেখানে সিদ্ধান্তগুলি ভিডিও স্ট্রিমের ভিতরে কী ঘটছে তা বোঝার উপর নির্ভর করে।
একটি ভিড় কিন্তু স্বতন্ত্র বিভাগ
Twelve Labs একটি কুলুঙ্গি দখল করে যা AI এর সবচেয়ে দৃশ্যমান দুটি বিভাগের মধ্যে বসে। একদিকে ভিডিও জেনারেটর, টুল যা টেক্সট প্রম্পট থেকে নতুন ভিডিও তৈরি করে। অন্য দিকে বড় ভাষার মডেল রয়েছে যা পাঠ্য প্রক্রিয়া করে। Twelve Labs এর পরিবর্তে ভিডিও বোঝার উপর দৃষ্টি নিবদ্ধ করা হয়েছে, বিদ্যমান ভিডিওকে ব্যাখ্যা করা যাতে মেশিনগুলি এটি অনুসন্ধান করতে, এটিকে সংক্ষিপ্ত করতে এবং এটিতে কাজ করতে পারে।
PYMNTS উল্লেখ করেছে যে ভিডিও জেনারেটরগুলি AI সঙ্গী, কথোপকথন অনুসন্ধান এবং প্রম্পট-ভিত্তিক কোডিং সরঞ্জামগুলির পাশাপাশি AI এর চারপাশে তৈরি হওয়া গ্রাহক সফ্টওয়্যার বিভাগের একটি নতুন প্রজন্মের অংশ। টুয়েলভ ল্যাবসের পদ্ধতিটি সেই প্রবণতার সরবরাহের দিকটিকে লক্ষ্য করে, অন্তর্নিহিত মডেলগুলি তৈরি করে যা ভিডিওটিকে এজেন্টদের জন্য প্রথম-শ্রেণীর ডেটা টাইপ এবং এর উপরে তৈরি করা অ্যাপ্লিকেশনগুলির জন্য তৈরি করতে পারে।
কেন বিনিয়োগকারীরা ভিডিও এআইকে সমর্থন করছে
রাউন্ডে সমর্থকদের তালিকা কৌশলগত আগ্রহের ভিডিও AI কমান্ডের দিকে নির্দেশ করে। কোম্পানির AWS ক্লাউড ডিভিশন AI পরিকাঠামোর একটি প্রধান প্রদানকারী এবং ভিডিও এবং মিডিয়া পরিষেবাগুলিতে নিজস্ব বিনিয়োগের কারণে Amazon-এর অংশগ্রহণ উল্লেখযোগ্য। দক্ষিণ কোরিয়ার ইন্টারনেট জায়ান্ট NAVER Ventures, এবং AI-এর উপর দৃষ্টি নিবদ্ধ একটি ফার্ম Radical Ventures, এই বিভাগে বিশ্বব্যাপী আগ্রহের ইঙ্গিত দেয়।
রাউন্ডটি 2026-এর মাঝামাঝি সময়ে AI তহবিলের একটি বিস্তৃত প্যাটার্নও প্রতিফলিত করে, যেখানে বিনিয়োগকারীরা পাঠ্যের বাইরে ডেটা পদ্ধতি অনুসরণ করে স্টার্টআপগুলির দিকে মূলধন নির্দেশ করছে। যদিও টেক্সট-ভিত্তিক মডেলগুলি মনোযোগ এবং বিনিয়োগের সিংহভাগকে শুষে নিয়েছে, ভিডিও এবং অন্যান্য ধরণের সমৃদ্ধ, বাস্তব-বিশ্বের ডেটা পরবর্তী ক্ষেত্র হিসাবে দেখা হয় যেখানে অর্থপূর্ণ সাফল্য এবং রিটার্ন পাওয়া যেতে পারে।
তহবিল কি সক্ষম করে
Twelve Labs নির্দিষ্ট ব্যয়ের পরিকল্পনার বিশদ বিবরণ দেয়নি, কিন্তু বৃদ্ধির স্কেল, এক রাউন্ডে $100 মিলিয়ন, গণনা, প্রতিভা এবং মডেল বিকাশে উল্লেখযোগ্য বিনিয়োগের পরামর্শ দেয়। ভিডিও-বোঝার মডেলগুলিকে প্রশিক্ষণ দেওয়া টেক্সট মডেলের চেয়ে অনেক বেশি গণনামূলকভাবে চাহিদাপূর্ণ, ভিডিও ফাইলের নিছক আকারের কারণে, যা অগ্রগতির খরচ বাড়ায়।
লির জন্য, বাজি হল যে বেতন সেই খরচটিকে ন্যায্যতা দেয়৷ তিনি যেমনটি লিখেছেন, "বাস্তবতার সবচেয়ে ধনী রেকর্ডটি এখনও আধুনিক এআই সিস্টেম ব্যবহার করে এমন শব্দার্থিক স্তরের বাইরে রয়েছে।" টুয়েলভ ল্যাবসের নতুন অর্থায়ন হল একটি বাজি যে সেই স্তরের ভিতরে ভিডিও আনা আগামী বছরগুলির সংজ্ঞায়িত AI অগ্রগতির একটি হবে৷
সূত্র: PYMNTS, Bloomberg News, Twelve Labs কোম্পানির ব্লগ।
---
এআই থেকে এগিয়ে থাকুনসর্বশেষ AI খবর, বিশ্লেষণ এবং সাফল্য পান — সব এক জায়গায়।
আরও এআই খবর পড়ুন →

