Η Twelve Labs, μια startup που κατασκευάζει τεχνητή νοημοσύνη που μπορεί να κατανοήσει το βίντεο με τον τρόπο που τα γλωσσικά μοντέλα κατανοούν το κείμενο, συγκέντρωσε 100 εκατομμύρια δολάρια σε έναν γύρο χρηματοδότησης της Series B καθώς στοιχηματίζει ότι το επόμενο όριο της τεχνητής νοημοσύνης βρίσκεται στην κίνηση και όχι στις λέξεις.
Η εταιρεία ανακοίνωσε τη χρηματοδότηση στο blog της την 1η Ιουλίου 2026. Ο γύρος διεξήχθη από τη NEA και τη NAVER Ventures, με συμμετοχή από την Amazon μαζί με τις Radical Ventures, Korea Investment Partners, Index Ventures, Quadrille Capital και Red Bull Ventures. Για την ευρύτερη κάλυψη της βιομηχανίας AI όπου ρέουν επιχειρηματικά κεφάλαια, η συμφωνία υπογραμμίζει την αυξανόμενη πεποίθηση των επενδυτών ότι το βίντεο είναι ο επόμενος σημαντικός τύπος δεδομένων που πρέπει να κυριαρχήσει η τεχνητή νοημοσύνη.
'Ο κόσμος δεν συμβαίνει σε κείμενο'
Ο συνιδρυτής και διευθύνων σύμβουλος Jae Lee πλαισίωσε την αποστολή της εταιρείας με αυστηρούς όρους. "Πριν από πέντε χρόνια, ξεκινήσαμε με μια απλή παρατήρηση: Ο κόσμος δεν συμβαίνει σε κείμενο. Συμβαίνει σε κίνηση", έγραψε στην ανακοίνωση.
Σε μια συνέντευξη στο Bloomberg News, ο Lee επέκτεινε την ιδέα, υποστηρίζοντας ότι το βίντεο «είναι το πιο παρόμοιο σήμα που λαμβάνουμε ως άνθρωποι για να μάθουμε για τον κόσμο». Το αντίθεσε με τις κυρίαρχες αρχιτεκτονικές τεχνητής νοημοσύνης της στιγμής, σημειώνοντας ότι «αυτό είναι διαφορετικό ακόμη και από τα πιο πρόσφατα μοντέλα συνόρων όπως το Fable 5 και το Mythos, που εξακολουθούν να είναι μοντέλα γλώσσας».
Το επιχείρημα βασίζεται σε ένα κενό στον τρόπο λειτουργίας της τεχνητής νοημοσύνης επί του παρόντος. Η τελευταία δεκαετία ανάπτυξης της τεχνητής νοημοσύνης, έγραψε ο Lee, «κατέστησε το κείμενο προγραμματιζόμενο», αλλά το βίντεο δεν έχει ακόμη λάβει την ίδια αντιμετώπιση. Περιέγραψε το παγκόσμιο βίντεο ως «ως επί το πλείστον σκοτεινή ύλη για τις μηχανές», που βρίσκεται σε αρχεία, σε drones και σε δορυφορικές τροφοδοσίες, και εξακολουθεί να έχει πρόσβαση σε μεγάλο βαθμό «μέσω ονομάτων αρχείων, φακέλων, λεζάντες, μεταγραφές και ανθρώπινη μνήμη».
Χρήση βίντεο από πράκτορες
Δηλωμένος στόχος των Δώδεκα Εργαστηρίων είναι να κλείσει αυτό το χάσμα. «Στόχος μας είναι να κάνουμε κάθε δευτερόλεπτο βίντεο με δυνατότητα διευθυνσιοδότησης, αναζήτησης και χρήσης από πράκτορες», έγραψε ο Lee, επισημαίνοντας την άνοδο των πρακτόρων τεχνητής νοημοσύνης, των αυτόνομων συστημάτων που μπορούν να συλλογιστούν και να αναλάβουν δράση, ως βασική κινητήρια δύναμη της ζήτησης.
Εάν τα μοντέλα γλώσσας έκαναν τα έγγραφα αναζητήσιμα και οι γεννήτριες κώδικα έκαναν το λογισμικό πιο γρήγορο στην κατασκευή, ένα μοντέλο κατανόησης βίντεο θα μπορούσε να κάνει το τεράστιο και σε μεγάλο βαθμό αναξιοποίητο αρχείο εγγεγραμμένων βίντεο προσβάσιμο σε αυτοματοποιημένα συστήματα. Αυτό έχει εφαρμογές σε πολυμέσα, ασφάλεια, αυτόνομα οχήματα και επιχειρήσεις, σε κάθε τομέα όπου οι αποφάσεις εξαρτώνται από την κατανόηση του τι συμβαίνει μέσα σε μια ροή βίντεο.
Μια πολυσύχναστη αλλά ξεχωριστή κατηγορία
Το Twelve Labs καταλαμβάνει μια θέση που βρίσκεται ανάμεσα σε δύο από τις πιο ορατές κατηγορίες στο AI. Στη μία πλευρά υπάρχουν γεννήτριες βίντεο, εργαλεία που δημιουργούν νέο βίντεο από μηνύματα κειμένου. Από την άλλη υπάρχουν μεγάλα γλωσσικά μοντέλα που επεξεργάζονται κείμενο. Το Twelve Labs επικεντρώνεται στην κατανόηση βίντεο, στην ερμηνεία του υπάρχοντος βίντεο, έτσι ώστε οι μηχανές να μπορούν να το αναζητήσουν, να το συνοψίσουν και να ενεργήσουν βάσει αυτού.
Η PYMNTS σημείωσε ότι οι γεννήτριες βίντεο αποτελούν μέρος μιας νέας γενιάς κατηγοριών καταναλωτικού λογισμικού που σχηματίζονται γύρω από την τεχνητή νοημοσύνη, μαζί με συνοδούς τεχνητής νοημοσύνης, την αναζήτηση συνομιλίας και τα εργαλεία κωδικοποίησης που βασίζονται σε προτροπές. Η προσέγγιση της Twelve Labs στοχεύει στην πλευρά της προσφοράς αυτής της τάσης, δημιουργώντας τα υποκείμενα μοντέλα που θα μπορούσαν να κάνουν το βίντεο έναν τύπο δεδομένων πρώτης κατηγορίας για τους πράκτορες και τις εφαρμογές που δημιουργούνται πάνω από αυτό.
Γιατί οι επενδυτές υποστηρίζουν το βίντεο AI
Ο κατάλογος των υποστηρικτών στον γύρο δείχνει τις εντολές τεχνητής νοημοσύνης βίντεο στρατηγικού ενδιαφέροντος. Η συμμετοχή της Amazon είναι αξιοσημείωτη δεδομένου ότι το τμήμα cloud AWS της εταιρείας είναι σημαντικός πάροχος υποδομής τεχνητής νοημοσύνης και των δικών της επενδύσεων σε υπηρεσίες βίντεο και πολυμέσων. Η NAVER Ventures, ο επενδυτικός βραχίονας του νοτιοκορεατικού γίγαντα του Διαδικτύου, και η Radical Ventures, μια εταιρεία που εστιάζει στην τεχνητή νοημοσύνη, σηματοδοτούν παγκόσμιο ενδιαφέρον για την κατηγορία.
Ο γύρος αντικατοπτρίζει επίσης ένα ευρύτερο μοτίβο στη χρηματοδότηση της τεχνητής νοημοσύνης μέχρι τα μέσα του 2026, όπου οι επενδυτές κατευθύνουν κεφάλαια προς νεοφυείς επιχειρήσεις που επιδιώκουν τρόπους δεδομένων πέρα από το κείμενο. Ενώ τα μοντέλα που βασίζονται σε κείμενο έχουν απορροφήσει τη μερίδα του λέοντος της προσοχής και των επενδύσεων, το βίντεο και άλλες μορφές πλούσιων, πραγματικών δεδομένων θεωρούνται ως η επόμενη αρένα όπου μπορούν να βρεθούν σημαντικές ανακαλύψεις και επιστροφές.
Τι επιτρέπει η χρηματοδότηση
Η Twelve Labs δεν ανέφερε λεπτομερώς συγκεκριμένα σχέδια δαπανών, αλλά η κλίμακα της αύξησης, 100 εκατομμυρίων δολαρίων σε έναν μόνο γύρο, υποδηλώνει σημαντική επένδυση σε υπολογιστές, ταλέντο και ανάπτυξη μοντέλων. Η εκπαίδευση μοντέλων κατανόησης βίντεο είναι πολύ πιο απαιτητική υπολογιστικά από τα μοντέλα εκπαίδευσης κειμένου, δεδομένου του τεράστιου μεγέθους των αρχείων βίντεο, γεγονός που αυξάνει το κόστος της προόδου.
Για τον Lee, το στοίχημα είναι ότι η πληρωμή δικαιολογεί αυτό το κόστος. Όπως το έθεσε, «το πλουσιότερο αρχείο της πραγματικότητας εξακολουθεί να βρίσκεται σε μεγάλο βαθμό έξω από το σημασιολογικό επίπεδο που χρησιμοποιούν τα σύγχρονα συστήματα τεχνητής νοημοσύνης». Η νέα χρηματοδότηση της Twelve Labs είναι ένα στοίχημα ότι η εισαγωγή βίντεο σε αυτό το επίπεδο θα είναι μια από τις καθοριστικές προόδους της τεχνητής νοημοσύνης των επόμενων ετών.
Πηγές: PYMNTS, Bloomberg News, Twelve Labs εταιρικό ιστολόγιο.
---
Μείνετε μπροστά από την τεχνητή νοημοσύνηΛάβετε τα τελευταία νέα, αναλύσεις και ανακαλύψεις AI — όλα σε ένα μέρος.
Διαβάστε περισσότερα νέα AI →
