Ένα νέο είδος μοντέλου τεχνητής νοημοσύνης έκανε το ντεμπούτο του αυτή την εβδομάδα και κάνει κάτι ασυνήθιστο για ένα μοντέλο που βασίζεται στην αρχιτεκτονική μετασχηματιστή: δεν παράγει ποτέ ούτε μια λέξη κειμένου. Το Jev, που κυκλοφόρησε από τη διετή startup TypeSafe AI, παράγει βαθμονομημένες πιθανότητες - αυτό που η εταιρεία αποκαλεί πληκτρολογημένες, βαθμονομημένες αποφάσεις - τοποθετώντας τον εαυτό της ως μια φθηνή, γρήγορη εναλλακτική σε μεγάλα γλωσσικά μοντέλα για εργασίες ταξινόμησης, δρομολόγησης και αυτοματισμού, σύμφωνα με το TechCrunch.

Η εταιρεία ιδρύθηκε από τον Diogo Almeida, έναν ερευνητή OpenAI που βοήθησε στη δημιουργία του ChatGPT και συνέβαλε στην εφεύρεση της ενισχυτικής μάθησης από την ανθρώπινη ανάδραση (RLHF), την τεχνική εκπαίδευσης που πιστώνεται ευρέως στη διαμόρφωση της τρέχουσας γενιάς βοηθών AI. Η ζήτηση για το νέο μοντέλο ήταν αρκετά έντονη που το TypeSafe έχασε για λίγο τη δυνατότητα να εξυπηρετεί ορισμένους χρήστες API μετά την κυκλοφορία. For more context on this story, see our ongoing AI trends.

Γιατί μια γλώσσα ChatGPT Pioneer εγκαταλείφθηκε

Η διαδρομή της Almeida προς ένα μοντέλο χωρίς κείμενο ξεκίνησε με απογοήτευση στο OpenAI. "Έχουμε κεραυνό σε ένα μπουκάλι, και όμως δεν είναι χρήσιμο", είπε ο Almeida στο TechCrunch, περιγράφοντας την απογοήτευσή του που παρά τις δυνατότητες του ChatGPT, η τεχνολογία υστερούσε σε πραγματικό αυτοματισμό. "Έχω παλέψει με αυτό το πρόβλημα από τότε. Μου πήρε λίγο χρόνο για να καταλήξω: Το πρόβλημα είναι ότι βελτιστοποιούμε την ανθρώπινη γλώσσα... Ήμασταν εξαιρετικά καλοί στην ανθρώπινη γλώσσα για τέσσερα χρόνια, αλλά δεν είναι χρήσιμο για την αυτοματοποίηση, επειδή οι υπολογιστές μιλούν διαφορετική γλώσσα."

Πριν από δύο χρόνια, η Almeida άφησε το OpenAI για να ιδρύσει το TypeSafe AI και να συνεχίσει αυτή τη διατριβή. Το αποτέλεσμα είναι το Jev, ένα μοντέλο που βασίζεται σε μετασχηματιστές, το οποίο η εταιρεία επιμένει ότι δεν είναι ένα μεγάλο γλωσσικό μοντέλο. Όταν ένα LLM δημιουργεί κείμενο ανοιχτού τύπου, ο Jev επιστρέφει πιθανότητες σε ένα σύνολο εξόδων που ο χρήστης ορίζει εκ των προτέρων — ένα σχέδιο που η εταιρεία λέει ότι καθιστά δομικά αδύνατη την ψευδαίσθηση, καθώς το μοντέλο μπορεί να απαντήσει μόνο με τις επιλογές που του δόθηκε.

Τα κέρδη απόδοσης αποτελούν βασικό μέρος του αγωνιστικού χώρου. Τα διακριτικά εξόδου από το Jev είναι δωρεάν και τα διακριτικά εισόδου μετρώνται με το δισεκατομμύριο αντί για το εκατομμύριο, σύμφωνα με το TechCrunch. Η εταιρεία περιγράφει το Jev ως ένα "System One μοντέλο", που επικεντρώνεται στη διαίσθηση και όχι στη λογική, και λέει ότι εκπαιδεύτηκε αποκλειστικά σε συνθετικά δεδομένα χρησιμοποιώντας μια τεχνική που ο Almeida ονομάζει ενίσχυση μάθησης από βαθμονομημένες αποφάσεις.

Το TypeSafe έχει κρατήσει κρυφή την αρχιτεκτονική του Jev, αν και εξωτερικοί παρατηρητές υποψιάζονται ότι το σύστημα είναι χτισμένο πάνω από ένα ανοιχτού βάρους LLM. "Το ήμισυ [της εταιρείας μας] είναι ένα εργαστήριο που κατέχει βασικά ολόκληρο το υποπεδίο των στατιστικά καλά κατανοητών συνθετικών δεδομένων και αυτή είναι τώρα η χαρά της ζωής μου", είπε η Almeida στο TechCrunch.

Πρώιμα Αποτελέσματα Προγραμματιστή: Πιο γρήγορα και φθηνότερα

Οι πρώτοι χρήστες ανέφεραν αξιοσημείωτα κέρδη στις δοκιμές. Ο Pranit Sharma, μηχανικός λογισμικού στη Vercel, είπε στο TechCrunch ότι η εταιρεία του χρησιμοποιούσε το ChatGPT Luna 5.6 του OpenAI για να εκτελέσει έναν ταξινομητή που εξετάζει εντολές για ασφάλεια. Αφού άλλαξε αυτόν τον φόρτο εργασίας στο Jev, ο Vercel είδε αποτελέσματα πέντε έως 18 φορές πιο γρήγορα και με μεγαλύτερη ακρίβεια.

Ο Nikhil Mudholkar, CTO της Bryo AI, έκανε μια διαφορετική σύγκριση: ταξινομώντας τα επαγγελματικά email με τον Jev έναντι του Gemini της Google. Στη δοκιμή του, ο Gemini ήταν ελαφρώς πιο ακριβής, αλλά 10 έως 20 φορές πιο ακριβός. Για τον Mudholkar, η πολυτιμότερη περιουσία του Jev ήταν ο χειρισμός της αβεβαιότητας. «Είναι το μόνο που δίνει πίσω μια πραγματική πιθανότητα που το καθιστά ιδανικό για την αυτοματοποίηση των ροών εργασίας», είπε στο TechCrunch.

Agents Watching Agents, Without the Bill

Πέρα από την αντικατάσταση των LLM σε εργασίες ταξινόμησης, ο TypeSafe υποστηρίζει ότι ο Jev μπορεί να τα αστυνομεύσει. Η χρήση πρακτόρων AI για την παρακολούθηση άλλων πρακτόρων γίνεται γρήγορα ακριβή, αλλά η Almeida υποστηρίζει ότι η ταχύτητα και το προφίλ κόστους του Jev καθιστούν πρακτική την παρακολούθηση των ιχνών πρακτόρων LLM και την αποτροπή jailbreak σε πραγματικό χρόνο.

Ο Armin Ronacher, CTO της Earendil και κατασκευαστής του μοντέλου ανοιχτού κώδικα, Pi, είπε στο TechCrunch ότι η προσέγγιση μεταθέτει την ευθύνη για την αβεβαιότητα στον προγραμματιστή. «Μεταβιβάζει λίγο το πρόβλημα των παραισθήσεων στον χρήστη», είπε ο Ronacher. "Ο χρήστης πρέπει να πει, εντάξει, αν αυτό επανέλθει μόνο με 50% πιθανότητα, ίσως πρόκειται για πέταγμα νομίσματος, και το αγνοώ. Αλλά αν είναι 95%, σίγουρα, τότε μπορώ να κάνω κάτι με αυτό."

Η Ronacher επισήμανε επίσης τη δρομολόγηση μοντέλων ως μια πολλά υποσχόμενη περίπτωση χρήσης: πρόβλεψη εάν ένας δεδομένος φόρτος εργασίας απαιτεί ένα συγκεκριμένο, πιο ακριβό μοντέλο. Η εκτέλεση αυτής της ταξινόμησης με ένα LLM θα ήταν δαπανηρή, αλλά η χαμηλή καθυστέρηση και η τιμή του Jev θα μπορούσαν να καταστήσουν βιώσιμη τη δρομολόγηση σε πραγματικό χρόνο.

Ένα όνομα δανεισμένο από τα οικονομικά

Το μοντέλο πήρε το όνομά του από τον William Stanley Jevons, τον οικονομολόγο του 19ου αιώνα πίσω από το παράδοξο Jevons - την παρατήρηση ότι καθώς ένα εμπόρευμα γίνεται φθηνότερο, η κατανάλωση του τείνει να αυξάνεται. Το στοίχημα της Almeida είναι ότι το μειωμένο κόστος της ευφυΐας βαθμού απόφασης θα οδηγήσει στην ανάπτυξή της παντού, όχι μόνο στα εμβληματικά chatbots.

«Πιστεύουμε ότι θα υπάρχει παντού έξυπνο λογισμικό παντού με τρόπο που να αναδύεται και να διανέμεται... πολύ περισσότερο σαν το πρώιμο Διαδίκτυο από ό,τι ξέρετε, όπως οι mega εφαρμογές που οι άνθρωποι προσπαθούν να δημιουργήσουν αυτή τη στιγμή», είπε ο Almeida στο TechCrunch.

Το αν ακολουθούν οι ανταγωνιστές παραμένει ένα ανοιχτό ερώτημα. «Θα έπρεπε να το είχαμε δει νωρίτερα με πολλούς τρόπους, αλλά πιθανώς επειδή τα LLM είναι τόσο φθηνά και επιδοτούμενα, συχνά δεν χρειάζεται να είστε δημιουργικοί ακόμα», είπε ο Ronacher στο TechCrunch. Το TypeSafe σχεδιάζει πρόσθετες εκδόσεις του Jev σε νέους τρόπους.

Όσο για το αν το TypeSafe μετράει ως συνοριακό εργαστήριο, η Almeida έδωσε μια οξυδερκή απάντηση: "Το κύριο προϊόν των συνοριακών εργαστηρίων είναι ο φόβος ή η διαφημιστική εκστρατεία. Θα ήθελα το κύριο προϊόν μας να είναι η ευφυΐα... [αλλά δεν είμαστε] ένα εργαστήριο με την έννοια, ξέρετε, όπως το στοίχημα σε άπειρο πλούτο ή μια θρησκεία, ή η κατασκευή του Θεού σε ένα κέντρο δεδομένων ή ό,τι άλλο είναι σήμερα."

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →