Η Cerebras Systems και το OpenAI μοιράστηκαν μια πρώιμη ματιά στη λειτουργία Ultrafast, μια νέα βαθμίδα υπηρεσιών που λανσάρεται για πρώτη φορά στο OpenAI API και τροφοδοτείται από την τεχνολογία κλίμακας wafer της Cerebras. Η συνεργασία επιτρέπει στο GPT-5.6 Sol να τρέχει με έως και 750 μάρκες εξόδου ανά δευτερόλεπτο, παρέχοντας νοημοσύνη σε επίπεδο συνόρων σε ταχύτητες σε πραγματικό χρόνο. Για τις τελευταίες ειδήσεις υλικού AI, επισκεφτείτε το AI Buzz Wire.

Εξάλειψη της ανταλλαγής Speed-Intelligence

Οι κατασκευαστές τεχνητής νοημοσύνης έχουν εδώ και καιρό αντιμετωπίσει μια θεμελιώδη αντιστάθμιση: καθώς τα μοντέλα αυξάνονται σε μέγεθος και ευφυΐα, επιβαρύνονται με υψηλότερο κόστος υπολογισμού και μετακίνησης δεδομένων, επιβραδύνοντας τους χρόνους απόκρισης. Οι προγραμματιστές αναγκάστηκαν να επιλέξουν μεταξύ αναμονής για αποτελέσματα υψηλής ποιότητας ή αποδοχής κατώτερων αποτελεσμάτων σε λιγότερο χρόνο.

Το GPT-5.6 Sol σε λειτουργία Ultrafast έχει σχεδιαστεί για να επιλύσει αυτό το δίλημμα. Σύμφωνα με την Cerebras, η υπηρεσία εκτελείται 11 φορές πιο γρήγορα από το Anthropic's Claude Fable 5 και 5 φορές πιο γρήγορα από το Opus 4.8 στη λειτουργία Fast, με βάση τις ταχύτητες εξόδου που αναφέρονται από την Artificial Analysis.

Η Τελευταία Εξέταση της Ανθρωπότητας: Το τεστ ταχύτητας

Η Cerebras δοκίμασε το Ultrafast έναντι ανταγωνιστικών μοντέλων στο Humanity's Last Exam (HLE), ένα προκλητικό σημείο αναφοράς που αποτελείται από 2.500 ερωτήσεις που συνήθως απαντώνται μόνο από όσους κατέχουν διδακτορικό σε τομείς όπως η χημεία, τα οικονομικά και η λογοτεχνία.

Σε αξιολογήσεις που διεξήγαγε η Cerebras, το GPT-5.6 Sol σε λειτουργία Ultrafast απάντησε και στις 2.500 ερωτήσεις HLE σε 11 ώρες και 11 λεπτά. Ο Claude Fable 5 χρειάστηκε 78 ώρες και 27 λεπτά, περισσότερες από τρεις ημέρες συνεχούς υπολογισμού, για να καταλήξει στα ίδια συμπεράσματα. Με άλλα λόγια, η Ultrafast επεξεργάστηκε τα όρια της ανθρώπινης γνώσης σε μία μόνο εργάσιμη ημέρα, επιτυγχάνοντας συγκρίσιμη ακρίβεια σχεδόν επτά φορές πιο γρήγορα.

Η συγκριτική αξιολόγηση πραγματοποιήθηκε από την Cerebras χρησιμοποιώντας το GPT-5.6 Sol Ultrafast με Codex στις ρυθμίσεις υψηλού συλλογισμού στις 10 Ιουλίου και το Claude Fable 5 με τον Claude Code σε ρυθμίσεις υψηλής αιτιολογίας από τις 13 έως τις 15 Ιουλίου.

Επιχειρηματικός αντίκτυπος στον πραγματικό κόσμο

Στο GDP-Val, ένα σημείο αναφοράς για οικονομικά πολύτιμες εργασίες εργασίας γνώσης, το Ultrafast παρείχε επιτάχυνση 5,6x από άκρο σε άκρο χωρίς υποβάθμιση της ποιότητας. Αυτό δείχνει πόσο ταχύτερη εξαγωγή συμπερασμάτων μπορεί να επιταχύνει οικονομικά πολύτιμη εργασία χωρίς να θυσιάζεται η ποιότητα παραγωγής.

Η Cerebras οραματίζεται το Ultrafast ως εργαλείο για σενάρια όπου κάθε δευτερόλεπτο έχει σημασία. Οι εταιρείες που διαχειρίζονται υπηρεσίες ιστού θα μπορούσαν να χρησιμοποιήσουν την τεχνολογία για να προκαλέσουν τη βασική αιτία και να αντιμετωπίσουν ταχύτερα τις διακοπές παραγωγής, διατηρώντας την εμπιστοσύνη των πελατών και αποτρέποντας τα χαμένα έσοδα. Σε καταστάσεις υψηλού κινδύνου στον κυβερνοχώρο, οι ομάδες ασφαλείας θα μπορούσαν να αξιοποιήσουν το Ultrafast για να ανιχνεύει και να ανταποκρίνεται γρήγορα σε επιθέσεις.

Η τεχνολογία πίσω από την ταχύτητα

Το πλεονέκτημα απόδοσης πηγάζει από την αρχιτεκτονική Wafer-Scale Engine της Cerebras, η οποία έχει σχεδιαστεί ειδικά για φόρτους εργασίας τεχνητής νοημοσύνης. Η βασική πρόκληση της γρήγορης εξαγωγής συνόρων είναι ένα πρόβλημα μετακίνησης δεδομένων: στις παραδοσιακές GPU, το συμπέρασμα σε μεγάλα μοντέλα περιορίζεται από το εύρος ζώνης της μνήμης, καθώς τα βάρη των μοντέλων πρέπει να μεταφέρονται επανειλημμένα μεταξύ της μνήμης στο chip και της αποθήκευσης εκτός τσιπ για να δημιουργηθούν διαδοχικά διακριτικά.

Το Cerebras ακολουθεί μια θεμελιωδώς διαφορετική προσέγγιση. Κάθε τσιπ μεγέθους γκοφρέτας συσκευάζει 44 GB SRAM απευθείας στο πυρίτιο. Τα βάρη μοντέλων παραμένουν στο τσιπ και τα κουπόνια ρέουν αδιάκοπα μέσα από τα στρώματα μοντέλων που διασχίζουν τα πλακίδια. Αυτό εξαλείφει την αναποτελεσματική κίνηση δεδομένων που επιβραδύνει τα συμπεράσματα βάσει GPU και κλιμακώνεται ομαλά με το μέγεθος του μοντέλου, ανοίγοντας το δρόμο για ένα συνεχές πλεονέκτημα ταχύτητας σε μελλοντικά μοντέλα συνόρων.

Διαθεσιμότητα και θέση στην αγορά

Το GPT-5.6 Sol σε λειτουργία Ultrafast είναι προς το παρόν διαθέσιμο σε περιορισμένη προεπισκόπηση σε μια επιλεγμένη ομάδα πελατών, με την πρόσβαση να επεκτείνεται με την πάροδο του χρόνου καθώς αυξάνεται η χωρητικότητα. Η Cerebras περιγράφει τη συνεργασία ως τροφοδοσία του επόμενου κύματος καινοτομίας τεχνητής νοημοσύνης και αύξησης του ανώτατου ορίου για το τι μπορούν να επιτύχουν οι οργανισμοί με την ανταποκρινόμενη τεχνητή νοημοσύνη.

Η συνεργασία αντιπροσωπεύει ένα σημαντικό ορόσημο για την Cerebras, η οποία επιδιώκει εδώ και καιρό τον υπολογισμό σε κλίμακα wafer ως εναλλακτική λύση στην αγορά υλικού τεχνητής νοημοσύνης που κυριαρχείται από GPU. Συνεργαζόμενος απευθείας με το OpenAI για την επιτάχυνση ενός από τα πιο ικανά μοντέλα συνόρων, η Cerebras υποστηρίζει σθεναρά ότι η αρχιτεκτονική της προσφέρει ένα πραγματικό ανταγωνιστικό πλεονέκτημα για φόρτους εργασίας εξαγωγής συμπερασμάτων υψηλής ταχύτητας.

Καθώς τα μοντέλα συνεχίζουν να μεγαλώνουν και να γίνονται πιο έξυπνα, η δυνατότητα εξυπηρέτησής τους με ταχύτητες σε πραγματικό χρόνο θα μπορούσε να γίνει καθοριστικός ανταγωνιστικός παράγοντας στην αγορά υποδομής τεχνητής νοημοσύνης. Η συνεργασία Cerebras-OpenAI σηματοδοτεί ότι ο αγώνας για την ταχύτητα συμπερασμάτων είναι πλέον εξίσου σημαντικός με τον αγώνα για την ευφυΐα μοντέλων.

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Για περισσότερες ειδήσεις υλικού AI, ανάλυση απόδοσης μοντέλων και εξελίξεις στον κλάδο, προσθέστε σελιδοδείκτη AI Buzz Wire.

Διαβάστε περισσότερα νέα AI →