Η AMD και η Cerebras Systems αποκάλυψαν μια τεχνική συνεργασία για τη δημιουργία ενός νέου είδους υποδομής συμπερασμάτων τεχνητής νοημοσύνης, συνδυάζοντας την πλατφόρμα Helios σε κλίμακα rack της AMD με τον κινητήρα Wafer-Scale Engine (WSE) της Cerebras σε μια ενιαία, αναλυμένη ροή εργασίας. Ανακοινώθηκε στην εκδήλωση Advancing AI 2026 της AMD στις 23 Ιουλίου 2026, η συνεργασία στοχεύει άμεσα στα σημεία συμφόρησης λανθάνοντος χρόνου και απόδοσης που έχουν καταστήσει το συμπέρασμα ένα από τα πιο ακριβά προβλήματα στην εποχή της γενετικής τεχνητής νοημοσύνης. Για ό,τι πιο πρόσφατο σε αυτήν την ταχέως εξελισσόμενη γωνιά του κλάδου, ακολουθήστε την κάλυψή μας [έκτακτες ειδήσεις AI] (https://aibuzzwire.news).
Η βασική ιδέα είναι να σταματήσουμε να αναγκάζουμε ένα τσιπ να κάνει τα πάντα. Σε μια παραδοσιακή στοίβα συμπερασμάτων, μια μεμονωμένη οικογένεια GPU χειρίζεται τόσο τη βαριά εργασία προπλήρωσης της αφομοίωσης μιας προτροπής όσο και τη λεπτή, διαδοχική εργασία δημιουργίας κάθε νέου διακριτικού. Αυτός είναι ένας συμβιβασμός, γιατί οι δύο δουλειές έχουν πολύ διαφορετικές απαιτήσεις. Η AMD και η Cerebras υποστηρίζουν ότι ο διαχωρισμός της εργασίας, μια τεχνική που είναι γνωστή ως διαχωρισμένη συμπέρασμα, επιτρέπει σε κάθε κινητήρα να κάνει αυτό που είναι καλύτερο.
Πώς οι δύο κινητήρες μοιράζουν την εργασία
Σύμφωνα με την επίσημη ανακοίνωση της AMD, η AMD Helios θα χρησιμεύσει ως η μηχανή υψηλής απόδοσης, κλιμακούμενης απόδοσης, βασισμένη σε GPU της AMD Instinct για την ταχεία επεξεργασία μεγάλων παρτίδων εισόδου. Η Cerebras Wafer-Scale Engine, εν τω μεταξύ, θα χειρίζεται εξαιρετικά γρήγορη, εξαιρετικά χαμηλής καθυστέρησης αποκωδικοποίηση και δημιουργία διακριτικών. Τα τσιπ των Cerebras είναι χτισμένα σε ολόκληρες γκοφρέτες αντί να είναι κομμένα σε κύβους σε μεμονωμένες μήτρες, δίνοντάς τους τεράστιο εύρος ζώνης μνήμης στο τσιπ που είναι ιδιαίτερα κατάλληλο για ροή κουπονιών χωρίς καθυστέρηση.
Οι εταιρείες λένε ότι συνδυάζοντας τους δύο υπολογιστικούς κινητήρες, η κοινή λύση αναμένεται να προσφέρει έως και 5 φορές υψηλότερα tokens ανά δευτερόλεπτο ανά watt, μια μέτρηση που έχει γίνει κεντρική βαθμολογία για τα οικονομικά συμπεράσματα καθώς οι πάροχοι ανταγωνίζονται τόσο για την ταχύτητα όσο και για το κόστος ενέργειας. Ο αριθμός αναφέρθηκε στο δελτίο τύπου της AMD και αναφέρθηκε σε καταστήματα όπως το Tom's Hardware, το Investing.com και το Yahoo Tech.
Μια βολή στην κυριαρχία της Nvidia
Η εταιρική σχέση είναι επίσης ένα στρατηγικό μήνυμα. Το οικοσύστημα CUDA και η σειρά GPU της Nvidia κυριαρχούν επί του παρόντος στην εκπαίδευση και την εξαγωγή συμπερασμάτων τεχνητής νοημοσύνης, και οι αμφισβητίες καταλήγουν όλο και περισσότερο στο συμπέρασμα ότι είναι δύσκολο να νικήσει κανείς τον κατεστημένο κατά μέτωπο σε μια ενιαία αρχιτεκτονική. Το Business Insider πλαισίωσε τη συμφωνία καθώς η AMD έριξε μια βολή στη Nvidia ποντάροντας στο συμπέρασμα, τη φάση της υπολογιστικής τεχνητής νοημοσύνης που αναμένεται να αναπτυχθεί ταχύτερα καθώς τα μοντέλα περνούν από την ανάπτυξη στην παραγωγή.
Για την AMD, ο συνδυασμός με το Cerebras διευρύνει την ελκυστικότητα του οδικού χάρτη της Instinct και Helios πέρα από την προπόνηση. Για την Cerebras, η οποία διαπραγματεύεται στο Nasdaq υπό την τιμή CBRS μαζί με την AMD (NASDAQ: AMD), η ενσωμάτωση με έναν μεγάλο προμηθευτή επιταχυντών δίνει στην τεχνολογία της σε κλίμακα wafer μια πιο ξεκάθαρη διαδρομή προς τις μεγάλες επιχειρήσεις και τις αναπτύξεις cloud. Η Cerebras σχεδιάζει να αναπτύξει την AMD Helios στα δικά της κέντρα δεδομένων και οι εταιρείες αναμένουν ότι η κοινή λύση θα είναι διαθέσιμη πρώτα μέσω του Cerebras Cloud το δεύτερο εξάμηνο του 2026.
Γιατί η διάσπαση έχει σημασία τώρα
Το κόστος συμπερασμάτων έχει γίνει καθοριστικό σημείο πίεσης για τον κλάδο της τεχνητής νοημοσύνης. Καθώς τα μοντέλα μεγαλώνουν και οι εφαρμογές απαιτούν αποκρίσεις σε πραγματικό χρόνο, το κόστος δημιουργίας κάθε διακριτικού και η λανθάνουσα εμπειρία που βιώνουν οι χρήστες την αναμονή του, μπορεί να καθορίσει εάν ένα προϊόν είναι βιώσιμο. Το διαχωρισμένο συμπέρασμα αντιμετωπίζει την προπλήρωση και την αποκωδικοποίηση ως χωριστούς φόρτους εργασίας που μπορούν να δρομολογηθούν στο υλικό που ταιριάζει καλύτερα με το καθένα, μια φιλοσοφία σχεδιασμού που υποστηρίζουν εταιρείες όπως η Cerebras για περισσότερο από ένα χρόνο.
Η ανακοίνωση της AMD-Cerebras υποδηλώνει ότι η προσέγγιση μετακινείται από μια εξεγερμένη ιδέα σε μια αρχιτεκτονική που υποστηρίζεται από τη βιομηχανία. Με τη σύζευξη ενός ειδικού απόδοσης με έναν ειδικό σε καθυστέρηση, οι δύο εταιρείες στοιχηματίζουν ότι το μέλλον της εξαγωγής συμπερασμάτων δεν είναι ένα τσιπ που θα τους κυβερνά όλους, αλλά ένα συντονισμένο σύστημα εξειδικευμένων κινητήρων.
Τι να παρακολουθήσετε
Αρκετά ερωτήματα παραμένουν. Ο αριθμός 5x tokens-per-second-per-watt είναι μια προσδοκία και όχι ένα σημείο αναφοράς τρίτου μέρους και η απόδοση του πραγματικού κόσμου θα εξαρτηθεί από τα συγκεκριμένα μοντέλα και τον φόρτο εργασίας που εκτελούν οι πελάτες. Οι λεπτομέρειες τιμολόγησης και διαθεσιμότητας πέρα από την κυκλοφορία του Cerebras Cloud δεν έχουν αποκαλυφθεί και δεν είναι σαφές πότε η λύση μπορεί να φτάσει σε άλλους παρόχους cloud.
Ωστόσο, η συμφωνία υπογραμμίζει μια ευρύτερη αλλαγή στο υλικό τεχνητής νοημοσύνης: η υπόθεση ότι μια ενιαία αρχιτεκτονική GPU θα εξυπηρετεί κάθε στάδιο του αγωγού τεχνητής νοημοσύνης ξεφτίζει. Εάν η AMD και η Cerebras μπορέσουν να ανταποκριθούν στους ισχυρισμούς τους σχετικά με την αποτελεσματικότητα, η ομαδοποιημένη συμπεράσματα θα μπορούσε να γίνει τυπικό μέρος του τρόπου κατασκευής των μεγαλύτερων συστημάτων AI.
Μείνετε μπροστά από την τεχνητή νοημοσύνη
Το τοπίο υλικού AI χωρίζεται σε εξειδικευμένα στρατόπεδα και οι επιπτώσεις στο κόστος, την ταχύτητα και τον ανταγωνισμό είναι τεράστιες. Διαβάστε περισσότερα νέα AI στο AI Buzz Wire για να παρακολουθείτε κάθε σημαντική συμφωνία, κυκλοφορία και σημείο αναφοράς.


