Η Intel άνοιξε το φετινό συνέδριο Hot Chips με μια βαθιά κατάδυση στο Crescent Island, την GPU του κέντρου δεδομένων στην οποία στοιχηματίζει για την επόμενη φάση του φόρτου εργασίας της τεχνητής νοημοσύνης: το agentic inference. Παρουσιάστηκε από τον Chief Enterprise AI Systems Architect Sumit Mohan και τον συνεργάτη της Intel Hong Jiang, η ομιλία επικεντρώθηκε σε τρεις μετρήσεις που η εταιρεία λέει ότι ορίζουν την εποχή του πράκτορα - tokens ανά watt, μεγάλη χωρητικότητα μνήμης και μια ανοιχτή στοίβα λογισμικού.

Σημασία έχει ο χρόνος. Η Nvidia χρησιμοποίησε το ίδιο συνέδριο για να αναλύσει λεπτομερώς το σύστημα κλίμακας rack Vera Rubin NVL72 και κάθε προμηθευτής επιταχυντών στο Hot Chips 2026 παρουσιάζει πλέον αποδοτικότητα και όχι ακατέργαστη κορυφαία απόδοση. Η απάντηση της Intel είναι ένα μέρος που ανταλλάσσει την τεχνολογία μνήμης που χρησιμοποιούν οι mainstream AI GPUs με κάτι φθηνότερο ανά gigabyte και δημιουργεί εντυπωσιακούς αριθμούς επικεφαλίδων. For more context on this story, see our ongoing AI industry coverage.

Κάρτα PCIe 480 GB στα 350 Watt

Το Crescent Island είναι μια αερόψυκτη GPU PCIe 350 watt. Η επώνυμη κάρτα της Intel διατίθεται με 160 GB μνήμης LPDDR5X, αλλά η σχεδίαση επιτρέπει στους συνεργάτες ODM να δημιουργούν παραλλαγές με έως και 480 GB ενσωματωμένες - περίπου τριπλάσια χωρητικότητα τυπικών καρτών επιτάχυνσης προηγμένης τεχνολογίας και αρκετή για να διατηρούνται οι πολύ μεγάλες κρυφές μνήμες KV για εργασίες μακράς διάρκειας και πολλαπλών περιόδων λειτουργίας. Η σχεδίαση καλύπτει τύπους δεδομένων από FP4 και MXFP4 έως και FP64.

Η επιλογή μνήμης είναι η στρατηγική απόφαση στο προϊόν. Το LPDDR5X ανταλλάσσει το εύρος ζώνης με χωρητικότητα και κόστος, το οποίο ταιριάζει σε ένα προφίλ φόρτου εργασίας συμπερασμάτων όπου τα τεράστια παράθυρα περιβάλλοντος και οι βρόχοι κλήσης εργαλείων καταναλώνουν τη χωρητικότητα μνήμης περισσότερο από τον ακατέργαστο υπολογισμό. Η Intel πλαισιώνει ολόκληρη τη σχεδίαση γύρω από "tokens per watt" - παρέχοντας πιο χρήσιμη απόδοση ανά μονάδα ενέργειας αντί να κερδίζει συγκρίσεις Peak-FLOPS.

Xe3P Silicon: 32 Cores, 256 XMX Engines

Κάτω από την κουκούλα, το Crescent Island είναι η αρχιτεκτονική Xe3P της Intel και η Intel το παρουσίασε ως ένα άλμα γενεών σε σχέση με τη γενιά Xe2 που βασίζεται στο Battlemage. Εκεί όπου το Xe2 προσέφερε 20 πυρήνες Xe και μια συστολική συστοιχία XMX 4 βάθους, το Crescent Island φέρνει 32 πυρήνες Xe και μια συστολική συστοιχία 16 βάθους, τροφοδοτώντας συνολικά 256 κινητήρες XMX.

Οι επεκτάσεις Xe Matrix τρίτης γενιάς προσθέτουν έναν εκτεταμένο σχεδιασμό Xe με τρεις κατευθύνσεις με συνέκδοση ακριβείας FP4 και υποστήριξη FP64. Κάθε πυρήνας Xe φέρει ένα αρχείο γενικού μητρώου 1MB και 512KB προσωρινής μνήμης L1, με ένα ενοποιημένο L2 32MB κοινόχρηστο σε όλη τη συσκευή. Ένας κινητήρας πολυμέσων με τέσσερις αποκωδικοποιητές και τέσσερις κωδικοποιητές βρίσκεται δίπλα, και ολόκληρο το SoC συνδέεται μέσω PCIe Gen5 x16 με υποστήριξη για κλιμάκωση σε ένα ύφασμα ανοιχτού διακόπτη. Η Intel αναφέρει μια ενεργή ισχύ αδράνειας 50 Watt ή λιγότερο στην κατάσταση G0 και περίπου 10 Watt στην κατάσταση G8 χαμηλής κατανάλωσης, που επιτυγχάνεται μέσω κατανεμημένων τομέων ισχύος, δρομολογητών δικτύου σε τσιπ που βασίζονται σε πακέτα με επιθετική πύλη ρολογιού και ανεξάρτητες ράγες DVFS για γραφικά και μέσα.

Λειτουργίες RAS που δανείστηκαν από τον Οδηγό διακομιστή

Για ένα τμήμα του κέντρου δεδομένων, η μηχανική αξιοπιστίας είχε τόσο χρόνο σταδίου όσο και απόδοση - ένα θέμα στο οποίο έκλινε και η Nvidia με τη Vera Rubin. Το Crescent Island μεταφέρει ECC και ισοτιμία σε βασικές δομές μνήμης, έλεγχο σφαλμάτων σε κάθε μετάβαση του υφάσματος εσωτερικής διασύνδεσης, δυναμική σελίδα εκτός σύνδεσης, επισκευή σκληρού πακέτου μετά τη συσκευασία και Αναφορά προηγμένων σφαλμάτων PCI Express. Η Intel λέει ότι ο συνδυασμός περιορίζει την αθόρυβη καταστροφή δεδομένων, τη λειτουργία αποτυχίας που έχει μεγαλύτερη σημασία για μακροχρόνια συμπεράσματα χωρίς επιτήρηση.

Η Intel τοποθέτησε επίσης το τμήμα μέσα σε ένα χαρτοφυλάκιο που εκτείνεται από τις GPU σταθμών εργασίας Arc Pro μέσω των RDU της SambaNova SN50 που απέκτησε, με το Crescent Island ως το κέντρο δεδομένων των επιχειρήσεων στην κορυφή. Η εταιρεία έδειξε μια γενεαλογία οδικού χάρτη που χρονολογείται πριν από περισσότερα από έξι χρόνια, χαρακτηρίζοντας τη GPU ως ένα ώριμο σχέδιο τρίτης γενιάς και όχι ως μια πρώτη προσπάθεια. Η κάρτα παρουσιάστηκε για πρώτη φορά στην Computex τον Ιούνιο. Το Hot Chips παρέδωσε την αρχιτεκτονική λεπτομέρεια πίσω από αυτό.

Γιατί το Agentic Inference ευνοεί αυτό το σχέδιο

Το επιχείρημα του φόρτου εργασίας είναι το πιο ενδιαφέρον μέρος του πεδίου εφαρμογής της Intel. Agentic AI - μοντέλα που αλυσιδώνουν τις κλήσεις εργαλείων, κρατούν ανοιχτά μεγάλα περιβάλλοντα και συντονίζουν μεταξύ της CPU και της GPU - φορολογούν ταυτόχρονα τον λανθάνοντα χρόνο, τη χωρητικότητα μνήμης και τη διεκπεραίωση του συστήματος, αντί για το προφίλ παρτίδας ροής της υπηρεσίας chatbot. Η χωρητικότητα της κρυφής μνήμης KV για μεγάλα περιβάλλοντα και ταυτόχρονες συνεδρίες συμπιεσμένου τομέα είναι ενσωματωμένη ρητά στη σχεδίαση του SoC.

Αυτό το πλαίσιο εξηγεί επίσης το στοίχημα LPDDR5X. Εάν το επόμενο κύμα υπολογισμού τεχνητής νοημοσύνης είναι πράκτορες που απαιτούν μνήμη αντί για τρεξίματα εκπαίδευσης, μια κάρτα 480 GB στα 350 watt είναι μια αξιόπιστη εναλλακτική λύση σε εξαρτήματα υψηλής ποιότητας που βασίζονται σε HBM - με την προϋπόθεση ότι η στοίβα λογισμικού προσφέρει. Η έμφαση της Intel στο ύφασμα ανοιχτής στοίβας και ανοιχτού διακόπτη στοχεύει ξεκάθαρα σε αγοραστές που είναι επιφυλακτικοί για το κλείδωμα της ενσωματωμένης πλατφόρμας της Nvidia.

Το Crescent Island δεν θα αντικαταστήσει τους επιταχυντές εκπαίδευσης που κυριαρχούν στους τίτλους της τεχνητής νοημοσύνης και η Intel δεν αποκάλυψε την τιμολόγηση ή τη διαθεσιμότητα στο συνέδριο. Αλλά ως δήλωση για το πού πιστεύει η Intel πηγαίνει το συμπέρασμα - παχιά μνήμη, λιτή δύναμη, ανοιχτό ύφασμα - είναι μια από τις πιο ξεκάθαρες ιστορίες αρχιτεκτονικής των φετινών Hot Chips.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →