Η Nvidia έθεσε σε πλήρη παραγωγή τον διαδραστικό επιταχυντή συμπερασμάτων Groq 3 LPX, ανακοίνωσε η εταιρεία στις 24 Αυγούστου 2026, κατά τη διάρκεια του συνεδρίου Hot Chips. Το τσιπ, μια επέκταση της πλατφόρμας Vera Rubin της Nvidia, απέδωσε ρεκόρ 3.400 διακριτικών εξόδου ανά δευτερόλεπτο στη συγκριτική αξιολόγηση Τεχνητής Ανάλυσης ενώ εκτελούσε το μοντέλο ανοιχτού κώδικα Gemma 4 31B με ενεργό παράθυρο περιβάλλοντος 100.000 κουπόνι — η ταχύτερη απόδοση που έχει καταγραφεί ποτέ για αυτό το μοντέλο.
Το λανσάρισμα σηματοδοτεί το πιο σημαντικό ορόσημο προϊόντος μέχρι σήμερα από την εξαγορά 20 δισεκατομμυρίων δολαρίων της Nvidia του ειδικού συμπερασμάτων Groq, μια συμφωνία την οποία η εταιρεία κινείται τώρα να κεφαλαιοποιήσει καθώς η ζήτηση για συμπεράσματα χαμηλής καθυστέρησης αυξάνεται. Το CNBC ανέφερε ότι η Nvidia λέει ότι τα πρώτα rack Groq θα είναι online πριν από το τέλος του έτους. Για περισσότερες πληροφορίες σχετικά με αυτήν την ιστορία, ανατρέξτε στην εν εξελίξει κάλυψη του κλάδου AI.
Γιατί έχει σημασία η ταχύτητα δημιουργίας διακριτικών
Συστήματα πρακτορικής τεχνητής νοημοσύνης - προγράμματα που συλλογίζονται, καλούν εργαλεία, γράφουν και δοκιμάζουν κώδικα και επαναλαμβάνονται σε εκατοντάδες ή χιλιάδες βήματα συμπερασμάτων - δημιουργούν τεράστιους όγκους διακριτικών εξόδου. Η ταχύτητα με την οποία παράγονται αυτά τα διακριτικά, γνωστή ως διαδραστικότητα ή απόδοση αποκωδικοποίησης, καθορίζει πόσο γρήγορα ένας πράκτορας μπορεί να ολοκληρώσει κάθε βήμα της εργασίας του.
Η Nvidia λέει ότι το Groq 3 LPX παρέχει 4 φορές ταχύτερη απόκριση για πράκτορες και φόρτους εργασίας ευαίσθητους σε καθυστέρηση από την πλησιέστερη εναλλακτική πλατφόρμα. Σε ετερογενείς αναπτύξεις, τα συστήματα Vera Rubin NVL72 χειρίζονται την απορρόφηση περιβάλλοντος και τον υπολογισμό προπλήρωσης, ενώ οι μονάδες Groq 3 LPX επεξεργάζονται τη φάση δημιουργίας διακριτικών που είναι ευαίσθητη σε καθυστέρηση.
«Το συμπέρασμα είναι η μηχανή ανάπτυξης της τεχνητής νοημοσύνης», δήλωσε στην ανακοίνωση ο Jensen Huang, ιδρυτής και διευθύνων σύμβουλος της Nvidia. "Η Vera Rubin επεκτείνει αυτό το όραμα με εργοστασιακές διαμορφώσεις τεχνητής νοημοσύνης βελτιστοποιημένες για το φόρτο εργασίας, σχεδιασμένες για την εποχή της τεχνητής νοημοσύνης, προωθώντας τα όρια απόδοσης με το LPX για εξαιρετικά γρήγορη παραγωγή διακριτικών."
Μέσα στο Υλικό
Σύμφωνα με την τεχνική ανάλυση του StorageReview, κάθε 2U υγρόψυκτος υπολογιστικός δίσκος φέρει δεκαέξι Groq 3 LPU μαζί με κεντρικό επεξεργαστή, λογική επέκτασης υφάσματος και DRAM, καθώς και μια κάρτα δικτύου BlueField-4 ή μια κάρτα δικτύου ConnectX-9. Ο δίσκος διαθέτει 32 οπτικούς συνδέσμους LPU chip-to-chip και Ethernet 400 Gb/s στον μπροστινό πίνακα.
Σε κλίμακα rack, μια ανάπτυξη Groq 3 LPX ενσωματώνει έως και 256 επιταχυντές LP30 που συνδέονται μέσω υψηλής ταχύτητας, απευθείας διασυνδέσεις chip-to-chip. Τα rack χωρούν στην ευρύτερη εργοστασιακή υποδομή Vera Rubin AI της Nvidia, την οποία η εταιρεία περιγράφει ως την πιο εκτεταμένη πλατφόρμα της ποτέ: επτά διακριτά τσιπ σε πέντε ειδικά διαμορφωμένες διαμορφώσεις rack, συμπεριλαμβανομένων BlueField-4 DPU, Vera CPU rack, Vera BlueField-4 STX storage και Spectrum-net.
Η Nvidia ανανέωσε επίσης τους ισχυρισμούς απόδοσης σε επίπεδο πλατφόρμας, δηλώνοντας ότι το Vera Rubin NVL72 αποδίδει έως και 30 φορές μεγαλύτερη απόδοση ανά μεγαβάτ σε σύγκριση με GB300 NVL72 σε φόρτο εργασίας 140.000 token, με το πλεονέκτημα να διευρύνεται καθώς οι στόχοι αλληλεπίδρασης ανά χρήστη αυξάνονται.
Σημείο αναφοράς με αστερίσκο
Ο αριθμός των 3.400 μάρκες ανά δευτερόλεπτο συνοδεύεται από μια προειδοποίηση που αξίζει να σημειωθεί. Όπως τόνισε το StorageReview, το αποτέλεσμα της Nvidia μετρήθηκε σε ένα ιδιωτικό τελικό σημείο προέκδοσης στις 21 Αυγούστου, ενώ οι ανταγωνιστικοί αριθμοί με τους οποίους συγκρίθηκε προέρχονται από ζωντανά τελικά σημεία παραγωγής χωρίς διακομιστή. Η απόδοση του πραγματικού κόσμου σε γενικά διαθέσιμες υπηρεσίες μπορεί να διαφέρει από τη ρύθμιση παραμέτρων αναφοράς για τη ρύθμιση ρεκόρ.
Ωστόσο, ο ανεξάρτητος οργανισμός συγκριτικής αξιολόγησης Artificial Analysis κατέγραψε το αποτέλεσμα ως το ταχύτερο που μετρήθηκε ποτέ για το Gemma 4 31B σε αυτό το μήκος περιβάλλοντος, και ο υποκείμενος ισχυρισμός - ότι το πυρίτιο που έχει κατασκευαστεί για το σκοπό αυτό μπορεί να επιταχύνει δραματικά τη φάση αποκωδικοποίησης του συμπερασμάτων - ευθυγραμμίζεται με τον τρόπο με τον οποίο ο κλάδος ανακατασκευάζει τον φόρτο εργασίας.
Η υιοθέτηση του Cloud ξεκινά
Το Nebius, το cloud AI με έδρα το Άμστερνταμ, είναι ο πρώτος πάροχος που δεσμεύεται να αναπτύξει το Groq 3 LPX, σχεδιάζοντας να το φέρει στο Nebius Token Factory, την πλατφόρμα συμπερασμάτων παραγωγής του.
«Η γενιά είναι η φάση εξαγωγής συμπερασμάτων που καθορίζει πόσο ανταποκρίνεται ένα σύστημα τεχνητής νοημοσύνης στην πραγματικότητα και αυτό ακριβώς έχει κατασκευαστεί για να επιταχύνει το NVIDIA Groq 3 LPX», δήλωσε η Danila Shtan, επικεφαλής τεχνολογίας της Nebius. «Ως το πρώτο σύννεφο τεχνητής νοημοσύνης που το φέρνει στην παραγωγή μέσω του Nebius Token Factory, διασφαλίζουμε ότι κάθε βήμα του βρόχου ενός πράκτορα είναι άμεσο — μέσω του ίδιου API που χρησιμοποιούν ήδη οι προγραμματιστές, χωρίς μετεγκατάσταση σε νέα στοίβα».
Ο πάροχος συμπερασμάτων Groq, που τώρα ανήκει στην οικογένεια της Nvidia, σχεδιάζει να συγκαταλέγεται στους πρώτους χρήστες της πλατφόρμας.
Η μεγαλύτερη εικόνα
Η ανακοίνωση πλήρους παραγωγής σηματοδοτεί πόσο έντονα έχει περιστραφεί η αγορά υποδομής τεχνητής νοημοσύνης από την εκπαίδευση στο συμπέρασμα. Καθώς οι επιχειρήσεις μετατοπίζουν τους προϋπολογισμούς από την προεκπαίδευση ακατέργαστων μοντέλων προς τη λογική σε πραγματικό χρόνο και την αυτόνομη ενορχήστρωση πρακτόρων, τα οικονομικά ενός κουπονιού - πόσο γρήγορα μπορεί να δημιουργηθεί και με ποιο ενεργειακό κόστος - έχουν γίνει το κεντρικό ανταγωνιστικό πεδίο μάχης.
Για τη Nvidia, το Groq 3 LPX επεκτείνει την υπεράσπιση του εργοστασιακού franchise της τεχνητής νοημοσύνης σε μια στιγμή που το προσαρμοσμένο πυρίτιο από παρόχους cloud και νεοσύστατες εταιρείες κυνηγούν τους ίδιους φόρτους εργασίας για εξαγωγή συμπερασμάτων. Τα ράφια που έρχονται στο διαδίκτυο φέτος, όπως ανέφερε το CNBC, θα έθεταν στα χέρια των πελατών τα πρώτα συστήματα παραγωγής μήνες μετά το κλείσιμο της εξαγοράς — μια γρήγορη ενσωμάτωση σύμφωνα με τα πρότυπα της βιομηχανίας ημιαγωγών.
Η εταιρεία δεν αποκάλυψε την τιμολόγηση των νέων συστημάτων. Το Groq 3 LPX θα προσφέρεται σε βάση όταν και εάν είναι διαθέσιμο μέσω συνεργατών cloud τεχνητής νοημοσύνης, με τον Nebius να αναμένεται να είναι ο πρώτος που θα προσφέρει πρόσβαση σε προγραμματιστές μέσω των υπαρχόντων τερματικών σημείων API του.
---
Μείνετε μπροστά από την τεχνητή νοημοσύνηΛάβετε τα τελευταία νέα, αναλύσεις και ανακαλύψεις AI — όλα σε ένα μέρος.
Διαβάστε περισσότερα νέα AI →