Το OpenAI δημοσίευσε τα πρώτα αποτελέσματα αναφοράς για το Jalapeño, το προσαρμοσμένο τσιπ συμπερασμάτων του, και οι αριθμοί είναι εντυπωσιακοί: στο σημείο αναφοράς InferenceX της SemiAnalysis, το νέο πυρίτιο κατέγραψε περισσότερα διακριτικά ανά χρήστη και μεγαλύτερη απόδοση ανά κιλοβάτ από τους τρέχοντες διαθέσιμους επεξεργαστές συμπερασμάτων τελευταίας τεχνολογίας — μια σύγκριση που περιλαμβάνει συστήματα Blackwell». Τα αποτελέσματα παρουσιάστηκαν την Τρίτη στο συνέδριο Hot Chips στο Palo Alto, μαζί με μια λεπτομερή τεχνική ματιά στον τρόπο κατασκευής του τσιπ. Για τους αναγνώστες που παρακολουθούν τον αγώνα υπολογιστών που βασίζεται σε κάθε έκδοση μοντέλου AI, είναι ένα από τα πιο σημαντικά σημεία δεδομένων υλικού της χρονιάς.

«Η ουσία είναι ότι τα αποτελέσματα δείχνουν μια πολύ, πολύ σημαντική πρόοδο στις επιδόσεις σε σχέση με την τελευταία λέξη της τεχνολογίας», δήλωσε ο Richard Ho, επικεφαλής υλικού του OpenAI, σε συνέντευξη Τύπου που αναφέρθηκε από το TechCrunch. "Το Jalapeño μπορεί να εξυπηρετήσει περισσότερη εργασία τεχνητής νοημοσύνης ανά μονάδα ισχύος, ενώ επίσης επιστρέφει απαντήσεις πιο γρήγορα. Είναι πολύ αποτελεσματικό να εξυπηρετεί πολλούς πελάτες, αλλά μπορεί επίσης να έχει πολύ χαμηλή καθυστέρηση."

Ένα τσιπ που κατασκευάστηκε για τον αγωγό Full Inference

Το Jalapeño αποκαλύφθηκε τον Ιούνιο του 2026 ως το πρώτο προσαρμοσμένο πυρίτιο του OpenAI, που αναπτύχθηκε σε στενή συνεργασία με την Broadcom, με τα μοντέλα AI του OpenAI να βοηθούν στη διαδικασία ανάπτυξης του τσιπ. Η ίδια η συνεργασία χρονολογείται από τον Οκτώβριο του 2025, όταν το OpenAI παρουσίασε σχέδια για ένα πρόγραμμα προσαρμοσμένων επιταχυντών πολλών γενεών παράλληλα με τον γίγαντα δικτύωσης.

Αυτό που κάνει το Jalapeño διαφορετικό από μια GPU γενικής χρήσης, σύμφωνα με το OpenAI, είναι ότι σχεδιάστηκε σε συμφωνία με τα μοντέλα που θα εξυπηρετήσει. Επειδή η εταιρεία ελέγχει την πλήρη στοίβα — προϊόντα τεχνητής νοημοσύνης, μοντέλα, τσιπ και μνήμη — οι μηχανικοί της μπόρεσαν να επιτεθούν σε συγκεκριμένες φάσεις της διαδικασίας συμπερασμάτων που συχνά προκαλούν τριβές.

Συγκεκριμένα, το Jalapeño έχει σχεδιαστεί για να ελαχιστοποιεί τις καθυστερήσεις κατά τη διάρκεια των φάσεων προπλήρωσης και επικοινωνίας της επεξεργασίας, οι οποίες σύμφωνα με το OpenAI συχνά λειτουργούν ως σημεία συμφόρησης κατά την προβολή μεγάλων γλωσσικών μοντέλων σε κλίμακα.

«Σχεδιάσαμε το Jalapeño για να ελαχιστοποιήσουμε τη μετακίνηση δεδομένων και τις καθυστερήσεις επικοινωνίας», έγραψε η εταιρεία σε μια ανάρτηση ιστολογίου που παρουσιάζει τα αποτελέσματα. "Αυτό σημαίνει ότι η κατάσταση του μοντέλου, συμπεριλαμβανομένης της κρυφής μνήμης KV που χρησιμοποιείται κατά τη δημιουργία μιας απόκρισης, μπορεί να τοποθετηθεί ρητά και να διατηρηθεί τοπική ενώ το σύστημα ενεργοποιεί τον σωστό συνδυασμό υπολογισμού, μνήμης και δικτύωσης για κάθε φάση εξαγωγής συμπερασμάτων."

Αυτό το τελευταίο σημείο έχει σημασία για οποιονδήποτε εκτελεί φόρτους εργασίας τεχνητής νοημοσύνης παραγωγής. Η κρυφή μνήμη KV - το συσσωρευμένο πλαίσιο που διατηρεί ένα μοντέλο ενώ δημιουργεί μια απόκριση - είναι ένας από τους μεγαλύτερους πονοκεφάλους μνήμης και εύρους ζώνης στη σύγχρονη εξαγωγή συμπερασμάτων. Η διατήρησή του σε τοπικό και ρητό τρόπο διαχείρισης, αντί να το ανακατεύετε σε ένα σύμπλεγμα, είναι ένας κλασικός τρόπος για να ανακτήσετε τον λανθάνοντα χρόνο και την ισχύ.

Καλύτερο από το Blackwell — Προς το παρόν

Η σύγκριση των πρωτοσέλιδων είναι ενάντια σε ένα σύστημα Nvidia Blackwell, το οποίο επί του παρόντος είναι το επίκεντρο των συνοριακών συμπερασμάτων AI. Η ανεξάρτητη ανάλυση που δημοσιεύθηκε την ίδια μέρα από τη SemiAnalysis, με τίτλο "OpenAI Jalapeño: Better than Nvidia Blackwell", κατέληξε σε ένα παρόμοιο συμπέρασμα σχετικά με τα πρώτα αποτελέσματα του τσιπ και η ιστορία έγινε γρήγορα ένα από τα πιο πολυσυζητημένα στοιχεία στο Hacker News.

Ωστόσο, τα στελέχη και οι αναλυτές του OpenAI προτρέπουν να είμαστε προσεκτικοί. Ο Ho εκτίμησε ότι το Jalapeño θα αναπτυχθεί στα τέλη του 2026 "σε πολύ μικρούς όγκους", με πιο σημαντική ανάπτυξη να έρχεται το 2027. Μέχρι τη στιγμή που το Jalapeño φτάσει σε πλήρη κλίμακα, ο ανταγωνισμός μπορεί να έχει προχωρήσει σημαντικά — ο οδικός χάρτης της Nvidia συνεχίζει να κινείται και άλλα προγράμματα υπερκλιμάκωσης, όπως η Google, η Amazon και η Microsoft, προωθούν τη δική τους προσαρμοσμένη προσαρμογή.

Όπως σημείωσε το TechCrunch, τα σημεία αναφοράς που μετρώνται σε σχέση με τη σημερινή κατάσταση της τέχνης αποτελούν στιγμιότυπο και όχι εγγύηση. Ένα τσιπ που κερδίζει με αποδοτικότητα το 2026 πρέπει να συνεχίσει να κερδίζει ενάντια σε ό,τι θα αποσταλεί η Nvidia και οι αντίπαλοί της το επόμενο έτος.

Γιατί το OpenAI κατασκευάζει το δικό του πυρίτιο

Η στρατηγική λογική είναι ξεκάθαρη: το συμπέρασμα είναι το μεγαλύτερο επαναλαμβανόμενο κόστος του OpenAI. Κάθε ερώτημα ChatGPT, κάθε κλήση API και κάθε αντιπροσωπευτική εργασία καταγράφει υπολογισμούς και η ενοικίαση αυτού του υπολογισμού από την Nvidia σε τιμές αγοράς συμπιέζει τα περιθώρια ως κλίμακες χρήσης. Ένα προσαρμοσμένο τσιπ προσαρμοσμένο στα μοντέλα του OpenAI — σχεδιασμένο από κοινού με την Broadcom και διαμορφωμένο από τα ίδια τα μοντέλα του OpenAI — δίνει στην εταιρεία έναν τρόπο να εξυπηρετεί περισσότερους χρήστες ανά watt και ανά δολάριο.

Το Jalapeño σχεδιάζεται επίσης ως πλατφόρμα πολλών γενεών και όχι ως εφάπαξ μέρος. Η OpenAI είπε ότι σκοπεύει να αναπτύξει προϊόντα, μοντέλα, τσιπ και μνήμη τεχνητής νοημοσύνης μαζί, έτσι ώστε κάθε γενιά πυριτίου να συν-βελτιστοποιείται με τα μοντέλα που θα τρέξει. Εάν τα αποτελέσματα πρώτης γενιάς διατηρηθούν στην παραγωγή, το Jalapeño γίνεται το πρότυπο για όλα όσα ακολουθούν.

Τα στοιχήματα εκτείνονται πέρα ​​από το OpenAI. Η κυριαρχία της Nvidia στους επιταχυντές τεχνητής νοημοσύνης ήταν το πιο στενό σημείο συμφόρησης στον κλάδο εδώ και τρία χρόνια, και κάθε αξιόπιστη εναλλακτική λύση —είτε από την ομάδα TPU της Google, την Amazon ή τώρα το OpenAI— αλλάζει το τοπίο των διαπραγματεύσεων για όλους όσους κατασκευάζουν υποδομές τεχνητής νοημοσύνης. Η ίδια η Nvidia φέρεται να προειδοποιεί τους πελάτες για αυξήσεις τιμών κατά 15 τοις εκατό ή περισσότερο στους διακομιστές τεχνητής νοημοσύνης, καθώς το κόστος της μνήμης αυξάνεται, κάτι που απλώς οξύνει την ελκυστικότητα των εσωτερικών εναλλακτικών.

Τι ακολουθεί

Προς το παρόν, το Jalapeño παραμένει ένα κομμάτι προ-παραγωγής με πολλά υποσχόμενους αριθμούς χαρτιού. Η πραγματική δοκιμή φτάνει στο τέλος του 2026, όταν θα αναπτυχθούν οι πρώτοι μικροί όγκοι, και ειδικά το 2027, όταν το OpenAI αναμένει σημαντική κλίμακα. Βασικά ερωτήματα παραμένουν αναπάντητα: η αξιοπιστία του πραγματικού κόσμου σε κλίμακα κέντρου δεδομένων, το συνολικό κόστος ιδιοκτησίας έναντι της ενοικιαζόμενης χωρητικότητας Blackwell και εάν το πλεονέκτημα της απόδοσης επιβιώνει έναντι της επόμενης γενιάς της Nvidia.

Παρόλα αυτά, τα πρώτα σημεία αναφοράς σηματοδοτούν ένα ορόσημο: η πρώτη φορά που ένα από τα μεγάλα εργαστήρια τεχνητής νοημοσύνης παρουσίασε δημόσια το πυρίτιο προσαρμοσμένων συμπερασμάτων που φαίνεται να ξεπερνά την καλύτερη απόδοση του κατεστημένου φορέα. Για έναν κλάδο που αντιμετωπίζει την παροχή Nvidia ως στρατηγική σωτηρία, αυτό είναι ένα πραγματικό σημείο καμπής.

---

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Λάβετε τα τελευταία νέα, αναλύσεις και ανακαλύψεις AI — όλα σε ένα μέρος.

Διαβάστε περισσότερα νέα AI →