Η xAI κυκλοφόρησε το Grok 4.6, την πιο πρόσφατη επανάληψη του μοντέλου της συνοριακής μεγάλης γλώσσας, με βαθμολογία 61 στον δείκτη νοημοσύνης τεχνητής ανάλυσης για να ταιριάζει με το GPT-5.6 Sol του OpenAI. Το μοντέλο κυκλοφόρησε σήμερα και είναι διαθέσιμο αμέσως σε Cursor και Grok Build, με πρόσβαση API και ενσωματώσεις συνεργατών μέσω OpenRouter, Vercel και Cloudflare.

Για τα πιο πρόσφατα νέα και αναλύσεις για την τεχνητή νοημοσύνη, επισκεφτείτε το AI Buzz Wire.

Συνοριακή νοημοσύνη με κλάσμα του κόστους

Σύμφωνα με την Artificial Analysis, μια ανεξάρτητη πλατφόρμα συγκριτικής αξιολόγησης, το Grok 4.6 κερδίζει πέντε πόντους σε σχέση με τον προκάτοχό του Grok 4.5 στον δείκτη νοημοσύνης, φέρνοντας το xAI πίσω στην οριακή βαθμίδα μαζί με το OpenAI. Το μοντέλο κάθεται ακριβώς πίσω από τους Claude Opus 5 (63) και Claude Fable 5 (62) της Anthropic και μπροστά από την Kimi K3.

Αυτό που κάνει το Grok 4.6 ιδιαίτερα αξιοσημείωτο είναι η τιμολόγησή του. Η αρχική τιμολόγηση παραμένει αμετάβλητη από το Grok 4,5 στα 2 $ ανά εκατομμύριο μάρκες εισόδου και 6 $ ανά εκατομμύριο μάρκες εξόδου. Αυτό το τοποθετεί περισσότερο από 60% κάτω από το Claude Opus 5 (5$/25$) και το GPT-5.6 Sol (5$/30$). Το μετρούμενο κόστος ανά εργασία είναι 0,84 $, τοποθετώντας το στα σύνορα Intelligence έναντι Cost Pareto.

Η διατήρηση σταθερών τιμών σε μια γενιά είναι ασυνήθιστη στα σύνορα, όπου τα κέρδη νοημοσύνης συνήθως συνοδεύονται από αυξήσεις τιμών. Το Grok 4.6 προσφέρει κέρδος σε δείκτη ευφυΐας πέντε μονάδων σε αμετάβλητη τιμολόγηση.

Κατασκευάστηκε για μακροχρόνιους πράκτορες

Το Grok 4.6 βασίζεται στο Grok 4.5 με αυτό που το xAI περιγράφει ως ιδιαίτερη εστίαση σε μακροχρόνιους πράκτορες και πιο φιλόδοξη διαδραστική και οπτική εργασία. Η εταιρεία λέει ότι το μοντέλο παραμένει με πολύπλοκες εργασίες σε πολλά βήματα, είτε ερευνά ένα θέμα, αναλύει πληροφορίες, εργάζεται σε μια βάση κώδικα ή μετατρέπει μια ιδέα σε μια βελτιωμένη εφαρμογή.

Τα πρακτορεία αναφοράς λένε μια συναρπαστική ιστορία. Στο GDPval-AA v2, ένα κορυφαίο μέτρο της εργασίας γνώσης των πρακτόρων του πραγματικού κόσμου, το Grok 4.6 επιτυγχάνει Elo 1753, πίσω μόνο από το Claude Opus 5 και στατιστικά στο ίδιο επίπεδο με το Claude Fable 5 και το Qwen3.8 Max. Σημειώνει 50,7% στο δείκτη αναφοράς του τραπεζικού κύβους tau για την εξυπηρέτηση πελατών πολλαπλών στροφών, τοποθετώντας το στις δύο πρώτες θέσεις μαζί με το Qwen3.8 Max.

Στο CursorBench v3.2, το Grok 4.6 σημειώνει 69,9%, μπροστά από το GPT-5.6 Sol (67,2%) και το Grok 4,5 (66,7%). Δημοσιεύει 65,9% στο DeepSWE v1.1 και 61,3% στο FrontierCode v1.1 Extended.

Αξιοσημείωτη απόδοση στροφών

Ένα από τα αξιοσημείωτα ευρήματα από την Τεχνητή Ανάλυση είναι το προφίλ αποτελεσματικότητας του Grok 4.6 στο AA-Briefcase, ένα ιδιωτικό σημείο αναφοράς για εργασίες εργασίας πρακτορικής γνώσης μεγάλου ορίζοντα. Το μοντέλο κάνει το ντεμπούτο του με ένα Elo του 1577, τοποθετώντας το στη βαθμίδα Fable 5.

Οι αριθμοί απόδοσης είναι εντυπωσιακοί. Το Grok 4.6 επιλύει εργασίες σε περίπου 53 στροφές και 0,5 δισεκατομμύρια διακριτικά εισόδου κατά μέσο όρο, σε σύγκριση με περίπου 103 στροφές και 2,0 δισεκατομμύρια διακριτικά εισόδου για το Claude Opus 5 max. Δεδομένου ότι η εργασία μακροχρόνιου ορίζοντα συσσωρεύει το πλαίσιο ταχέως, ένα μοντέλο που φτάνει σε συγκρίσιμη απάντηση στις μισές στροφές και στο ένα τέταρτο των διακριτικών εισόδου έχει πλεονέκτημα κόστους πολύ πέρα ​​από την τιμολόγηση ανά κουπόνι.

Εκπαίδευση και Ασφάλεια

Το Grok 4.6 υποβλήθηκε σε μεγαλύτερη διάρκεια συμπληρωματικής εκπαίδευσης από το Grok 4.5, με επιμελημένα δεδομένα που δημιουργήθηκαν από μοντέλα για συλλογισμούς και προηγμένες τεχνικές έννοιες, υψηλής ποιότητας δεδομένα μηχανικής και βελτιωμένη συνταγή βελτιστοποίησης και εκπαίδευσης. Η xAI χρησιμοποίησε το Grok 4.5 για την αναγέννηση τροχιών SFT σε προσπάθειες συλλογισμού, δέσμες πρακτόρων και τομείς όπως το STEM, η μηχανική λογισμικού και η εργασία γνώσης.

Το μοντέλο φέρει ένα παράθυρο περιβάλλοντος 500.000 διακριτικών, αμετάβλητο από το Grok 4.5. Το xAI αναφέρει ότι το Grok 4.6 υποβλήθηκε στην ευρύτερη σουίτα δοκιμών πριν από την ανάπτυξη για ικανότητες και βαθμονόμηση ασφαλείας, μαζί με εκτεταμένες δοκιμές μετά την ανάπτυξη και τρίτων.

Διαθεσιμότητα και τιμολόγηση

Το Grok 4.6 είναι διαθέσιμο σήμερα σε Cursor και Grok Build. Το xAI προσφέρει διπλή χρήση και στις δύο πλατφόρμες για την πρώτη εβδομάδα. Η τιμολόγηση ξεκινά από 2 $ ανά εκατομμύριο μάρκες εισόδου και 6 $ ανά εκατομμύριο μάρκες εξόδου, με μια γρήγορη παραλλαγή διαθέσιμη σε διπλάσια τιμή. Οι επισκέψεις στην προσωρινή μνήμη μειώνονται σε 0,50 $ ανά εκατομμύριο διακριτικά.

Η κυκλοφορία συνεχίζει έναν γρήγορο ρυθμό για το xAI, με το Grok 4.6 να έρχεται λίγο περισσότερο από ένα μήνα μετά το Grok 4.5. Το μοντέλο τοποθετεί το xAI ως σοβαρό διεκδικητή στην κούρσα των συνόρων, ιδιαίτερα για προγραμματιστές που δίνουν προτεραιότητα στην απόδοση των πρακτόρων και την αποδοτικότητα κόστους.

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Για συνεχή κάλυψη των πιο σημαντικών εξελίξεων του κλάδου της τεχνητής νοημοσύνης, προσθέστε σελιδοδείκτη στο AI Buzz Wire και μην χάσετε ποτέ μια σημαντική ιστορία.

Διαβάστε περισσότερα νέα AI