Η ευρωπαϊκή εταιρεία τεχνητής νοημοσύνης Multiverse Computing κυκλοφόρησε το Quasar 438B, ένα μεγάλο συλλογιστικό μοντέλο που η εταιρεία λέει ότι είναι το πιο έξυπνο μοντέλο τεχνητής νοημοσύνης που έχει κατασκευαστεί στην Ευρώπη. Σύμφωνα με την ανακοίνωση της εταιρείας, το Quasar 438B βαθμολογείται με 43 στον Δείκτη Νοημοσύνης Τεχνητής Ανάλυσης, το υψηλότερο αποτέλεσμα από οποιοδήποτε ευρωπαϊκό μοντέλο που μετράται σε αυτό το σημείο αναφοράς.

Η κυκλοφορία σηματοδοτεί ένα σημαντικό βήμα για την ισπανική εταιρεία, η οποία έχτισε τη φήμη της στη συμπίεση μοντέλων τεχνητής νοημοσύνης και όχι στην εκπαίδευση συστημάτων συνοριακής κλίμακας. Το Quasar 438B είναι το πρώτο μεγάλο μοντέλο που κυκλοφόρησε η Multiverse Computing και έρχεται καθώς οι ευρωπαϊκές κυβερνήσεις και εταιρείες πιέζουν για ικανότητα τεχνητής νοημοσύνης που δεν εξαρτάται εξ ολοκλήρου από αμερικανικά και κινεζικά εργαστήρια. Για τους αναγνώστες που παρακολουθούν την ειδησεογραφική κάλυψη της τεχνητής νοημοσύνης, η κυκλοφορία σηματοδοτεί επίσης ότι ο αγώνας για να κλείσει το χάσμα με τα μοντέλα αιχμής δεν περιορίζεται πλέον στους συνήθεις υποψήφιους των ΗΠΑ.

Τι βαθμολογεί πραγματικά το Quasar 438B

Ο Δείκτης Νοημοσύνης Τεχνητής Ανάλυσης (έκδοση 4.1.1) συνδυάζει εννέα αξιολογήσεις, συμπεριλαμβανομένων των GDPval-AA v2, tau3-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-AA-LCR και AA-Omniscience. Η σύνθετη βαθμολογία του Quasar 438B με 43 το τοποθετεί μπροστά από το Mistral Medium 3.5 στο 30, το Nemotron 3 Ultra της NVIDIA στο 38 και το Inkling στο 42, σύμφωνα με την ανακοίνωση της εταιρείας.

Το ευρύτερο πεδίο εξακολουθεί να ανήκει στα αμερικανικά σύνορα: ο Claude Opus 5 οδηγεί τον δείκτη στο 63. Η Multiverse Computing δεν ισχυρίζεται διαφορετικά. Αντίθετα, η εταιρεία χαρακτηρίζει το Quasar 438B ως την ισχυρότερη ευρωπαϊκή επιλογή, ξεπερνώντας τα συγκρίσιμα ευρωπαϊκά μοντέλα σε επτά από τις οκτώ επιλεγμένες αξιολογήσεις Τεχνητής Ανάλυσης που ανέδειξε.

Η ταχύτητα είναι το δεύτερο επιχείρημα

Οι ακατέργαστες βαθμολογίες αναφοράς είναι μόνο το ήμισυ του αγωνιστικού χώρου της Multiverse Computing. Η εταιρεία λέει ότι το Quasar 438B επιστρέφει 500 μάρκες, συμπεριλαμβανομένου του χρόνου σκέψης, σε 15,3 δευτερόλεπτα. Μεταξύ των μοντέλων της σύγκρισης, μόνο το Nemotron 3.5 Lightning (9,4 δευτερόλεπτα), το Gemini 3.5 Flash-Lite (10,8 δευτερόλεπτα) και το Gemini 3.7 Flash (11,5 δευτερόλεπτα) είναι ταχύτερα και μόνο το Gemini 3.7 Flash είναι ταχύτερο και πιο ικανό στο ευρετήριο.

Η σύγκριση με το Mistral Medium 3.5 γίνεται μονόδρομος και στους δύο άξονες: Το Quasar σκοράρει υψηλότερα (43 έναντι 30) και απαντά πιο γρήγορα (15,3 δευτερόλεπτα έναντι 18,8 δευτερολέπτων). Το Inkling, το οποίο σχεδόν ταιριάζει με τη νοημοσύνη του Quasar στα 42, χρειάζεται 48,3 δευτερόλεπτα για την ίδια απόκριση 500-token, περισσότερο από τρεις φορές περισσότερο.

Ισχυρή συλλογιστική με μακροχρόνιο πλαίσιο

Ένα αποτέλεσμα ξεχωρίζει από την ανακοίνωση: στο AA-LCR, την αξιολόγηση που ελέγχει την ικανότητα εξαγωγής, σύνδεσης και αιτιολογίας πληροφοριών που διαχέονται σε μεγάλα έγγραφα, το Quasar 438B βαθμολογείται με 75,0. Αυτό ισοδυναμεί με το Grok 4,6 (υψηλό), εντός ενός σημείου από τον Claude Opus 5 στο 75,7 και μπροστά από το Qwen3.8 2.4T A95B στο 75,3, σύμφωνα με τα στοιχεία της εταιρείας.

Ο χειρισμός μακροπρόθεσμου πλαισίου είναι σημαντικός επειδή βασίζεται σε αυτό η εταιρική έρευνα, η ανάλυση εγγράφων και οι ροές εργασιών αντιπροσώπων. Εάν ένα μοντέλο δεν μπορεί να συγκρατήσει και να συνδέσει πληροφορίες σε ένα μεγάλο έγγραφο, δεν μπορεί να τροφοδοτήσει τα εργαλεία πολλαπλών βημάτων που πραγματικά θέλουν να αναπτύξουν οι εταιρείες. Αυτό είναι όπου το Quasar έρχεται πιο κοντά στην ομάδα των συνόρων.

Η Agentic Coding έχει ακόμα χώρο

Το πιο αδύναμο αποτέλεσμα στην ανακοίνωση είναι το Terminal-Bench v2.1, το οποίο βάζει τους πράκτορες κωδικοποίησης να λειτουργούν σε περιβάλλοντα πραγματικών τερματικών. Το Quasar 438B βαθμολογείται με 69,3, προηγώντας το Mistral Medium 3,5 με 18,7 πόντους και το Nemotron 3 Ultra με 15,4, αλλά ακολουθεί το γκρουπ των συνόρων με επικεφαλής τον Claude Opus 5 στο 89,1. Η Multiverse Computing αναγνωρίζει ότι αυτή είναι η αξιολόγηση με τον μεγαλύτερο χώρο και λέει ότι ο επόμενος γύρος εργασίας στοχεύει σε αυτήν.

Κατασκευάστηκε για Enterprise Agents

Το Quasar 438B τοποθετείται ως μοντέλο για οργανισμούς που διαθέτουν πράκτορες ανάπτυξης λογισμικού, τεχνικούς πιλότους, ερευνητικά συστήματα και αυτοματοποίηση ροής εργασιών. Βρίσκεται στην κλάση 400 δισεκατομμυρίων παραμέτρων, χειρίζεται Αγγλικά και Ισπανικά και έχει σχεδιαστεί για εργασίες πολλαπλών βημάτων που απαιτούν σχεδιασμό, χρήση εργαλείων, εκτέλεση κώδικα και μεγάλο πλαίσιο χωρίς τον λανθάνοντα χρόνο που συνήθως φέρει η κλάση.

Η Access εκτελείται μέσω του CompactifAI API της εταιρείας, ώστε οι ομάδες να μπορούν να δοκιμάσουν το μοντέλο χωρίς να στηρίζουν τη δική τους υποδομή. Η Multiverse Computing λέει ότι έρχονται περισσότερες ενημερώσεις για το Quasar.

Τι σημαίνει για τον Ευρωπαϊκό αγώνα AI

Η κυκλοφορία προσγειώνεται σε μια περίεργη στιγμή για την ευρωπαϊκή AI. Το Mistral, εδώ και καιρό ο σημαιοφόρος της ηπείρου, έχει αντιμετωπίσει ερωτήματα σχετικά με την κατεύθυνσή του, ενώ τα εργαστήρια των ΗΠΑ έχουν εδραιώσει το προβάδισμά τους σε σύνθετα σημεία αναφοράς. Ένα ευρωπαϊκό μοντέλο που εύλογα βρίσκεται στην κορυφή του ευρωπαϊκού πεδίου σε έναν ανεξάρτητο δείκτη δίνει στις επιχειρήσεις της ηπείρου μια αξιόπιστη περιφερειακή επιλογή, ιδιαίτερα για δίγλωσσες αναπτύξεις αγγλικών-ισπανικών.

Το αν το Quasar 438B κατέχει αυτή τη θέση είναι άλλο θέμα. Η ίδια η εταιρεία σημειώνει ότι μόνο ένα κλάσμα των ηγετών του δείκτη απαντά πιο γρήγορα και η διαφορά από τον Claude Opus 5 παραμένει είκοσι μονάδες μεγάλη. Ωστόσο, η εταιρεία που ήταν πρώτη στη συμπίεση έδειξε τώρα ότι μπορεί να ανταγωνιστεί στην κατηγορία βαρέων βαρών και οι ευρωπαϊκές επιχειρήσεις έχουν επιτέλους ένα μοντέλο εγχώριας αγοράς που αξίζει να συγκριθεί με τις αθετήσεις πληρωμών τους στις ΗΠΑ.

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Το τοπίο της τεχνητής νοημοσύνης αλλάζει με την ώρα και οι υποψήφιοι δείκτες αναφοράς που φαινόταν απρόσβλητοι τον Ιανουάριο εξαφανίζονται μέχρι το καλοκαίρι. Διαβάστε περισσότερες ειδήσεις AI στο AI Buzz Wire για να παρακολουθείτε κάθε έκδοση μοντέλου, αποτελέσματα συγκριτικής αξιολόγησης και αλλαγή πολιτικής, όπως συμβαίνει.

Ακολουθήστε τις τελευταίες εξελίξεις AI εδώ.