Η Anthropic αποκάλυψε το Claude Opus 5, ένα νέο μοντέλο τεχνητής νοημοσύνης που η εταιρεία λέει ότι προσφέρει νοημοσύνη σχεδόν στα σύνορα σε περίπου τη μισή τιμή από το κορυφαίο μοντέλο Fable 5. Κυκλοφόρησε στις 24 Ιουλίου 2026, το Opus 5 είναι πλέον το προεπιλεγμένο μοντέλο του Claude Max και το ισχυρότερο μοντέλο που διατίθεται στο Claude Pro, τοποθετώντας το ως το καθημερινό εργαλείο της Anthropic για κωδικοποίηση, αυτόνομους πράκτορες και επαγγελματική γνώση.

Η εκτόξευση προσγειώνεται σε μια στιγμή που οι επιχειρήσεις εξετάζουν εξονυχιστικά τις δαπάνες για τεχνητή νοημοσύνη. Σύμφωνα με το CNBC, το νέο μοντέλο «συναγωνίζεται το Fable 5 και είναι φθηνότερο καθώς οι επιχειρήσεις ανησυχούν για το κόστος», ενώ το Bloomberg το χαρακτήρισε ως «πιο οικονομικό μοντέλο για καθημερινές εργασίες». Για τις ομάδες που παρακολουθούν τις τελευταίες [εξελίξεις τεχνητής νοημοσύνης] (https://aibuzzwire.news), το Opus 5 αντιπροσωπεύει ένα σκόπιμα στοίχημα ότι το επόμενο ανταγωνιστικό πεδίο μάχης είναι η αξία και όχι η πρωτογενής υπεροχή του σημείου αναφοράς.

Συγκριτική απόδοση: Νέα τελευταίας τεχνολογίας σε θέματα κωδικοποίησης και γνώσης

Η Anthropic αναφέρει ότι το Opus 5 δημοσιεύει αποτελέσματα τελευταίας τεχνολογίας σχετικά με την κωδικοποίηση και τις αξιολογήσεις εργασιών γνώσης, συμπεριλαμβανομένων των Frontier-Bench και GDPval-AA. Στο Frontier-Bench v0.1, η εταιρεία λέει ότι το Opus 5 ξεπερνά όλα τα άλλα μοντέλα και υπερδιπλασιάζει την απόδοση του προκατόχου του, Opus 4.8, με χαμηλότερο κόστος ανά εργασία.

Στο CursorBench 3.2, το Opus 5 βρίσκεται εντός του 0,5% της μέγιστης βαθμολογίας του Fable 5, ενώ κοστίζει το μισό ανά εργασία, σύμφωνα με τα σημεία αναφοράς της Anthropic. Ο Decrypt σημείωσε ότι το μοντέλο "ξεπερνά το Fable 5 στα περισσότερα σημεία αναφοράς — στη μισή τιμή".

Τα κέρδη επεκτείνονται σε αξιολογήσεις αντιπροσώπων και επίλυσης προβλημάτων:

  • ARC-AGI 3: Το Opus 5 βαθμολογείται περίπου τρεις φορές υψηλότερα από το επόμενο καλύτερο μοντέλο σε αυτό το νέο τεστ επίλυσης προβλημάτων.
  • Zapier AutomationBench: Ποσοστό επιτυχίας περίπου 1,5 φορές το επόμενο καλύτερο μοντέλο για το ίδιο κόστος, που μετρά την ολοκλήρωση των εργασιών από άκρο σε άκρο.
  • OSWorld 2.0 (χρήση υπολογιστή): Το Opus 5 ξεπερνά το καλύτερο αποτέλεσμα του Fable 5 σε λίγο περισσότερο από το ένα τρίτο του κόστους.

Συγκεκριμένα, η Anthropic αναγνωρίζει ότι το Opus 5 «παραμένει πίσω από το Mythos 5 σε εργασίες κυβερνοασφάλειας», μια περιοχή όπου ένα ανταγωνιστικό μοντέλο συνόρων διατηρεί το προβάδισμα.

Ισχυρότερη αντιπροσωπεία και αυτοεπαλήθευση

Ένα επαναλαμβανόμενο θέμα στην ανακοίνωση είναι η βελτιωμένη ικανότητα του Opus 5 να επαληθεύει τη δουλειά του και να επαναλαμβάνει μέχρι να πετύχει. Ο Anthropic περιέγραψε πολλά παραδείγματα από δοκιμές πρώιμης πρόσβασης που τονίζουν αυτήν την αυτονομία.

Σε μια εργασία Frontier-Bench, δόθηκε στο μοντέλο ένα σχέδιο ενός εξαρτήματος μηχανής και του ζητήθηκε να γράψει κώδικα για να το ανακατασκευάσει ως μοντέλο 3D FreeCAD — αλλά σκόπιμα δεν του δόθηκε τρόπος να δει απευθείας το σχέδιο. Το Opus 5 φέρεται να έγραψε τη δική του γραμμή όρασης υπολογιστή για να εξάγει γεωμετρία από ακατέργαστα pixel, στη συνέχεια ανακατασκεύασε το πλήρες μέρος, πετυχαίνοντας επανειλημμένα όπου κανένα ανταγωνιστικό μοντέλο δεν μπορούσε να λύσει την εργασία μετά από πέντε προσπάθειες.

Δεδομένου ενός πραγματικού σφάλματος σε ένα δημοφιλές διαχειριστή πακέτων ανοιχτού κώδικα, το Opus 5 βρήκε τη βασική αιτία και διόρθωσε μια περίπτωση αιχμής που είχε χάσει το patch της κοινότητας, ενώ ένα ανταγωνιστικό μοντέλο διόρθωσε μόνο το σύμπτωμα επιφάνειας και δήλωσε ότι το σφάλμα επιλύθηκε. Ένας μηχανικός σε μια εμπορική εταιρεία φέρεται να χρησιμοποίησε το Opus 5 για να δημιουργήσει μια ροή δεδομένων αγοράς για μια νέα ανταλλαγή σε μία μόνο συνεδρία - μια εργασία που τα προηγούμενα μοντέλα δεν μπορούσαν να ολοκληρώσουν καθόλου - και, καθώς δεν βρήκε ζωντανή ροή για επικύρωση, το μοντέλο κατασκεύασε τη δική του ζώνη δοκιμής.

Υποδοχή πελατών

Οι εταίροι πρώιμης πρόσβασης προσέφεραν σε μεγάλο βαθμό θετικές αξιολογήσεις. Ο Scott Wu, Διευθύνων Σύμβουλος της Cognition (κατασκευαστής του πράκτορα κωδικοποίησης Devin), είπε ότι το Opus 5 "προσεγγίζει την απόδοση σε επίπεδο Fable στο μισό κόστος" και δείχνει "ιδιαίτερη δύναμη σε δύσκολες εργασίες εντοπισμού σφαλμάτων και ανάλυσης βασικών αιτιών". Η Sualeh Asif, συνιδρυτής της Cursor, είπε ότι το μοντέλο προσφέρει "σχεδόν ευφυΐα Fable 5 με ταχύτητα και κόστος Opus".

Ο Wade Foster, Διευθύνων Σύμβουλος της Zapier, ανέφερε ότι το Opus 5 "ανέβηκε στην κορυφή του leaderboard AutomationBench του Zapier χωρίς να ξοδέψει περισσότερα tokens από τα προηγούμενα μοντέλα Claude", ολοκληρώνοντας μια πλήρη ροή εργασιών πρόληψης αναστάτωσης - επισήμανση λογαριασμών σε κίνδυνο, ειδοποίηση του σωστού ιδιοκτήτη και σύνοψη για ομάδες διατήρησης. Τα προηγούμενα μοντέλα δεν πέρασαν? Το Opus 5 έφτασε στο 100%.

Κέρδη στην Επιστημονική Έρευνα

Η Anthropic τόνισε επίσης τις βελτιώσεις του Opus 5 για την επιστημονική εργασία. Το μοντέλο ξεπερνά το Opus 4.8 σε κάθε αξιολόγηση βιοεπιστημών της Anthropic, που καλύπτει τη δομική βιολογία, την οργανική χημεία και τη βιοπληροφορική. Η εταιρεία επεσήμανε μια βελτίωση κατά 10,2 ποσοστιαίες μονάδες σε ένα σημείο αναφοράς εσωτερικής οργανικής χημείας (συναγωγή μοριακών δομών από δεδομένα φασματοσκοπίας) και κέρδος 7,7 μονάδων στις εργασίες πρόβλεψης πρωτεϊνικής λειτουργίας. Ένας πελάτης της γονιδιωματικής περιέγραψε το μοντέλο ότι συμπεριφέρεται «περισσότερο σαν προσεκτικός επιστήμονας», προσπαθώντας για τις σωστές στατιστικές δοκιμές και διασταυρώνοντας τα δικά του αποτελέσματα.

Η Στρατηγική Τιμολόγησης

Με την τιμολόγηση του Opus 5 στο ίδιο επίπεδο με το Opus 4.8, ενώ πλησιάζει την ευφυΐα του Fable 5, η Anthropic μειώνει ουσιαστικά το χάσμα μεταξύ της μεσαίας κατηγορίας και των ναυαρχίδων της. Το VentureBeat πλαισίωσε την κυκλοφορία ως «ένα φθηνότερο μοντέλο τεχνητής νοημοσύνης για κωδικοποίηση, πράκτορες και εταιρικές ροές εργασιών» και το Seeking Alpha παρατήρησε ότι το Opus 5 είναι «πιο κοντά και φθηνότερο στο συνοριακό μοντέλο Fable 5». Η εταιρεία προσφέρει μια ρυθμιζόμενη ρύθμιση «προσπάθειας» που επιτρέπει στους πελάτες να ανταλλάσσουν τη νοημοσύνη για ταχύτητα και χαμηλότερο κόστος συμβολαίων, προσαρμόζοντας την αναλογία κόστους προς απόδοση ανά εργασία.

Τι σημαίνει για τον αγώνα AI

Το Opus 5 υπογραμμίζει πόσο γρήγορα μειώνεται το κόστος της τεχνητής νοημοσύνης κοντά στα σύνορα. Ένα μοντέλο που βρίσκεται σε απόσταση αναπνοής από τα πιο ικανά συστήματα που είναι διαθέσιμα - στη μισή τιμή της συμβολικής τιμής - πιέζει τους ανταγωνιστές να δικαιολογήσουν την premium τιμολόγηση για οριακά κέρδη. Με το Anthropic, το OpenAI, το Google και άλλα που αγωνίζονται να κάνουν ικανά μοντέλα αρκετά προσιτά για καθημερινή, μεγάλης κλίμακας ανάπτυξη, το ερώτημα για τις επιχειρήσεις μετατοπίζεται από το "ποιο μοντέλο είναι πιο έξυπνο;" σε "ποιο μοντέλο προσφέρει την περισσότερη νοημοσύνη ανά δολάριο;"

Για την Anthropic, το μήνυμα είναι σαφές: η συλλογιστική υψηλού επιπέδου δεν είναι πλέον προϊόν πολυτελείας. Το Opus 5 φέρνει τη συνοριακή ικανότητα σε ένα σημείο τιμής που καθιστά τη συνεχή, καθημερινή ανάπτυξη ρεαλιστική — και αυτό μπορεί να αποδειχθεί η πιο σημαντική λεπτομέρεια από όλες.

Μείνε μπροστά από την τεχνητή νοημοσύνη

Το Claude Opus 5 είναι διαθέσιμο από σήμερα στα Claude Pro, Claude Max και μέσω του API της Anthropic. Για περισσότερα σχετικά με αυτήν την ιστορία και το ευρύτερο τοπίο της τεχνητής νοημοσύνης, παρακολουθήστε τις έκλυτες ειδήσεις AI όπως συμβαίνει.

Διαβάστε περισσότερα νέα AI →