Το κινεζικό εργαστήριο τεχνητής νοημοσύνης DeepSeek κυκλοφόρησε το V4-Flash "0731" στις 31 Ιουλίου 2026, μια επανεκπαιδευμένη έκδοση του μοντέλου προϋπολογισμού του που ταιριάζει σχεδόν με το GPT-5.6 Luna του OpenAI σε σημεία αναφοράς τρίτων με περίπου 60 τοις εκατό χαμηλότερο κόστος. Η κυκλοφορία, η οποία θέτει το δημόσιο beta API του μοντέλου σε γενική διαθεσιμότητα, είναι η πιο πρόσφατη καταστροφή σε έναν εντεινόμενο πόλεμο τιμών μεταξύ Κινέζων παρόχων ανοιχτού βάρους και εργαστηρίων στα δυτικά σύνορα. Για συνεχή κάλυψη των πολέμων μοντέλων, ελέγξτε τις [τελευταίες ειδήσεις AI] (https://aibuzzwire.news).

Σύμφωνα με το The Decoder, η νέα έκδοση κερδίζει 50 βαθμούς στον δείκτη νοημοσύνης τεχνητής ανάλυσης — ένα άλμα δέκα βαθμών σε σχέση με το προηγούμενο V4-Flash που κυκλοφόρησε τον Απρίλιο του 2026. Αυτό το τοποθετεί μόλις ένα πόντο πίσω από το GPT-5.6 Luna του OpenAI, παρά το κόστος περίπου 60 τοις εκατό λιγότερο ανά εργασία, ακόμη και μετά την πρόσφατη μείωση της τιμής 8 τοις εκατό του OpenAI.

Κατασκευάστηκε για πρακτορεία

Τα μεγαλύτερα κέρδη προέκυψαν από τα καθήκοντα πρακτόρων, την ικανότητα να ολοκληρώνει αυτόνομα την εργασία σε πολλά βήματα στον πραγματικό κόσμο. Το TechNode ανέφερε ότι το μοντέλο βαθμολογείται με 82,7 στο Terminal Bench 2.1 και 54,4 στο DeepSWE, δύο σημεία αναφοράς που έχουν σχεδιαστεί για να μετρούν πόσο καλά μια τεχνητή νοημοσύνη μπορεί να χρησιμοποιήσει εργαλεία, να γράψει κώδικα και να λύσει μηχανολογικά προβλήματα χωρίς να κρατάει το χέρι.

Στο GDPval, ένα σημείο αναφοράς που δοκιμάζει μοντέλα σε πολύπλοκες εργασίες γραφείου, το V4-Flash ανέβηκε από 1.189 σε 1.559 βαθμούς Elo. Ο DeepSeek είπε επίσης ότι το μοντέλο έχει παραισθήσεις λιγότερο συχνά από τον προκάτοχό του και χρησιμοποιεί περίπου 12 τοις εκατό λιγότερα token για να ολοκληρώσει τις ίδιες εργασίες.

Ίδια αρχιτεκτονική, πιο έξυπνα βάρη

Η αναβάθμιση διατηρεί την ίδια υποκείμενη δομή: 284 δισεκατομμύρια συνολικές παραμέτρους με 13 δισεκατομμύρια ενεργές ανά πάσα στιγμή και ένα παράθυρο περιβάλλοντος ενός εκατομμυρίου διακριτικών. Αντί να διευρύνει το μοντέλο, το DeepSeek το εκπαίδευσε εκ νέου — αποσπώντας περισσότερη απόδοση από το ίδιο αποτύπωμα. Τα βάρη των μοντέλων κυκλοφορούν με την άδεια του MIT στο Hugging Face, συνεχίζοντας την προσέγγιση ανοιχτού βάρους του DeepSeek.

Το DeepSeek ήταν προσεκτικό για να καλύψει την κυκλοφορία. Η ενημέρωση ισχύει μόνο για το V4-Flash API. το υψηλότερου επιπέδου V4-Pro API και τα μοντέλα που εξυπηρετούνται μέσω της εφαρμογής για καταναλωτές και του ιστότοπου του DeepSeek παραμένουν αμετάβλητα. Το νέο Flash API προσθέτει επίσης υποστήριξη για το Responses API και είναι προσαρμοσμένο για χρήση με το Codex, διευρύνοντας την απήχησή του στους προγραμματιστές που δημιουργούν πράκτορες κωδικοποίησης.

Το Edge έκπτωσης στην προσωρινή μνήμη

Ένα σημαντικό μέρος του πλεονεκτήματος κόστους του DeepSeek προέρχεται από τους μηχανισμούς τιμολόγησης του. Η εταιρεία προσφέρει έκπτωση 98 τοις εκατό στην προσωρινή μνήμη - πολύ πάνω από το βιομηχανικό πρότυπο 90 τοις εκατό - που σημαίνει ότι επαναλαμβανόμενα ή προβλέψιμα τμήματα ενός αιτήματος χρεώνονται με ένα μικρό κλάσμα της κανονικής τιμής. Σε συνδυασμό με λιγότερα διακριτικά ανά εργασία, το πραγματικό κόστος για πολλούς φόρτους εργασίας μειώνεται δραματικά.

Αυτή η δομή τιμολόγησης είναι μια άμεση πρόκληση για το OpenAI, το οποίο μειώνει τις τιμές για να υπερασπιστεί το μερίδιο αγοράς. Το αποτέλεσμα είναι μια αγορά όπου η σχεδόν αόρατη ποιότητα γίνεται εμπόρευμα και ο ανταγωνισμός καθορίζεται όλο και περισσότερο από την αποδοτικότητα των υποδομών και τα οικονομικά στοιχεία της μονάδας και όχι από την ακατέργαστη ικανότητα.

Ένας πόλεμος τιμών χωρίς πάτωμα

Η έκδοση εντείνει αυτό που οι αναλυτές περιγράφουν τώρα ως έναν πλήρη πόλεμο τιμών. Το OpenAI μείωσε τις τιμές του GPT-5.6 Luna κατά 80 τοις εκατό για να υπερασπιστεί τη βάση προγραμματιστών του, μόνο για να απαντήσει η DeepSeek με ένα μοντέλο που είναι συγκρίσιμα ικανό και ακόμα πολύ φθηνότερο. Κάθε γύρος μειώνει το αποτελεσματικό κόστος της νοημοσύνης κοντά στα σύνορα και το χάσμα μεταξύ των φθηνότερων και πιο ακριβών ικανών μοντέλων συνεχίζει να μειώνεται.

Η δυναμική είναι ασυνήθιστη στο λογισμικό. Στις περισσότερες αγορές, ένα πλεονέκτημα κόστους 60 τοις εκατό σε σχεδόν ίση ποιότητα θα καταλάμβανε γρήγορα μερίδιο. Εδώ, το πλεονέκτημα αντιστοιχίζεται και αντιστοιχίζεται εκ νέου εντός εβδομάδων, αφήνοντας τους προγραμματιστές με έναν συνεχώς μεταβαλλόμενο πίνακα κατάταξης. Η ισοτιμία αναφοράς, κάποτε η αποκλειστική επαρχία των συνοριακών εργαστηρίων, διατίθεται όλο και περισσότερο από ανταγωνιστές ανοιχτού βάρους που είναι πρόθυμοι να δημοσιεύσουν τόσο τα βάρη τους όσο και τις τιμές τους.

Τι σημαίνει για τους προγραμματιστές

Για τους προγραμματιστές, η πρακτική συνέπεια είναι σαφής: τα ικανά μοντέλα αντιπροσώπων γίνονται φθηνότερα γρήγορα. Ένα μοντέλο που μπορεί να πλοηγηθεί αυτόνομα σε ένα τερματικό, να γράψει και να διορθώσει κώδικα και να χειριστεί περίπλοκες εργασίες γραφείου - όλα με ένα κλάσμα του λεπτού ανά αίτημα - αλλάζει τα οικονομικά της κατασκευής προϊόντων με τεχνητή νοημοσύνη.

Η έκδοση ανοιχτού βάρους σημαίνει επίσης ότι οι ομάδες μπορούν να εκτελέσουν το μοντέλο με το δικό τους υλικό, αποφεύγοντας εξ ολοκλήρου τις χρεώσεις API ανά διακριτικό για ευαίσθητους φόρτους εργασίας. Καθώς οι DeepSeek, OpenAI και άλλοι συνεχίζουν να ανταλλάσσουν πλήγματα στην τιμή και την απόδοση, οι νικητές είναι οι κατασκευαστές που έχουν τώρα ένα αυξανόμενο μενού ικανών, προσιτών μοντέλων για να διαλέξουν.

Μείνετε μπροστά από την καμπύλη AI

Το τοπίο της τεχνητής νοημοσύνης κινείται πιο γρήγορα από ποτέ και οι εταιρείες που παρακολουθούν αυτές τις αλλαγές νωρίς αποκτούν πλεονέκτημα διαρκείας. Για συνεχή, ελεγμένη από την πηγή κάλυψη των εκδόσεων μοντέλων, των γύρων χρηματοδότησης και των κινήσεων πολιτικής, ακολουθήστε τις [τελευταίες ειδήσεις AI] (https://aibuzzwire.news).

Διαβάστε περισσότερα νέα AI →