Η Google ανακοίνωσε την Τρίτη το Gemini 4 Argon, το πιο πρόσφατο μοντέλο της που έχει σχεδιαστεί για επαγγελματική εργασία μακράς διάρκειας στον τομέα της μηχανικής λογισμικού, των εργασιών επιχειρηματικής γνώσης και της άμυνας στον κυβερνοχώρο. Γράφοντας στο επίσημο ιστολόγιο της Google, ο Koray Kavukcuoglu, SVP του Google DeepMind και Chief AI Architect, είπε ότι το μοντέλο θα κυκλοφορήσει αρχικά σε ένα σύνολο αξιόπιστων υπερασπιστών στον κυβερνοχώρο μέσω του Προγράμματος Fairwind της Google, με ευρύτερη πρόσβαση που θα ακολουθήσει μόλις ενισχυθούν τα προστατευτικά κιγκλιδώματα.

Η ανακοίνωση προσγειώνεται κατά τη διάρκεια μιας από τις πιο πολυσύχναστες εκδόσεις του έτους για τις συνοριακές εκδόσεις AI. Για συνεχή κάλυψη των κυκλοφοριών μοντέλων, των πολιτικών αγώνων και των γύρων χρηματοδότησης, το AI Buzz Wire παρακολουθεί τις εξελίξεις που έχουν σημασία καθώς συμβαίνουν.

Μια σταδιακή διάθεση διαμορφωμένη με προσοχή

Σε αντίθεση με μια τυπική κυκλοφορία μεγάλου μοντέλου, οι περισσότεροι χρήστες δεν μπορούν να δοκιμάσουν το Argon σήμερα. Η Google δήλωσε ότι συμμετέχει στην εθελοντική διαδικασία της κυβέρνησης των ΗΠΑ για πρόσβαση στο μοντέλο πριν από την κυκλοφορία και θα επεκτείνει σταδιακά τη διαθεσιμότητα καθώς τα σχόλια από τους πρώτους δοκιμαστές διαμορφώνουν τα προστατευτικά κιγκλιδώματα της. Το Reuters ανέφερε ότι η ναυαρχίδα φτάνει μετά από μήνες καθυστερήσεων και η VentureBeat σημείωσε ότι η στρατηγική περιορισμένης κυκλοφορίας εξακολουθεί να επιτρέπει στην Google να διεκδικήσει ένα νέο προβάδισμα αναφοράς έναντι των OpenAI και Anthropic. Το Bloomberg ανέφερε μετρήσιμο σκεπτικισμό σχετικά με το νέο μοντέλο μεταξύ των εργαζομένων της Google πριν από την κυκλοφορία του.

Όταν έρθει ευρύτερη πρόσβαση, η Google είπε ότι θα ξεκινήσει με πελάτες API επί πληρωμή και συνδρομητές Google AI Ultra.

Αυτό που λέει η Google μπορεί να κάνει το Argon

Η βασική αλλαγή ικανότητας είναι η αντοχή. Το όριο διακριτικών εξόδου του Argon έχει επεκταθεί σε 1 εκατομμύριο μάρκες κορυφαίας βιομηχανίας, από τα προηγούμενα 64 χιλιάδες. Η Google υποστηρίζει ότι το να δίνει σε ένα μοντέλο το περιθώριο λογικής σε εκατοντάδες χιλιάδες διακριτικά σε μία μόνο τροχιά, του επιτρέπει να λύνει δύσκολα προβλήματα με ένα πέρασμα αντί να κατακερματίζει την εργασία σε περιόδους σύνδεσης.

Η Google δημοσίευσε αποτελέσματα συγκριτικής αξιολόγησης για να υποστηρίξει τον ισχυρισμό των συνόρων:

  • DeepSWE v1.1: 77,9% — μια νέα τελευταία λέξη της τεχνολογίας στο σημείο αναφοράς μηχανικής λογισμικού του πραγματικού κόσμου
  • Δείκτης Vals: Νο. 1 — κορυφαία απόδοση σε θέματα χρηματοοικονομικής, κωδικοποίησης, νομικής και φορολογικής εργασίας σταθμισμένη με βάση τη συνεισφορά στο ΑΕΠ των ΗΠΑ
  • AutomationBench: 51,3% — πρώτη θέση στο σημείο αναφοράς εκτέλεσης επιχειρήσεων από άκρο σε άκρο της Zapier
  • LVBench: 91,7% — τελευταίας τεχνολογίας στην κατανόηση βίντεο μεγάλης διάρκειας
  • CWE-bench v1: 68% — ισόπαλος πρώτος στην αποκατάσταση ευπάθειας ασφαλείας

Μέσα στις ροές εργασίας της Google

Το Argon τροφοδοτεί ήδη την εσωτερική εργασία της Google και η εταιρεία πρόσφερε ασυνήθιστα συγκεκριμένα παραδείγματα. Στον κβαντικό υπολογισμό, το μοντέλο βελτιστοποίησε χωροχρονικούς πόρους για υπορουτίνες συμφόρησης, ξεπερνώντας τη δημοσιευμένη βασική γραμμή κατά 40% σε λεπτά. Αναλύοντας την τηλεμετρία προφίλ σε όλο τον στόλο, ομάδες πρακτόρων Argon εντόπισαν και εφάρμοσαν βελτιστοποιήσεις μνήμης στα κέντρα δεδομένων της Google που απελευθέρωσαν πάνω από 300 TiB μόλις κυκλοφόρησαν, με εκτιμώμενη συνολική εξοικονόμηση 500 TiB έως 1 PiB.

Το μοντέλο οδηγεί επίσης σε μεταναστεύσεις κώδικα μεγάλης κλίμακας από το C/C++ στο Rust, κλιμακώνοντας από δεκάδες χιλιάδες γραμμές σε βασικές βιβλιοθήκες όπως το re2 και το libgav1 σε περισσότερες από 800.000 γραμμές στον πυρήνα Fuchsia Zircon. Για το libgav1, τον αποκωδικοποιητή βίντεο ανοιχτού κώδικα της Google, οι πράκτορες Argon αντικατέστησαν 32.000 γραμμές κώδικα SIMD με το ασφαλές Rust που είναι φιλικό προς τον μεταγλωττιστή, δημιουργώντας έναν αποκωδικοποιητή ασφαλή για μνήμη που λειτουργεί 2,7 φορές πιο γρήγορα από την προηγούμενη θύρα Rust με την ίδια έξοδο.

Η άμυνα στον κυβερνοχώρο έρχεται πρώτη

Το Argon εκπαιδεύτηκε ρητά για αμυντική εργασία στον κυβερνοχώρο: αυτόνομη εύρεση, επικύρωση και επιδιόρθωση κρίσιμων τρωτών σημείων λογισμικού. Για τους αξιόπιστους υπερασπιστές και τις εσωτερικές ομάδες της Google, η εταιρεία θα κυκλοφορήσει το μοντέλο χωρίς προστατευτικά κιγκλιδώματα, ώστε οι υπερασπιστές να έχουν πλήρη ικανότητα. Στο CWE-bench v1, το οποίο μετρά την αποκατάσταση ευπάθειας, το Argon καταλαμβάνει την πρώτη θέση στο 68%, βασιζόμενη στην οριακή απόδοση του 3,8 Flash Cyber, και η Google λέει ότι το Argon ξεπέρασε αυτό το μοντέλο στην ανακάλυψη επιφανειών επίθεσης και τη δημιουργία αποδεικτικών στοιχείων στο σημείο αναφοράς δοκιμών διείσδυσης μαύρου κουτιού της Wiz.

Η εταιρεία ασφαλείας Wiz χρησιμοποιεί ήδη το Argon μέσω της πρωτοβουλίας Scan for Good, η οποία προστατεύει κρίσιμες δημόσιες υποδομές δωρεάν. Σε μια πρώιμη επίδειξη, η Google λέει ότι το μοντέλο αποκάλυψε μια κρίσιμη ευπάθεια που εκθέτει ευαίσθητες προσωπικές πληροφορίες σε λογισμικό υγειονομικής περίθαλψης που χρησιμοποιείται από νοσοκομεία σε όλο τον κόσμο - έναν κίνδυνο που είχαν χάσει τα προηγούμενα μοντέλα συνόρων.

Τέσσερα επίπεδα διασφαλίσεων συνόρων

Πριν από την ευρεία διαθεσιμότητα, η Google ενισχύει τις διασφαλίσεις σε τέσσερις τομείς. Κατά της κακής χρήσης, το Argon έχει σχεδιαστεί για να απορρίπτει αιτήματα επιθέσεων στον κυβερνοχώρο και CBRN, διατηρώντας παράλληλα τη νόμιμη έρευνα διπλής χρήσης, με νέες τεχνικές που παρακολουθούν τις εσωτερικές ενεργοποιήσεις του μοντέλου για τον εντοπισμό καταχρήσεων. Ενάντια στην άμεση έγχυση, η εκπαίδευση σε αντιπάλους έχει καταστήσει το Argon Google το πιο ανθεκτικό μοντέλο μέχρι σήμερα, οδηγώντας στο σημείο αναφοράς Indirect Prompt Injection της Grey Swan.

Για κακή ευθυγράμμιση, η Google αναπτύσσει μέτρα μετριασμού που παρακολουθούν την αλυσίδα σκέψεων και ενεργειών του Argon, σταματώντας την εκτέλεση όταν είναι απαραίτητο, με ειδοποιήσεις που δρομολογούνται σε μια ειδική ομάδα αντιμετώπισης περιστατικών. Η εταιρεία σκληρύνει επίσης τα περιβάλλοντα εκπαίδευσης και αξιολόγησης με sandbox, σφραγίζοντάς τα πριν από τρεξίματα υψηλού κινδύνου. Συγκεκριμένα, η Google προέτρεψε τον υπόλοιπο κλάδο να διατηρήσει τη διαφάνεια των συλλογισμών, ώστε οι σκέψεις του μοντέλου να παραμένουν χρήσιμες για τη διάγνωση της κακής ευθυγράμμισης.

Τιμές και διαθεσιμότητα

Το Argon θα κυκλοφορήσει σε τιμή γνωριμίας 2 $ ανά εκατομμύριο μάρκες εισόδου και 10 $ ανά εκατομμύριο μάρκες εξόδου, με κρυφά διακριτικά εισόδου με έκπτωση 95% από την τιμή εισόδου. Μετά την εισαγωγική περίοδο, η τιμολόγηση αυξάνεται σε 4 $ ανά εκατομμύριο μάρκες εισόδου και 20 $ ανά εκατομμύριο μάρκες εξόδου - τοποθετώντας το Argon επιθετικά έναντι των ανταγωνιστικών συνόρων προσφορών.

Το σκηνικό ντεμπούτο αντικατοπτρίζει μια νέα πραγματικότητα για τις προοριακές εκδόσεις: η ικανότητα είναι πλέον στοιχήματα τραπεζιού και το διαφοροποιητικό επιδεικνύει έλεγχο. Η Google στοιχηματίζει ότι οι υπερασπιστές στον κυβερνοχώρο, το λογισμικό νοσοκομείων και οι μεταναστεύσεις Rust είναι η σωστή βιτρίνα — και ότι μια πιο αργή δημόσια κυκλοφορία κοστίζει λιγότερο από ένα άλλο περιστατικό ασφάλειας. Οι προγραμματιστές και οι επιχειρήσεις θα πρέπει να παρακολουθούν το επί πληρωμή παράθυρο πρόσβασης API και AI Ultra, το οποίο η Google λέει ότι θα ανοίξει μόλις το επιτρέψει η δοκιμή προστατευτικών κιγκλιδωμάτων.

---

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Λάβετε τα τελευταία νέα, αναλύσεις και ανακαλύψεις AI — όλα σε ένα μέρος.

Διαβάστε περισσότερα νέα AI →