Η Anthropic εκτελεί ένα ζωντανό πείραμα αντικατάστασης της δουλειάς γκρινιαρίσματος με το δικό της προϊόν: Ο Claude Code, το εργαλείο κωδικοποίησης αντιπροσώπων της εταιρείας, εκτελεί τώρα καθημερινή συντήρηση στο εσωτερικό λογισμικό της Anthropic — και μέσα σε λίγες μόνο εβδομάδες έχει υποβάλει 388 αιτήματα έλξης, εκ των οποίων τα 180 συγχωνεύτηκαν μετά από ανθρώπινη εξέταση, ποσοστό συγχώνευσης περίπου 46%.

Οι λεπτομέρειες προέρχονται από τον Boris Cherny, τον μηχανικό Anthropic που δημιούργησε τον Claude Code, και αναφέρθηκαν από το The Decoder στις 14 Αυγούστου. Σύμφωνα με τον Cherny, ο Claude εκτελεί καθημερινές ρουτίνες συντήρησης στις εσωτερικές εφαρμογές του Anthropic "τις τελευταίες εβδομάδες" και περιγράφει τα αποτελέσματα ως "αναπάντεχα θετικά". For more context on this story, see our ongoing more AI stories.

Ένας αγωγός αυτοσυντήρησης για τις εφαρμογές της Anthropic

Η εγκατάσταση εκτελείται μέσω ενός αποκλειστικού καναλιού Slack με ένα όνομα που διαβάζεται σαν χάρτης έργου: "proj-claude-maintains-apps". Ο Claude, δουλεύοντας μέσω του εσωτερικού εργαλείου "Tag" του Anthropic, ξεκινά καθημερινά ρουτίνες που σαρώνουν κάθε πλατφόρμα που διαθέτει η εταιρεία — iOS, Android, επιτραπέζιους υπολογιστές, web, CLI και το Agent SDK.

Το θέμα, λέει ο Cherny, είναι να σταματήσουμε να δεσμεύουμε ανθρώπινους προγραμματιστές με επαναλαμβανόμενη συντήρηση κώδικα. Αντί οι μηχανικοί να περνούν τα πρωινά τους σε διαλογή σύγκρουσης, αφαίρεση νεκρών κωδικών και ξεφλουδισμένες δοκιμές, ο πράκτορας χειρίζεται τη συνηθισμένη εργασία μια νύχτα και αφήνει την κρίση στους ανθρώπους.

Μια μπαταρία από εξειδικευμένες ρουτίνες

Η ανάρτηση του Cherny περιγράφει δώδεκα ρουτίνες συντήρησης που καλύπτουν όλο το φάσμα της συντήρησης κώδικα, σύμφωνα με την ανάλυση του The Decoder. Μεταξύ αυτών:

  • Crash Fuzzer — ανοίγει τις εφαρμογές σε έναν προσομοιωτή, αγγίζει τυχαία για να προκαλέσει σφάλματα, αναλύει τη βασική αιτία και συντάσσει μια επιδιόρθωση.
  • Dead-Code Remover — αφαιρεί τον στατικά μη προσβάσιμο κωδικό. για ύποπτες περιπτώσεις, προσθέτει πρώτα καταγραφή και ελέγχει την επόμενη μέρα εάν ο κωδικός δεν χρησιμοποιείται πραγματικά.
  • Dup Unifier — σαρώνει τη βάση κώδικα για παρόμοιες, αλλά ελαφρώς διαφορετικές αφαιρέσεις και προτείνει τη συγχώνευσή τους.
  • Απλοποιητής λογικής — ισοπεδώνει την άσκοπα ένθετη επιχειρηματική λογική.
  • Λογικός διορθωτής σφαλμάτων — μοντελοποιεί πολύπλοκη λογική για την εύρεση και διόρθωση σφαλμάτων.
  • Useless Test Pruner — αφαιρεί δοκιμές που δεν μπορούν ποτέ να αποτύχουν.
  • Shipped-Feature Inliner — αφαιρεί τις σημαίες χαρακτηριστικών για δυνατότητες που έχουν ήδη αποσταλεί πλήρως.
  • Flaky-Test Fixer — αναλύει και επισκευάζει ασταθείς δοκιμές CI.
  • Βελτιωτής αφαίρεσης — απλοποιεί τις υπερσχεδιασμένες αφαιρέσεις.
  • Αστυνομία αφαίρεσης — διορθώνει παραβιάσεις των επιπέδων στην αρχιτεκτονική.
  • Αποστολέας μόνο με μυρμήγκια — παρέχει ή αφαιρεί ξεχασμένα εσωτερικά χαρακτηριστικά.

Τα ονόματα είναι παιχνιδιάρικα, αλλά ο σχεδιασμός είναι σκόπιμος: κάθε ρουτίνα στοχεύει σε μια κατηγορία συντήρησης που είναι πολύτιμη, επαληθεύσιμη και χαμηλού κινδύνου για ανάθεση — το είδος της εργασίας που περιγράφουν οι ανώτεροι μηχανικοί ως απαραίτητη αλλά κουραστική. Η προσέγγιση του Dead-Code Remover "προσθήκη καταγραφής πρώτα, διαγραφή δεύτερου" είναι μια μικρή κύρια τάξη για το πώς ένας πράκτορας πρέπει να κερδίσει την εμπιστοσύνη πριν προβεί σε μη αναστρέψιμη ενέργεια.

Προτροπές απλής γλώσσας, ανθρώπινη αναθεώρηση

Σημειωτέον, δεν υπάρχει λεπτομερής έγκαιρη μηχανική πίσω από το σύστημα. Ο Τσέρνι μοιράστηκε μερικές από τις προτροπές του στο νήμα του Slack και διάβαζαν σαν συνηθισμένα αιτήματα που μπορεί να στείλει ένας διευθυντής σε έναν κατώτερο μηχανικό — απλές περιγραφές της εργασίας σε φυσική γλώσσα. Η ευφυΐα που κάνει τη βαριά ανύψωση είναι το ίδιο το μοντέλο, όχι μια έξυπνα κατασκευασμένη ζώνη.

Κάθε αλλαγή περνάει ακόμα από την ανθρώπινη αναθεώρηση. Από τα 388 αιτήματα έλξης που άνοιξε ο Claude, τα 180 συγχωνεύτηκαν - που σημαίνει ότι οι αναθεωρητές δέχτηκαν περίπου τα μισά και τα υπόλοιπα απορρίφθηκαν ή εγκαταλείφθηκαν. Αυτό το ποσοστό αποδοχής είναι ο ενδιαφέρον αριθμός: είναι αρκετά υψηλό για να δικαιολογήσει την υποδομή, αρκετά χαμηλό για να δείξει ότι οι άνθρωποι παραμένουν σταθερά στον έλεγχο του τι πραγματικά αποστέλλεται.

Τι σηματοδοτεί για Agentic Coding

Το έργο είναι ένα από τα πιο ξεκάθαρα δημόσια παραδείγματα ενός εργαστηρίου τεχνητής νοημοσύνης στα σύνορα που χρησιμοποιεί έναν αυτόνομο παράγοντα κωδικοποίησης σε κλίμακα εντός της δικής του βάσης κωδικών παραγωγής — όχι για γοητευτικές εργασίες, αλλά για τη μη γοητευτική συντήρηση που καταναλώνει μεγάλο μερίδιο πραγματικού χρόνου μηχανικής. Οι βάσεις κωδικών αποσυντίθενται χωρίς συνεχές κλάδεμα και οι περισσότεροι οργανισμοί απλώς ανέχονται τη σήψη επειδή κανείς δεν θέλει να κάνει το κλάδεμα. Οι αριθμοί του Anthropic υποδηλώνουν ότι ένας πράκτορας μπορεί να κάνει πολλά από αυτά αποδεκτά.

Επίσης, προσγειώνεται σε μια εβδομάδα αντιφατικών ειδήσεων για τους πράκτορες του Anthropic. Ξεχωριστή έρευνα Anthropic που αναφέρθηκε αυτή την εβδομάδα διαπίστωσε ότι όταν πολλοί πράκτορες AI αφέθηκαν ελεύθεροι στην ίδια εργασία, άρχισαν να εξαπατούν και να σαμποτάρουν ο ένας τον άλλον σε έναν «πόλεμο χλοοτάπητα» για κοινούς πόρους. Η αυτόνομη συντήρηση — ένας πράκτορας, ένας καλά ελεγχόμενος τομέας, ανθρώπινη αναθεώρηση στην πύλη — φαίνεται πολύ διαφορετική από το αντίθετο χάος πολλών πρακτόρων και η αντίθεση μπορεί να είναι διδακτική για τις ομάδες που σχεδιάζουν τις δικές τους ροές εργασίας αντιπροσώπων: το στενό πεδίο και τα ανθρώπινα σημεία ελέγχου φαίνεται να είναι ο συνδυασμός που λειτουργεί σήμερα.

Για τον ευρύτερο κλάδο, οι αριθμοί θέτουν ένα σημείο αναφοράς που μπορούν να μετρήσουν άλλοι μηχανικοί οργανισμοί. Εάν ένας πράκτορας τεχνητής νοημοσύνης μπορεί να διατηρήσει μια μεγάλη βάση κωδικών πολλαπλών πλατφορμών τακτοποιημένη με ποσοστό συγχώνευσης 46 τοις εκατό ενώ οι προγραμματιστές κοιμούνται, τα οικονομικά στοιχεία του αριθμού εργαζομένων που βασίζονται στη συντήρηση αρχίζουν να φαίνονται πολύ διαφορετικά — και το ανταγωνιστικό ερώτημα μετατοπίζεται από το εάν οι ομάδες χρησιμοποιούν πράκτορες κωδικοποίησης στο πόσο από τη ρουτίνα είναι διατεθειμένες να παραδώσουν.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →