Η Sakana AI με έδρα το Τόκιο κυκλοφόρησε το Fugu, ένα σύστημα που προσφέρει την απόδοση ενός μοντέλου τεχνητής νοημοσύνης συνόρων συντονίζοντας δυναμικά πολλά μοντέλα ταυτόχρονα. Αντί να δημιουργεί ένα γιγάντιο νευρωνικό δίκτυο, το Fugu είναι το ίδιο ένα μοντέλο γλώσσας που έχει εκπαιδευτεί να καλεί άλλα LLM από ένα swappable "agent pool", συγκεντρώνοντας μια ομάδα εξειδικευμένων μοντέλων για κάθε εργασία και συνθέτοντας τα αποτελέσματά τους μέσω ενός ενιαίου API συμβατού με OpenAI.

Η κυκλοφορία, που καλύπτεται από το THE DECODER, το MarkTechPost και το MIT Sloan Management Review, αντιπροσωπεύει ένα στοίχημα ότι το επόμενο άλμα στην απόδοση της τεχνητής νοημοσύνης μπορεί να προέλθει λιγότερο από ακατέργαστη κλίμακα και περισσότερο από πιο έξυπνο συντονισμό των μοντέλων που ήδη υπάρχουν. For more context on this story, see our ongoing latest AI developments.

Ένα μοντέλο για να τους κουμαντάρεις όλους

Για τον χρήστη, το Fugu συμπεριφέρεται σαν ένα ενιαίο μοντέλο. Κάτω από την κουκούλα, είτε χειρίζεται ένα αίτημα μόνο του είτε συγκεντρώνει μια ομάδα εξειδικευμένων μοντέλων, διαχειρίζοντας την επιλογή, την ανάθεση, τον έλεγχο και τη σύνθεση εσωτερικά. Η Sakana AI λέει ότι η προσέγγιση βασίζεται σε προηγούμενες εργασίες, όπως το ALE-Agent, το οποίο κατέταξε την 21η θέση στους 1.000 ειδικούς σε έναν διαγωνισμό κωδικοποίησης χρησιμοποιώντας τεχνικές ενορχήστρωσης.

Η εταιρεία κυκλοφορεί δύο παραλλαγές. Το βασικό μοντέλο Fugu στοχεύει σε χαμηλή καθυστέρηση και σταθερή καθημερινή απόδοση σε περιπτώσεις κωδικοποίησης, αναθεώρησης κώδικα και χρήσης chatbot, και επιτρέπει στις ομάδες να αποκλείουν συγκεκριμένους πράκτορες από το pool για απόρρητο ή συμμόρφωση. Το Fugu Ultra έχει κατασκευαστεί για μέγιστη ποιότητα απαντήσεων σε σύνθετα προβλήματα πολλαπλών βημάτων, όπως η αναπαραγωγή επιστημονικών εργασιών, η ανάλυση της ασφάλειας στον κυβερνοχώρο και οι αναζητήσεις διπλωμάτων ευρεσιτεχνίας και βιβλιογραφίας.

Συγκριτική αξιολόγηση αξιώσεων που γυρίζουν τα κεφάλια

Σύμφωνα με τα αποτελέσματα συγκριτικής αξιολόγησης που δημοσίευσε η Sakana AI, το Fugu Ultra αποδίδει ισάξια με το Fable 5 και το Mythos Preview της Anthropic σε μια σειρά σημείων αναφοράς κωδικοποίησης, συλλογισμού και επιστήμης. Σημειωτέον, κανένα από τα μοντέλα Anthropic δεν είναι στην πραγματικότητα στην ομάδα πρακτόρων της Fugu επειδή δεν είναι δημόσια διαθέσιμα, πράγμα που σημαίνει ότι η Fugu έφτασε σε συγκρίσιμες βαθμολογίες χρησιμοποιώντας άλλα μοντέλα.

Οι αριθμοί που δημοσιεύονται είναι εντυπωσιακοί. Στο SWE-Bench Pro, το Fugu Ultra σημείωσε 73,7, μπροστά από το Opus 4,8 στο 69,2, το Gemini 3,1 Pro στο 54,2 και το GPT 5,5 στο 58,6. Στο TerminalBench 2.1 σημείωσε 80.2 έναντι 82.1 του Opus 4.8. Στο LiveCodeBench έφτασε το 93,2 έναντι του 85,3 του GPT 5,5 και στο Humanity's Last Exam δημοσίευσε το 50,0, ξεπερνώντας το 49,8 του Opus 4.8 και το 41,4 του GPT 5.5.

Πραγματικές δοκιμές Ζωγραφίστε μια μικτή εικόνα

Οι πρώτες πρακτικές κριτικές ήταν λιγότερο ενθουσιώδεις από τα σημεία αναφοράς. Ο ερευνητής τεχνητής νοημοσύνης, Ethan Mollick, έγραψε στο X ότι το Fugu Ultra είναι «απίστευτα αργό», με τις συνήθεις δοκιμές κωδικοποίησης να διαρκούν 30 λεπτά και τα αποτελέσματα ήταν «καλά» αλλά στην πράξη δεν ήταν του Fable. Ένας άλλος χρήστης ανέφερε ότι ξεπέρασε ένα ολόκληρο όριο πέντε ωρών στο πρόγραμμα 20 $ με μία μόνο προτροπή, ενώ οι προγραμματιστές στο Hacker News παραπονέθηκαν ότι το πρόγραμμα των 200 $ ανά μήνα αποδίδει λιγότερο από τρεις ώρες την εβδομάδα χρήσιμο χρόνο.

Οι κριτικές κώδικα εμφανίστηκαν ως ένα φωτεινό σημείο, που ταιριάζουν χονδρικά με το Opus 4.8 ή το GPT 5.5 σε ποιότητα. Μια head-to-head δοκιμή έδειξε ότι το Fugu Ultra ολοκλήρωσε μια εργασία κωδικοποίησης σε 22 λεπτά για 7,32 $, πολύ πιο γρήγορα και φθηνότερα από τα 79 λεπτά και τα 37,85 $ του Opus 4.8, αν και ο κριτικός προτίμησε την έξοδο του Opus.

Η Sakana AI, που ιδρύθηκε στο Τόκιο το 2023 και υποστηρίζεται από την Nvidia, έχει χτίσει την ταυτότητά της στην έρευνα τεχνητής νοημοσύνης εμπνευσμένη από τη φύση, χρησιμοποιώντας εξελικτικούς αλγόριθμους και ιδέες συλλογικής νοημοσύνης για να συμπιέζει περισσότερη απόδοση από τα υπάρχοντα μοντέλα. Η Fugu επεκτείνει αυτή τη φιλοσοφία στην εμπορική αγορά, μετατρέποντας την ίδια την ενορχήστρωση σε προϊόν. Η εταιρεία τοποθετεί επίσης το σύστημα για ένα ιαπωνικό κοινό που ανησυχεί για την υπερβολική εξάρτηση από παρόχους των ΗΠΑ, με δίγλωσσο ιστότοπο και τιμολόγηση που απευθύνεται τόσο σε μεμονωμένους προγραμματιστές όσο και σε ομάδες επιχειρήσεων.

Ένα αντιστάθμισμα κατά του κλειδώματος πωλητή

Πέρα από την ακατέργαστη απόδοση, η Sakana AI προωθεί τη Fugu ως προστασία έναντι της εξάρτησης από οποιονδήποτε πάροχο τεχνητής νοημοσύνης. Η εταιρεία επεσήμανε τους πρόσφατους ελέγχους εξαγωγών των ΗΠΑ που απέσυραν τα μοντέλα Anthropic's Fable και Mythos από τις ξένες αγορές ως απόδειξη ότι η πρόσβαση σε κορυφαία συστήματα μπορεί να εξαφανιστεί εν μία νυκτί.

«Για έναν οργανισμό ή ένα έθνος, το να βασίζεται στα API μιας μεμονωμένης εταιρείας για κρίσιμες υποδομές, χρηματοδότηση ή διακυβέρνηση είναι μια σημαντική ευπάθεια», έγραψε η Sakana AI στην ανακοίνωσή της. Επειδή η ομάδα μοντέλων της Fugu είναι πλήρως εναλλάξιμη, το σύστημα μπορεί να επαναδρομολογηθεί σε άλλα μοντέλα εάν ένας πάροχος σκοτεινιάσει.

Οι αναλυτές προειδοποιούν ότι αυτό δεν είναι το ίδιο με την πραγματική κυριαρχία. Η απόδοση της Fugu εξαρτάται από τα μοντέλα που θα τοποθετηθούν στην πισίνα της και αρκετοί κορυφαίοι πάροχοι που περιορίζουν την πρόσβαση ταυτόχρονα θα εξακολουθούν να συρρικνώνουν τις επιλογές της. Η εταιρεία επίσης δεν έχει αποκαλύψει ακόμη πόσο αυξάνει τη χρήση και το κόστος του επιπέδου ενορχήστρωσης. Ωστόσο, καθώς τα συνοριακά μοντέλα γίνονται γεωπολιτικά περιουσιακά στοιχεία και το κλείδωμα ενός προμηθευτή γίνεται πιο επικίνδυνο, η Fugu προσφέρει μια προεπισκόπηση μιας βιομηχανίας τεχνητής νοημοσύνης όπου ο συντονισμός μπορεί να έχει σημασία όσο και η ικανότητα.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →