Ένα νέο πρότυπο για το τι σημαίνει «ανοιχτό» στην τεχνητή νοημοσύνη ορίστηκε την Πέμπτη. Το Institute of Foundation Models (IFM), ένα ινστιτούτο τεχνητής νοημοσύνης με έδρα το Άμπου Ντάμπι, κυκλοφόρησε το K2 Horizon, έναν συνδεδεμένο στόλο έξι γλωσσικών μοντέλων που συνοδεύει τα πάντα, από τελικά βάρη μέχρι δεδομένα εκπαίδευσης, ενδιάμεσα σημεία ελέγχου, κώδικα εκπαίδευσης και λεπτομερή αρχεία καταγραφής — ένα πακέτο που το Reuters περιέγραψε ως μοντέλα πλήρως ανοιχτού κώδικα που κυκλοφόρησαν με τα εκπαιδευτικά δεδομένα και τον κώδικα.
Οι περισσότερες εκδόσεις ανοιχτού βάρους εξακολουθούν να σταματούν στα βάρη, αφήνοντας τους ξένους να μαντέψουν πώς κατασκευάστηκαν πραγματικά τα μοντέλα. Το K2 Horizon ακολουθεί την αντίθετη προσέγγιση και η άφιξή του είναι μια σημαντική στιγμή για όποιον παρακολουθεί [μοντέλα τεχνητής νοημοσύνης ανοιχτού βάρους] (https://aibuzzwire.news) σε όλη τη βιομηχανία.
Έξι μοντέλα, από ένα ρολόι μέχρι την επιχείρηση
Ο στόλος εκτείνεται σε έξι μεγέθη: παραμέτρους 375B-A23B, 36B-A4B, 32B, 7B, 3.7B και 0.9B. Σύμφωνα με την ανακοίνωση της IFM, τα μοντέλα έχουν σχεδιαστεί ως ένα συνδεδεμένο σύστημα και όχι ως έξι άσχετες εκδόσεις.
Το μικρότερο μοντέλο στοχεύει σε πολύ περιορισμένα περιβάλλοντα, όπως ρολόγια και γυαλιά, ενώ τα μοντέλα 3.7B και 7B είναι τοποθετημένα για τηλέφωνα και άλλες εφαρμογές στη συσκευή. Το πυκνό μοντέλο 32B και το αραιό μοντέλο 36B-A4B απευθύνονται σε τοπικούς σταθμούς εργασίας και αποτελεσματική εξυπηρέτηση, και το ναυαρχίδα 375B-A23B μεταφέρει τις ισχυρότερες δυνατότητες του στόλου σε απαιτητικές επιχειρηματικές αναπτύξεις. Και τα έξι μοντέλα αποστέλλονται με υποστήριξη κβαντοποίησης.
Τα μοντέλα μοιράζονται την αρχιτεκτονική πυρήνα, το λεξιλόγιο, τη μεθοδολογία εκπαίδευσης, τις διεπαφές, την υποδομή αξιολόγησης και τα εργαλεία ανάπτυξης, με το μοντέλο 0.9B να χρησιμοποιεί μικρότερο λεξιλόγιο. Η IFM λέει ότι η συνέπεια διευκολύνει τη μετακίνηση μεταξύ μεγεθών, τη δυναμική δρομολόγηση της εργασίας σε όλο τον στόλο και τη μελέτη του τρόπου με τον οποίο κλιμακώνονται οι δυνατότητες.
Αυτό που στην πραγματικότητα καλύπτει το "πλήρως ανοιχτό".
Εδώ το K2 Horizon ξεφεύγει από τον κανόνα του κλάδου. Για κάθε μοντέλο του στόλου, η IFM λέει ότι ανοίγει τον κύκλο ζωής της εκπαίδευσης από την προεκπαίδευση μέσω της συλλογιστικής και της μετα-εκπαίδευσης.
Η έκδοση περιλαμβάνει ενδιάμεσα σημεία ελέγχου, δεδομένα εκπαίδευσης ή λεπτομερείς συνταγές κατασκευής δεδομένων, τεκμηρίωση ανοιχτής αρχιτεκτονικής, συνθέσεις μειγμάτων, κώδικα εκπαίδευσης, διαμορφώσεις, λεπτομερή αρχεία καταγραφής εκπαίδευσης, αποτελέσματα αξιολόγησης και τελικά βάρη. Τα μοντέλα και ο κώδικας κυκλοφορούν με την άδεια Apache 2.0, μια από τις πιο επιτρεπτές σε εμπορική χρήση. Τα σύνολα δεδομένων εκδίδονται σύμφωνα με τις ισχύουσες άδειές τους, όπως η ODC-BY, και η IFM δεσμεύεται να αποκαλύψει τον τρόπο κατασκευής και ανάμειξης των δεδομένων σε περιπτώσεις όπου η αναδιανομή δεν είναι δυνατή.
Η IFM πλαισιώνει επίσης την κυκλοφορία ως την πρώτη ανοιχτή οικογένεια μοντέλων που αποκαλύπτει την πλήρη διαδικασία ανάπτυξης μέσω της μετα-εκπαίδευσης με πράκτορες. Στην πράξη, αυτό σημαίνει ότι οι ερευνητές μπορούν να μελετήσουν πώς ο συλλογισμός, η χρήση εργαλείων, ο σχεδιασμός και οι πρακτικές συμπεριφορές εμφανίζονται κατά τη διάρκεια της εκπαίδευσης, να αναπαράγουν τις μεθόδους και να τις προσαρμόσουν σε νέα εργαλεία και τομείς - εργασία που συνήθως είναι αδύνατη όταν δημοσιεύονται μόνο τα τελικά βάρη.
Οι ισχυρισμοί απόδοσης
Η IFM λέει ότι τα μικρότερα μοντέλα του στόλου θέτουν νέα τελευταίας τεχνολογίας αποτελέσματα στις αντίστοιχες κλίμακες τους. Τα μοντέλα 0.9B, 3.7B και 7B φέρονται να οδηγούν στις κατηγορίες μεγεθών τους σε μαθηματικά, συλλογισμό, γενικές ικανότητες, κωδικοποίηση και πρακτορικές εργασίες.
Μερικές λεπτομέρειες από την ανακοίνωση: Το K2 Horizon 0.9B σκοράρει πάνω από 48 στο AIME 2026, ένα σημείο αναφοράς για τα μαθηματικά του διαγωνισμού που παραμένει βάναυσο για μοντέλα τόσο μικρά. Τα μοντέλα 3.7B και 7B επισημαίνονται για ισχυρά αποτελέσματα SWE-bench και BrowseComp, υποδεικνύοντας την ικανότητα μηχανικής λογισμικού και περιήγησης πολλαπλών βημάτων ασυνήθιστη για το μέγεθός τους. Το μοντέλο 36B-A4B εισάγει έναν νέο μηχανισμό Mixture-of-Value-Attention (MoVA), τον οποίο η IFM πιστώνει για ικανότητα που ξεπερνά αυτό που θα υποδείξει ο αριθμός των ενεργών παραμέτρων του. Τα μοντέλα 32B και 375B-A23B περιγράφονται ως κατάταξη μεταξύ των κορυφαίων μοντέλων στις αντίστοιχες κατηγορίες τους.
Όπως συμβαίνει με κάθε αξιολόγηση που δημοσιεύεται στο εργαστήριο, αυτά τα στοιχεία αναφέρονται μόνοι τους και η ανεξάρτητη επαλήθευση θα χρειαστεί χρόνο. Ωστόσο, εάν οι αριθμοί επιμείνουν, οι βασικές και μεσαίες βαθμίδες του στόλου θα μπορούσαν να αναδιαμορφώσουν αυτό που περιμένουν οι προγραμματιστές από μοντέλα που λειτουργούν με καταναλωτικό υλικό.
Γιατί το Άμπου Ντάμπι συνεχίζει να εμφανίζεται στο ανοιχτό AI
Η κυκλοφορία ενισχύει το αυξανόμενο αποτύπωμα των Ηνωμένων Αραβικών Εμιράτων στην ανάπτυξη ανοιχτών μοντέλων. Το οικοσύστημα τεχνητής νοημοσύνης του Άμπου Ντάμπι – που εδραιώθηκε από ιδρύματα, συμπεριλαμβανομένου του MBZUAI, το οποίο κυκλοφόρησε το σύστημα συλλογιστικής K2 Think με το G42 το 2025 – τοποθετεί σταθερά την ανοιχτή δημοσίευση ως στρατηγικό παράγοντα διαφοροποίησης, ένα μοτίβο που κατέγραψε το Reuters στην κάλυψη της κυκλοφορίας της Πέμπτης.
Ο συγχρονισμός προσγειώνεται επίσης σε μια μεταβαλλόμενη αγορά για ανοιχτά μοντέλα. Η συμφωνία της Nvidia για την εξαγορά της Hugging Face για περίπου 12,9 δισεκατομμύρια δολάρια, που ανακοινώθηκε αυτή την εβδομάδα, υπογράμμισε ακριβώς πόση εμπορική αξία έχει συσσωρευτεί γύρω από τις πλατφόρμες διανομής ανοιχτών μοντέλων. Εν τω μεταξύ, οι υπερκλιμακωτές έχουν παραταχθεί για να αδειοδοτήσουν μοντέλα ανοιχτού βάρους από κινεζικά εργαστήρια και οι δυτικές εταιρείες τεχνητής νοημοσύνης δημοσίευσαν μια επιστολή προειδοποιώντας ενάντια στους πρόωρους περιορισμούς στα ανοιχτά βάρη.
Σε αυτό το πλαίσιο, ένας στόλος δίπλα στα σύνορα που δημοσιεύει ολόκληρο τον αγωγό εκπαίδευσης δίνει σε ερευνητές, νεοφυείς επιχειρήσεις και κυβερνήσεις μια εναλλακτική λύση για να εξαρτώνται από κλειστά API από μια χούφτα παρόχων των ΗΠΑ.
Τι να παρακολουθήσετε στη συνέχεια
Τρεις ερωτήσεις θα καθορίσουν εάν το K2 Horizon έχει σημασία πέρα από τα πρωτοσέλιδα. Πρώτον, μπορούν τα αποτελέσματα αναφοράς να αναπαραχθούν από ανεξάρτητους αξιολογητές, ιδιαίτερα για τα μικροσκοπικά μοντέλα όπου οι ισχυρισμοί είναι πιο εντυπωσιακοί; Δεύτερον, πόσο επιτρεπτές είναι οι άδειες δεδομένων στην πράξη, δεδομένου ότι η IFM αναγνωρίζει ότι ορισμένα δεδομένα εκπαίδευσης δεν μπορούν να αναδιανεμηθούν και τεκμηριώνονται με συνταγή; Τρίτον, θα αναπτύξουν οι επιχειρήσεις στην πραγματικότητα ένα αραιό μοντέλο 375B εκτός ενός μεγάλου cloud ή θα επικεντρωθεί ο πρακτικός αντίκτυπος στο επίπεδο 7B και κάτω που τρέχει σε τηλέφωνα και φορητούς υπολογιστές;
Το πιο πιθανό άμεσο αποτέλεσμα είναι η διαφάνεια της έρευνας. Με δημόσια σημεία ελέγχου, αρχεία καταγραφής και συνταγές δεδομένων, το K2 Horizon δίνει στο πεδίο ένα πλήρες επεξεργασμένο παράδειγμα του τρόπου με τον οποίο χτίζεται μια σύγχρονη οικογένεια μοντέλων με συλλογισμούς και ικανούς πράκτορες — κάτι που η κοινότητα δεν είχε ποτέ σε αυτήν την κλίμακα.
Μείνετε μπροστά από κάθε σημαντική ανάπτυξη AI
Οι εκδόσεις μοντέλων έρχονται πιο γρήγορα κάθε μήνα. Παρακολουθήστε κάθε κυκλοφορία και σημείο αναφοράς πριν έχει σημασία.
---
Μείνετε μπροστά από την τεχνητή νοημοσύνηΛάβετε τα πιο πρόσφατα νέα, αναλύσεις και ανακαλύψεις για την τεχνητή νοημοσύνη — όλα σε ένα μέρος.
Διαβάστε περισσότερα νέα AI →