Το ερευνητικό εργαστήριο Qwen της Alibaba κυκλοφόρησε την Παρασκευή το Qwen 3.8 27B, ένα μοντέλο μεγάλης γλώσσας με άδεια χρήσης Apache 2.0, με δυνατότητα όρασης, το οποίο τρέχει σε έναν λογικά προσδιορισμένο φορητό υπολογιστή — και, σύμφωνα με τα σημεία αναφοράς του ίδιου του εργαστηρίου, ξεπερνά όχι μόνο τον προκάτοχό του, αλλά ένα κλειστού βάρους μοντέλο Q που ήταν πρόσφατα από το ισχυρότερο μοντέλο του Μαΐου.

Η κυκλοφορία έχει γίνει ένα από τα πιο πολυσυζητημένα μοντέλα του μήνα στους κύκλους των προγραμματιστών. Μια πρακτική ανασκόπηση που δημοσιεύθηκε την Κυριακή από τον Simon Willison, τον εξέχοντα ανεξάρτητο ερευνητή και blogger της τεχνητής νοημοσύνης, έφτασε στην πρώτη σελίδα του Hacker News με εκατοντάδες θετικές ψήφους, με τους αναγνώστες να συζητούν τις δυνατότητες του μοντέλου και την ασυνήθιστη προεπιλεγμένη διαμόρφωσή του. For more context on this story, see our ongoing latest AI developments.

Τι νέο υπάρχει στο Qwen 3.8 27B

Το μοντέλο είναι το πιο πρόσφατο στη σειρά ανοιχτών βαρών της Alibaba, που έρχεται εβδομάδες μετά την πολύ μεγαλύτερη κυκλοφορία του μείγματος ειδικών Qwen 3.8 2.4T-A95B. Σύμφωνα με τα αυτοαναφερθέντα σημεία αναφοράς της Qwen, το μοντέλο 27B παρουσιάζει κέρδη σε σχέση με το Qwen 3.6 27B και το κλειστού βάρους Qwen 3.7-Plus — ένα μοντέλο που, παρά το όνομά του, ήταν ένα από τα πιο δυνατά χαρακτηριστικά της Qwen σε οποιοδήποτε μέγεθος νωρίτερα φέτος.

Το μοντέλο υποστηρίζει μέγιστο μήκος περιβάλλοντος 262.144 διακριτικών, χειρίζεται εισόδους όρασης και αποστέλλεται με επίσημη υποστήριξη για μια παράμετρο «reasoning_efort» που προσαρμόζει το βάθος συλλογισμού σε τρία επίπεδα: «xhigh», «medium» και «low».

Είναι αυτή η πρώτη ρύθμιση — «xhigh», η εργοστασιακή προεπιλογή — που έχει γίνει το σημείο συζήτησης της κυκλοφορίας.

Το πρόβλημα της υπερβολικής σκέψης

Ο Willison, ο οποίος δοκίμασε το μοντέλο σε ένα MacBook Pro 128 GB και ένα NVIDIA DGX Spark χρησιμοποιώντας την κβαντισμένη κατασκευή 17 GB Q4_K_M του LM Studio, περιέγραψε την προεπιλογή ως «θεαματική υπερβολική σκέψη».

Σε ένα εντυπωσιακό παράδειγμα, ζήτησε από το μοντέλο να σχεδιάσει ένα SVG ενός πελεκάνου που έκανε ποδήλατο. Με την προεπιλεγμένη συλλογιστική προσπάθεια «xhigh», το μοντέλο ξόδεψε 22.276 κουπόνια συλλογισμού για να παράγει 3.223 μάρκες εξόδου — μια διαδικασία που χρειάστηκε 21 λεπτά στο υλικό του. Το αποτέλεσμα, σημείωσε, ήταν «μακράν ο καλύτερος πελεκάνος SVG» που μπόρεσε να δημιουργήσει με ένα μοντέλο που τρέχει τοπικά, με σωστή γεωμετρία ποδηλάτου, πόδια και στις δύο πλευρές του πλαισίου και ένα καλόγουστο εικονογραφημένο φόντο.

Η αντιστάθμιση είναι προφανής: 21 λεπτά είναι μια μη πρακτική αναμονή για τις περισσότερες εργασίες. Η επανάληψη της ίδιας προτροπής με απενεργοποιημένη τη συλλογιστική παρήγαγε μια απόκριση σε 137 δευτερόλεπτα - κάτω από το ένα δέκατο του χρόνου - σε παρόμοια διάρκεια εξόδου.

Ακόμη και ασήμαντα απλές προτροπές ενεργοποιούν τη συμπεριφορά. Ζητήθηκε να "σχεδιάσει ένα svg κύκλου", το ίχνος συλλογισμού του μοντέλου άνοιξε με ζύγιση επιλογών παλέτας, στυλ Bauhaus, πολυεπίπεδους δακτυλίους και προσεγγίσεις κινούμενων εικόνων — αρκετά λεπτά σκέψης για ένα σχήμα που απαιτεί μια ενιαία ετικέτα XML.

Η ετυμηγορία του Willison: το μοντέλο είναι εξαιρετικό, αλλά η προεπιλεγμένη διαμόρφωση "δεν είναι απολύτως καλός τρόπος για να τρέξετε το μοντέλο, ειδικά σε καταναλωτικό υλικό." Οι χρήστες μπορούν να μεταβούν σε «μέτρια» ή «χαμηλή» συλλογιστική προσπάθεια ή να απενεργοποιήσουν εντελώς την εκτεταμένη σκέψη.

Τοπική ορμή AI

Η έκδοση υπογραμμίζει πόσο γρήγορα έχει μειωθεί το χάσμα δυνατοτήτων μεταξύ των μοντέλων συνόρων σύννεφο και των μοντέλων ανοιχτών μοντέλων με δυνατότητα τοπικής εκτέλεσης. Ένα αρχείο 17 GB που εκτελείται σε φορητό υπολογιστή παράγει τώρα αποτελέσματα που, σε συγκεκριμένες δημιουργικές εργασίες, συναγωνίζονται ό,τι απαιτούσε τα μοντέλα κλίμακας κέντρου δεδομένων πριν από λίγο καιρό.

Συνεχίζει επίσης τη δυναμική ανοιχτών βαρών από τα κινεζικά εργαστήρια που καθόρισε το 2026. Η οικογένεια Qwen της Alibaba συγκαταλέγεται στις σειρές μοντέλων με τις περισσότερες λήψεις παγκοσμίως φέτος, ανταγωνιζόμενη τις εκδόσεις των Meta, DeepSeek και Moonshot AI για κοινή χρήση γνώσεων προγραμματιστών. Τα αποτελέσματα ανεξάρτητων κριτηρίων αναφοράς για το Qwen 3.8 27B εξακολουθούν να συσσωρεύονται και ο Willison προειδοποίησε ρητά ότι οι αριθμοί που αναφέρονται από τον ίδιο το εργαστήριο αναμένουν επαλήθευση από τρίτους.

Πρακτική καθοδήγηση για χρήστες

Για τους προγραμματιστές και τους λάτρεις που εξετάζουν το μοντέλο, η αναδυόμενη συναίνεση από τις πρώιμες δοκιμές είναι απλή: Το Qwen 3.8 27B είναι μια ισχυρή προεπιλεγμένη επιλογή για τοπικούς φόρτους εργασίας AI που περιλαμβάνουν όραμα ή μεγάλα έγγραφα, αλλά η προσπάθεια συλλογιστικής θα πρέπει να προσαρμοστεί στην εργασία. Η σύνθετη ανάλυση μπορεί να δικαιολογήσει το «xhigh». Οι καθημερινές ερωτήσεις και οι γρήγορες πρόχειρες είναι πιο γρήγορες και φθηνότερες στο «μέτριο» ή χαμηλότερο.

Οι χρήστες που εκτελούν το μοντέλο μέσω εργαλείων όπως το LM Studio θα πρέπει επίσης να αυξήσουν το προεπιλεγμένο παράθυρο περιβάλλοντος από 8.192 διακριτικά — ο Willison διαπίστωσε ότι η εκτεταμένη σκέψη του μοντέλου εξάντλησε αυτόν τον προϋπολογισμό ακόμη και σε εγκόσμια προβλήματα προτού το φορτώσει με το πλήρες πλαίσιο των 262.144 διακριτικών.

Το μεγαλύτερο ερώτημα είναι τι σηματοδοτεί η έκδοση για την επόμενη φάση της κούρσας ανοιχτών μοντέλων: καθώς τα μοντέλα σε στυλ συλλογισμού γίνονται κανόνας, οι προεπιλογές διαμόρφωσης μετατρέπονται σε αποφάσεις προϊόντων με πραγματικές συνέπειες χρηστικότητας — και η προεπιλογή «xhigh» του Qwen είναι ήδη το πιο πολυσυζητημένο παράδειγμα.

Ένα ορόσημο για ανοιχτά βάρη

Η κυκλοφορία σηματοδοτεί επίσης ένα ορόσημο στο τι μπορούν πλέον να προσφέρουν τα εργαστήρια ανοιχτού βάρους σε μικρή κλίμακα. Η δυνατότητα όρασης, ένα παράθυρο περιβάλλοντος με 262.144 διακριτικά και η ανταγωνιστική απόδοση συλλογισμού σε ένα πακέτο που ταιριάζει σε φορητό υπολογιστή καταναλωτή θα ήταν αδιανόητο σε ένα μοντέλο με άδεια χρήσης Apache-2.0 πριν από δύο χρόνια. Για προγραμματιστές που δημιουργούν τοπικές εφαρμογές — όπου το απόρρητο δεδομένων, η καθυστέρηση ή η λειτουργία εκτός σύνδεσης αποκλείουν τα API cloud — οι πρακτικές επιλογές συνεχίζουν να βελτιώνονται με γρήγορο ρυθμό.

Οι δοκιμές του Willison υπογραμμίζουν επίσης ένα σημείο ωριμότητας για το οικοσύστημα: τα εργαλεία γύρω από τα τοπικά μοντέλα, από τις λήψεις GGUF με ένα κλικ του LM Studio έως τις παραμέτρους λογικής που μπορούν να διαμορφωθούν, έχει προχωρήσει αρκετά ώστε ο συντονισμός του βάθους σκέψης ενός μοντέλου είναι πλέον μια συνηθισμένη απόφαση χρήστη παρά μια άσκηση έρευνας. Καθώς συσσωρεύονται ανεξάρτητα σημεία αναφοράς τις επόμενες ημέρες, η εικόνα για το πού ακριβώς προσγειώνεται το Qwen 3.8 27B έναντι των ανοιχτών και κλειστών ανταγωνιστών του θα οξύνεται - αλλά η πρώιμη αποδοχή υποδηλώνει μια άλλη ισχυρή είσοδο στη γραμμή που έχει κάνει την Alibaba έναν από τους πιο σημαντικούς εκδότες ανοιχτού μοντέλου στον κόσμο.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →