Η Perplexity κυκλοφόρησε το Portable Computer, μια έκδοση της πλατφόρμας "Computer" που εκτελείται εξ ολοκλήρου σε υλικό που διαθέτουν ήδη χρήστες — ξεκινώντας από τον επιτραπέζιο υπερυπολογιστή DGX Spark της Nvidia και μηχανήματα Linux που είναι εξοπλισμένα με GPU RTX. Αναπτύχθηκε σε στενή συνεργασία με τη Nvidia και ανακοινώθηκε στις 25 Αυγούστου 2026, είναι μια από τις πιο επιθετικές προσπάθειες που έχουν γίνει μέχρι σήμερα για τη μεταφορά σοβαρών φόρτων εργασίας πρακτόρων τεχνητής νοημοσύνης από το cloud και σε τοπικές συσκευές.

Το βήμα είναι απλό αλλά συνεπακόλουθο: το μοντέλο, τα αρχεία του χρήστη και η ίδια η εργασία μπορούν όλα να παραμείνουν στο μηχάνημα. Η εργασία που ολοκληρώνεται τοπικά δεν καταναλώνει πιστώσεις χρέωσης, κάθε εργασία ξεκινά στη συσκευή από προεπιλογή και το σύστημα ζητά άδεια πριν στείλει οποιοδήποτε μεμονωμένο βήμα σε ένα πιο ισχυρό μοντέλο συνόρων στο cloud. For more context on this story, see our ongoing AI trends.

«Βασικά έχουμε φέρει την ίδια ακριβώς διεπαφή χρήστη σε μια πλήρως τοπική εφαρμογή», ​​δήλωσε ο Nate, αντιπρόεδρος μηχανικής για υποδομές και επιχειρήσεις της Perplexity, κατά τη διάρκεια ενημέρωσης τύπου τη Δευτέρα. "Αυτό ενσωματώνει το σύνολο της πλεξούδας και των συμπερασμάτων του πράκτορα και όλα όσα χρειάζονται για να γίνει δουλειά σε τοπικό επίπεδο."

Για τη Nvidia, η οποία έχει ξοδέψει τα τελευταία δύο χρόνια πουλώντας τον κόσμο σε κέντρα δεδομένων τεχνητής νοημοσύνης τρισεκατομμυρίων δολαρίων, η ανακοίνωση φέρει ένα πιο λεπτό μήνυμα: ο κατασκευαστής chip πιστεύει ότι η τοπική τεχνητή νοημοσύνη έχει περάσει ένα όριο από την περιέργεια των χομπίστων στο πρακτικό εργαλείο. "Η τοπική τεχνητή νοημοσύνη έφτασε σε ένα σημείο καμπής", δήλωσε ο Nader, διευθυντής τεχνολογίας προγραμματιστών της Nvidia. "Για το μεγαλύτερο χρονικό διάστημα, ήταν χομπίστες και λάτρεις... να τρέξουν αυτά τα κβαντισμένα μοντέλα που ήταν πολύ μικροσκοπικά. Και παρόλο που είναι ωραίο, δεν είναι εξαιρετικά πρακτικό. Αλλά όλα αυτά άλλαξαν με πολλά από αυτά τα νέα μοντέλα ανοιχτού κώδικα."

Μια πλήρης τοπική στοίβα AI σε μία εφαρμογή

Το Perplexity Computer, το προϊόν cloud, ενορχηστρώνει μοντέλα, αρχεία, εργαλεία και πρόσβαση στον ιστό για την ολοκλήρωση εργασιών γνώσης πολλαπλών βημάτων — έλεγχος φακέλων εγγράφων, ανάλυση δεδομένων και παραγωγή αναφορών. Ο φορητός υπολογιστής αναπαράγει αυτό τοπικά, ομαδοποιώντας τα τοπικά μοντέλα, την πλεξούδα πράκτορα, τη μηχανή συμπερασμάτων, τα εργαλεία, τις υποδοχές εφαρμογών και ένα sandbox ασφαλείας σε μια ενιαία εφαρμογή. Η ομαδοποίηση έχει σημασία: με τις περισσότερες τοπικές στοίβες τεχνητής νοημοσύνης σήμερα, οι χρήστες πρέπει να συναρμολογούν μόνοι τους αυτά τα κομμάτια — λήψη βαρών, εγκατάσταση ενός διακομιστή συμπερασμάτων και εργαλείων καλωδίωσης μαζί.

Σε μια επίδειξη τύπου, το σύστημα έπαιξε έναν λιανικό επενδυτή που εξέταζε έναν φάκελο με 1099 και επενδυτικά έγγραφα — το είδος του ευαίσθητου οικονομικού υλικού που πολλοί χρήστες θα δίσταζαν να ανεβάσουν σε μια υπηρεσία cloud. Εκτελώντας ένα μοντέλο Qwen 27 δισεκατομμυρίων παραμέτρων με πλήρη χρήση GPU σε ένα DGX Spark, ο πράκτορας επισήμανε περιπτώσεις όπου ο επενδυτής πλήρωνε περιττές χρεώσεις. Το στοιχείο διεπαφής που κανονικά υπολογίζει τις πιστώσεις στο cloud, σημείωσε η Perplexity, "απλώς σταθμεύει στο μηδέν".

Το προϊόν είναι επίσης υβριδικό παρά ερμητικό. Μια δεύτερη επίδειξη ανέλυσε ένα CSV δεδομένων διοχέτευσης χρήστη τοπικά και, στη συνέχεια, ώθησε την τελική ανάλυση στο Slack χρησιμοποιώντας το οικοσύστημα σύνδεσης του Perplexity. Το σύστημα συνδέεται με το Google Drive, το Gmail και το GitHub και μπορεί να κλιμακωθεί σε μοντέλο σύννεφο συνόρων όταν το τοπικό μοντέλο φτάσει στα όριά του.

Απαιτήσεις και διαθεσιμότητα

Κατά την κυκλοφορία, οι χρήστες μπορούν να τρέξουν Qwen 3.8 27B ή PPLX 27B - μια έκδοση που το Perplexity έχει εκπαιδεύσει εκ των υστέρων στη δική του ζώνη - με το Nemotron 3.5 Lightning της Nvidia να έρχεται σύντομα. Το σύστημα χρησιμοποιεί vLLM για να φιλοξενήσει τα συμπεράσματα από κάτω, με μια προηγμένη λειτουργία για χρήστες που θέλουν να συνδέσουν το δικό τους τελικό σημείο. Οποιαδήποτε GPU RTX με τουλάχιστον 24 GB VRAM, περίπου GeForce RTX 3090 ή νεότερη, διαγράφει τη γραμμή.

Ο φορητός υπολογιστής είναι τώρα διαθέσιμος για συνδρομητές Pro, Max, Enterprise Pro και Enterprise Max στο Linux, με την υποστήριξη των Windows να ακολουθεί τον Σεπτέμβριο.

Συν-σχεδιασμός του μοντέλου και του λουριού

Παράλληλα με το λανσάρισμα, το Perplexity δημοσίευσε μια ερευνητική εργασία υποστηρίζοντας ότι οι αποτελεσματικοί τοπικοί πράκτορες απαιτούν να σχεδιάζονται μαζί το μοντέλο και η πλεξούδα του πράκτορα - η σκαλωσιά των προτροπών, τα εργαλεία και η λογική ενορχήστρωσης. Οι ιμάντες γενικής χρήσης υποθέτουν μοντέλα συνόρων που μπορούν να απορροφήσουν τεράστια περιβάλλοντα και να πλοηγηθούν σε εκτεταμένες επιφάνειες εργαλείων. μικρά τοπικά μοντέλα αγκυρώνουν κάτω από αυτές τις απαιτήσεις. Το Perplexity διαπίστωσε ότι παρόλο που το Qwen 3.8 27B διαφημίζει ένα παράθυρο περιβάλλοντος 260.000 token, αρχίζει να δυσκολεύεται πέρα ​​από τα 100.000 token.

Η απάντηση της εταιρείας είναι μια σκόπιμα ελάχιστη εξάρτηση: μια συνοπτική προτροπή συστήματος, ένα μικρό σύνολο βασικών εργαλείων και δυνατότητες που φορτώνουν και ξεφορτώνουν ως «δεξιότητες» κατά παραγγελία. Μετέτρεψε δημοφιλείς συνδέσεις όπως το Gmail και το GitHub από διακομιστές MCP που απαιτούν διακριτικά σε συμπαγή εργαλεία γραμμής εντολών, πρόσθεσε άγκιστρα αυτο-επαλήθευσης και ενίσχυσε το περιβάλλον δοκιμών σε επίπεδο λειτουργικού συστήματος.

Τα αποτελέσματα αναφοράς Οι αναφορές Perplexity είναι εντυπωσιακές, αν και προέρχονται από τις αξιολογήσεις της ίδιας της εταιρείας. Στον εσωτερικό πάγκο εργασίας Local Knowledge — 53 εργασίες που καλύπτουν βαθιά έρευνα, οικονομική ανάλυση και δημιουργία εγγράφων, τις οποίες η Perplexity σκοπεύει να μετατρέψει σε ανοιχτό κώδικα — Ο υπολογιστής που τρέχει το Qwen 3.8 27B σε DGX Spark σημείωσε 82,6%, έναντι 77,6% για την πλεξούδα ανοιχτού κώδικα Pi και 74,0% για το μοντέλο Hermes. Το PPLX 27B της Perplexity μετά την εκπαίδευση ώθησε το σκορ στο 85,4%. Στο BrowseComp, ένα σημείο αναφοράς για την έρευνα στον ιστό, το Computer σημείωσε ακρίβεια 66,7% έναντι 50,2% για το Pi και 43,9% για το Hermes, ενώ χρησιμοποιεί 51% λιγότερο χρόνο τοίχου και 70% λιγότερα tokens από το Pi.

The Token Economics Driving Agents Local

Η στρατηγική λογική γίνεται σαφής στο πώς έχουν αλλάξει οι φόρτοι εργασίας της τεχνητής νοημοσύνης. Η συζήτηση ήταν γεμάτη - μια ερώτηση, μια απάντηση, έγινε. Οι πράκτορες τρέχουν για ώρες. "Με τους πράκτορες, θέλετε αυτούς τους πράκτορες να είναι πάντα ενεργοποιημένοι, αν μπορείτε... Αυτό που βλέπουμε είναι μια ακόρεστη ζήτηση για μάρκες, και αυτό είναι κάτι που κάνει την τοπική τεχνητή νοημοσύνη τόσο σπουδαία", είπε ο Nader. "Δεν σε μετρούσε το κουπόνι. Δεν πλήρωνες για το κουπόνι."

Το υβριδικό μεσαίο μπορεί να είναι το πιο ενδιαφέρον εμπορικά αποτέλεσμα. Στο Terminal Bench 2.1, ένα προκλητικό σημείο αναφοράς κωδικοποίησης, το πλήρως τοπικό μοντέλο Qwen σημείωσε 59,6% με ουσιαστικά μηδενικό οριακό κόστος. Αφήνοντάς το να κλιμακωθεί σε έναν «σύμβουλο» του Claude Opus 5 στο σύννεφο αύξησε το σκορ στο 73,0% με εκτιμώμενα 0,415 $ ανά εργασία, ενώ η εκτέλεση μόνο του μοντέλου συνόρων σημείωσε 82,4% στα 0,65 $ ανά εργασία. Η κλιμάκωση ανέκαμψε περίπου τα τρία πέμπτα της διαφοράς ως προς τα όρια απόδοσης με περίπου τα δύο τρίτα του κόστους — και ο χρήστης αποφασίζει πότε αξίζει να πραγματοποιηθεί η συναλλαγή. Πριν από οποιαδήποτε κλήση συμβούλου, η πλεξούδα εκτελεί έναν ταξινομητή PII στο εξερχόμενο περιβάλλον και δείχνει στον χρήστη τι ακριβώς θα άφηνε τη συσκευή. το απομακρυσμένο μοντέλο επιστρέφει μόνο καθοδήγηση κειμένου και δεν αγγίζει ποτέ τοπικά αρχεία ή εργαλεία.

Η Nvidia τόνισε επίσης ότι το υλικό κλιμακώνεται πέρα ​​από ένα κουτί: η σύνδεση δύο DGX Sparks μέσω κοινής μνήμης εκτελεί ανοιχτά μοντέλα συνοριακής κλάσης όπως το πιο πρόσφατο της DeepSeek, τέσσερα μπορούν να τρέξουν GLM 5.2 ή Nemotron Ultra και ο Nader είπε ότι «έχει δει ακόμη και οκτώ Sparks να συνδέονται».

Το λανσάρισμα επεκτείνει μια συνεργασία που έχει δημιουργηθεί για περισσότερο από ένα χρόνο, αφού η Nvidia και η Perplexity ανακοίνωσαν μια κυρίαρχη συνεργασία AI για ευρωπαίους εκδότες και τηλεπικοινωνίες τον Ιούνιο του 2025. Για προγραμματιστές που ζυγίζουν μια στοίβα Ollama DIY, ανοιχτές ιμάντες και αυτο-φιλοξενούμενο συμπέρασμα, το στοίχημα του Portable Computer — το στοίχημα-όπως το μοντέλο της εφαρμογής, το sandbox είναι αυτό που κάνει τελικά το τοπικό agent AI mainstream.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →