Η Εθνική Διοίκηση Δεδομένων της Κίνας δήλωσε ότι θα αναπτύξει πρότυπα για τα δεδομένα που χρησιμοποιούνται για την εκπαίδευση ενσωματωμένων συστημάτων AI και θα καθοδηγήσει τις τοπικές αρχές στην εργασία, ένα βήμα που ανέφερε το Bloomberg στις 13 Σεπτεμβρίου που στοχεύει ένα από τα μεγαλύτερα σημεία συμφόρησης στον ταχέως αναπτυσσόμενο τομέα της ρομποτικής: πρόσβαση σε υψηλής ποιότητας, ποικίλα και μεγάλης κλίμακας δεδομένα εκπαίδευσης.

Η ανακοίνωση ακολούθησε συνεδρίαση στις 10 Σεπτεμβρίου υπό την προεδρία του Λιου Λιεχόνγκ, ο οποίος ηγείται του οργανισμού. Ερευνητικά ινστιτούτα, εταιρείες τεχνολογίας και ανθρωποειδείς ρομποτικοί οργανισμοί συμμετείχαν και η ρυθμιστική αρχή είπε ότι η βιομηχανία καθοδηγείται ολοένα και περισσότερο στα δεδομένα. Η διοίκηση σηματοδότησε επίσης ότι θα υποστηρίξει τις εταιρείες που επενδύουν περισσότερα χρήματα σε πόρους δεδομένων. For more context on this story, see our ongoing AI trends.

Ερωτήθηκε ο κλάδος, το Πεκίνο απάντησε

Αξιοσημείωτο είναι το πόσο γρήγορα κινήθηκε ο ρυθμιστής. Δέκα ημέρες νωρίτερα, η ίδια υπηρεσία είχε συναντηθεί με επτά εταιρείες από τους τομείς της τεχνητής νοημοσύνης, της πληροφορικής και των δεδομένων, σύμφωνα με το MLex. Σε εκείνη τη συνάντηση, οι συμμετέχοντες ζήτησαν δημόσια υποδομή δεδομένων για ενσωματωμένη τεχνητή νοημοσύνη, κοινά πρότυπα δεδομένων και κανόνες μέτρησης διακριτικών, μαζί με διαπεριφερειακό συντονισμό των υπολογιστικών πόρων.

Η επίσημη απάντηση ήρθε λιγότερο από δύο εβδομάδες αργότερα, υπογραμμίζοντας πόσο κεντρική έχει γίνει η πολιτική δεδομένων στις φιλοδοξίες της Κίνας για τη ρομποτική. Η ενσωματωμένη τεχνητή νοημοσύνη - συστήματα που συνδυάζουν τη νοημοσύνη μηχανών με φυσικές μηχανές όπως τα ανθρωποειδή ρομπότ - αντιμετωπίζεται στο Πεκίνο ως στρατηγική βιομηχανία και τα δεδομένα είναι η πρώτη ύλη της.

Η συμφόρηση δεδομένων στην ανθρωποειδή ρομποτική

Η κλίμακα της πρόκλησης είναι σημαντική. Σύμφωνα με την εκτίμηση της Ακαδημίας Τεχνολογίας Πληροφοριών και Επικοινωνιών της Κίνας, τα ενσωματωμένα μοντέλα θεμελίωσης τεχνητής νοημοσύνης χρειάζονται περίπου 10 εκατομμύρια ώρες δεδομένων εκπαίδευσης σε πραγματικό κόσμο. Κάπου μεταξύ 100.000 και 1 εκατομμυρίου ωρών δεδομένων υψηλής ποιότητας υπάρχουν παγκοσμίως, σύμφωνα με στοιχεία που αναφέρει το The Next Web.

Ο περιορισμός στην ανθρωποειδή ρομποτική, με άλλα λόγια, δεν είναι πλέον το μοντέλο. Είναι ώρες καταγεγραμμένης πραγματικότητας — δεδομένα που καταγράφουν τον τρόπο με τον οποίο οι μηχανές αντιλαμβάνονται, συλλογίζονται και ενεργούν σε ακατάστατα φυσικά περιβάλλοντα.

Ένας αγωγός προτύπων ήδη σε κίνηση

Η νέα ώθηση βασίζεται σε ουσιαστική βάση. Τα εθνικά πρότυπα που δημοσιεύθηκαν στις 27 Αυγούστου καλύπτουν την ποιότητα των δεδομένων ενσωματωμένης νοημοσύνης του πραγματικού κόσμου και τις τεχνικές απαιτήσεις για πλατφόρμες παραγωγής δεδομένων, με αρκετές πρόσθετες προδιαγραφές να βρίσκονται ακόμη υπό ανάπτυξη, σύμφωνα με μια αναφορά του AP News.

Μεταξύ των έργων που επιβλέπονται από την Εθνική Διοίκηση Δεδομένων προτείνονται πρότυπα που καλύπτουν τις πηγές και τα συστατικά στοιχεία υψηλής ποιότητας συνόλων δεδομένων ενσωματωμένης νοημοσύνης, την προσομοίωση παραγωγής και επεξεργασίας συνθετικών δεδομένων και προδιαγραφές για τη συλλογή δεδομένων και την εκπαίδευση μοντέλων σε βάσεις εκπαίδευσης. Η εργασία αναπτύσσεται στο πλαίσιο της Εθνικής Τεχνικής Επιτροπής Τυποποίησης Δεδομένων.

Ένα προσχέδιο προγράμματος, που καταχωρήθηκε τον Απρίλιο, ορίζει ένα χρονοδιάγραμμα 12 μηνών για ένα πρότυπο σχετικά με τη συλλογή δεδομένων και την κατάρτιση μοντέλων σε βάσεις εκπαίδευσης ενσωματωμένης νοημοσύνης. Η ομάδα σύνταξης του περιλαμβάνει το China Electronics Standardization Institute, το Τεχνολογικό Ινστιτούτο του Πεκίνου, το Ινστιτούτο Λογισμικού στην Κινεζική Ακαδημία Επιστημών και εταιρείες ρομποτικής. Ένα ξεχωριστό προσχέδιο αντιμετωπίζει συνθετικά δεδομένα, τα οποία γίνονται ολοένα και πιο σημαντικά επειδή η συλλογή αρκετών αλληλεπιδράσεων ρομπότ στον φυσικό κόσμο μπορεί να είναι δαπανηρή, αργή και δύσκολη στην αναπαραγωγή.

Ένα σχέδιο υλοποίησης που εκδόθηκε τον Ιούνιο απαιτούσε ταχύτερη κατασκευή συνόλων δεδομένων σε στρατηγικούς και αναδυόμενους τομείς, όπως η ενσωματωμένη νοημοσύνη, η έξυπνη οδήγηση και η οικονομία χαμηλού υψομέτρου. Ζήτησε επίσης δεδομένα που καλύπτουν τη φυσική αλληλεπίδραση, την περιβαλλοντική αντίληψη και τον έλεγχο της κίνησης σε βασικά σενάρια και έδωσε εντολή στις αρχές να βελτιώσουν τον καθαρισμό, τη βελτίωση, την επισήμανση, την ευθυγράμμιση και την ποιοτική επιθεώρηση δεδομένων.

Κτίριο προπόνησης-εδάφους της Κίνας

Το Πεκίνο κατασκευάζει επίσης τη φυσική υποδομή για τη συλλογή αυτών των δεδομένων. Περισσότερα από 70 ενσωματωμένα πεδία εκπαίδευσης τεχνητής νοημοσύνης λειτουργούν ήδη σε περισσότερες από τις μισές επαρχιακές περιφέρειες της Κίνας, με 46 ακόμη προγραμματισμένες ή υπό κατασκευή, ανέφερε το TechNode. Περίπου το 86 τοις εκατό από αυτά απευθύνονται στη βιομηχανική μεταποίηση.

Οι εγκαταστάσεις συγκεντρώνονται σε τρεις περιοχές: το Δέλτα του ποταμού Yangtze, την περιοχή Beijing-Tianjin-Hebei και το Pearl River Delta. Μαζί σχηματίζουν μια συσκευή συλλογής δεδομένων που λίγες χώρες μπορούν επί του παρόντος να ταιριάξουν.

Η αντίθεση με την Ευρώπη

Η ανακοίνωση υπογραμμίζει μια διευρυνόμενη ασυμμετρία με τις δυτικές ρυθμιστικές προσεγγίσεις. Η Ευρώπη έχει γράψει εκτενείς κανόνες για αυτού του είδους τα δεδομένα χωρίς να δημιουργεί μεγάλο μέρος της προσφοράς. Ο νόμος για τα δεδομένα της ΕΕ εφαρμόζεται από τις 12 Σεπτεμβρίου 2025 και διέπει ποιος μπορεί να έχει πρόσβαση σε δεδομένα που παράγονται από συνδεδεμένα προϊόντα, συμπεριλαμβανομένων των βιομηχανικών μηχανημάτων, ενώ οι υποχρεώσεις σχεδιασμού βαρύνουν τα συνδεδεμένα προϊόντα που διατίθενται στην αγορά της ΕΕ μετά τις 12 Σεπτεμβρίου 2026.

Η Ευρωπαϊκή Επιτροπή δημοσίευσε μια Στρατηγική της Ένωσης Δεδομένων στις 19 Νοεμβρίου 2025, της οποίας η πρώτη προτεραιότητα είναι η κλιμάκωση της πρόσβασης σε δεδομένα για την τεχνητή νοημοσύνη. Δέκα μήνες μετά, οι περισσότερες από αυτές τις ενέργειες δεν έχουν πραγματοποιηθεί, συμπεριλαμβανομένων των εργαστηρίων δεδομένων που υποσχέθηκε η στρατηγική, ανέφερε το The Next Web. Το πλησιέστερο ευρωπαϊκό ισοδύναμο ενός κινεζικού προπονητικού κέντρου είναι μια ιδιωτική εταιρεία: η NEURA Robotics κατασκευάζει δέκα γυμναστήρια ρομποτικής, πέντε από τα οποία πρόκειται να λειτουργήσουν μέχρι το τέλος του τρέχοντος έτους, χωρισμένα μεταξύ Ευρώπης, Ηνωμένων Πολιτειών και Κίνας.

Έλεγχος πραγματικότητας από την πλευρά της ζήτησης

Η τυποποίηση της παροχής δεδομένων δεν εγγυάται τη ζήτηση. Μόνο το 23 τοις εκατό των κινεζικών επιχειρήσεων που συμμετείχαν στην έρευνα φέτος δήλωσαν ικανοποιημένοι με τα ρομπότ που προσφέρονται, αριθμός που υποδηλώνει ότι η αγορά - όχι ο αγωγός δεδομένων - μπορεί τελικά να καθορίσει τον ρυθμό υιοθέτησης.

Ωστόσο, η κατεύθυνση του ταξιδιού είναι ξεκάθαρη. Η Κίνα αντιμετωπίζει τα ενσωματωμένα δεδομένα τεχνητής νοημοσύνης ως στρατηγικό πόρο που πρέπει να παράγονται συστηματικά, να τυποποιούνται και να κλιμακώνονται, ενώ οι ρυθμιστικές αρχές της συντονίζονται στενά με τη βιομηχανία που επιβλέπουν. Για τους κατασκευαστές ρομπότ παγκοσμίως, το χάσμα μεταξύ των δικαιοδοσιών που δημιουργούν την εκπαιδευτική πραγματικότητα και εκείνων που ρυθμίζουν κυρίως τη χρήση της γίνεται ένα από τα καθοριστικά ανταγωνιστικά ερωτήματα του τομέα.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →