สำนักงานข้อมูลแห่งชาติของจีนกล่าวว่าจะพัฒนามาตรฐานสำหรับข้อมูลที่ใช้ในการฝึกอบรมระบบ AI ที่รวบรวมไว้และเป็นแนวทางให้กับหน่วยงานท้องถิ่นในการทำงาน ซึ่งเป็นขั้นตอนที่บลูมเบิร์กรายงานเมื่อวันที่ 13 กันยายน โดยตั้งเป้าไปที่ปัญหาคอขวดที่ใหญ่ที่สุดแห่งหนึ่งในภาคส่วนวิทยาการหุ่นยนต์ที่เติบโตอย่างรวดเร็ว นั่นก็คือ การเข้าถึงข้อมูลการฝึกอบรมคุณภาพสูง หลากหลาย และมีขนาดใหญ่
การประกาศดังกล่าวเกิดขึ้นหลังจากการประชุมเมื่อวันที่ 10 กันยายน โดยมี Liu Liehong เป็นประธาน ซึ่งเป็นหัวหน้าหน่วยงาน มีสถาบันวิจัย บริษัทเทคโนโลยี และองค์กรหุ่นยนต์ฮิวแมนนอยด์เข้าร่วมงาน และหน่วยงานกำกับดูแลกล่าวว่าอุตสาหกรรมนี้กำลังขับเคลื่อนด้วยข้อมูลมากขึ้น ฝ่ายบริหารยังส่งสัญญาณว่าจะสนับสนุนบริษัทต่างๆ ที่ทุ่มเงินให้กับแหล่งข้อมูลมากขึ้น For more context on this story, see our ongoing artificial intelligence updates.
ถามอุตสาหกรรม ปักกิ่งตอบ
สิ่งที่น่าสังเกตคือความรวดเร็วในการเคลื่อนที่ของตัวควบคุม เมื่อสิบวันก่อนหน้านี้ หน่วยงานเดียวกันได้พบกับบริษัทเจ็ดแห่งจากภาคส่วนปัญญาประดิษฐ์ คอมพิวเตอร์ และข้อมูล ตามข้อมูลของ MLex ในการประชุมครั้งนั้น ผู้เข้าร่วมประชุมเรียกร้องให้มีโครงสร้างพื้นฐานข้อมูลสาธารณะสำหรับ AI ที่รวบรวมไว้ มาตรฐานข้อมูลทั่วไป และกฎการวัดโทเค็น พร้อมด้วยการประสานงานทรัพยากรคอมพิวเตอร์ข้ามภูมิภาค
การตอบสนองอย่างเป็นทางการเกิดขึ้นภายในเวลาไม่ถึงสองสัปดาห์ต่อมา โดยเน้นย้ำว่านโยบายข้อมูลส่วนกลางได้กลายมาเป็นความทะเยอทะยานด้านหุ่นยนต์ของจีนอย่างไร AI ที่เป็นตัวเป็นตน - ระบบที่รวมสติปัญญาของเครื่องจักรเข้ากับเครื่องจักรทางกายภาพ เช่น หุ่นยนต์ฮิวแมนนอยด์ - ถูกมองว่าเป็นอุตสาหกรรมเชิงกลยุทธ์ในกรุงปักกิ่ง และข้อมูลเป็นวัตถุดิบ
ปัญหาคอขวดของข้อมูลในหุ่นยนต์ฮิวแมนนอยด์
ขนาดของความท้าทายมีความสำคัญมาก ตามการประเมินของ China Academy of Information and Communications Technology โมเดลพื้นฐานของ AI ที่รวมไว้นั้นจำเป็นต้องใช้ข้อมูลการฝึกอบรมในโลกแห่งความเป็นจริงประมาณ 10 ล้านชั่วโมง ข้อมูลคุณภาพสูงมีอยู่ประมาณ 100,000 ถึง 1 ล้านชั่วโมงทั่วโลก ตามตัวเลขที่อ้างโดย The Next Web
กล่าวอีกนัยหนึ่งข้อจำกัดในหุ่นยนต์ฮิวแมนนอยด์ไม่ใช่แบบจำลองอีกต่อไป มันเป็นชั่วโมงแห่งความเป็นจริงที่บันทึกไว้ — ข้อมูลที่บันทึกวิธีที่เครื่องจักรรับรู้ ให้เหตุผล และดำเนินการในสภาพแวดล้อมทางกายภาพที่ยุ่งเหยิง
ไปป์ไลน์มาตรฐานกำลังดำเนินการแล้ว
แรงผลักดันใหม่นี้สร้างขึ้นจากรากฐานที่สำคัญ มาตรฐานแห่งชาติที่เผยแพร่เมื่อวันที่ 27 สิงหาคม ครอบคลุมถึงคุณภาพของข้อมูลอัจฉริยะในโลกแห่งความเป็นจริงและข้อกำหนดทางเทคนิคสำหรับแพลตฟอร์มการสร้างข้อมูล โดยข้อกำหนดเพิ่มเติมหลายประการยังอยู่ระหว่างการพัฒนา ตามรายงานของ AP News
ในบรรดาโครงการต่างๆ ที่ดูแลโดยสำนักงานข้อมูลแห่งชาตินั้น มีการนำเสนอมาตรฐานที่ครอบคลุมแหล่งที่มาและองค์ประกอบของชุดข้อมูลอัจฉริยะคุณภาพสูง การสร้างและประมวลผลข้อมูลสังเคราะห์จำลอง และข้อกำหนดสำหรับการรวบรวมข้อมูลและการฝึกอบรมแบบจำลองที่ฐานการฝึกอบรม งานนี้อยู่ระหว่างการพัฒนาภายใต้คณะกรรมการด้านเทคนิคมาตรฐานข้อมูลแห่งชาติ
โครงการร่างหนึ่งโครงการซึ่งจดทะเบียนในเดือนเมษายน ได้กำหนดตารางเวลา 12 เดือนสำหรับมาตรฐานในการรวบรวมข้อมูลและการฝึกอบรมแบบจำลองที่ฐานการฝึกอบรมด้านสติปัญญาแบบรวม กลุ่มร่างประกอบด้วยสถาบันมาตรฐานอิเล็กทรอนิกส์ของจีน สถาบันเทคโนโลยีปักกิ่ง สถาบันซอฟต์แวร์ที่สถาบันวิทยาศาสตร์จีน และบริษัทหุ่นยนต์ ร่างที่แยกต่างหากกล่าวถึงข้อมูลสังเคราะห์ ซึ่งกำลังมีความสำคัญมากขึ้นเรื่อยๆ เนื่องจากการรวบรวมปฏิสัมพันธ์ระหว่างหุ่นยนต์ในโลกทางกายภาพอย่างเพียงพออาจมีราคาแพง ช้า และยากที่จะทำซ้ำ
แผนการดำเนินงานที่ออกเมื่อเดือนมิถุนายน เรียกร้องให้มีการสร้างชุดข้อมูลที่รวดเร็วยิ่งขึ้นในด้านยุทธศาสตร์และสาขาที่กำลังเกิดใหม่ รวมถึงระบบอัจฉริยะที่รวบรวมไว้ การขับขี่อัจฉริยะ และเศรษฐกิจในพื้นที่ต่ำ นอกจากนี้ ยังเรียกร้องให้มีข้อมูลที่ครอบคลุมปฏิสัมพันธ์ทางกายภาพ การรับรู้ด้านสิ่งแวดล้อม และการควบคุมการเคลื่อนไหวในสถานการณ์สำคัญ และสั่งให้หน่วยงานต่างๆ ปรับปรุงการทำความสะอาดข้อมูล การปรับปรุง การติดฉลาก การจัดตำแหน่ง และการตรวจสอบคุณภาพ
การสร้างสนามฝึกซ้อมของจีน
ปักกิ่งกำลังสร้างโครงสร้างพื้นฐานทางกายภาพเพื่อรวบรวมข้อมูลนั้นด้วย พื้นที่ฝึกอบรม AI ที่รวบรวมไว้มากกว่า 70 แห่งได้เปิดดำเนินการแล้วทั่วมากกว่าครึ่งหนึ่งของภูมิภาคมณฑลของจีน โดยมีการวางแผนหรืออยู่ระหว่างการก่อสร้างอีก 46 แห่ง TechNode รายงาน ประมาณร้อยละ 86 มุ่งเป้าไปที่การผลิตเชิงอุตสาหกรรม
สิ่งอำนวยความสะดวกกระจุกตัวอยู่ในสามภูมิภาค ได้แก่ สามเหลี่ยมปากแม่น้ำแยงซี ภูมิภาคปักกิ่ง-เทียนจิน-เหอเป่ย และสามเหลี่ยมปากแม่น้ำเพิร์ล พวกเขาร่วมกันสร้างเครื่องมือรวบรวมข้อมูลที่มีเพียงไม่กี่ประเทศเท่านั้นที่สามารถเทียบเคียงได้ในปัจจุบัน
ความแตกต่างกับยุโรป
การประกาศดังกล่าวเน้นย้ำถึงความไม่สมดุลที่เพิ่มมากขึ้นด้วยแนวทางการกำกับดูแลของตะวันตก ยุโรปได้เขียนกฎเกณฑ์ที่ครอบคลุมสำหรับข้อมูลประเภทนี้โดยไม่ต้องสร้างอุปทานมากนัก กฎหมายข้อมูลของสหภาพยุโรปมีผลบังคับใช้ตั้งแต่วันที่ 12 กันยายน 2025 และควบคุมผู้ที่สามารถเข้าถึงข้อมูลที่สร้างโดยผลิตภัณฑ์ที่เชื่อมต่อ รวมถึงเครื่องจักรอุตสาหกรรม ในขณะที่ภาระผูกพันในการออกแบบกัดผลิตภัณฑ์ที่เชื่อมต่อที่วางอยู่ในตลาดสหภาพยุโรปหลังวันที่ 12 กันยายน 2026
คณะกรรมาธิการยุโรปเผยแพร่ยุทธศาสตร์ Data Union เมื่อวันที่ 19 พฤศจิกายน 2025 ซึ่งมีความสำคัญเป็นอันดับแรกในการขยายการเข้าถึงข้อมูลสำหรับ AI สิบเดือนที่ผ่านมา การดำเนินการส่วนใหญ่ยังไม่ได้ดำเนินการ รวมถึงห้องปฏิบัติการข้อมูลตามกลยุทธ์ที่สัญญาไว้ The Next Web รายงาน ประเทศยุโรปที่ใกล้ที่สุดซึ่งเทียบเท่ากับสนามฝึกของจีนคือบริษัทเอกชน โดย NEURA Robotics กำลังสร้างยิมฝึกหุ่นยนต์ 10 แห่ง โดย 5 แห่งมีแผนจะเปิดดำเนินการภายในสิ้นปีนี้ โดยแยกระหว่างยุโรป สหรัฐอเมริกา และจีน
การตรวจสอบความเป็นจริงด้านอุปสงค์
การกำหนดมาตรฐานการจัดหาข้อมูลไม่ได้รับประกันความต้องการ มีเพียงร้อยละ 23 ขององค์กรจีนที่สำรวจในปีนี้กล่าวว่าพวกเขาพอใจกับหุ่นยนต์ที่นำเสนอ ซึ่งเป็นตัวเลขที่ชี้ให้เห็นว่าตลาด ไม่ใช่ท่อส่งข้อมูล อาจเป็นตัวกำหนดจังหวะของการนำไปใช้ในที่สุด
แต่ทิศทางการเดินทางยังชัดเจน จีนกำลังปฏิบัติต่อข้อมูล AI ที่รวบรวมไว้ในฐานะทรัพยากรเชิงกลยุทธ์ที่จะผลิตอย่างเป็นระบบ ได้มาตรฐาน และปรับขนาด ในขณะที่หน่วยงานกำกับดูแลประสานงานอย่างใกล้ชิดกับอุตสาหกรรมที่พวกเขาดูแล สำหรับผู้ผลิตหุ่นยนต์ทั่วโลก ช่องว่างระหว่างเขตอำนาจศาลที่สร้างความเป็นจริงในการฝึกอบรมกับเขตที่ควบคุมการใช้งานเป็นส่วนใหญ่ กำลังกลายเป็นหนึ่งในคำถามเชิงแข่งขันที่กำหนดในสาขานี้
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →