ChatGPT लाँच झाल्यापासून प्रकाशित झालेल्या वेब पृष्ठांपैकी एक तृतीयांश पेक्षा जास्त वेब पृष्ठे कृत्रिम बुद्धिमत्तेने लिहिलेली असल्याची चिन्हे दाखवतात, Pew Research Center च्या एका नवीन अभ्यासानुसार – AI ने ओपन वेबच्या सामग्रीला किती उत्पादक रीतीने आकार दिला आहे याचे सर्वात कठोर मापनांपैकी एक.

गैर-पक्षीय संशोधन संस्थेने गुरुवारी प्रसिद्ध केलेले निष्कर्ष, इंटरनेट मशीन-लिखित मजकूर कोणीही ट्रॅक करू शकत नाही त्यापेक्षा अधिक वेगाने भरत आहे या वाढत्या चिंतेमध्ये उतरले आहे. शिफ्टचा स्केल ही एआय युगाची परिभाषित कथा आहे आणि एआय उद्योग कव्हरेज मध्ये सतत ट्रॅक केली जाते.

Pew ने AI-लिखित वेब कसे मोजले

अहवाल संकलित करण्यासाठी, Pew ने कॉमन क्रॉल वेब आर्काइव्हचा वापर करून सुमारे अर्धा दशलक्ष इंग्रजी-भाषेतील वेब पृष्ठे एकत्रित केली होती जी ChatGPT च्या नोव्हेंबर 2022 च्या रिलीझच्या काही वर्ष आधीपासून साधारणपणे गेल्या पाच वर्षांत पसरलेली होती. त्यानंतर संशोधकांनी एआयद्वारे किती लिहीले किंवा मोठ्या प्रमाणात संपादित केले गेले याचा अंदाज घेण्यासाठी पॅनग्राम या एआय-डिटेक्शन तंत्रज्ञानाद्वारे पृष्ठे चालवली.

हेडलाइनचे आकडे लक्षवेधी आहेत. जुलै 2026 मध्ये गोळा केलेल्या 10,000 वेब पृष्ठांच्या यादृच्छिक नमुन्यात, सुमारे 10% ने AI लेखकत्वाची लक्षणीय चिन्हे दर्शविली. परंतु त्या यादृच्छिक नमुन्यात AI लेखन साधने अस्तित्वात येण्यापूर्वी प्रकाशित मोठ्या संख्येने जुनी पृष्ठे अपरिहार्यपणे समाविष्ट होती - अशी पृष्ठे जी मशीनद्वारे लिहिली जाऊ शकत नाहीत.

जेव्हा Pew ने ते फिल्टर केले आणि फक्त ChatGPT लाँच झाल्यानंतर प्रकाशित झालेल्या पृष्ठांवर नजर टाकली, तेव्हा AI लेखकत्वाची चिन्हे दर्शविणारा शेअर 35% वर गेला - तीनपैकी एकापेक्षा जास्त.

व्यावसायिक डोमेन मार्ग दाखवतात

अभ्यासाचे डोमेन-स्तरीय ब्रेकडाउन हे त्याचे सर्वात उघड शोध असू शकते. .com डोमेनवरील पृष्ठांवर .edu आणि .gov डोमेनच्या अंदाजे दहापट दराने AI लेखकत्वाची चिन्हे दिसून आली, जे दोन्ही सुमारे 1% AI-लेखक आहेत. नानफा .org डोमेन 4.6% च्या दरम्यान घसरले.

नमुना प्रोत्साहनांबद्दल एक कथा सांगते. जिथे सामग्री शोध इंजिनमध्ये रँक करण्यासाठी आणि जाहिरात किंवा संलग्न महसूल निर्माण करण्यासाठी तयार केली जाते, तिथे AI लेखन वाढले आहे. जिथे संस्था त्यांची प्रतिष्ठा त्यांनी प्रकाशित केलेल्या गोष्टींशी जोडतात — विद्यापीठे, सरकारी संस्था — मानवी लेखकत्व अजूनही वर्चस्व गाजवते.

प्यूला असेही आढळून आले की मशीन लेखनाचे क्लासिक स्टायलिस्टिक सांगणे गेल्या काही वर्षांमध्ये वेबवर अधिक सामान्य झाले आहे: em डॅश, ऑक्सफर्ड स्वल्पविराम आणि "इट्स नॉट एक्स, इट्स वाय" सारख्या बांधकामांची वारंवारता वाढली आहे.

शोध इंजिन ऑप्टिमायझेशन प्रॅक्टिशनर्सनी वर्षानुवर्षे काय नोंदवले आहे याच्याशी .com चा शोध देखील जोडतो: सामग्री फार्म, संलग्न साइट आणि कमी किमतीचे प्रकाशक हे जनरेटिव्ह लेखनाचे सर्वात जुने आणि सर्वात आक्रमक स्वीकारणारे होते, कारण त्यांच्यासाठी दुसरे पृष्ठ - कोणतेही पृष्ठ - तयार करण्याचे अर्थशास्त्र आधीच कोलमडले होते. संपादकीय मानकांसह संस्थात्मक प्रकाशक हळूहळू हलले आणि ते डेटामध्ये दिसून येते.

सांगकामे बॉट्ससाठी लेखन

इंटरनेट इन्फ्रास्ट्रक्चर प्रोव्हायडर क्लाउडफ्लेअरने बॉट वेब ट्रॅफिकने मानवी वेब ट्रॅफिकला मागे टाकल्याचा खुलासा केल्यानंतर लगेचच Pew अहवाल आला - कंपनीच्या अंदाजापेक्षा एक मैलाचा दगड लवकर पोहोचला. TechCrunch ने अभ्यासाच्या कव्हरेजमध्ये नमूद केल्याप्रमाणे, दोन निष्कर्ष एकत्रितपणे एक अस्वस्थ करणारे चित्र रेखाटतात: वेबचा बराचसा भाग आता बॉट्स ब्राउझिंग पृष्ठे आहे जी बर्याच बाबतीत, इतर बॉट्सने लिहिलेली होती.

समालोचकांनी डेटाला "डेड इंटरनेट थिअरी" शी जोडण्यास झटपट केले आहे - स्वयंचलित क्रॉलर्सच्या प्रेक्षकांसाठी बरीच ऑनलाइन सामग्री कृत्रिमरित्या तयार केली जाते ही एकेकाळची कल्पना. षड्यंत्र-मनाचे मेम म्हणून जे सुरू झाले ते कमीत कमी व्यावसायिक वेबसाठी, मोजता येण्याजोग्या लोकसंख्याशास्त्रीय वास्तवासारखे दिसत आहे.

तपासातील सावधगिरी

प्यूने त्याच्या कार्यपद्धतीच्या मर्यादा लक्षात घेण्याची काळजी घेतली. Pangram, इतर AI-डिटेक्शन टूल्सप्रमाणे, मानवी-लिखित पृष्ठांचे AI-व्युत्पन्न म्हणून चुकीचे वर्गीकरण करू शकते आणि शोध अचूकता लेखन शैली आणि शैलींमध्ये बदलते. शेकडो हजारो पृष्ठांच्या प्रमाणात, तथापि, डेटा कमीतकमी दिशात्मकदृष्ट्या योग्य आहे, असे संस्थेने म्हटले आहे - आणि एकाधिक स्वतंत्र अभ्यास AI लेखकत्वाची चिन्हे दर्शविणाऱ्या नवीन वेब सामग्रीच्या शेअरबद्दल समान निष्कर्षांवर पोहोचले आहेत.

अभ्यासाने केवळ इंग्रजी-भाषेतील पृष्ठांचे मोजमाप केले आणि कॉमन क्रॉलच्या संग्रहणातून काढले, जे वेबच्या संपूर्णतेऐवजी स्नॅपशॉट कॅप्चर करते.

संख्या महत्त्वाची का आहे

इंटरनेट ट्रिव्हियाच्या पलीकडे या शोधाचे परिणाम आहेत. जेव्हा अनुक्रमित सामग्रीचा वाढता वाटा मशीन-व्युत्पन्न केला जातो तेव्हा विश्वासार्ह परिणाम कसे मिळवायचे याबद्दल शोध इंजिने आधीपासूनच झगडत आहेत. प्रकाशक आणि शिक्षकांना मूळ प्रस्थापित करण्यासाठी कठीण वेळ सहन करावा लागतो. आणि AI मॉडेल बिल्डर्सना एक शांत समस्या भेडसावत आहे: वेबवरून स्क्रॅप केलेल्या प्रशिक्षण डेटामध्ये वाढत्या प्रमाणात AI आउटपुट असते, ज्यामुळे सिंथेटिक मजकूराच्या फीडबॅक लूपद्वारे मॉडेलच्या ऱ्हासाची भीती वाढते.

दैनंदिन वाचकांसाठी, व्यावहारिक टेकअवे हा संशयवादाचा एक नवीन पूर्वनिर्धारित पवित्रा आहे. ChatGPT-नंतरच्या काळात व्यावसायिक डोमेनवर प्रकाशित केलेल्या उत्पादनाचे पुनरावलोकन, कसे-मार्गदर्शक किंवा बातम्यांशी संलग्न ब्लॉग पोस्टमध्ये आता AI चे बोटांचे ठसे असण्याची शक्यता तीनपैकी एक आहे — आणि साइटच्या काही श्रेण्यांवर, बहुधा जास्त.

वेब नेहमीच अस्सल आणि उत्पादित यांचे मिश्रण आहे. Pew चा डेटा दर्शवितो की शिल्लक टिपली गेली, आणि त्वरीत: चार वर्षांपेक्षा कमी कालावधीत, मशीन लेखन अस्तित्त्वात नव्हते ते ऑनलाइन प्रकाशित झालेल्या प्रत्येक गोष्टीच्या महत्त्वपूर्ण अंशापर्यंत पोहोचले.

AI च्या पुढे रहा

नवीनतम AI संशोधन, उद्योग डेटा आणि ट्रेंड विश्लेषणासाठी, बुकमार्क करा AI Buzz Wire.

अधिक AI बातम्या वाचा →