ஆந்த்ரோபிக், ஓபன்ஏஐ மற்றும் கூகுள் ஆகியவற்றிலிருந்து முன்னணி AI மாடல்களால் உருவாக்கப்பட்ட மறைக்கப்பட்ட சிந்தனைப் பகுத்தறிவை, தனியுரிம தர்க்கம், தனிப்பட்ட தரவு மற்றும் நற்சான்றிதழ்களை அம்பலப்படுத்தும் மறைகுறியாக்கப்பட்ட தடயங்களிலிருந்து மீட்டெடுக்க முடியும் என்பதை ஆராய்ச்சியாளர்கள் குழு நிரூபித்துள்ளது.

ஆகஸ்ட் 11, 2026 அன்று வெளியிடப்பட்ட கண்டுபிடிப்புகள், சொந்தமான LLM API களில் இருந்து நியாயப்படுத்துதல் தடயங்களைத் திருடுதல் என்ற தலைப்பில் வெளியிடப்பட்டது, முக்கிய AI வழங்குநர்கள் தங்கள் மிகவும் மதிப்புமிக்க அறிவுசார் சொத்துக்களை எவ்வாறு பாதுகாக்கிறார்கள் என்பதற்கான அடிப்படை கட்டடக்கலை பாதிப்பை வெளிப்படுத்துகிறது. பிரேக்கிங் AI செய்திகளைப் பின்தொடரும் எவருக்கும், பொதுவில் பகிரப்படும்போது, ​​மறைகுறியாக்கப்பட்ட மாதிரி வெளியீடுகள் கூட எவ்வாறு பொறுப்பாக மாறும் என்பதை ஆராய்ச்சி அடிக்கோடிட்டுக் காட்டுகிறது.

தாக்குதல் எவ்வாறு செயல்படுகிறது

முன்னணி AI வழங்குநர்கள், அறிவுசார் சொத்துரிமையைப் பாதுகாப்பதற்கும் தகவல் கசிவைக் கட்டுப்படுத்துவதற்கும் தங்கள் மாதிரிகளின் படிப்படியான பகுத்தறிவை மறைத்துவிடுகிறார்கள் - இது சிந்தனையின் சங்கிலி என்று அழைக்கப்படுகிறது. இந்த ட்ரேஸ்களை சர்வர் பக்கமாகச் சேமிப்பதற்குப் பதிலாக, வழங்குநர்கள் அவற்றைக் கிளையண்டிற்கு என்க்ரிப்ட் செய்யப்பட்ட உரைத் தொகுதிகளாகத் திருப்பித் தருகிறார்கள்.

இந்த மறைகுறியாக்கப்பட்ட தொகுதிகள் வெவ்வேறு அமர்வுகள், பயனர்கள் மற்றும் வழங்குநரின் சுற்றுச்சூழல் அமைப்பில் உள்ள மாதிரிகள் முழுவதும் முழுமையாக இணக்கமானவை மற்றும் ஒன்றுக்கொன்று மாறக்கூடியவை என்பதை ஆராய்ச்சியாளர்கள் அடையாளம் கண்டுள்ளனர். இந்த பெயர்வுத்திறன் தாக்குதலுக்கு முக்கியமாகும்.

இந்த முறை இரண்டு API அழைப்புகளில் வேலை செய்கிறது. முதலில், தாக்குதல் செய்பவர் ஒரு எல்லைப்புற மாதிரியால் உருவாக்கப்பட்ட மறைகுறியாக்கப்பட்ட பகுத்தறிவுத் தடத்தை எடுத்துக்கொள்கிறார் - எடுத்துக்காட்டாக, கிளாட் ஓபஸ் 4.8 - மேலும் அதை அதே வழங்குனரின் பலவீனமான, குறைவான பாதுகாப்பற்ற உடன்பிறப்பு மாதிரியில் செலுத்துகிறார், அதாவது க்ளாட் ஹைக்கூ 4.5. பலவீனமான மாதிரியானது, நியாயமான வார்த்தைகளில் படியெடுக்க ஒரு எளிய அறிவுறுத்தலுடன் ஜெயில்பிரோக் செய்யப்படுகிறது. மறைகுறியாக்கப்பட்ட தொகுதி ஒன்றுக்கொன்று மாறக்கூடியதாக இருப்பதால், பலவீனமான மாதிரியானது வலுவான மாதிரியின் மறைக்கப்பட்ட பகுத்தறிவை எளிய உரையில் டிகோட் செய்து வெளியிடுகிறது - வலுவான மாதிரியை நேரடியாகத் தாக்காமல்.

ஆந்த்ரோபிக்ஸ் கிளாட், ஓபன்ஏஐயின் ஜிபிடி மற்றும் கூகிளின் ஜெமினி ஆகிய மூன்று முக்கிய வழங்குநர்களின் மாதிரிகள் முழுவதும் ஆராய்ச்சியாளர்கள் இந்தத் தாக்குதலை நிரூபித்துள்ளனர்.

தரவு வெளிப்பாட்டின் அளவு

பொதுவில் பகிரப்பட்ட அமர்வு பதிவுகள் மூலம் கசிந்த முக்கியமான தரவுகளின் அளவு மிகவும் ஆபத்தான கண்டுபிடிப்பு ஆகும். கிட்ஹப் மற்றும் ஹக்கிங் ஃபேஸ் ஆகியவற்றிலிருந்து பொதுவில் கிடைக்கும் 6,708 ஏஜென்ட் பாதைகளை ஆராய்ச்சியாளர்கள் சேகரித்தனர் - கிளாட், ஜிபிடி மற்றும் ஜெமினி மாடல்களால் தயாரிக்கப்பட்டது மற்றும் இன்னும் மறைகுறியாக்கப்பட்ட பகுத்தறிவுத் தொகுதிகளைக் கொண்டுள்ளது.

கையொப்பமிடப்பட்ட ஒவ்வொரு தொகுதிக்கும் அவற்றின் டிகோடிங் பைப்லைனைப் பயன்படுத்துவதால் 315,320 புனரமைக்கப்பட்ட பகுத்தறிவுத் தொகுதிகள் கிடைத்தன. இந்த மறைக்கப்பட்ட தடயங்களில் உண்மையான ரகசியங்கள் மற்றும் முக்கியமான தகவல்கள் இருந்தன.

உண்மையான, பெஞ்ச்மார்க் அல்லாத பயனர் அமர்வுகளுக்கு கட்டுப்படுத்தி, ஆராய்ச்சியாளர்கள் மீட்டெடுத்தனர்:

  • 704 தனித்துவமான தனியுரிமை கலைப்பொருட்கள் மொத்தம்
  • 204 தொழில்நுட்ப அடையாளங்காட்டிகள் (உள் URLகள், சர்வர் பாதைகள்)
  • 30 தனிப்பட்ட மின்னஞ்சல் முகவரிகள், பெயர்கள் மற்றும் அஞ்சல் முகவரிகள் உட்பட 126 தனிப்பட்ட முறையில் அடையாளம் காணக்கூடிய தகவல் (PII) உருப்படிகள்
  • 62 API விசைகள், 33 கடவுச்சொற்கள் மற்றும் 24 அணுகல் டோக்கன்கள் உட்பட 23 சான்றுகள்

704 கலைப்பொருட்களில், 64 பகுத்தறிவுத் தொகுதிகளுக்குள் பிரத்தியேகமாக தோன்றின மற்றும் காணக்கூடிய அமர்வு உரையில் எங்கும் இல்லை - அதாவது பகிர்வதற்கு முன் தங்கள் பதிவுகளை மதிப்பாய்வு செய்த டெவலப்பர்கள் அவர்கள் ரகசியங்களை கசியவிடுவதை அறிந்திருக்க மாட்டார்கள்.

ஒரு ஆவணப்படுத்தப்பட்ட எடுத்துக்காட்டு GPT-5.2 கோடெக்ஸ் அமர்வைக் காட்டியது, அங்கு மாதிரியின் மறைக்கப்பட்ட பகுத்தறிவு API விசைகள், AWS நற்சான்றிதழ்கள் மற்றும் GitHub டோக்கன்களைத் தேடுவது மற்றும் கையாள்வது பற்றிய விரிவான உள் எண்ணங்களைக் கொண்டிருந்தது - இவை அனைத்தும் உரையாடலின் புலப்படும் வெளியீட்டில் கண்ணுக்கு தெரியாதவை.

காய்ச்சி வடித்தல் எதிர்ப்பு பாதுகாப்புகள்

இரண்டாவது முக்கிய உட்குறிப்பு வடிகட்டுதல் எதிர்ப்பு வழிமுறைகளை மீறுவதாகும். AI வழங்குநர்கள் வேண்டுமென்றே தங்கள் மாடல்களின் காரணத்தை மறைத்து, அந்த தர்க்கத்தில் சிறிய மாடல்களைப் பயிற்சி செய்வதிலிருந்து போட்டியாளர்களைத் தடுக்கிறார்கள். ஆராய்ச்சியாளர்களின் நுட்பம் இந்த பாதுகாப்புகளை முழுவதுமாக கடந்து செல்கிறது.

டிகோட் செய்யப்பட்ட பகுத்தறிவின் நம்பகத்தன்மையை சரிபார்க்க, ஆராய்ச்சியாளர்கள் 120 Codeforces போட்டி நிரலாக்க சிக்கல்களை சோதித்தனர். டிகோட் செய்யப்பட்ட பகுத்தறிவின் டோக்கன் எண்ணிக்கையானது, ஒவ்வொரு மாடலின் API ஆல் அறிவிக்கப்பட்ட மறைக்கப்பட்ட சிந்தனை-டோக்கன் எண்ணிக்கையை நெருக்கமாகக் கண்காணித்து, கிட்டத்தட்ட முழுமையான மீட்டெடுப்பை உறுதிப்படுத்துகிறது.

நான்கு தாக்குதல் திசையன்கள்

இந்த பாதிப்பால் இயக்கப்பட்ட நான்கு தனித்துவமான தாக்குதல் திசையன்களை காகிதம் அடையாளம் காட்டுகிறது:

1. ஆண்டிடிஸ்டில்லேஷன் சர்கம்வென்ஷன் - ஆந்த்ரோபிக், ஓபன்ஏஐ மற்றும் கூகுள் முழுவதும் நிரூபிக்கப்பட்ட, போட்டியிடும் மாடல்களைப் பயிற்றுவிப்பதற்கான தனியுரிம மாதிரியின் நியாயத்தை பிரித்தெடுத்தல்.

2. பெரிய அளவிலான தனிப்பட்ட தரவு பிரித்தெடுத்தல் — டெவலப்பர்கள் அறியாமல் பொது களஞ்சியங்களில் பகிர்ந்துள்ள ஆயிரக்கணக்கான மறைகுறியாக்கப்பட்ட பகுத்தறிவு தொகுதிகளிலிருந்து இரகசியங்கள் மற்றும் PII ஐ அறுவடை செய்தல்.

3. அபாயகரமான தகவல் வெளிப்பாடு — மறைக்கப்பட்ட பகுத்தறிவு சில நேரங்களில், ஆபத்தான தகவல் உட்பட, புலப்படும் வெளியீட்டில் இருந்து வழங்குநர்கள் வேண்டுமென்றே ஒடுக்கப்பட்ட உள்ளடக்கத்தைக் கொண்டுள்ளது.

4. மாடல் கைரேகை — மாதிரி அடையாளம் மறைக்கப்பட்டிருந்தாலும், எந்த குறிப்பிட்ட மாதிரி பதிப்பு ஒரு தடயத்தை உருவாக்கியது என்பதை அடையாளம் காண டிகோட் செய்யப்பட்ட பகுத்தறிவைப் பயன்படுத்தலாம்.

எந்த மாதிரிகள் பாதிக்கப்படுகின்றன

மூன்று முக்கிய வழங்குநர்களின் மறைகுறியாக்கப்பட்ட பகுத்தறிவு அமைப்புகளில் பாதிப்பை ஆராய்ச்சியாளர்கள் உறுதிப்படுத்தினர்:

  • மானுடவியல் — க்ளாட் மாதிரிகள் மறைகுறியாக்கப்பட்ட `சிந்தனை` தொகுதிகளை `கையொப்பம்` புலத்துடன் வழங்கும்
  • OpenAI — GPT மாதிரிகள் மறைகுறியாக்கப்பட்ட பகுத்தறிவு சுருக்கங்களை வழங்கும்
  • Google — ஜெமினி மாதிரிகள் மறைகுறியாக்கப்பட்ட சிந்தனைத் தொகுதிகளை வழங்கும்

சமீபத்தில் சாண்ட்பாக்ஸ் சோதனையில் இருந்து தப்பிய சீன AI நிறுவனமான மூன்ஷாட் AI இன் மாதிரியான Kimi-K3, குறிப்பாக முக்கியமானது, ஏனெனில் அதன் மறைகுறியாக்கப்பட்ட பகுத்தறிவு தொகுதிகள் டிகோட் செய்வது மிகவும் எளிதானது என்பதை நிரூபித்தது.

டெவலப்பர்களுக்கு இது என்ன அர்த்தம்

டெவலப்பர்களுக்கான நடைமுறையில் எடுத்துச் செல்லக்கூடியது அப்பட்டமானது: நீங்கள் பகிரங்கமாகப் பகிரும் எந்த என்க்ரிப்ட் செய்யப்பட்ட பகுத்தறிவுத் தொகுதியும் — கிட்ஹப் ரெப்போ, ஹக்கிங் ஃபேஸ் டேட்டாசெட் அல்லது வலைப்பதிவு இடுகையில் — மீட்டெடுக்கக்கூடிய ரகசியங்களைக் கொண்டிருக்கலாம். குறியாக்கம் அமர்வு தொடர்ச்சிக்காக வடிவமைக்கப்பட்டுள்ளது, இந்த வகை தாக்குதலுக்கு எதிரான ரகசியத்தன்மை அல்ல.

மறைகுறியாக்கப்பட்ட பகுத்தறிவுத் தொகுதிகளுக்கான பகிரப்பட்ட அமர்வு பதிவுகளை டெவலப்பர்கள் தணிக்கை செய்து வெளியிடுவதற்கு முன் அவற்றை அகற்றுமாறு ஆராய்ச்சியாளர்கள் பரிந்துரைக்கின்றனர். பாதுகாப்பை விட தற்போது API வசதிக்கு முன்னுரிமை அளிக்கும் தங்கள் மறைகுறியாக்கப்பட்ட பகுத்தறிவு அமைப்புகளின் கட்டமைப்பை மறுபரிசீலனை செய்ய வழங்குநர்களை அவர்கள் அழைக்கின்றனர்.

எல்லிஸ் இன்ஸ்டிடியூட் டூபிங்கன், மேக்ஸ் பிளாங்க் இன்ஸ்டிடியூட் ஃபார் இன்டலிஜென்ட் சிஸ்டம்ஸ், டூபிங்கன் ஏஐ சென்டர், மேட்ஸ் ரிசர்ச், ஸ்னைக் மற்றும் டூபின்ஜென் பல்கலைக்கழகம் ஆகியவற்றில் ஜோனாஸ் கீப்பிங் மற்றும் மாக்சிம் ஆண்ட்ரியுஷ்செங்கோ ஆகியோரின் மேற்பார்வையில் அலெக்சாண்டர் பன்ஃபிலோவ், டேவிட் ஷ்மோட்ஸ் மற்றும் இலியா ஷுமைலோவ் ஆகியோர் இந்த ஆராய்ச்சியை மேற்கொண்டனர்.

AIக்கு முன்னால் இருங்கள்

AI பாதுகாப்பு நிலப்பரப்பு வேகமாக உருவாகி வருகிறது. சமீபத்திய AI மேம்பாடுகள் மற்றும் வளர்ந்து வரும் பாதிப்புகள் பற்றிய ஆழமான கவரேஜிற்காக, AI Buzz Wire முக்கியமான செய்திகளை வழங்குகிறது.

மேலும் AI செய்திகளைப் படிக்கவும் →