தன்னாட்சி AI முகவர்களை மதிப்பிடுவதற்கு உருவகப்படுத்தப்பட்ட டிஜிட்டல் சூழல்களை உருவாக்கும் தொடக்க நிறுவனமான Patronus AI, நம்பகமான முகவர் சோதனைக்கான தேவை அதிகரித்து வருவதால், தொடர் B சுற்றில் $50 மில்லியனை திரட்டியுள்ளது. குறிப்பிடத்தக்க மூலதனம், லைட்ஸ்பீட், டேட்டாடாக் மற்றும் சாம்சங் ஆகியவற்றின் பங்கேற்புடன் கிரீன்ஃபீல்ட் பார்ட்னர்களால் இந்த சுற்று வழிநடத்தப்பட்டது, டெக் க்ரஞ்ச் அறிக்கையின்படி நிறுவனத்தின் மொத்த நிதியுதவியை $70 மில்லியனாகக் கொண்டு வந்தது.

ஒரு புதிய சிக்கல்: குறுக்குவழிகளை எடுக்கும் முகவர்கள் For more context on this story, see our ongoing more AI stories.

AI முகவர்கள் கேள்விகளுக்குப் பதிலளிப்பதில் இருந்து சிக்கலான, பல-படி பணிகளைத் தன்னாட்சி முறையில் செயல்படுத்துவது வரை உருவாகும்போது, மாதிரி வழங்குநர்கள் மற்றும் அத்தகைய முகவர்களை உருவாக்கும் ஸ்டார்ட்அப்கள் பரந்த அளவிலான காட்சிகளில் கணினிகள் நம்பகத்தன்மையுடன் செயல்படும் என்பதற்கு உத்தரவாதம் தேவை. AI ஆய்வகங்கள் ஒரு மாதிரியின் திறமையைக் காட்ட பெரும்பாலும் வரையறைகளைப் பயன்படுத்துகின்றன, ஆனால் முகவர் சார்ந்த அளவுகோலில் அதிக மதிப்பெண் இருந்தால், ஒரு AI உண்மையில் நிஜ-உலக வேலைகளைச் சரியாகச் செய்ய முடியும் என்பதை நிரூபிக்கவில்லை.

அந்த இடைவெளியில்தான் Patronus AI கவனம் செலுத்துகிறது. முன்னாள் மெட்டா AI ஆராய்ச்சியாளர்களான ஆனந்த் கண்ணப்பன் மற்றும் ரெபேக்கா கியான் ஆகியோரால் 2023 இல் நிறுவப்பட்டது, சான் பிரான்சிஸ்கோவை தளமாகக் கொண்ட நிறுவனம், "டிஜிட்டல் உலக மாதிரிகள்", வலைத்தளங்களின் பிரதிகள் மற்றும் பயிற்சிக்குப் பிறகு மன அழுத்தத்தை சோதிக்கும் உள் அமைப்புகளை உருவாக்குகிறது. முகவர்கள் வலுவூட்டல் கற்றலைப் பயன்படுத்தி மதிப்பீடு செய்யப்படுகிறார்கள், இது பணியை வெற்றிகரமாக முடிப்பதற்கு மீண்டும் மீண்டும் வெகுமதி அளிக்கிறது மற்றும் பிழைகளுக்கு அபராதம் விதிக்கிறது.

தன்னாட்சி வாகனங்களில் இருந்து கடன் வாங்குதல்

Waymo எவ்வாறு சுய-ஓட்டுநர் கார்களைப் பயிற்றுவித்தது என்பதை நிறுவனம் அதன் அணுகுமுறையை ஒப்பிடுகிறது, கடுமையான வானிலை அல்லது பந்தைப் பின்தொடர்ந்து ஓடும் குழந்தை போன்ற அரிய ஆபத்துகளுக்கு எதிராக வாகனங்களைச் சோதிக்க செயற்கை உலகங்களை முதலில் உருவாக்கியது. AI முகவர்களுடனான முக்கிய வேறுபாடு என்னவென்றால், அவர்கள் குறுக்குவழிகளை எடுக்க முனைகிறார்கள், அதாவது அவர்கள் வெற்றிபெறத் தோன்றினாலும் பணிகளைச் சரியாக முடிக்கத் தவறிவிடுகிறார்கள்.

"பேட்ரோனஸ் ஹேக்குகளைக் கண்டறிவதிலும், மாடல்களை அவர்கள் பொறுப்பேற்கிறார்களா என்பதை உறுதி செய்வதிலும் மிகவும் நல்லவர்," என்று குறிப்பிடத்தக்க கேபிட்டலின் நிர்வாக இயக்குனர் க்ளென் சாலமன் கூறினார். சாலமன் நிறுவனத்தின் உருவகப்படுத்தப்பட்ட சூழல்களுக்கான தேவையை கிட்டத்தட்ட திருப்தியற்றதாக விவரித்தார். ஏறக்குறைய ஒவ்வொரு எல்லைப்புற AI ஆய்வகமும் பல வளர்ந்து வரும் ஸ்டார்ட்அப்களும் இப்போது வாடிக்கையாளர்களாக உள்ளன, மேலும் கடந்த ஆண்டில் பேட்ரோனஸின் வருவாய் 15 மடங்கு அதிகரித்துள்ளது.

சரிபார்க்கக்கூடிய பணிகளுக்கு அப்பால் விரிவடைகிறது

Patronus தற்போது மென்பொருள் பொறியியல் மற்றும் நிதிக்கு அதன் உருவகப்படுத்தப்பட்ட டிஜிட்டல் உலகங்களை வழங்குகிறது, விளைவுகளைச் சரிபார்க்க ஒப்பீட்டளவில் எளிதாக இருக்கும் இரண்டு களங்கள். ஆனால் நிறுவனம் இவற்றை வெறும் தொடக்கமாகவே பார்க்கிறது. "இன்று நாங்கள் சரிபார்க்கக்கூடிய சிக்கல்கள், நீங்கள் உடனடியாகச் சரிபார்த்து சரிபார்க்கக்கூடிய சிக்கல்கள் ஆகியவற்றில் கவனம் செலுத்துகிறோம், ஆனால் இன்னும் ஒரு டன் பகுதிகள் சரிபார்க்க முடியாதவை அல்லது சரிபார்க்க மிகவும் கடினமானவை" என்று கண்ணப்பன் கூறினார்.

நீண்ட எல்லைகளில் முகவர்களைச் சோதிக்கும் அளவுக்கு கணிசமான சூழல்களை உருவாக்குவதே லட்சியம். "10 மணிநேரம் அல்லது 10 நாட்கள் அல்லது 10 வாரங்கள் இயங்கக்கூடிய ஒரு முகவரை நீங்கள் இயக்கக்கூடிய சூழலை உண்மையில் உருவாக்க நாங்கள் விரும்புகிறோம்," என்று கண்ணப்பன் கூறினார். செயல்முறைகள் சரிபார்க்கக்கூடியவை என்பதால் அவை எளிமையானவை என்று அர்த்தமல்ல, மேலும் ஒரு நாள்-நீண்ட பணிப்பாய்வு மூலம் ஒரு ஏஜென்ட் தோல்வியடைவதைப் பிடிக்கும் திறன் நிறுவனத்தின் மதிப்பு முன்மொழிவின் மையமாகும்.

பரந்த AI தொழிற்துறையானது முன்னேற்றத்தை எவ்வாறு அளவிடுவது என்பதைப் பற்றிப் போராடும் போது நிதியும் வருகிறது. பெஞ்ச்மார்க் மதிப்பெண்கள் ஒரு சர்ச்சைக்குரிய நாணயமாக மாறியுள்ளன, உண்மையான பணிகளில் உண்மையாக மேம்படுத்தப்படாமல் கேம் குறிப்பிட்ட சோதனைகளுக்கு மாடல்களை மேம்படுத்தலாம் என்று விமர்சகர்கள் வாதிடுகின்றனர். பேட்ரோனஸின் உருவகப்படுத்தப்பட்ட சூழல்கள் ஒரு மாற்று, சோதனை முகவர்களை திறந்த நிலைக் காட்சிகளில் வழங்குகின்றன, வெற்றிக்கான ஒரே ஆதாரம் லீடர்போர்டில் உள்ள எண்ணை விட சரியாக முடிக்கப்பட்ட வேலை மட்டுமே.

நிறுவன வாடிக்கையாளர்களுக்கு, அந்த வேறுபாடு முக்கியமானது. ஒரு குறியீட்டு முகவர் ஒரு அளவுகோலைக் கடந்து, ஆனால் ஒரு உற்பத்திக் குறியீட்டுத் தளத்தில் பிழைகளை மௌனமாக அறிமுகப்படுத்துகிறார், அல்லது புள்ளிவிவரங்களைத் தவறாகச் சுற்றும் ஒரு நிதி முகவர், குறைந்த சோதனை மதிப்பெண் பரிந்துரைப்பதை விட அதிக சேதத்தை ஏற்படுத்தும். வரிசைப்படுத்தப்படுவதற்கு முன்பு அந்த தோல்விகளை சாண்ட்பாக்ஸில் பிடிப்பதன் மூலம், பேட்ரோனஸ் மதிப்பீட்டை நம்பிக்கைக்கான ஒரு முன்நிபந்தனையாக நிலைநிறுத்துகிறார், பின் சிந்தனை அல்ல.

நெரிசலான களத்தில் ஒரு தனித்துவமான அணுகுமுறை

போட்டியாளர்களைப் பொறுத்தவரை, ஏஜென்ட் நடத்தையை மதிப்பிடுவதற்கு AI ஆய்வகங்கள் ஏற்கனவே உருவாக்கிய உள் மதிப்பீட்டுக் குழுக்களுக்கு எதிராக முதன்மையாக போட்டியிடுவதாக பேட்ரோனஸ் நம்புகிறார். மெர்கோர் மற்றும் சர்ஜ் போன்ற மனித-தரவு நிறுவனங்கள் வலுவூட்டல் கற்றலில் மாதிரி தயாரிப்பாளர்களுக்கு உதவுகின்றன, பேட்ரோனஸ் வித்தியாசமாக செயல்படுகிறது, எந்த மனித ஈடுபாடும் இல்லாமல் முகவர்கள் எவ்வாறு நடந்துகொள்கிறார்கள் என்பதை மதிப்பீடு செய்து, தோல்விகளைக் கண்டறிவதை தானியங்குபடுத்துகிறது, இல்லையெனில் விலையுயர்ந்த கைமுறை மதிப்பாய்வு தேவைப்படும்.

முகவர் மதிப்பீடு AI அடுக்கின் அடிப்படை அடுக்காக மாறும் என்ற முதலீட்டாளர் நம்பிக்கையை இந்த சுற்று சமிக்ஞை செய்கிறது. பயணங்களை முன்பதிவு செய்வது முதல் நிதி பகுப்பாய்வு நடத்துவது வரை, முகவர்கள் அதிக தன்னாட்சிப் பணிகளை மேற்கொள்வதால், அந்த அமைப்புகள் நம்பகமானவை என்பதை நிரூபிக்கும் ஸ்டார்ட்அப்கள், அவை பயன்படுத்தப்படுவதற்கு முன்பு, ஏஜென்டிக் AI சகாப்தம் வரை தங்களை இன்றியமையாத கேட் கீப்பர்களாக நிலைநிறுத்திக் கொள்கின்றன.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →