Amazon Web Services ஆனது Amazon Bedrock AgentCore மதிப்பீடுகளை அறிமுகப்படுத்தியுள்ளது, இது OpenTelemetry ட்ரேஸ்களை மதிப்பீட்டிற்கான உலகளாவிய இடைமுகமாக கருதுவதன் மூலம் - AWS இன் சொந்த கருவி மட்டுமல்ல - எந்தவொரு பெரிய கட்டமைப்பையும் கொண்டு கட்டமைக்கப்பட்ட AI முகவர்களை மதிப்பீடு செய்யும் புதிய திறனாகும். ஸ்வர்னிம் சிங்கால், பாரதி சீனிவாசன் மற்றும் ரென்யா குஜிராடா ஆகியோரால் ஆகஸ்ட் 26 அன்று வெளியிடப்பட்ட AWS இயந்திர கற்றல் வலைப்பதிவு இடுகையில் இந்த அறிவிப்பு வந்தது.

உற்பத்தி AI வேலையில் AWS ஒரு ஏமாற்றமளிக்கும் சமச்சீரற்ற தன்மையை சுருதி குறிப்பிடுகிறது: மதிப்பீட்டு கருவி வேகத்தை வைத்திருக்காத போது முகவர் கட்டமைப்பின் பன்முகத்தன்மை தொடர்ந்து வளர்ந்து வருகிறது. பரந்த AI தொழில்துறை செய்தி சுழற்சி உடன் தொடர, அணிகள் இப்போது வழக்கமாகக் கருவிகளைக் கலந்து பொருத்துகின்றன - துல்லியமாக பாரம்பரிய மதிப்பீட்டு பைப்லைன்கள் பிரிந்து செல்கின்றன.

துண்டாடுதல் பிரச்சனை

AWS குழு அதை வடிவமைத்துள்ளதால், பெரும்பாலான மதிப்பீட்டு அமைப்புகள் நீங்கள் உங்கள் முகவரை ஒரு குறிப்பிட்ட வழியில் உருவாக்கியதாகக் கருதுகின்றன: ஒரு குறிப்பிட்ட SDK, ஒரு குறிப்பிட்ட பெரிய மொழி மாதிரி கிளையன்ட், ஒரு குறிப்பிட்ட தடமறிதல் முறை. குறுகிய பொருந்தக்கூடிய மண்டலத்திற்கு வெளியே செல்லுங்கள் மற்றும் மதிப்பீட்டு குழாய் உடைகிறது.

நிஜ உலக அடுக்குகள் ஒரு விற்பனையாளரின் பாதையில் அரிதாகவே இருக்கும். வலைப்பதிவு இடுகையின் கணக்கில், குழுக்கள் பணிப்பாய்வு ஆர்கெஸ்ட்ரேஷனுக்காக LangGraph ஐ உருவாக்குகின்றன, இறுக்கமான மீட்டெடுப்பு பைப்லைன் ஒருங்கிணைப்பிற்காக LlamaIndex இல் மற்றும் GPT மாதிரிகளில் ஒரு நிறுவனம் தரப்படுத்தும்போது OpenAI முகவர்கள் SDK இல் உருவாக்கப்படும். அவர்கள் மல்டி-ஏஜெண்ட் ஒருங்கிணைப்புக்கு Google ADK அல்லது நேட்டிவ் ஆந்த்ரோபிக் திறனுக்காக Claude Agent SDK ஐப் பயன்படுத்துகின்றனர், மேலும் அதன் மாதிரி-உந்துதல் லூப் சில நாட்களுக்குப் பதிலாக நிமிடங்களில் Amazon Bedrock AgentCore இல் இயங்கும் ஒரு வேலை செய்யும் முகவரைப் பெறும்போது அவர்கள் Strands Agents ஐ அடைகின்றனர்.

அந்த கட்டமைப்புகள் ஒவ்வொன்றும் ஒரு முகவர் என்ன செய்தார் என்பதை அதன் சொந்த உள் பிரதிநிதித்துவத்தை உருவாக்குகிறது - கருவி அழைப்புகள், மீட்டெடுப்புகள், துணை முகவர்களுக்கிடையில் கைமாறுகள். வரலாற்று ரீதியாக, அவற்றை மதிப்பிடுவது என்பது ஒவ்வொன்றிற்கும் கருவிகளை மீண்டும் உருவாக்குவது அல்லது சில கட்டமைப்புகளை வெறுமனே தரப்படுத்த முடியாது என்பதை ஏற்றுக்கொள்வது.

இது எப்படி வேலை செய்கிறது: டெலிமெட்ரி ஓவர் டைட் கப்ளிங்

AgentCore மதிப்பீடுகள் ஒவ்வொரு முக்கிய கட்டமைப்பையும் ஏற்கனவே பேசும் ஒரு இடைமுகத்தைத் தேர்ந்தெடுப்பதன் மூலம் அந்த இணைப்பைக் கலைக்க முயற்சிக்கிறது. ஏறக்குறைய அவை அனைத்தும் ஓபன் டெலிமெட்ரியை, சொந்தமாகவோ அல்லது சமூக கருவி நூலகங்கள் மூலமாகவோ ஆதரிக்கின்றன - கிளவுட் மற்றும் பயன்பாட்டு அவதானிப்புக் கருவிகள் பல ஆண்டுகளுக்கு முன்பு ஒன்றிணைந்த நடைமுறை தரநிலை.

தர்க்கம் நேரடியானது: ஒரு ஏஜென்ட்டின் டெலிமெட்ரி OpenTelemetry வழியாகப் பாயும் வரை, SDK என்ன அடியில் அமர்ந்திருந்தாலும் மதிப்பீட்டுச் சேவை அதை ஸ்கோர் செய்ய முடியும். வலைப்பதிவு இடுகை, சேவை என்ன டெலிமெட்ரியைப் படிக்கிறது, ஸ்பான்களை எவ்வாறு விளக்குவது, எந்தெந்தப் பண்புக்கூறுகள் மதிப்பீட்டுத் தரவைக் கொண்டு செல்கிறது, மற்றும் AWS இன் பெயரிடப்பட்ட பட்டியலுக்கு அப்பாற்பட்ட கட்டமைப்பிற்கு கவரேஜ் எவ்வாறு விரிவடைகிறது - கட்டமைப்பை, ஒப்பந்தத்தை விட வடிவமைப்பை திறம்பட உருவாக்குகிறது.

பொறியியல் நிறுவனங்களுக்கு, இது ஒரு திட்டத்திற்குப் பதிலாக ஒரு உள்கட்டமைப்பு முடிவாக மதிப்பீட்டை மாற்றுகிறது. ஒரு முகவர் அனுப்பும் நாளை அதன் ஆசிரியர்கள் LangGraph அல்லது Claude Agent SDK இல் எழுதியிருந்தாலும் அதே அளவீடுகளுடன் ஒப்பிடலாம்.

இது AgentCore இல் எங்கு பொருந்துகிறது

மதிப்பீடுகள் பரந்த Amazon Bedrock AgentCore இயங்குதளத்தில் இடம் பெற்றுள்ளன, அதன் இயக்க நேரம் ஏற்கனவே ஹோஸ்டிங், அளவிடுதல், நினைவகம் மற்றும் கவனிக்கக்கூடிய உள்கட்டமைப்பு உருவாக்குநர்கள் ஒவ்வொரு திட்டத்திற்கும் மறுகட்டமைப்பார்கள். அதே மேற்பரப்பில் மதிப்பீட்டைச் சேர்த்ததன் மூலம், AWS ஆனது முகவர்களுக்கான முழு வாழ்க்கைச் சுழற்சியின் அளவைக் கூட்டுகிறது: இயக்க நேரத்தில் அவற்றைப் பயன்படுத்தவும், உள்ளமைக்கப்பட்ட அவதானிப்பு மூலம் அவற்றைப் பார்க்கவும், இப்போது தளத்தை விட்டு வெளியேறாமல் நிலையான அளவுகோல்களுடன் அவற்றை அளவிடவும்.

நேரம் தற்செயலானது அல்ல. தொழில்துறை முழுவதும், முகவர்கள் உண்மையில் எண்ணியபடி நடந்துகொள்கிறார்களா என்பது பற்றிய கேள்விகள் கல்விசார் அக்கறையிலிருந்து போர்டு-நிலை அபாயத்திற்கு நகர்ந்தன, ஹக்கிங் ஃபேஸ் மீறல் விசாரணையில் ஆவணப்படுத்தப்பட்ட ஒருங்கிணைக்கப்பட்ட தவறான நடத்தை மற்றும் முகவர் நம்பகத்தன்மையின் முழுமையற்ற படத்தை வரையறுப்பதற்கான ஆதாரங்கள் அதிகரித்து வருகின்றன. மதிப்பீட்டை தொடர்ச்சியான, மலிவான மற்றும் கட்டமைப்பின் சார்பற்றதாக மாற்றும் கருவி அந்த கவலையை நேரடியாகப் பேசுகிறது.

ஏன் இது முக்கியமானது

நிறுவன முகவர் தத்தெடுப்பின் தடையாக மதிப்பீடு அமைதியாக மாறிவிட்டது. வளர்ச்சி வேகம் இனி தடையாக இருக்காது - கட்டுப்பாடு நம்பிக்கை: வாடிக்கையாளர்களுக்கு பதிலளிக்கும் முகவர், தரவை நகர்த்துதல் அல்லது பணிப்பாய்வுகளை செயல்படுத்துதல் ஆகியவை தனித்தனியாக யாரும் சோதிக்கப்படாத நிலைமைகளின் கீழ் சரியாகச் செய்வார் என்பதை அறிந்துகொள்வது.

எந்தவொரு SDK க்கும் இல்லாமல் OpenTelemetry க்கு மதிப்பீட்டைத் தொகுத்து வழங்குவதன் மூலம், AWS தொழில்துறையின் கவனிப்பு ஒருமித்த கருத்து அதன் தர-உறுதி அடுக்குடன் இரட்டிப்பாகும் என்று பந்தயம் கட்டுகிறது. போட்டியாளர்கள் சமமான ஃப்ரேம்வொர்க்-அக்னாஸ்டிக் ஸ்கோரிங்கைப் பின்பற்றுகிறார்களா என்பது, டெமோக்களிலிருந்து நம்பகமான உள்கட்டமைப்புக்கு எவ்வளவு விரைவாக ஏஜென்டிக் AI முதிர்ச்சியடைகிறது என்பதைப் பற்றி அதிகம் கூறுகிறது.

பன்முகக் கடற்படைகளை இயக்கும் அணிகளுக்கு, நடைமுறை உட்குறிப்பு ஒப்பீடு ஆகும். ஒவ்வொரு ஏஜெண்டும் ஒரே டெலிமெட்ரி வடிவத்தில் அறிக்கையிடும் போது, ​​தரமானது ஒரு திட்டத்திற்கு மீண்டும் பெறுவதற்குப் பதிலாக, ஒரு நிறுவனம் காலப்போக்கில் மற்றும் குழுக்கள் முழுவதும் கண்காணிக்கக்கூடியதாக மாறும் - முகவர் அமைப்புகளில் செயல்பாட்டு முதிர்ச்சியை ஒத்த எதற்கும் இது ஒரு முன்நிபந்தனை. LangGraph-LlamaIndex ஹைப்ரிட் அடுக்குகளில் ஆழமான நிறுவனங்களுக்கு, அல்லது ஒரு சிறந்த கட்டமைப்பு தோன்றும் போதெல்லாம் கருவிகளை மீண்டும் எழுதுவதில் எச்சரிக்கையாக இருக்கும், இப்போது அவர்களின் கிளவுட் வழங்குநரிடமிருந்து முதல் தரப்பு விருப்பம் உள்ளது.

---

AIக்கு முன்னால் இருங்கள்

சமீபத்திய AI செய்திகள், பகுப்பாய்வு மற்றும் முன்னேற்றங்கள் - அனைத்தையும் ஒரே இடத்தில் பெறுங்கள்.

மேலும் AI செய்திகளைப் படிக்கவும் →