Amazon Web Services បានដាក់ឱ្យដំណើរការ Amazon Bedrock AgentCore Evaluations ដែលជាសមត្ថភាពថ្មីមួយដែលផ្តល់ពិន្ទុដល់ភ្នាក់ងារ AI ដែលបានបង្កើតឡើងជាមួយនឹងក្របខ័ណ្ឌសំខាន់ៗណាមួយ - មិនត្រឹមតែឧបករណ៍ផ្ទាល់ខ្លួនរបស់ AWS ប៉ុណ្ណោះទេ ដោយចាត់ទុក OpenTelemetry traces ជាចំណុចប្រទាក់សកលសម្រាប់ការវាយតម្លៃ។ សេចក្តីប្រកាសនេះបានធ្វើឡើងនៅក្នុងការបង្ហោះប្លុករៀនម៉ាស៊ីន AWS ដែលត្រូវបានចេញផ្សាយនៅថ្ងៃទី 26 ខែសីហា ដោយ Swarnim Singhal, Bharathi Srinivasan និង Renya Kujirada ។
ទីលាននិយាយអំពីអ្វីដែល AWS ហៅថា asymmetry ដ៏គួរឱ្យខកចិត្តនៅក្នុងការងារ AI ផលិតកម្ម៖ ភាពចម្រុះនៃក្របខ័ណ្ឌភ្នាក់ងារបន្តកើនឡើងខណៈពេលដែលឧបករណ៍វាយតម្លៃមិនរក្សាល្បឿន។ ដើម្បីបន្តជាមួយនឹង [វដ្តព័ត៌មានឧស្សាហកម្ម AI] (https://aibuzzwire.news) កាន់តែទូលំទូលាយ ឥឡូវនេះក្រុមនានាតែងតែលាយបញ្ចូលគ្នា និងឧបករណ៍ដែលត្រូវគ្នា — ដែលជាកន្លែងជាក់លាក់ដែលបំពង់វាយតម្លៃបែបប្រពៃណីធ្លាក់ចុះដាច់ពីគ្នា។
បញ្ហាបែកខ្ញែក
ដូចដែលក្រុម AWS កំណត់វា ប្រព័ន្ធវាយតម្លៃភាគច្រើនសន្មត់ថាអ្នកបានបង្កើតភ្នាក់ងាររបស់អ្នកតាមវិធីជាក់លាក់មួយ៖ SDK ជាក់លាក់ អតិថិជនគំរូភាសាធំជាក់លាក់ លំនាំតាមដានជាក់លាក់។ ចេញទៅក្រៅតំបន់ភាពត្រូវគ្នាដ៏តូចចង្អៀតនោះ ហើយបំពង់វាយតម្លៃបានដាច់។
ជង់ពិភពពិតកម្រស្ថិតនៅខាងក្នុងផ្លូវរបស់អ្នកលក់មួយ។ នៅក្នុងគណនីរបស់ប្លក់ ក្រុមការងារបង្កើតនៅលើ LangGraph សម្រាប់ការរៀបចំលំហូរការងារ នៅលើ LlamaIndex សម្រាប់ការរួមបញ្ចូលបំពង់យកមកវិញយ៉ាងតឹងរឹង និងនៅលើ OpenAI Agents SDK នៅពេលដែលស្ថាប័នមួយធ្វើស្តង់ដារលើគំរូ GPT ។ ពួកគេប្រើ Google ADK សម្រាប់ការសម្របសម្រួលពហុភ្នាក់ងារ ឬ Claude Agent SDK សម្រាប់សមត្ថភាព Anthropic ដើម ហើយពួកគេឈានដល់ Strands Agents នៅពេលដែលរង្វិលជុំដែលដឹកនាំដោយគំរូរបស់វាអាចទទួលបានភ្នាក់ងារដែលកំពុងដំណើរការនៅលើ Amazon Bedrock AgentCore ក្នុងរយៈពេលប៉ុន្មាននាទីជាជាងថ្ងៃ។
ក្របខ័ណ្ឌនីមួយៗនៃក្របខ័ណ្ឌទាំងនោះបង្កើតតំណាងផ្ទៃក្នុងរបស់ខ្លួនអំពីអ្វីដែលភ្នាក់ងារបានធ្វើ — ការហៅឧបករណ៍ ការទាញយកមកវិញ ការប្រគល់ជូនរវាងភ្នាក់ងាររង។ ជាប្រវត្តិសាស្ត្រ ការវាយតម្លៃពួកវាមានន័យថាការកសាងឧបករណ៍ឡើងវិញសម្រាប់នីមួយៗ ឬទទួលយកថាក្របខ័ណ្ឌមួយចំនួនមិនអាចត្រូវបានគេចាត់ថ្នាក់ទាល់តែសោះ។
របៀបដែលវាដំណើរការ៖ Telemetry Over Tight Coupling
ការវាយតម្លៃ AgentCore ព្យាយាមរំលាយការភ្ជាប់គ្នានោះដោយជ្រើសរើសចំណុចប្រទាក់គ្រប់ក្របខណ្ឌសំខាន់ៗដែលនិយាយរួចហើយ។ ស្ទើរតែទាំងអស់នៃពួកគេគាំទ្រ OpenTelemetry ទាំងប្រភពដើមឬតាមរយៈបណ្ណាល័យឧបករណ៍សហគមន៍ — ស្តង់ដារជាក់ស្តែងដែលឧបករណ៍សង្កេតលើពពក និងកម្មវិធីបានបញ្ចូលគ្នាកាលពីឆ្នាំមុន។
តក្កវិជ្ជាគឺត្រង់៖ ដរាបណា telemetry របស់ភ្នាក់ងារហូរតាមរយៈ OpenTelemetry សេវាកម្មវាយតម្លៃអាចដាក់ពិន្ទុបាន ដោយមិនគិតពីអ្វីដែល SDK ស្ថិតនៅខាងក្រោម។ ប្រកាសប្លក់ដើរតាមអ្វីដែលសេវាតេឡេម៉ែត្រអាន របៀបដែលវាសម្រេចពីរបៀបបកស្រាយវិសាលភាព ដែលគុណលក្ខណៈផ្ទុកទិន្នន័យវាយតម្លៃ និងរបៀបដែលការគ្របដណ្តប់ពង្រីកទៅក្របខ័ណ្ឌលើសពីបញ្ជីឈ្មោះរបស់ AWS — បង្កើតទម្រង់ប្រកបដោយប្រសិទ្ធភាព ជាជាងក្របខ័ណ្ឌកិច្ចសន្យា។
សម្រាប់ស្ថាប័នវិស្វកម្ម នេះបង្វែរការវាយតម្លៃទៅជាការសម្រេចចិត្តលើហេដ្ឋារចនាសម្ព័ន្ធ ជំនួសឱ្យការស្ថាបនាក្នុងមួយគម្រោង។ ភ្នាក់ងារដែលបានចាត់ថ្នាក់ថ្ងៃដែលវាដឹកជញ្ជូនអាចត្រូវបានប្រៀបធៀបជាមួយនឹងមាត្រដ្ឋានដូចគ្នាថាតើអ្នកនិពន្ធរបស់វាបានសរសេរវាជា LangGraph ឬ Claude Agent SDK។
កន្លែងដែលវាសមនៅក្នុង AgentCore
ការវាយតម្លៃដាក់ចូលទៅក្នុងវេទិកា Amazon Bedrock AgentCore ដ៏ធំទូលាយ ដែលរយៈពេលដំណើរការរបស់វាគ្រប់គ្រងការបង្ហោះ ការធ្វើមាត្រដ្ឋាន អង្គចងចាំ និងអ្នកអភិវឌ្ឍន៍ហេដ្ឋារចនាសម្ព័ន្ធដែលអាចមើលបានរួចហើយនឹងសាងសង់ឡើងវិញសម្រាប់គម្រោងនីមួយៗ។ ជាមួយនឹងការវាយតម្លៃដែលត្រូវបានបន្ថែមទៅលើផ្ទៃដូចគ្នានោះ AWS កំពុងប្រមូលផ្តុំនូវបរិមាណនៃវដ្តជីវិតពេញលេញសម្រាប់ភ្នាក់ងារ៖ ដាក់ពង្រាយពួកវានៅលើពេលដំណើរការ មើលពួកវាតាមរយៈការសង្កេតដែលភ្ជាប់មកជាមួយ ហើយឥឡូវនេះវាស់វាប្រឆាំងនឹងលក្ខណៈវិនិច្ឆ័យស្របគ្នាដោយមិនចាកចេញពីវេទិកា។
ពេលវេលាមិនចៃដន្យទេ។ នៅទូទាំងឧស្សាហកម្មនេះ សំណួរអំពីថាតើភ្នាក់ងារពិតជាមានឥរិយាបទដូចបំណងបានផ្លាស់ប្តូរពីការព្រួយបារម្ភផ្នែកសិក្សាទៅហានិភ័យកម្រិតក្រុមប្រឹក្សា បន្ទាប់ពីវគ្គដែលមានទម្រង់ខ្ពស់ដូចជាអាកប្បកិរិយាមិនត្រឹមត្រូវដែលបានសម្របសម្រួលដែលបានចងក្រងជាឯកសារនៅក្នុងការស៊ើបអង្កេតការរំលោភលើមុខការឱប និងភស្តុតាងដែលកំពុងកើនឡើងដែលបង្ហាញតែរូបភាពមិនពេញលេញនៃភាពជឿជាក់របស់ភ្នាក់ងារ។ ឧបករណ៍ដែលធ្វើឱ្យការវាយតម្លៃបន្ត ថោក និងឯករាជ្យនៃក្របខ័ណ្ឌនិយាយដោយផ្ទាល់ទៅនឹងការថប់បារម្ភនោះ។
ហេតុអ្វីវាសំខាន់
ការវាយតម្លៃបានក្លាយទៅជាឧបសគ្គយ៉ាងស្ងប់ស្ងាត់នៃការទទួលយកភ្នាក់ងារសហគ្រាស។ ល្បឿននៃការអភិវឌ្ឍន៍មិនមែនជាឧបសគ្គទៀតទេ — ឧបសគ្គគឺភាពជឿជាក់៖ ដោយដឹងថាភ្នាក់ងារដែលឆ្លើយតបអតិថិជន ការផ្លាស់ប្តូរទិន្នន័យ ឬដំណើរការលំហូរការងារនឹងធ្វើដូច្នេះបានត្រឹមត្រូវនៅក្រោមលក្ខខណ្ឌដែលគ្មាននរណាម្នាក់បានសាកល្បងដោយឡែកពីគ្នា។
ដោយការវាយតម្លៃបោះយុថ្កាទៅ OpenTelemetry ជាជាង SDK តែមួយណាមួយនោះ AWS កំពុងភ្នាល់ថាការយល់ស្របលើការសង្កេតរបស់ឧស្សាហកម្មអាចកើនឡើងទ្វេដងជាស្រទាប់ធានាគុណភាពរបស់វា។ ថាតើដៃគូប្រកួតប្រជែងធ្វើតាមការវាយតម្លៃក្របខ័ណ្ឌសមមូល - ភាពមិនច្បាស់លាស់នឹងនិយាយច្រើនអំពីរបៀបដែលភ្នាក់ងារ AI ឆាប់ចាស់ទុំពីការបង្ហាញទៅជាហេដ្ឋារចនាសម្ព័ន្ធដែលអាចទុកចិត្តបាន។
សម្រាប់ក្រុមដែលកំពុងដំណើរការកងនាវាផ្សេងៗគ្នា ការជាប់ពាក់ព័ន្ធជាក់ស្តែងគឺការប្រៀបធៀប។ នៅពេលដែលភ្នាក់ងារទាំងអស់រាយការណ៍ក្នុងទម្រង់ telemetry ដូចគ្នា គុណភាពក្លាយជាអ្វីមួយដែលអង្គការអាចតាមដានតាមពេលវេលា និងនៅទូទាំងក្រុម ជាជាងការទទួលបានឡើងវិញក្នុងមួយគម្រោង — លក្ខខណ្ឌជាមុនសម្រាប់អ្វីៗដែលស្រដៀងនឹងភាពចាស់ទុំនៃប្រតិបត្តិការនៅក្នុងប្រព័ន្ធភ្នាក់ងារ។ សម្រាប់សហគ្រាសដែលស៊ីជម្រៅនៅក្នុងបណ្តុំកូនកាត់ LangGraph-LlamaIndex ឬគ្រាន់តែប្រយ័ត្នចំពោះការសរសេរឧបករណ៍ឡើងវិញនៅពេលណាដែលក្របខ័ណ្ឌល្អប្រសើរជាងមុនលេចឡើង ឥឡូវនេះមានជម្រើសភាគីទីមួយពីក្រុមហ៊ុនផ្តល់សេវាពពករបស់ពួកគេដែលមិនសុំឱ្យពួកគេជ្រើសរើសភាគី។
---
ស្នាក់នៅមុន AIទទួលបានព័ត៌មាន AI ការវិភាគ និងរបកគំហើញចុងក្រោយបំផុត — ទាំងអស់នៅកន្លែងតែមួយ។
អានព័ត៌មាន AI បន្ថែម →