Amazon Web Services បានដាក់ឱ្យដំណើរការ Amazon Bedrock AgentCore Evaluations ដែលជាសមត្ថភាពថ្មីមួយដែលផ្តល់ពិន្ទុដល់ភ្នាក់ងារ AI ដែលបានបង្កើតឡើងជាមួយនឹងក្របខ័ណ្ឌសំខាន់ៗណាមួយ - មិនត្រឹមតែឧបករណ៍ផ្ទាល់ខ្លួនរបស់ AWS ប៉ុណ្ណោះទេ ដោយចាត់ទុក OpenTelemetry traces ជាចំណុចប្រទាក់សកលសម្រាប់ការវាយតម្លៃ។ សេចក្តីប្រកាសនេះបានធ្វើឡើងនៅក្នុងការបង្ហោះប្លុករៀនម៉ាស៊ីន AWS ដែលត្រូវបានចេញផ្សាយនៅថ្ងៃទី 26 ខែសីហា ដោយ Swarnim Singhal, Bharathi Srinivasan និង Renya Kujirada ។

ទីលាននិយាយអំពីអ្វីដែល AWS ហៅថា asymmetry ដ៏គួរឱ្យខកចិត្តនៅក្នុងការងារ AI ផលិតកម្ម៖ ភាពចម្រុះនៃក្របខ័ណ្ឌភ្នាក់ងារបន្តកើនឡើងខណៈពេលដែលឧបករណ៍វាយតម្លៃមិនរក្សាល្បឿន។ ដើម្បីបន្តជាមួយនឹង [វដ្តព័ត៌មានឧស្សាហកម្ម AI] (https://aibuzzwire.news) កាន់តែទូលំទូលាយ ឥឡូវនេះក្រុមនានាតែងតែលាយបញ្ចូលគ្នា និងឧបករណ៍ដែលត្រូវគ្នា — ដែលជាកន្លែងជាក់លាក់ដែលបំពង់វាយតម្លៃបែបប្រពៃណីធ្លាក់ចុះដាច់ពីគ្នា។

បញ្ហាបែកខ្ញែក

ដូចដែលក្រុម AWS កំណត់វា ប្រព័ន្ធវាយតម្លៃភាគច្រើនសន្មត់ថាអ្នកបានបង្កើតភ្នាក់ងាររបស់អ្នកតាមវិធីជាក់លាក់មួយ៖ SDK ជាក់លាក់ អតិថិជនគំរូភាសាធំជាក់លាក់ លំនាំតាមដានជាក់លាក់។ ចេញទៅក្រៅតំបន់ភាពត្រូវគ្នាដ៏តូចចង្អៀតនោះ ហើយបំពង់វាយតម្លៃបានដាច់។

ជង់ពិភពពិតកម្រស្ថិតនៅខាងក្នុងផ្លូវរបស់អ្នកលក់មួយ។ នៅក្នុងគណនីរបស់ប្លក់ ក្រុមការងារបង្កើតនៅលើ LangGraph សម្រាប់ការរៀបចំលំហូរការងារ នៅលើ LlamaIndex សម្រាប់ការរួមបញ្ចូលបំពង់យកមកវិញយ៉ាងតឹងរឹង និងនៅលើ OpenAI Agents SDK នៅពេលដែលស្ថាប័នមួយធ្វើស្តង់ដារលើគំរូ GPT ។ ពួកគេប្រើ Google ADK សម្រាប់ការសម្របសម្រួលពហុភ្នាក់ងារ ឬ Claude Agent SDK សម្រាប់សមត្ថភាព Anthropic ដើម ហើយពួកគេឈានដល់ Strands Agents នៅពេលដែលរង្វិលជុំដែលដឹកនាំដោយគំរូរបស់វាអាចទទួលបានភ្នាក់ងារដែលកំពុងដំណើរការនៅលើ Amazon Bedrock AgentCore ក្នុងរយៈពេលប៉ុន្មាននាទីជាជាងថ្ងៃ។

ក្របខ័ណ្ឌនីមួយៗនៃក្របខ័ណ្ឌទាំងនោះបង្កើតតំណាងផ្ទៃក្នុងរបស់ខ្លួនអំពីអ្វីដែលភ្នាក់ងារបានធ្វើ — ការហៅឧបករណ៍ ការទាញយកមកវិញ ការប្រគល់ជូនរវាងភ្នាក់ងាររង។ ជាប្រវត្តិសាស្ត្រ ការវាយតម្លៃពួកវាមានន័យថាការកសាងឧបករណ៍ឡើងវិញសម្រាប់នីមួយៗ ឬទទួលយកថាក្របខ័ណ្ឌមួយចំនួនមិនអាចត្រូវបានគេចាត់ថ្នាក់ទាល់តែសោះ។

របៀបដែលវាដំណើរការ៖ Telemetry Over Tight Coupling

ការវាយតម្លៃ AgentCore ព្យាយាមរំលាយការភ្ជាប់គ្នានោះដោយជ្រើសរើសចំណុចប្រទាក់គ្រប់ក្របខណ្ឌសំខាន់ៗដែលនិយាយរួចហើយ។ ស្ទើរតែទាំងអស់នៃពួកគេគាំទ្រ OpenTelemetry ទាំងប្រភពដើមឬតាមរយៈបណ្ណាល័យឧបករណ៍សហគមន៍ — ស្តង់ដារជាក់ស្តែងដែលឧបករណ៍សង្កេតលើពពក និងកម្មវិធីបានបញ្ចូលគ្នាកាលពីឆ្នាំមុន។

តក្កវិជ្ជាគឺត្រង់៖ ដរាបណា telemetry របស់ភ្នាក់ងារហូរតាមរយៈ OpenTelemetry សេវាកម្មវាយតម្លៃអាចដាក់ពិន្ទុបាន ដោយមិនគិតពីអ្វីដែល SDK ស្ថិតនៅខាងក្រោម។ ប្រកាសប្លក់ដើរតាមអ្វីដែលសេវាតេឡេម៉ែត្រអាន របៀបដែលវាសម្រេចពីរបៀបបកស្រាយវិសាលភាព ដែលគុណលក្ខណៈផ្ទុកទិន្នន័យវាយតម្លៃ និងរបៀបដែលការគ្របដណ្តប់ពង្រីកទៅក្របខ័ណ្ឌលើសពីបញ្ជីឈ្មោះរបស់ AWS — បង្កើតទម្រង់ប្រកបដោយប្រសិទ្ធភាព ជាជាងក្របខ័ណ្ឌកិច្ចសន្យា។

សម្រាប់ស្ថាប័នវិស្វកម្ម នេះបង្វែរការវាយតម្លៃទៅជាការសម្រេចចិត្តលើហេដ្ឋារចនាសម្ព័ន្ធ ជំនួសឱ្យការស្ថាបនាក្នុងមួយគម្រោង។ ភ្នាក់ងារ​ដែល​បាន​ចាត់ថ្នាក់​ថ្ងៃ​ដែល​វា​ដឹកជញ្ជូន​អាច​ត្រូវ​បាន​ប្រៀបធៀប​ជាមួយ​នឹង​មាត្រដ្ឋាន​ដូចគ្នា​ថាតើ​អ្នក​និពន្ធ​របស់​វា​បាន​សរសេរ​វា​ជា LangGraph ឬ Claude Agent SDK។

កន្លែងដែលវាសមនៅក្នុង AgentCore

ការវាយតម្លៃដាក់ចូលទៅក្នុងវេទិកា Amazon Bedrock AgentCore ដ៏ធំទូលាយ ដែលរយៈពេលដំណើរការរបស់វាគ្រប់គ្រងការបង្ហោះ ការធ្វើមាត្រដ្ឋាន អង្គចងចាំ និងអ្នកអភិវឌ្ឍន៍ហេដ្ឋារចនាសម្ព័ន្ធដែលអាចមើលបានរួចហើយនឹងសាងសង់ឡើងវិញសម្រាប់គម្រោងនីមួយៗ។ ជាមួយនឹងការវាយតម្លៃដែលត្រូវបានបន្ថែមទៅលើផ្ទៃដូចគ្នានោះ AWS កំពុងប្រមូលផ្តុំនូវបរិមាណនៃវដ្តជីវិតពេញលេញសម្រាប់ភ្នាក់ងារ៖ ដាក់ពង្រាយពួកវានៅលើពេលដំណើរការ មើលពួកវាតាមរយៈការសង្កេតដែលភ្ជាប់មកជាមួយ ហើយឥឡូវនេះវាស់វាប្រឆាំងនឹងលក្ខណៈវិនិច្ឆ័យស្របគ្នាដោយមិនចាកចេញពីវេទិកា។

ពេលវេលាមិនចៃដន្យទេ។ នៅទូទាំងឧស្សាហកម្មនេះ សំណួរអំពីថាតើភ្នាក់ងារពិតជាមានឥរិយាបទដូចបំណងបានផ្លាស់ប្តូរពីការព្រួយបារម្ភផ្នែកសិក្សាទៅហានិភ័យកម្រិតក្រុមប្រឹក្សា បន្ទាប់ពីវគ្គដែលមានទម្រង់ខ្ពស់ដូចជាអាកប្បកិរិយាមិនត្រឹមត្រូវដែលបានសម្របសម្រួលដែលបានចងក្រងជាឯកសារនៅក្នុងការស៊ើបអង្កេតការរំលោភលើមុខការឱប និងភស្តុតាងដែលកំពុងកើនឡើងដែលបង្ហាញតែរូបភាពមិនពេញលេញនៃភាពជឿជាក់របស់ភ្នាក់ងារ។ ឧបករណ៍ដែលធ្វើឱ្យការវាយតម្លៃបន្ត ថោក និងឯករាជ្យនៃក្របខ័ណ្ឌនិយាយដោយផ្ទាល់ទៅនឹងការថប់បារម្ភនោះ។

ហេតុអ្វីវាសំខាន់

ការវាយតម្លៃបានក្លាយទៅជាឧបសគ្គយ៉ាងស្ងប់ស្ងាត់នៃការទទួលយកភ្នាក់ងារសហគ្រាស។ ល្បឿននៃការអភិវឌ្ឍន៍មិនមែនជាឧបសគ្គទៀតទេ — ឧបសគ្គគឺភាពជឿជាក់៖ ដោយដឹងថាភ្នាក់ងារដែលឆ្លើយតបអតិថិជន ការផ្លាស់ប្តូរទិន្នន័យ ឬដំណើរការលំហូរការងារនឹងធ្វើដូច្នេះបានត្រឹមត្រូវនៅក្រោមលក្ខខណ្ឌដែលគ្មាននរណាម្នាក់បានសាកល្បងដោយឡែកពីគ្នា។

ដោយការវាយតម្លៃបោះយុថ្កាទៅ OpenTelemetry ជាជាង SDK តែមួយណាមួយនោះ AWS កំពុងភ្នាល់ថាការយល់ស្របលើការសង្កេតរបស់ឧស្សាហកម្មអាចកើនឡើងទ្វេដងជាស្រទាប់ធានាគុណភាពរបស់វា។ ថាតើដៃគូប្រកួតប្រជែងធ្វើតាមការវាយតម្លៃក្របខ័ណ្ឌសមមូល - ភាពមិនច្បាស់លាស់នឹងនិយាយច្រើនអំពីរបៀបដែលភ្នាក់ងារ AI ឆាប់ចាស់ទុំពីការបង្ហាញទៅជាហេដ្ឋារចនាសម្ព័ន្ធដែលអាចទុកចិត្តបាន។

សម្រាប់ក្រុមដែលកំពុងដំណើរការកងនាវាផ្សេងៗគ្នា ការជាប់ពាក់ព័ន្ធជាក់ស្តែងគឺការប្រៀបធៀប។ នៅពេលដែលភ្នាក់ងារទាំងអស់រាយការណ៍ក្នុងទម្រង់ telemetry ដូចគ្នា គុណភាពក្លាយជាអ្វីមួយដែលអង្គការអាចតាមដានតាមពេលវេលា និងនៅទូទាំងក្រុម ជាជាងការទទួលបានឡើងវិញក្នុងមួយគម្រោង — លក្ខខណ្ឌជាមុនសម្រាប់អ្វីៗដែលស្រដៀងនឹងភាពចាស់ទុំនៃប្រតិបត្តិការនៅក្នុងប្រព័ន្ធភ្នាក់ងារ។ សម្រាប់សហគ្រាសដែលស៊ីជម្រៅនៅក្នុងបណ្តុំកូនកាត់ LangGraph-LlamaIndex ឬគ្រាន់តែប្រយ័ត្នចំពោះការសរសេរឧបករណ៍ឡើងវិញនៅពេលណាដែលក្របខ័ណ្ឌល្អប្រសើរជាងមុនលេចឡើង ឥឡូវនេះមានជម្រើសភាគីទីមួយពីក្រុមហ៊ុនផ្តល់សេវាពពករបស់ពួកគេដែលមិនសុំឱ្យពួកគេជ្រើសរើសភាគី។

---

ស្នាក់នៅមុន AI

ទទួលបានព័ត៌មាន AI ការវិភាគ និងរបកគំហើញចុងក្រោយបំផុត — ទាំងអស់នៅកន្លែងតែមួយ។

អានព័ត៌មាន AI បន្ថែម →