Amazon Web Services បានបន្ថែម GLM 5.3 ពី Z.ai ដែលជាអ្នកបង្កើតគំរូដែលត្រូវបានគេស្គាល់ថា Zhipu AI ទៅ Amazon Bedrock ដោយផ្តល់ឱ្យអតិថិជនសហគ្រាសនូវសិទ្ធិចូលប្រើ API យ៉ាងពេញលេញទៅកាន់ម៉ូដែលបើកចំហដ៏ធំបំផុតមួយដែលបានចេញផ្សាយនៅឆ្នាំនេះ។ ការដាក់ឱ្យដំណើរការដែលបានប្រកាសនៅលើ AWS Machine Learning Blog នៅថ្ងៃទី 5 ខែតុលា ធ្វើឱ្យគំរូ 753B-parameter mix-of-experts អាចរកបានតាមរយៈហេដ្ឋារចនាសម្ព័ន្ធគ្រប់គ្រងរបស់ Bedrock ជាជាងតម្រូវឱ្យក្រុមហ៊ុនរៀបចំទម្ងន់ដោយខ្លួនឯង។
យោងតាម AWS, GLM 5.3 — ដូចដែលបានចេញផ្សាយនៅលើ Hugging Face Hub — ត្រូវបានធ្វើឱ្យប្រសើរសម្រាប់ការសរសេរកូដ និងកិច្ចការភ្នាក់ងារផ្តេកវែង ដោយ Z.ai រាយការណ៍ពីសមត្ថភាពសុវត្ថិភាពអ៊ីនធឺណិតគួរឱ្យកត់សម្គាល់។ ភាពខ្លាំងទាំងនោះគូសផែនទីដោយផ្ទាល់ទៅលើអ្វីដែលអ្នកទិញសហគ្រាសបាននឹងកំពុងដកខ្លួនចេញពី APIs ព្រំដែននៅឆ្នាំនេះ៖ ការវែកញែកច្រើនជំហាន លំហូរការងារដែលបន្ថែមឧបករណ៍ និងបរិបទប្រកបដោយនិរន្តរភាពនៅទូទាំងមូលដ្ឋានកូដធំ។ For more context on this story, see our ongoing artificial intelligence updates.
អ្វីដែលអតិថិជន Bedrock ទទួលបានពិតប្រាកដ
សមាហរណកម្មនេះធ្វើឡើងតាមសៀវភៅស្ដង់ដារដែលគ្រប់គ្រងដោយ Bedrock ជាមួយនឹងការបន្ថែមកម្រិតសហគ្រាសមួយចំនួន៖
- ការចូលប្រើ API ដែលអាចបត់បែនបាន។ GLM 5.3 អាចត្រូវបានហៅតាមរយៈការឆ្លើយតបដែលឆបគ្នាជាមួយ OpenAI និង Chat Completions APIs — ដែល AWS ណែនាំសម្រាប់កម្មវិធីថ្មី — ក៏ដូចជាតាមរយៈ Bedrock Invoke និង Converse APIs ដើម។ ក្រុមដែលធ្វើចំណាកស្រុកតាមបំពង់ដែលមានមូលដ្ឋានលើ OpenAI អាចកំណត់គោលដៅគំរូឡើងវិញជាមួយនឹងការផ្លាស់ប្តូរកូដតិចតួចបំផុត។
- ការសន្និដ្ឋានឆ្លងតំបន់។ គំរូដឹកជញ្ជូននៅពីក្រោយទម្រង់ការសន្និដ្ឋានពីរ us.zai.glm-5.3 សម្រាប់ចរាចរណ៍ឆ្លងតំបន់របស់សហរដ្ឋអាមេរិក និង global.zai.glm-5.3 សម្រាប់ការធ្វើដំណើរជុំវិញពិភពលោក។ សំណើទៅកាន់តំបន់ប្រភពនៃជម្រើសរបស់អតិថិជន ហើយ Bedrock គ្រប់គ្រងការនាំផ្លូវដែលមានសុវត្ថិភាព។
- ឃ្លាំងសម្ងាត់ភ្លាមៗ។ ឃ្លាំងសម្ងាត់ដោយស្វ័យប្រវត្តិដោយចេតនាគឺត្រូវបានបើកតាមលំនាំដើម ជាមួយនឹងការគ្រប់គ្រងឃ្លាំងសម្ងាត់ច្បាស់លាស់ដែលមាននៅលើ APIs ដែលត្រូវគ្នាជាមួយ OpenAI ។ សម្រាប់បន្ទុកការងារភ្នាក់ងារដែលបញ្ជូនសារប្រព័ន្ធធំឡើងវិញ ឬបរិបទឃ្លាំងនៅគ្រប់វេន AWS និយាយថា ឃ្លាំងសម្ងាត់កាត់បន្ថយទាំងភាពយឺតយ៉ាវ និងតម្លៃបញ្ចូល។
- កម្រិតសេវាកម្ម។ អតិថិជនអាចជ្រើសរើស Flex សម្រាប់តម្លៃការងារដែលមានប្រសិទ្ធភាព ចំណាយពេលវេលាតិច អាទិភាពសម្រាប់ចរាចរណ៍ពេលយឺត-សំខាន់ក្នុងតម្លៃបុព្វលាភ ឬស្តង់ដារសម្រាប់សមតុល្យលំនាំដើម។
ការព្រមានមួយគឺលេចធ្លោ៖ AWS បញ្ជាក់ថាការចូលប្រើ GLM 5.3 នៅលើ Bedrock គឺអាចរកបានសម្រាប់អតិថិជនសហគ្រាសដែលមានសិទ្ធិ ដោយស្នើឱ្យដំណើរការបើកដំណើរការជាជាងបើកសេវាកម្មដោយខ្លួនឯងសម្រាប់គណនីទាំងអស់។
ការចែករំលែកចំណូលដំបូងសម្រាប់មន្ទីរពិសោធន៍ចិន
លើសពីការធ្វើសមាហរណកម្មបច្ចេកទេស សារព័ត៌មាននៃការបើកដំណើរការពិពណ៌នាអំពីការរៀបចំចែករំលែកចំណូលផ្អែកលើការប្រើប្រាស់រវាង AWS និង Z.ai ដែលអ្នកផ្តល់គំរូទទួលបានការកាត់បន្ថយការប្រើប្រាស់ Bedrock ដែលជាគំរូពាណិជ្ជកម្មស្តង់ដារដែល Bedrock ប្រើជាមួយដៃគូលោកខាងលិច ឥឡូវនេះបានអនុវត្តចំពោះគំរូស្តង់ដាររបស់មន្ទីរពិសោធន៍ចិននៅព្រំដែន។ ការរាយការណ៍ព័ត៌មានហិរញ្ញវត្ថុនៅលើទីផ្សារហុងកុងបាននិយាយថាភាគហ៊ុនដែលទាក់ទងនឹង Zhipu បានកើនឡើងច្រើនជាង 7% នៅក្នុងការជួញដូរដំបូងនៅលើព័ត៌មាននេះ។
កិច្ចព្រមព្រៀងនេះមានសារៈសំខាន់ចំពោះអ្វីដែលវាបង្ហាញអំពីយុទ្ធសាស្ត្រវេទិកា។ Hyperscalers បានចំណាយពេលពីរឆ្នាំចុងក្រោយនេះក្នុងការចាក់សោរនៅក្នុងសម្ព័ន្ធភាពនៃអារម្មណ៍ផ្តាច់មុខជាមួយមន្ទីរពិសោធន៍លោកខាងលិច។ ការបើក Bedrock ដល់គ្រួសារទម្ងន់បើកចំហរបស់ចិន ពង្រីកវិសាលភាពនៃវេទិកាទៅកាន់សហគ្រាសដែលងាយនឹងចំណាយ និងទៅកាន់ទីផ្សារដែលម៉ូដែលអាមេរិកប្រឈមនឹងសម្ពាធតម្លៃ។ វាក៏ផ្តល់ឱ្យការចែកចាយ Z.ai មិនមានការចេញផ្សាយទម្ងន់បើកចំហអាចផ្គូផ្គងបានទេ: សហគ្រាសរាប់ពាន់ដែលនឹងមិនទាញយកចំណុចត្រួតពិនិត្យប៉ារ៉ាម៉ែត្រ 753B ឥឡូវនេះអាចហៅវាថានៅពីក្រោយ SLA មួយ។
ពីទម្ងន់បើកចំហទៅកាន់ API ដែលបានគ្រប់គ្រង
ផ្លូវរបស់ GLM 5.3 ទៅ Bedrock បានរត់កាត់សហគមន៍បើកចំហ។ ម៉ូដែលនេះត្រូវបានបោះពុម្ភនៅលើ Hugging Face Hub ដែលទម្ងន់ លក្ខណៈវិនិច្ឆ័យ និងលក្ខខណ្ឌអាជ្ញាបណ្ណបានទាក់ទាញចំណាប់អារម្មណ៍អ្នកអភិវឌ្ឍន៍ មុនពេលដែលការបង្ហោះដែលត្រូវបានគ្រប់គ្រងត្រូវបានផ្តល់ជូន — សៀវភៅលេង Z.ai បានប្រើនៅទូទាំងស៊េរី GLM រួមទាំងការចេញផ្សាយ GLM-5.3-Flash ដែលមានអាជ្ញាប័ណ្ណ MIT ដែលដំណើរការលើបន្ទះឈីបដែលផលិតនៅប្រទេសចិន។
សម្រាប់សហគ្រាស ការគណនារវាងការទាញយកទម្ងន់ និងការហៅ API តែងតែចុះមកក្នុងប្រតិបត្តិការ៖ ការបង្ហោះដោយខ្លួនឯងនូវគំរូចម្រុះនៃអ្នកជំនាញ 753B-parameter ទាមទារសមត្ថភាព GPU ធ្ងន់ធ្ងរនិងភាពចាស់ទុំ MLOps ដែលអង្គការភាគច្រើនមិនអាចបង្ហាញអំពីភាពត្រឹមត្រូវសម្រាប់បន្ទុកការងារតែមួយ។ ការចូលប្រើដែលត្រូវបានគ្រប់គ្រងរបស់ Bedrock ដករបាំងនោះចេញ ខណៈពេលដែលរក្សាជម្រើសនៃការដាក់ពង្រាយកូនកាត់បើកចំហសម្រាប់ក្រុមហ៊ុនដែលមានដែនកំណត់ការស្នាក់នៅទិន្នន័យ។
ការចាប់ផ្តើមជាក់ស្តែង
ឯកសាររបស់ AWS ដើរតាមរយៈការអំពាវនាវពីកុងសូល Bedrock — ដែលគំរូបង្ហាញនៅក្នុងសួនកុមារស្តង់ដារសម្រាប់ការធ្វើតេស្តភ្លាមៗដោយមិនទាមទារកូដ — និងតាមកម្មវិធីតាមរយៈចំណុចបញ្ចប់នៃពេលវេលាដំណើរការ។ តម្រូវការជាមុនគឺការអនុញ្ញាត IAM ធម្មតាសម្រាប់ការហៅទូរសព្ទគំរូ រួមមាន bedrock: InvokeModel និង bedrock: InvokeModelWithResponseStream បូកនឹងការអនុញ្ញាតសម្រាប់ទម្រង់ការសន្និដ្ឋានឆ្លងតំបន់ដែលបានជ្រើសរើស។ Python 3.10 ឬថ្មីជាងនេះ ត្រូវបានរាយបញ្ជីសម្រាប់ឧទាហរណ៍កូដ។
គួរកត់សម្គាល់ថាការប្រកាសរបស់ AWS រួមបញ្ចូលការបង្ហាញសាកល្បងសុវត្ថិភាពជាជម្រើសដែលបង្កើតឡើងដោយ Docker និងឧបករណ៍ Strix បើកចំហរដែលដំណើរការ GLM 5.3 តាមរយៈ Bedrock សម្រាប់លំហូរការងារសុវត្ថិភាពដែលវាយលុក — ការដាក់បញ្ចូលមិនធម្មតាដែលគូសបញ្ជាក់ទីតាំងសុវត្ថិភាពតាមអ៊ីនធឺណិត Z.ai បានអះអាងសម្រាប់ម៉ូដែលនេះ។ សម្រាប់វេទិកាដែលមានលក្ខណៈអនុលោមភាពដូច AWS ការបង្ហាញគំរូចិននៅក្នុងបរិបទការលួចចូលសាកល្បងគឺជាសញ្ញាចង្អុលអំពីល្បាយបន្ទុកការងារ Z.ai កំពុងដេញតាម។
សេដ្ឋកិច្ចចម្រុះនៃអ្នកជំនាញ
តួលេខប៉ារ៉ាម៉ែត្រ 753B មានសារៈសំខាន់តិចជាងសម្រាប់ទំហំរបស់វាជាងសម្រាប់ស្ថាបត្យកម្មរបស់វា។ ម៉ូដែលចម្រុះនៃអ្នកជំនាញធ្វើឱ្យសកម្មតែប្រភាគនៃប៉ារ៉ាម៉ែត្ររបស់ពួកគេក្នុងមួយសញ្ញាសម្ងាត់ ដែលជារបៀបដែល GLM 5.3 អាចផ្តល់នូវសមត្ថភាពខ្នាតព្រំដែនដោយមិនចាំបាច់ចំណាយលើការសន្និដ្ឋានខ្នាតព្រំដែនលើរាល់សំណើ។ រួមបញ្ចូលជាមួយឃ្លាំងសម្ងាត់ភ្លាមៗ - ដែលជាកន្លែងដែលការរំលឹកប្រព័ន្ធម្តងហើយម្តងទៀតនិងបរិបទនៃឃ្លាំងត្រូវបានបម្រើពីឃ្លាំងសម្ងាត់ក្នុងការចំណាយកាត់បន្ថយ - សេដ្ឋកិច្ចគឺសំដៅលើបន្ទុកការងារភ្នាក់ងារបរិមាណខ្ពស់ដែលគ្រប់គ្រងថវិកា AI របស់សហគ្រាសនៅឆ្នាំនេះ៖ ជំនួយការសរសេរកូដ ប្រតិបត្តិការសុវត្ថិភាព និងបំពង់ស្វ័យប្រវត្តិកម្មដែលដំណើរការយូរ។
ថ្នាក់សេវាកម្មរបស់ Bedrock បន្ទាប់មកអនុញ្ញាតឱ្យក្រុមប្រតិបត្តិការធ្វើពាណិជ្ជកម្មតម្លៃធៀបនឹងភាពយឺតយ៉ាវក្នុងមួយបន្ទុក។ ការងារវិភាគកូដជាក្រុមនៅពេលយប់អាចដំណើរការលើតម្លៃ Flex ខណៈពេលដែលអ្នកត្រួតពិនិត្យសន្តិសុខអន្តរកម្មជិះថ្នាក់អាទិភាព — គំរូដូចគ្នា វាស់ខុសគ្នា។
អ្វីដែលត្រូវមើល
ការបាញ់បង្ហោះនេះបង្កើតការសាកល្បងរយៈពេលជិតចំនួនបី។ ទីមួយ ការសុំកូនចិញ្ចឹម៖ ថាតើមូលដ្ឋានសហគ្រាសរបស់ Bedrock ចាត់ទុក GLM 5.3 ជាជម្រើសផលិតកម្ម ឬការចង់ដឹងចង់ឃើញគោល។ ទីពីរ ការកំណត់តម្លៃ៖ កម្រិត Flex កាត់បន្ថយកម្រិតសេវាកម្មដែលបង្កើនប្រសិទ្ធភាព latency ហើយការកំណត់តម្លៃស៊េរី GLM បានសម្ពាធជាប្រវត្តិសាស្ត្រទៅលើគូប្រជែងលោកខាងលិចលើតម្លៃ។ ទីបី ការឆ្លើយតប៖ អ្នកធ្វើមាត្រដ្ឋានខ្ពស់ផ្សេងទៀតប្រឈមមុខនឹងជម្រើសដូចគ្នានៃការបង្ហោះ ឬបោះបង់ផ្នែកសហគ្រាសគំរូរបស់ចិន។
សម្រាប់ក្រុម AI ដែលតាមដានភាពអាចរកបាននៃគំរូ ការទទួលយកជាក់ស្តែងគឺសាមញ្ញ - មួយក្នុងចំណោមគំរូទម្ងន់បើកចំហដែលត្រូវបានមើលយ៉ាងជិតស្និទ្ធបំផុតនៅឆ្នាំ 2026 ឥឡូវនេះគឺជាការហៅ API មួយសម្រាប់អតិថិជន AWS ហើយទេសភាពនៃគំរូ AI កាន់តែមានការប្រកួតប្រជែងជាមួយគ្រប់វេទិកាដែលចុះហត្ថលេខាលើមន្ទីរពិសោធន៍ចិន។
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →