Sakana AI ដែលមានមូលដ្ឋាននៅទីក្រុងតូក្យូ បានដាក់ឱ្យដំណើរការ Fugu ដែលជាប្រព័ន្ធដែលផ្តល់នូវដំណើរការនៃគំរូ AI ព្រំដែន ដោយធ្វើការសម្របសម្រួលយ៉ាងសកម្មនូវម៉ូដែលជាច្រើនក្នុងពេលតែមួយ។ ជាជាងការកសាងបណ្តាញសរសៃប្រសាទយក្សមួយ Fugu គឺជាគំរូភាសាដែលត្រូវបានបណ្តុះបណ្តាលដើម្បីហៅ LLMs ផ្សេងទៀតពី "ក្រុមភ្នាក់ងារ" ដែលអាចផ្លាស់ប្តូរបានដោយប្រមូលផ្តុំក្រុមនៃគំរូឯកទេសសម្រាប់កិច្ចការនីមួយៗ និងសំយោគលទ្ធផលរបស់ពួកគេតាមរយៈ API ដែលឆបគ្នាជាមួយ OpenAI តែមួយ។
ការបើកដំណើរការដែលគ្របដណ្តប់ដោយ THE DECODER, MarkTechPost, និង MIT Sloan Management Review តំណាងឱ្យការភ្នាល់ដែលការកើនឡើងបន្ទាប់នៅក្នុងការអនុវត្ត AI អាចមកពីទំហំឆៅ និងច្រើនទៀតពីការសម្របសម្រួលដ៏ឆ្លាតវៃនៃម៉ូដែលដែលមានស្រាប់។ For more context on this story, see our ongoing more AI stories.
គំរូមួយដើម្បីបញ្ជាពួកគេទាំងអស់គ្នា
សម្រាប់អ្នកប្រើប្រាស់ Fugu មានអាកប្បកិរិយាដូចគំរូតែមួយ។ នៅក្រោមក្រណាត់ វាគ្រប់គ្រងសំណើដោយខ្លួនឯង ឬទាញក្រុមនៃគំរូឯកទេស គ្រប់គ្រងការជ្រើសរើស ការធ្វើប្រតិភូកម្ម ការត្រួតពិនិត្យ និងការសំយោគខាងក្នុង។ Sakana AI និយាយថា វិធីសាស្រ្តនេះបង្កើតលើការងារមុនៗដូចជា ALE-Agent របស់ខ្លួន ដែលបានដាក់ចំណាត់ថ្នាក់ទី 21 ក្នុងចំណោមអ្នកជំនាញមនុស្ស 1,000 នាក់ក្នុងការប្រកួតប្រជែងសរសេរកូដដោយប្រើបច្ចេកទេស orchestration ។
ក្រុមហ៊ុនកំពុងបញ្ចេញវ៉ារ្យ៉ង់ពីរ។ គំរូ Fugu មូលដ្ឋានផ្តោតលើភាពយឺតយ៉ាវទាប និងការអនុវត្តប្រចាំថ្ងៃដ៏រឹងមាំលើការសរសេរកូដ ការពិនិត្យកូដ និងករណីប្រើប្រាស់ chatbot ហើយអនុញ្ញាតឱ្យក្រុមដកចេញភ្នាក់ងារជាក់លាក់ពីក្រុមសម្រាប់ភាពឯកជន ឬការអនុលោមតាមច្បាប់។ Fugu Ultra ត្រូវបានបង្កើតឡើងសម្រាប់គុណភាពចម្លើយអតិបរមាលើបញ្ហាស្មុគស្មាញច្រើនជំហានដូចជាការផលិតឯកសារវិទ្យាសាស្ត្រឡើងវិញ ការវិភាគសុវត្ថិភាពតាមអ៊ីនធឺណិត និងការស្វែងរកប៉ាតង់ និងអក្សរសិល្ប៍។
Benchmark អះអាងថាងាកក្បាល
យោងតាមលទ្ធផលគោល Sakana AI បានចេញផ្សាយ Fugu Ultra ដំណើរការស្មើទៅនឹង Anthropic's Fable 5 និង Mythos Preview នៅទូទាំងជួរនៃការសរសេរកូដ ហេតុផល និងស្តង់ដារវិទ្យាសាស្ត្រ។ គួរកត់សម្គាល់ថា ទាំងម៉ូដែល Anthropic ពិតជាមិនមាននៅក្នុងក្រុមភ្នាក់ងាររបស់ Fugu ទេ ដោយសារពួកវាមិនមានជាសាធារណៈ មានន័យថា Fugu ទទួលបានពិន្ទុប្រៀបធៀបដោយប្រើម៉ូដែលផ្សេងទៀត។
លេខដែលបានចេញផ្សាយមានភាពទាក់ទាញ។ នៅលើ SWE-Bench Pro, Fugu Ultra ទទួលបានពិន្ទុ 73.7 នាំមុខ Opus 4.8 នៅ 69.2, Gemini 3.1 Pro នៅ 54.2 និង GPT 5.5 នៅ 58.6។ នៅលើ TerminalBench 2.1 វាបានពិន្ទុ 80.2 ធៀបនឹង Opus 4.8's 82.1។ នៅលើ LiveCodeBench វាបានឈានដល់ 93.2 ទល់នឹង 85.3 របស់ GPT 5.5 ហើយនៅលើការប្រឡងចុងក្រោយរបស់មនុស្សជាតិ វាបានបង្ហោះ 50.0 ដោយនាំមុខ Opus 4.8's 49.8 និង GPT 5.5's 41.4។
ការសាកល្បងពិភពលោកពិត គូររូបភាពចម្រុះ
ការពិនិត្យលើដៃដំបូងមានភាពសាទរតិចជាងការវាយតម្លៃ។ អ្នកស្រាវជ្រាវ AI លោក Ethan Mollick បានសរសេរនៅលើ X ថា Fugu Ultra គឺ "យឺតមិនគួរឱ្យជឿ" ជាមួយនឹងការធ្វើតេស្តសរសេរកូដធម្មតារបស់គាត់ចំណាយពេល 30 នាទី ហើយលទ្ធផលគឺ "ល្អ" ប៉ុន្តែមិនបានអនុវត្ត Fable ។ អ្នកប្រើប្រាស់ម្នាក់ទៀតបានរាយការណ៍ថាបានឆ្លងកាត់កូតារយៈពេលប្រាំម៉ោងទាំងមូលលើគម្រោង $20 ជាមួយនឹងការបញ្ចូលតែមួយ ខណៈពេលដែលអ្នកអភិវឌ្ឍន៍នៅលើ Hacker News បានត្អូញត្អែរថាគម្រោង $200 ក្នុងមួយខែផ្តល់ទិន្នផលតិចជាងបីម៉ោងក្នុងមួយសប្តាហ៍នៃពេលវេលាដែលអាចប្រើបាន។
ការពិនិត្យកូដបានលេចចេញជាចំណុចភ្លឺ ដែលប្រហាក់ប្រហែលនឹង Opus 4.8 ឬ GPT 5.5 ក្នុងគុណភាព។ ការធ្វើតេស្តមួយទល់នឹងក្បាលបានបង្ហាញថា Fugu Ultra បញ្ចប់កិច្ចការសរសេរកូដក្នុងរយៈពេល 22 នាទីក្នុងតម្លៃ $7.32 ដែលលឿនជាង និងថោកជាង Opus 4.8's 79 នាទី និង $37.85 ទោះបីជាអ្នកត្រួតពិនិត្យចូលចិត្តលទ្ធផល Opus ក៏ដោយ។
Sakana AI ដែលត្រូវបានបង្កើតឡើងនៅទីក្រុងតូក្យូក្នុងឆ្នាំ 2023 និងគាំទ្រដោយ Nvidia បានបង្កើតអត្តសញ្ញាណរបស់ខ្លួនលើការស្រាវជ្រាវ AI ដែលបំផុសគំនិតដោយធម្មជាតិ ដោយប្រើក្បួនដោះស្រាយវិវត្តន៍ និងគំនិតសមូហភាពដើម្បីច្របាច់ការអនុវត្តកាន់តែច្រើនពីម៉ូដែលដែលមានស្រាប់។ Fugu ពង្រីកទស្សនវិជ្ជានោះទៅកាន់ទីផ្សារពាណិជ្ជកម្ម ដោយបង្វែរ orchestration ខ្លួនវាទៅជាផលិតផល។ ក្រុមហ៊ុនក៏កំពុងដាក់ប្រព័ន្ធសម្រាប់ទស្សនិកជនជប៉ុនដែលព្រួយបារម្ភអំពីការពឹងផ្អែកខ្លាំងលើអ្នកផ្តល់សេវារបស់សហរដ្ឋអាមេរិក ជាមួយនឹងគេហទំព័រ និងតម្លៃពីរភាសាដែលផ្តោតលើអ្នកអភិវឌ្ឍន៍បុគ្គល និងក្រុមសហគ្រាស។
ការការពារប្រឆាំងនឹងការចាក់សោររបស់អ្នកលក់
លើសពីការអនុវត្តជាក់ស្តែង Sakana AI កំពុងជំរុញ Fugu ក្នុងនាមជាការការពារប្រឆាំងនឹងការពឹងផ្អែកលើអ្នកផ្តល់សេវា AI តែមួយ។ ក្រុមហ៊ុនបានចង្អុលទៅការត្រួតពិនិត្យការនាំចេញរបស់សហរដ្ឋអាមេរិកនាពេលថ្មីៗនេះ ដែលបានទាញម៉ូដែល Fable និង Mythos របស់ Anthropic ពីទីផ្សារបរទេសជាភស្តុតាងដែលថាការចូលទៅកាន់ប្រព័ន្ធកំពូលអាចបាត់ទៅវិញពេញមួយយប់។
Sakana AI បានសរសេរនៅក្នុងសេចក្តីប្រកាសរបស់ខ្លួនថា "សម្រាប់អង្គការ ឬប្រទេសមួយ ការពឹងផ្អែកលើ APIs របស់ក្រុមហ៊ុនតែមួយសម្រាប់ហេដ្ឋារចនាសម្ព័ន្ធ ហិរញ្ញវត្ថុ ឬអភិបាលកិច្ចដ៏សំខាន់ គឺជាភាពងាយរងគ្រោះផ្នែកសម្ភារៈ" ។ ដោយសារតែអាងគំរូរបស់ Fugu គឺអាចផ្លាស់ប្តូរបានពេញលេញ ប្រព័ន្ធអាចប្តូរទិសដៅទៅម៉ូដែលផ្សេងទៀត ប្រសិនបើអ្នកផ្តល់សេវាមួយងងឹត។
អ្នកវិភាគព្រមានថា នេះមិនដូចគ្នានឹងអធិបតេយ្យភាពពិតទេ។ ដំណើរការរបស់ Fugu អាស្រ័យលើម៉ូដែលណាដែលអង្គុយនៅក្នុងអាងរបស់វា ហើយអ្នកផ្តល់សេវាកំពូលមួយចំនួនដែលដាក់កម្រិតការចូលប្រើក្នុងពេលតែមួយនឹងនៅតែកាត់បន្ថយជម្រើសរបស់វា។ ក្រុមហ៊ុនក៏មិនទាន់បានបង្ហាញផងដែរថាតើស្រទាប់ orchestration ជំរុញឱ្យមានការប្រើប្រាស់សញ្ញាសម្ងាត់និងតម្លៃប៉ុន្មាននោះទេ។ ទោះបីជាយ៉ាងណាក៏ដោយ ដោយសារគំរូព្រំដែនក្លាយជាទ្រព្យសម្បត្តិភូមិសាស្ត្រនយោបាយ ហើយការចាក់សោររបស់អ្នកលក់តែមួយមានការកើនឡើងហានិភ័យ Fugu ផ្តល់នូវការមើលជាមុននៃឧស្សាហកម្ម AI ដែលការសម្របសម្រួលអាចមានបញ្ហាច្រើនតាមសមត្ថភាព។
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →



