Cerebras သည် ၎င်း၏ WSE-3 Turbo wafer-စကေးပရိုဆက်ဆာအသစ်ကို ဝန်းရံတည်ဆောက်ထားသည့် rack-scale AI အနုမာနစနစ် CS-4 ကို ဖယ်ရှားခဲ့ပြီး၊ စက်သည် Nvidia ၏ဒေတာစင်တာအင်ပါယာထက် အဆ 30 ပိုမြန်သော အနုမာနကို ထုတ်ပေးသည်ဟု ဆိုကာ ကုမ္ပဏီက Nvidia ၏ဒေတာစင်တာအင်ပါယာ၏အမြန်နှုန်းအဖြစ် နေရာယူထားသည်။

အင်္ဂါနေ့က ကြေညာခဲ့ပြီး ကုမ္ပဏီ၏ ထုတ်ကုန်စာမျက်နှာများတစ်လျှောက် အသေးစိတ်ဖော်ပြကာ Reuters၊ Bloomberg နှင့် The Register တို့မှ လွှမ်းခြုံထားသောလှိုင်းများသည် Cerebras ၏ အထင်ရှားဆုံးသော ဟာ့ဒ်ဝဲ ပြန်လည်ဆန်းသစ်မှုကို အမှတ်အသားပြုခြင်းဖြစ်သည် — နှင့် ၎င်း၏ IPO ကတည်းက စတော့ရှယ်ယာများ ရုန်းကန်နေရသော ကုမ္ပဏီအတွက် အရေးကြီးသည့် အခိုက်အတန့်ဖြစ်သည်။ ရင်းနှီးမြုပ်နှံသူများသည် အာရုံစိုက်နေကြပုံပေါ်သည်- သတင်းတွင် Cerebras (CBRS) ၏ ရှယ်ယာများ မြင့်တက်လာပြီး AI အနုမာနစျေးကွက်သည် "အလွန်လျင်မြန်စွာကြီးထွားနေသည်" ဟု Investor's Business Daily ၏ CEO မှတ်ချက်ကို ကိုးကားဖော်ပြခဲ့သည်။

AI မော်ဒယ်များကို တုံ့ပြန်မှုပိုမိုမြန်ဆန်စေရန် အရှိန်မြှင့်ပြိုင်ဆိုင်မှုကို ခြေရာခံဖတ်ရှုသူများအတွက် CS-4 လွှင့်တင်မှုသည် သုံးလပတ်၏ အကျိုးဆက်အရှိဆုံး ဟာ့ဒ်ဝဲဇာတ်လမ်းများထဲမှ တစ်ခုဖြစ်ပြီး တွက်ချက်မှုအခင်းအကျင်းကို ဆက်လက်ပုံဖော်နေသည့် AI လုပ်ငန်းနယ်ပယ်တွင် ပိုမိုကျယ်ပြန့်သော အပြောင်းအလဲများကြားတွင် ထွက်ပေါ်လာသည်။

CS-4 မှာ ဘာတွေပါလဲ။

ခေါင်းစီးအစိတ်အပိုင်းသည် Cerebras ၏ ညစာ-ပန်းကန်အရွယ်အစား Wafer Scale Engine ၏ အဆင့်မြှင့်ထားသော ဗားရှင်း WSE-3 Turbo ဖြစ်သည်။ The Register ၏နည်းပညာဆိုင်ရာ နက်ရှိုင်းသောငုပ်လျှိုးမှုအရ WSE-3T သည် ဆီလီကွန်အသစ်မဟုတ် - ၎င်းသည် တူညီသော TSMC 5nm လုပ်ငန်းစဉ်၊ 46,225 စတုရန်းမီလီမီတာသေဆုံးဧရိယာ၊ 4 ထရီလီယံထရီလီယံ၊ 900,000 cores နှင့် 44 GB သက်တမ်းရှိသော WSE-3 ကဲ့သို့ on-wafer SRAM ကို ထိန်းသိမ်းထားသည်။

ယင်းအစား၊ Cerebras သည် ရှိပြီးသား ချစ်ပ်ကို ပိုမိုခက်ခဲအောင် တွန်းအားပေးခြင်းဖြင့် ၎င်း၏ စွမ်းဆောင်ရည် နှစ်ဆ အောင်မြင်ခဲ့သည်။ WSE-3T သည် ကျဲသည့် FP16 တွက်ချက်မှုကို 250 petaFLOPS သို့ နှစ်ဆတိုးစေပြီး သိပ်သည်းသော FP16 စွမ်းဆောင်ရည်ကို ခန့်မှန်းခြေ 25 petaFLOPS သို့ နှစ်ဆ၊ မှတ်ဉာဏ်ဘန်းဝဒ်ကို တစ်စက္ကန့်လျှင် 43.2 petabytes သို့ နှစ်ဆတိုးစေပြီး I/O လှိုင်းနှုန်းကို တစ်စက္ကန့်လျှင် 2.4 terabits သို့ နှစ်ဆတိုးစေသည်။ Register က ကုမ္ပဏီသည် ယခင်မျိုးဆက်တွင် 1.4 GHz ထက် အကြမ်းဖျင်း 2.8 GHz တွင် ဆီလီကွန်ကို ချိန်ညှိနေသည်ဟု ခန့်မှန်းထားသည်။

Cerebras အဆိုအရ အဆိုပါလှည့်ကွက်သည် ပရိုဆက်ဆာမှ 0.5 မီလီမီတာအကွာတွင်ရှိသော ပြန်လည်ဒီဇိုင်းထုတ်ထားသော ပါဝါပေးပို့မှုစနစ်ဖြစ်ပြီး သမားရိုးကျ GPU ဘုတ်များထက် အဆ 100 ပိုနီးပါသည်။ ထိုအနီးအပါးသည် ဘုတ်အဖွဲ့အဆင့်ပါဝါဆုံးရှုံးမှုကို ဖယ်ရှားလုနီးပါးနီးပါးဖြစ်ပြီး wafer သို့ရောက်ရှိရန် ပါဝါနှစ်ဆပိုမိုရရှိစေပြီး ပိုမိုမြန်ဆန်သော တိုကင်ထုတ်လုပ်ခြင်းနောက်ကွယ်တွင် ပိုမိုမြင့်မားသောလုပ်ဆောင်မှုကြိမ်နှုန်းများကို အသုံးပြုနိုင်မည်ဖြစ်သည်။

Nexus Rack ဗိသုကာ

ချစ်ပ်ကိုယ်တိုင်အပြင်၊ CS-4 သည် Cerebras ဟုခေါ်သည့် Nexus Platform Architecture၊ ၎င်း၏ပထမဆုံးစစ်မှန်သော rack-scale ဒီဇိုင်းနှင့် Nvidia ၏ NVL72 နှင့် AMD ၏ Helios rack စနစ်များအတွက် တိုက်ရိုက်အဖြေကို မိတ်ဆက်ပေးသည်။ CS-4 တစ်ခုစီသည် ကိုယ်တိုင်ပါရှိသော "Wafer-Scale Backpacks" တွင် တပ်ဆင်ထားသော WSE-3T ပရိုဆက်ဆာ သုံးခုအထိ သယ်ဆောင်နိုင်သည် — wafer ခေါက်ခြင်း၊ ပါဝါပြောင်းခြင်း၊ တိုက်ရိုက်အအေးခံခြင်း၊ မြန်နှုန်းမြင့် I/O နှင့် အီလက်ထရွန်းနစ်ပစ္စည်းများကို အစိတ်အပိုင်း 50% နည်းသော အစိတ်အပိုင်းများ တစ်ခုတည်းတွင် တပ်ဆင်သည့် 3D အထုပ်များ။

မော်ဂျူလာ ဒီဇိုင်းသည် တည်ငြိမ်သော ပါဝါ၊ အအေးခံခြင်းနှင့် ကွန်ရက်အလွှာကို ကွန်ပျူတာနှင့် ပိုင်းခြားထားသည်။ Cerebras PowerRack ကို မည်သည့်ကွန်ပျူတာမှ မရောက်ရှိမီတွင် တပ်ဆင်နိုင်ပြီး အရည်အချင်းပြည့်မီပြီး ကျောပိုးအိတ်များသည် နေရာတကျ လျှောကျလာကာ - ဖြန့်ကျက်ချိန်ကို ရက်များမှ နာရီအထိ လျှော့ချနိုင်သည်ဟု ကုမ္ပဏီမှ သိရသည်။

ပါဝါသုံးစွဲမှုသည် များပြားသည်။ Register သည် ကျောပိုးအိတ်တစ်လုံးလျှင် 46 kW ဝန်းကျင်ခန့်နှင့် စုစုပေါင်းစနစ်ဆွဲအား 120 မှ 140 kW ဖြစ်သည် — မည်သို့ပင်ဆိုစေကာမူ 240 မှ 250 kW rack စနစ်များဘေးရှိ AMD နှင့် Nvidia တို့သည် ရှေးရိုးစွဲဆန်သောနံပါတ်များကို ယခုနှစ်နှောင်းပိုင်းတွင် တင်ပို့နိုင်ဖွယ်ရှိသည်။

ခလုတ်ကိုသတ်ခြင်း။

နည်းပညာအရ စိတ်ဝင်စားစရာအကောင်းဆုံးရွေးချယ်မှုမှာ အပြန်အလှန်ချိတ်ဆက်မှုဖြစ်နိုင်သည်။ ခလုတ်များမှတဆင့် wafer-to-wafer အသွားအလာကိုလမ်းကြောင်းပြခြင်းထက် — ၎င်း၏ Trainium3 အရှိန်မြှင့်စက်များအတွက် AWS လက်ခံကျင့်သုံးသည့်ချဉ်းကပ်မှု — Cerebras သည် ၎င်း၏ချစ်ပ်များကို 2D torus topology အဖြစ်သို့ ပြောင်းပေးသည် ဒီဇိုင်းသည် wafer-to-wafer latency ကို 5 microseconds မှ 2 ခုသို့ လျှော့ချပေးထားပြီး၊ mesh သည် 50 trillion parameters အထိ မော်ဒယ်များကို ထောက်ပံ့ပေးနိုင်ပြီး လက်ရှိရှိနေသည့်အရာထက် သာလွန်ကောင်းမွန်သည်ဟု Cerebras မှပြောကြားခဲ့သည်။

အရှိန်ရလာဒ်တွေက သိသိသာသာကြီး။ CS-4 စနစ်တစ်ခုတည်းတွင်၊ စံပြုသည့်ကုမ္ပဏီ Artificial Analysis သည် အသုံးပြုသူတစ်ဦးလျှင် gpt-oss-120b တွင် တစ်စက္ကန့်လျှင် တိုကင် 4,400 အထိတိုင်းတာခဲ့သည် — ယနေ့ရရှိနိုင်သည့်အမြန်ဆုံး GPU-based inference ဝန်ဆောင်မှုများ၏ တစ်စက္ကန့်လျှင် ~ 350 တိုကင်များ၏ အကြမ်းဖျင်း 12 ဆဖြစ်သည်။ Cerebras မှလည်း စနစ်သည် တစ်စက္ကန့်လျှင် တိုကင်ပေါင်း 1,000 ကျော်ကို ကန့်သတ်ဘောင် 10 ထရီလျံကျော်ရှိသော မော်ဒယ်များတွင် ထောက်ပံ့ပေးသည်ဟု ဆိုသည်။

အစုလိုက်အပြုံလိုက်ပူးပေါင်းဆောင်ရွက်မှုမဟာဗျူဟာ

ထင်ရှားသည်မှာ၊ Cerebras သည် ၎င်း၏ကိုယ်ပိုင်ဆီလီကွန်ပေါ်တွင် အနုမာနပိုက်လိုင်းတစ်ခုလုံးကို လည်ပတ်ရန် မကြိုးစားတော့ပါ။ ကုမ္ပဏီသည် Trainium XPUs နှင့် Instinct GPUs အသီးသီးတွင် ကွန်ပြူတာ-အများသုံး ကွန်ပြူတာလုပ်ဆောင်ခြင်းအဆင့်ကို ဖြတ်တောက်ရန် AWS နှင့် AMD နှင့် ပူးပေါင်းခဲ့ပြီး ၎င်းတို့၏ကြီးမားသော SRAM သိုလှောင်မှုတောက်ပသည့် latency-sensitive decode အဆင့်ကို ကိုင်တွယ်ရန် ၎င်း၏ wafer-စကေးအင်ဂျင်များကို ချန်ထားခဲ့သည်။

CS-4 လွှတ်တင်မှုသည် OpenAI နှင့် Cerebras ၏ ပူးပေါင်းဆောင်ရွက်မှုကိုလည်း တိုးမြှင့်ပေးသည်။ Yahoo Finance သည် AI inference ကို အရှိန်မြှင့်ရန် ရည်ရွယ်သည့် OpenAI နှင့် AMD မိတ်ဖက်များနှင့်အတူ ထုတ်ဖော်ပြသခဲ့သည် — သြဂုတ်လအစောပိုင်းတွင် ကုမ္ပဏီများက မိတ်ဆက်ခဲ့သော Ultrafast mode ကို တည်ဆောက်ကာ၊ တစ်စက္ကန့်လျှင် 750 tokens အထိ သုံးစွဲသူများထံ GPT-5.6 Sol ကို ယူဆောင်လာခဲ့သည်။

ခေါင်းကြီးနံပါတ်များနောက်တွင် သတိပေးချက်များ

စျေးကွက်ရှာဖွေရေး ကိန်းဂဏန်းများအပေါ် သတိပြုရန် စက်မှုလေ့လာသုံးသပ်သူများက တိုက်တွန်းထားသည်။ Cerebras ၏ ခေါင်းစီး 250 petaFLOPS သည် ယေဘုယျအားဖြင့် ကြီးမားသော ဘာသာစကားပုံစံ ကောက်ချက်ချခြင်းကို အကျိုးမပြုသည့် ပျော့ပျောင်းမှုအပေါ် မှီခိုနေပြီး WSE-3 တွင် ၎င်း၏ကိုယ်ပိုင် SRAM ပြည့်ဝစေရန် တွက်ချက်မှု မရှိသည့်အတွက် သီအိုရီအရ အကျုံးဝင်ပါသည်။ ထုတ်ဝေမှုသည် WSE-2 ကိုလွန်ခဲ့သောငါးနှစ်ကတည်းကစတင်ခဲ့ပြီးကတည်းက အဓိပ္ပါယ်ရှိစွာမတိုးတက်သေးသည့် SRAM စွမ်းရည်ကို တိုးမြှင့်ခြင်းထက် စွမ်းဆောင်ရည်နှစ်ဆတိုးလာရခြင်းအပေါ် မေးခွန်းထုတ်ခဲ့သည်။

သို့တိုင် စျေးကွက် အခွင့်အလမ်းသည် မှန်ကန်ပါသည်။ AI chatbots များနှင့် အေးဂျင့်များသည် ပိုမိုမြန်ဆန်သောတုံ့ပြန်မှုအချိန်များကိုတောင်းဆိုလာသောကြောင့်၊ အနုမာနအမြန်နှုန်းသည် စစ်မှန်သောပြိုင်ဆိုင်မှုကွဲပြားမှုတစ်ခုဖြစ်လာပြီး Cerebras သည် ၎င်း၏သမားရိုးကျမဟုတ်သော wafer-စကေးနည်းပညာကို စီးပွားဖြစ်အစီအစဥ်တွင် ထပ်လောင်းပြသနိုင်ပြီဖြစ်သည်။

ပထမဆုံး CS-4 တင်ပို့ရောင်းချမှုများကို ယခုသုံးလပတ်တွင် စတင်မည်ဖြစ်ပြီး စက်တင်ဘာလမကုန်မီတွင် ပထမဆုံးစနစ်များကို အွန်လိုင်းတွင် မျှော်လင့်ထားသည်။ Nvidia ၏ လွှမ်းမိုးမှုကို ဖြိုဖျက်ရန် လုံလောက်မှု ရှိမရှိကို မြင်တွေ့ရဆဲဖြစ်သည် — သို့သော် ခဏတာအတွင်း ပထမဆုံးအကြိမ်အဖြစ် စက်မှုလုပ်ငန်းတွင် အလျင်မြန်ဆုံး AI ကောက်ချက်ချမှုတွင် လိပ်စာအသစ်တစ်ခုရှိသည်။

AI ထက်သာလွန်နေပါစေ။

CS-4 ကဲ့သို့ ဟာ့ဒ်ဝဲသည် စျေးကွက်များကို ရွေ့လျားစေပြီး AI စနစ်များ လုပ်ဆောင်နိုင်သည့်အရာကို ပြန်လည်သတ်မှတ်သည်။ ဖွံ့ဖြိုးတိုးတက်မှုတိုင်းကို အမီလိုက်ရန် AI သတင်းများကို ပိုမိုဖတ်ရှုရန်

နောက်ဆုံးပေါ် AI လွှမ်းခြုံမှုကို စူးစမ်းလေ့လာပါ →