Lab AI Tionghoa StepFun wis ngluncurake Pratinjau Langkah 5, model basa unggulan anyar sing kurang narik perhatian kanggo dominasi patokan mentah lan luwih akeh ing papan sing ana ing kurva kinerja rega. Model kasebut, sistem campuran para ahli (MoE) 600-miliar-parameter kanthi jendela konteks token 1 yuta, wis diarani model kelas perbatasan paling murah ing China dening pers teknologi sing nutupi rilis kasebut.
Spesifikasi: Model Gedhe, Konteks Gedhe
Miturut Pandaily, sing nglaporake peluncuran kasebut, Pratinjau Langkah 5 dibangun ing arsitektur MoE sing jarang 600B - desain sing mung bagean sekedhik saka parameter model sing diaktifake kanggo token apa wae, supaya biaya inferensi bisa diatur sanajan jumlah parameter total sing gedhe banget. Kulawarga arsitektur wis dadi paradigma dominan kanggo model skala wates, digunakake dening kabeh wong saka DeepSeek nganti Mistral.
Jendhela konteks uga penting: 1 yuta token, sing digambarake dening Analisis Artificial minangka kira-kira 1,500 kaca A4 teks. Kapasitas kasebut ngidini model njupuk kabeh basis kode, dokumen hukum sing dawa, utawa analisis multi-dokumen lengkap ing siji pass. Model kasebut nampa input teks lan gambar lan ngasilake teks, lan mlaku ing mode penalaran, ngasilake pamikiran penengah sadurunge ngasilake jawaban pungkasan.
Mbok menawa rincian sing paling diawasi kanggo pangembang: StepFun rencana bakal ngeculake bobot mbukak model ing Oktober 15, miturut Pandaily. Periode pratinjau ing mburi API sing diikuti bobot mbukak dadi irama sing akrab kanggo laboratorium Cina, menehi wektu komunitas kanggo ngevaluasi model kasebut sadurunge mlebu ing hardware lokal.
Posisi Benchmark: Kuwat, Ora Dominasi
Ing Indeks Intelijen Analisis Artificial independen, Langkah 5 Pratinjau skor 44, nempatake nomer 24 saka 200 model sing dilacak ing platform - luwih dhuwur tinimbang rata-rata 24 kanggo kelase, sanajan ora ana ing sisih ndhuwur wates. Analisis Artificial nggambarake model kasebut minangka "ing antarane model intelijen sing unggul lan regane apik yen dibandhingake karo model liyane kanthi rega sing padha."
Metrik kacepetan uga padhet. Model kasebut ngasilake output kira-kira 99,8 token per detik ing evaluasi platform, luwih cepet tinimbang rata-rata 70 token per detik ing model sing dilacak.
Siji caveat worth kang lagi nyimak: Langkah 5 Pratinjau luar biasa verbose. Analisis Ponggawa ngukur ngasilake watara 160 yuta token ing evaluasi Indeks Intelijen, dibandhingake karo rata-rata 92 yuta kanggo model sing padha. Verbosity penting ing praktik - token sing luwih akeh tegese tanggapan sing luwih alon lan tagihan token output sing luwih dhuwur, sing bisa ngilangi sawetara keuntungan rega judhul gumantung saka tugas kasebut.
Kisah Rega
Rega ing endi Langkah 5 Pratinjau nggawe pitch paling agresif. Model kasebut biaya $ 1,00 saben yuta token input lan $ 2,70 saben yuta token output liwat API, miturut Analisis Artificial - nglawan rata-rata $ 1,88 lan $ 10,00 kanggo model ing kelas kasebut. Judhul Eastern Herald digambarake kanthi jelas: model AI 600B China ing $1 saben yuta token.
Kanggo beban kerja sing sensitif biaya - pangolahan dokumen kanthi volume dhuwur, ringkesan batch, sistem agen sing ngobong jutaan token saben dina - model sing cedhak karo wates sing regane ing ngisor median kelas ing input lan output minangka pilihan komersial sing signifikan. Rilis bobot mbukak sing direncanakake kanggo Oktober bisa nyuda biaya efektif kanggo organisasi sing bisa dadi tuan rumah.
Perbatasan Cina sing rame
Langkah 5 Pratinjau teka ing tengah-tengah rilis sing kuat saka lab AI Cina, karo kulawarga Qwen Alibaba, DeepSeek, Z.ai, lan liya-liyane kabeh ngirim model anyar kanthi cepet. Toko teknologi ing China nggambarake wektu saiki minangka pertunjukan model dhasar sprint lengkap, kanthi laboratorium dilaporake nggarap apa sing biasane dadi preian supaya bisa bersaing karo saingan.
Kanggo StepFun khusus, taruhan kasebut yaiku kombinasi intelijen sing cedhak karo wates, jendela konteks token 1M, input multimodal, lan rega sing agresif bakal menangake mindshare pangembang sadurunge rilis bobot mbukak Oktober. Diskusi babagan Hacker News, ing ngendi peluncuran model kasebut narik luwih saka satus poin, nuduhake manawa komunitas pangembang menehi perhatian.
Apa kanggo Watch
Telung pitakonan bakal mbentuk Resepsi Pratinjau Langkah 5 ing minggu ngarep. Pisanan, kepiye carane nindakake ing coding, penalaran, lan pathokan agenik ing njaba evaluasi indeks standar? Kapindho, apa masalah verbosity bakal disetel sadurunge diluncurake bobot mbukak, lan kaya apa syarat sistem kanggo panyebaran lokal? Katelu, apa infrastruktur API StepFun bisa nangani panjaluk kanthi skala - tantangan sing wis nate nyepetake peserta sing luwih murah?
Jawaban bakal teka kanthi cepet ing pasar sing ngukur kemajuan ing sawetara dina. Kanggo terus jangkoan StepFun, ekosistem AI Cina, lan kompetisi global babagan rega model, tindakake perkembangan AI paling anyar nalika kedadeyan kasebut.
Tetep Ahead saka AI
Model sing diluncurake kaya iki nggawe maneh biaya infrastruktur AI. Terusake saben rilis ing AI Buzz Wire, sumber sampeyan kanggo warta AI ing antarane model, riset, lan bisnis.
Waca liyane warta AI →