Reflection AI, startup Amerika sing didhukung Nvidia, ngenalake model bobot terbuka sing pertama ing 5 Oktober, sistem campuran sing jarang ahli sing diarani Beam sing posisi perusahaan minangka tantangan Barat sing paling kuat durung menyang wates bobot mbukak sing saiki didominasi lab Cina. Pengumuman kasebut, diterbitake ing blog Reflection dhewe lan dijupuk kanthi cepet dening Reuters, TechCrunch, Fortune lan Semafor, teka kanthi corak: model kasebut durung bisa didownload.

Beam lagi ngalami apa sing diterangake perusahaan minangka tim abang lan evaluasi pungkasan. Akses awal mbukak liwat proses ndhaptar, lan Reflection ujar manawa bakal ngeculake bobot, laporan teknis, kertu model lan artefak pangembang ing wulan iki. Yen kedadeyan kasebut, Beam bakal dadi salah sawijining rilis bobot mbukak paling gedhe sing tau diterbitake dening lab AS, lan tes sing paling jelas manawa perusahaan Amerika bisa cocog karo irama rilis lan keterbukaan sing nggawe model Cina minangka pilihan standar kanggo akeh komunitas open-source. Kanggo jangkoan terus-terusan babagan balapan bobot mbukak lan kabeh liyane sing ngobahake lapangan, tetenger homepage warta AI kita.

Angka ing Konco Beam

Beam minangka model campuran jarang ahli kanthi total 501 milyar paramèter, sing kira-kira 23 milyar aktif saben token. Reflection ujar manawa model kasebut wis dilatih ing 23,8 triliun token sing digambar saka web lan dataset sing dilisensi, sing ngaku model dhasar kasebut cocog utawa ngungguli model dhasar mbukak ukuran sing padha.

Klaim sing luwih khas yaiku babagan sinau penguatan. Refleksi mbangun algoritma, lingkungan latihan lan infrastruktur kanggo nyengkuyung RL komputasi dhuwur kanthi skala, lan perusahaan kasebut nglaporake manawa RL rune ngasilake luwih saka 100 yuta rollout ing 10,500 GPU NVIDIA GB300 sajrone latihan patang minggu. Iki minangka investasi RL sing luar biasa gedhe kanggo rilis bobot mbukak, lan Reflection nyatakake kanggo kinerja kompetitif Beam kanthi apa sing diarani efisiensi komputasi inferensi perbatasan.

Tolok ukur: Kompetitif, Durung Ujung

Tabel pathokan sing diterbitake Reflection nempatake Beam kanthi padhet ing paket bobot mbukak, ing mburi model Cina sing paling gedhe nanging luwih dhuwur tinimbang utawa level karo sawetara jeneng sing wis ditemtokake.

Ing SWE-Bench Pro v2-Hard, Beam skor 77,2, konco GLM 5,3 ing 88,2 lan Kimi K3 ing 88,2 ing baris padha, nanging uga ahead saka Inkling ing 56,9. Ing SWE-Bench Pro v1, Beam skor 65,5, sadurunge Inkling (54,3), Nemotron 3 Ultra (46,4) lan GLM 5,2 (62,1), nalika Qwen 3,8-Max posting 67,7. Ing DeepSWE v1.1 agen coding pathokan, Beam cathetan 44.4, tingkat karo GLM 5.2 kang 44.0 lan konco GLM 5.3 (61.0), Qwen 3.8-Max (51.0) lan DeepSeek V4.1 Flash (74.2).

Framing perusahaan dhewe jujur ​​​​ing ngendi Beam lenggah. Ing postingan blog, Reflection nulis yen Beam "maju ing wates bobot mbukak Kulon" lan "saingan karo model mbukak sing luwih gedhe kaya GLM 5.2 lan nyedhaki Qwen 3.8-Max babagan tugas coding lan agen." Iku uga ngakoni yen model mbukak wates kaya Kimi K3 "tetep ahead ing kemampuan mentah."

Loro caveat pantes ditekani. Pisanan, saben nomer ing kene dilapurake dhewe dening Reflection sadurunge rilis bobot, lan verifikasi independen mung bakal bisa ditindakake sawise laporan teknis lan checkpoints umum. Kapindho, sawetara sel ing tabel perusahaan dhewe ditandhani minangka ora dilapurake, sing ndadekake mbandhingake apel-kanggo-apel lengkap ora mungkin saiki.

Argumen Efisiensi

Apa Reflection pitches minangka kauntungan nyata Beam ora posisi leaderboard mentah nanging biaya ing wektu inferensi. Amarga mung 23 milyar saka 501 milyar paramèter sing diaktifake saben token, perusahaan kasebut ujar manawa Beam bisa menehi kinerja agen lan kode sing cedhak-frontier kanthi biaya komputasi model sing luwih gedhe. Posisi kasebut nggambarake strategi sing nggawe kulawarga bobot terbuka Tionghoa dadi populer karo para pemula: kemampuan sing cukup kuat ing rega sing nggawe agen sing tansah aktif kanthi ekonomi.

Yen pratelan efisiensi tetep benchmarking independen, bisa uga luwih penting tinimbang delta leaderboard. Tim sing nglakokake ewu agen coding paralel luwih peduli babagan biaya saben tugas sing wis rampung tinimbang babagan titik pathokan siji digit.

Arus Geopolitik

Cakupan peluncuran wis geopolitik banget kanggo rilis model open-source. Reuters nggambarake Beam minangka "model AI pisanan" saka Reflection kanggo "njupuk model mbukak Cina." Fortune takon apa Beam bisa dadi "kesempatan paling apik ing Amerika kanggo saingan karo China," lan Semafor nggawe perusahaan kasebut minangka "jawaban Barat sing mbukak sumber kanggo laboratorium Cina."

Framing kasebut nggambarake kahanan ekosistem bobot mbukak ing pungkasan taun 2026: model sing bisa didownload sing paling bisa didownload saka laboratorium Cina kalebu kulawarga Z.ai's GLM, Moonshot's Kimi line, Alibaba's Qwen lan DeepSeek. Laboratorium Amérika umume tetep bobote sing paling apik, kanthi taruhan ing revenue API. Refleksi taruhan ngelawan: sing model wewatesan Western mbukak bisa narik kawigaten ekosistem pangembang, lan backing Nvidia menehi landasan komputasi kanggo tetep.

Apa Kelakon Sabanjure

Rilis bobot mengko wulan iki bakal mangsuli pitakon sing penting: kepiye Beam nindakake ing njaba evaluasi Reflection dhewe, lisensi apa sing digandhengake karo bobote, lan apa efisiensi tetep ana ing beban mandiri. Nganti saiki, Beam tetep dadi meja benchmark sing janjeni, formulir pendaftaran, lan janji bobot mbukak sing paling penting sing ditindakake dening laboratorium Amerika ing taun iki.

Kanggo pangembang sing mutusake manawa bakal nggawe standar ing GLM, Kimi, Qwen utawa ngenteni Beam, saran praktis yaiku njupuk keputusan pungkasan nganti laporan teknis lan evaluasi pihak katelu teka. Lomba mbukak-bobot duwe peserta Amerika anyar, lan kanggo pisanan ing sawetara wektu, iku ora miwiti saka mburi Pack.

Tetep Ahead saka AI

Perbatasan mbukak-bobot obah saben minggu, lan laboratorium ngeculake luwih cepet tinimbang sing bisa dilacak. Waca warta AI liyane ing AI Buzz Wire kanggo peluncuran model, kerusakan pathokan lan crita bisnis ing mburi.

Jelajahi perkembangan AI paling anyar ing kene.