Reflection AI, syarikat permulaan Amerika yang disokong Nvidia, memperkenalkan model berat terbuka pertamanya pada 5 Oktober, sistem campuran pakar yang jarang dipanggil Beam yang kedudukan syarikat itu sebagai cabaran Barat yang paling kuat untuk sempadan berat terbuka yang kini dikuasai oleh makmal China. Pengumuman itu, yang diterbitkan di blog Reflection sendiri dan cepat diambil oleh Reuters, TechCrunch, Fortune dan Semafor, tiba dengan kelainan: model itu belum boleh dimuat turun lagi.

Beam sedang menjalani apa yang disifatkan oleh syarikat sebagai gabungan dan penilaian terakhir. Akses awal dibuka melalui proses pendaftaran, dan Reflection mengatakan ia akan mengeluarkan pemberat, laporan teknikal, kad model dan artifak pembangun akhir bulan ini. Apabila itu berlaku, Beam akan menjadi salah satu keluaran berat terbuka terbesar yang pernah diterbitkan oleh makmal AS, dan ujian paling jelas sama ada syarikat Amerika boleh memadankan irama keluaran dan keterbukaan yang telah menjadikan model Cina sebagai pilihan lalai untuk kebanyakan komuniti sumber terbuka. Untuk liputan berterusan tentang perlumbaan berat terbuka dan segala-galanya yang bergerak dalam bidang ini, tandai halaman utama berita AI kami.

Nombor Di Sebalik Rasuk

Beam ialah model campuran pakar yang jarang dengan 501 bilion jumlah parameter, yang mana kira-kira 23 bilion aktif setiap token. Reflection mengatakan ia telah melatih model pada 23.8 trilion token yang diambil daripada web dan set data berlesen proprietari, dengan mendakwa bahawa model asas sepadan atau mengatasi prestasi model asas terbuka bersaiz serupa.

Tuntutan yang lebih tersendiri berkenaan pembelajaran pengukuhan. Reflection membina algoritma, persekitaran latihan dan infrastruktur untuk mengekalkan RL berkomputer tinggi pada skala, dan syarikat melaporkan bahawa larian RLnya menjana lebih daripada 100 juta pelancaran merentas 10,500 GPU NVIDIA GB300 sepanjang empat minggu latihan. Itu adalah pelaburan RL yang luar biasa besar untuk pelepasan berat terbuka, dan Reflection mengkreditkannya untuk prestasi kompetitif Beam dengan apa yang dipanggil kecekapan pengiraan inferens sempadan.

Penanda Aras: Berdaya saing, Belum Mendahului

Jadual penanda aras yang diterbitkan oleh Reflection meletakkan Beam dengan kukuh dalam pek berat terbuka, di belakang model Cina yang paling besar tetapi di hadapan atau setanding dengan beberapa nama terkenal.

Pada SWE-Bench Pro v2-Hard, Beam mendapat markah 77.2, di belakang GLM 5.3 pada 88.2 dan Kimi K3 pada 88.2 pada baris yang sama, tetapi jauh di hadapan Inkling pada 56.9. Pada SWE-Bench Pro v1, Beam mendapat markah 65.5, mendahului Inkling (54.3), Nemotron 3 Ultra (46.4) dan GLM 5.2 (62.1), manakala Qwen 3.8-Max mencatatkan 67.7. Pada penanda aras pengekodan agen DeepSWE v1.1, Beam merekodkan 44.4, tahap dengan 44.0 GLM 5.2 dan di belakang GLM 5.3 (61.0), Qwen 3.8-Max (51.0) dan DeepSeek V4.1 Flash (74.2).

Pembingkaian syarikat sendiri adalah terang tentang di mana Beam duduk. Dalam catatan blog, Reflection menulis bahawa Beam "memajukan sempadan berat terbuka Barat" dan "berdaya saing dengan model terbuka yang lebih besar seperti GLM 5.2 dan mendekati Qwen 3.8-Max pada pengekodan dan tugas agen." Ia juga mengakui bahawa model terbuka sempadan seperti Kimi K3 "kekal di hadapan dengan keupayaan mentah."

Dua kaveat patut diberi penekanan. Pertama, setiap nombor di sini dilaporkan sendiri oleh Reflection sebelum keluaran berat, dan pengesahan bebas hanya akan menjadi mungkin setelah laporan teknikal dan pusat pemeriksaan diumumkan. Kedua, beberapa sel dalam jadual syarikat sendiri ditandakan sebagai tidak dilaporkan, yang menjadikan perbandingan epal-ke-epal yang lengkap mustahil buat masa ini.

Hujah Kecekapan

Apa yang Reflection katakan sebagai kelebihan sebenar Beam bukanlah kedudukan papan pendahulu mentah tetapi kos pada masa inferens. Oleh kerana hanya 23 bilion daripada 501 bilion parameternya diaktifkan setiap token, syarikat itu berpendapat Beam boleh menyampaikan prestasi agen dan pengekodan berhampiran sempadan pada sebahagian kecil daripada kos pengiraan model padat yang lebih besar. Kedudukan itu mencerminkan strategi yang menjadikan keluarga berwajaran terbuka Cina begitu popular di kalangan pemula: keupayaan yang cukup kukuh pada harga yang menjadikan ejen sentiasa aktif berdaya maju dari segi ekonomi.

Jika tuntutan kecekapan kekal dalam penanda aras bebas, ia mungkin lebih penting daripada delta papan pendahulu. Pasukan yang menjalankan beribu-ribu ejen pengekodan selari lebih mementingkan kos setiap tugasan yang telah disiapkan berbanding mata penanda aras satu digit.

Arus Bawah Geopolitik

Liputan pelancaran adalah sangat geopolitik untuk keluaran model sumber terbuka. Reuters menggambarkan Beam sebagai "model AI pertama" dari Reflection untuk "mengambil model terbuka Cina." Fortune bertanya sama ada Beam boleh menjadi "peluang terbaik Amerika untuk bersaing dengan China," dan Semafor membingkai syarikat itu sebagai "jawapan Barat sumber terbuka kepada makmal China."

Pembingkaian itu mencerminkan keadaan ekosistem berwajaran terbuka pada penghujung 2026: model boleh dimuat turun yang paling berkebolehan banyak diperoleh daripada makmal China termasuk keluarga GLM Z.ai, baris Kimi Moonshot, Qwen dan DeepSeek Alibaba. Makmal Amerika sebahagian besarnya telah menutup pemberat terbaik mereka, sebaliknya mempertaruhkan hasil API. Refleksi mempertaruhkan sebaliknya: model sempadan Barat yang terbuka boleh menarik ekosistem pembangun, dan sokongan Nvidia memberikannya landasan pengiraan untuk bersaing.

Apa Yang Berlaku Seterusnya

Keluaran berat akhir bulan ini akan menjawab soalan yang penting: bagaimana Beam berprestasi di luar penilaian Reflection sendiri, jenis lesen yang disertakan dengan pemberat dan sama ada kecekapan bertahan di bawah beban bebas. Sehingga itu, Beam kekal sebagai jadual penanda aras yang menjanjikan, borang pendaftaran, dan janji berat terbuka yang paling penting yang telah dibuat oleh makmal Amerika tahun ini.

Bagi pembangun yang memutuskan sama ada untuk menyeragamkan pada GLM, Kimi, Qwen atau menunggu Beam, nasihat praktikal adalah untuk membuat keputusan muktamad sehingga laporan teknikal dan penilaian pihak ketiga tiba. Perlumbaan berat terbuka mempunyai peserta Amerika yang baharu, dan buat pertama kali selepas beberapa ketika, ia tidak bermula dari belakang pek.

Kekal Mendahului AI

Sempadan berat terbuka bergerak setiap minggu, dan makmal mengeluarkan lebih cepat daripada yang dapat dijejaki oleh sesiapa sahaja. Baca lebih banyak berita AI di AI Buzz Wire untuk pelancaran model, pecahan penanda aras dan kisah perniagaan di belakangnya.

Terokai perkembangan AI terkini di sini.