Model AI
53 articles
OpenAI Mulai Meluncurkan GPT-6 Astra ke Pelanggan Terpilih, Menyatakan Era AGI Telah Tiba
OpenAI telah mulai meluncurkan GPT-6 Astra untuk memilih pelanggan keamanan siber, dengan Greg Brockman mendeklarasikan era AGI. Inilah siapa yang mendapat akses dan apa selanjutnya.
IFM Abu Dhabi Merilis K2 Horizon: Enam Model Terbuka Dengan Data dan Kode Pelatihan Lengkap
IFM meluncurkan K2 Horizon: enam model terbuka (0,9B hingga 375B-A23B) dengan data pelatihan lengkap, pos pemeriksaan, log, dan kode di bawah Apache 2.0. Apa yang termasuk di dalamnya.
Meta Meluncurkan Muse Spark 1.3 Dengan Peningkatan Agentik untuk Kode Muse dan API Model Meta
Muse Spark 1.3 dari Meta diluncurkan ke Muse Code dan Meta Model API dengan peningkatan alur kerja agen, multitasking yang lebih baik, dan penalaran maksimal untuk pengujian keamanan.
Google Meluncurkan Gemini 3.8 Flash dan Flash Cyber, Rilis Model Ketiganya dalam Enam Minggu
Google mengirimkan Gemini 3.8 Flash dan varian Flash Cyber yang berfokus pada keamanan siber, mengklaim kinerja pengkodean yang mendekati Opus dengan harga yang lebih murah.
Multiverse Computing Meluncurkan Quasar 438B, Model AI dengan Peringkat Tertinggi di Eropa
Multiverse Computing meluncurkan Quasar 438B, model penalaran kelas 400B yang mendapat skor 43 pada Indeks Kecerdasan Analisis Buatan, hasil tertinggi dari model Eropa mana pun.
Google Mempersiapkan Peluncuran Flash Gemini 3.8 secepatnya pada hari Rabu untuk Menutup Kesenjangan Pengkodean AI
Google DeepMind berencana untuk meluncurkan Gemini 3.8 Flash secepatnya pada hari Rabu, WSJ melaporkan, dengan tes internal menunjukkan kemajuan dalam pengkodean dimana Gemini telah membuntuti para pesaingnya.
OpenAI Mengonfirmasi Astra Adalah Model Keamanan Siber 'Kritis' Pertama, Menetapkan Rilis Terbatas
OpenAI mengonfirmasi bahwa model Astra yang akan datang telah melewati ambang batas keamanan siber yang 'kritis' dan akan segera dikirimkan dengan akses terbatas ke alat siber terkuatnya.
Anthropic Meluncurkan Claude Fable 5.1 dan Mythos 5.1: 25% Lebih Murah, Lebih Kuat dalam Agentic Coding
Claude Fable 5.1 dari Anthropic memangkas biaya tipikal sebesar 25% dan memberikan keuntungan besar pada tolok ukur pengkodean agen, sementara Mythos 5.1 hadir untuk pengguna dengan akses tepercaya.
Cohere Merilis Parse 5, AI Parsing Dokumen Parameter 2,3B yang Dibuat untuk Penyerapan Biaya Pertama
Parse 5 Cohere mengubah PDF, slide, dan pindaian menjadi penurunan harga terstruktur dengan model parameter 2,3B. Hasil tangkapannya: keunggulan benchmarknya bertumpu pada skor parsial.
Z.ai Membuka Bobot GLM-5.3 pada Wajah Memeluk Dengan Lisensi yang Ditujukan untuk Hyperscaler
Z.ai telah merilis bobot GLM-5.3 pada Hugging Face dengan konteks token 1 juta dan lisensi khusus yang memerlukan tinjauan keamanan untuk penyedia MaaS senilai $10 miliar lebih.
Pratinjau Hy4 Sumber Terbuka Tencent: MoE Parameter 770B Dengan Konteks 1 Juta Token
Tim Hunyuan Tencent merilis pratinjau Hy4 di bawah Apache 2.0 — model MoE dengan parameter 770B dengan parameter aktif 49B, konteks token 1 juta, dan dukungan vLLM hari pertama.
Google Mengirimkan Gemini 3.5 Transkrip dan Omni 1.1 Flash: Dua Peningkatan untuk Pengembang AI
Gemini 3.5 Transcribe baru dari Google mencapai tingkat kesalahan kata sebesar 2,6% sementara Omni 1.1 Flash menambahkan adegan video 40 detik, peningkatan 4K, dan kontrol tingkat bingkai.
Flash Gemini Omni 1.1 Google Menambahkan Kontrol Kelas Studio dan Output 4K ke Video AI
Google merilis Gemini Omni 1.1 Flash dengan ekstensi adegan hingga 40 detik, transisi bingkai awal dan akhir, dan peningkatan 4K melalui API Gemini.
Google Meluncurkan Transkrip Gemini 3.5: Pengenalan Ucapan Waktu Nyata dalam 85 Bahasa
Google meluncurkan Gemini 3.5 Transcribe dengan deteksi 85 bahasa, tingkat kesalahan streaming 4%, dan respons 70% lebih cepat dibandingkan Chirp 3, yang diluncurkan di seluruh aplikasinya.
Qwen3.8-Flash-Next Alibaba Mempratinjau Arsitektur Qwen4 Dengan 6B Parameter Aktif
Qwen3.8-Flash-Next dari Alibaba mempratinjau Qwen4: parameter 125B dengan 6B aktif, bobot terbuka, dan hasil mengalahkan Qwen3.7-Plus dengan biaya sepersembilan dari biaya pelatihan.
Z.ai Meluncurkan GLM-5.3-Flash Di Bawah Lisensi MIT: Ox Alpha Terungkap, Bobot Hidup
GLM-5.3-Flash Z.ai adalah model multimodal berlisensi MIT 320B-A18B yang disajikan pada chip AI Tiongkok yang kini menduduki peringkat teratas Analisis Buatan dengan biaya rendah.
Z.ai Mengonfirmasi Ox Alpha Adalah Model Seri GLM dan Akan Melepaskan Bobotnya
Z.ai mengatakan kepada Bloomberg bahwa model siluman Ox Alpha yang sedang viral adalah rilisan seri GLM baru, dan bobot terbuka akan tiba malam ini, mengakhiri satu minggu penuh tebak-tebakan.
Ox Alpha's Maker May Have Been Unmasked: Analysis Points to Zhipu's GLM
Trik injeksi cepat dan analisis kompresi gzip menunjukkan bahwa model misteri OpenRouter Ox Alpha adalah GLM Zhipu - tetapi para skeptis menolaknya.
DeepSeek Menambahkan Visi ke V4-Flash Dengan Model Berkemampuan Gambar Eksperimental
DeepSeek mengirimkan deepseek-v4-flash-vision-exp dengan input gambar, konteks token 1 juta, dan harga tingkat Flash, sehingga memperbaiki titik buta modelnya yang paling terkenal.
OpenAI Memotong Harga GPT-5.6 Sol API Lebih dari 20% Saat Perang Harga Mencapai Unggulannya
OpenAI memangkas harga pengembang GPT-5.6 Sol lebih dari 20%, sehingga menurunkan token keluaran menjadi $20 per juta. Langkah ini mengakhiri berbulan-bulan menahan harga andalan.
Ox Alpha: Model AI Stealth Gratis OpenRouter Dengan Konteks 1 Juta Token Memicu Whodunit
Model perbatasan siluman gratis bernama Ox Alpha muncul di OpenRouter dengan konteks token dan input video 1 juta, dan komunitas AI berlomba untuk membuka kedok pembuatnya.
Model Terbuka Gemma Google Melampaui 1 Miliar Unduhan sebagai Varian Komunitas 100.000 Teratas
Google mengatakan model terbuka Gemma-nya telah melampaui 1 miliar unduhan, dengan lebih dari 100.000 varian komunitas, penerapan orbital dengan NASA, dan hub Awesome Gemma yang baru.
Ornith-1.5 Mencocokkan Claude Opus 4.8 pada Tolok Ukur Pengkodean Agentik Dengan Model yang Sepenuhnya Terbuka dan Berkembang Sendiri
Keluarga Ornith-1.5 yang berlisensi MIT menghasilkan tugas pelatihan dan perancahnya sendiri — dan kapal andalan 397B-nya menghubungkan Claude Opus 4.8 pada pengkodean Terminal-Bench 2.1.
Qwen 3.8 27B dari Alibaba Berjalan di Laptop dan Mengalahkan Modelnya yang Lebih Besar
Qwen 3.8 27B dari Alibaba adalah model visi Apache-2.0 yang berjalan di laptop dan mengalahkan Qwen 3.7-Plus yang tertutup — tetapi pengaturan penalaran defaultnya terlalu memikirkan segalanya.
Model AI Qwen Alibaba Mencapai 3 Miliar Unduhan Teratas, Menyalip Meta dan Google
Model Qwen milik Alibaba melampaui 3 miliar unduhan untuk menyalip Meta dan Google dalam adopsi AI sumber terbuka, beberapa minggu setelah rilis bobot terbuka Qwen 3.8.
GLM-5.3 Z.ai Menggandakan Pengkodean dan Muncul Dengan Keterampilan Keamanan Siber yang Menakjubkan
GLM-5.3 baru dari Z.ai menghasilkan peningkatan pengkodean yang tajam dan penemuan kerentanan yang canggih, mempersempit kesenjangan pada Anthropic dan OpenAI dari frontier open-weight.
Google Mengirimkan Gemini 3.7 Flash: Pekerja Keras Paling Cerdas untuk Pengkodean dan Agen dengan Setengah Harga
Google Gemini 3.7 Flash hadir hanya tiga minggu setelah 3.6 Flash dengan keuntungan coding dan agen yang besar, ditambah harga perkenalan dengan setengah biaya pendahulunya.
DeepSeek Meluncurkan V4 Pro ke Ketersediaan Umum, Agen Memanfaatkan Sumber Terbuka, dan Menaikkan Harga API
Lab AI Tiongkok DeepSeek merilis V4 Pro tanpa pratinjau, mengirimkan Harness v0.1 sebagai saingan sumber terbuka untuk Claude Code, dan menaikkan harga API secara tajam menjelang IPO-nya.
xAI Meluncurkan Grok 4.6, Mencocokkan Sol GPT-5.6 pada Frontier Intelligence Index
Grok 4.6 xAI mendapat skor 61 pada Indeks Kecerdasan Analisis Buatan, menyamai GPT-5.6 Sol dengan kinerja agen yang menonjol dengan biaya 60% lebih rendah. Tersedia sekarang di Cursor dan Grok Build.
SL2T Google DeepMind Menghadirkan Terjemahan Bahasa Isyarat ke Ponsel Pixel 11
Google DeepMind meluncurkan SL2T, model terjemahan bahasa isyarat yang mengubah bahasa isyarat menjadi teks pada jajaran Pixel 11, dimulai dengan Pixel 11 Pro Fold.
Nvidia Membuat Nemotron 4 dengan 1 Triliun Parameter untuk Menantang Model AI Sumber Terbuka Teratas
Nvidia sedang mengembangkan Nemotron 4, model AI sumber terbuka dengan setidaknya satu triliun parameter, untuk menyaingi sistem bobot terbuka terkemuka. Modelnya mungkin tiba pada musim gugur ini.
NVIDIA Meluncurkan Nemotron 3.5 Lightning dan NeMo Switchyard untuk Agentic AI yang Lebih Cerdas
Model terbuka baru dengan 30 miliar parameter dan pustaka perutean sumber terbuka dari NVIDIA menjanjikan output hingga 4x lebih cepat dan tugas agen 30% lebih cepat di seluruh perangkat edge, PC, dan cloud.
Mark Zuckerberg Menyatakan Perang terhadap Saingan AI Tertutup dalam Manifesto Superintelligence sebagai Meta Open-Source Model Paling Kuatnya
Mark Zuckerberg dari Meta menerbitkan manifesto besar-besaran yang menyerukan AI super cerdas untuk semua, menyerang pesaing AI yang tertutup, dan merilis versi terbuka dari model Meta yang paling kuat.
Meta Merilis Muse Glimmer, Model Open-Weight 30B yang Menjalankan Agen AI pada GPU Konsumen
Meta menerbitkan Muse Glimmer, model terbuka dengan 30 miliar parameter di bawah Apache 2.0 yang mengungguli Gemma4-31B dan Qwen3.6-27B pada benchmark agen saat dijalankan secara lokal.
OpenAI Menghentikan Model Astra Setelah Evaluasi Menandai Kemampuan Keamanan Siber yang 'Kritis'
OpenAI telah menghentikan sementara pengembangan model Astra yang akan datang setelah pengujian menunjukkan bahwa model tersebut mungkin mencapai ambang batas keamanan siber yang 'Kritis' — model pertama yang memicu tingkat risiko tertinggi.
ByteDance Dilaporkan Melatih Model AI 10 Triliun Parameter untuk Menyaingi Mitos Anthropic
Financial Times melaporkan ByteDance sedang membangun model besar dengan 10 triliun parameter yang dirancang agar sesuai dengan skala Anthropic's Mythos, sehingga mengintensifkan persaingan AI antara AS dan Tiongkok.
OpenAI Menghentikan Pengerjaan Model Astra Baru Karena Masalah Keamanan Siber yang Kritis
OpenAI telah memperlambat pengembangan model Astra yang akan datang setelah pengujian internal mengungkapkan kemampuan siber pada tingkat kritis, sehingga memperketat kontrol sebelum dirilis.
Imagine Image 2.0 xAI Mendarat Tepat Di Belakang GPT-Image-2 OpenAI di Benchmark Arena
xAI telah merilis Imagine Image 2.0 untuk Grok, menempati peringkat kedua secara global dalam benchmark Arena di belakang OpenAI GPT-Image-2, dengan alat pengeditan baru, dukungan multi-referensi, dan templat yang telah dikonfigurasi sebelumnya.
OpenAI Menghentikan Pengembangan Model Astra Setelah Mencapai Ambang Risiko Keamanan Siber yang 'Kritis'
OpenAI menghentikan sebagian pengembangan Astra setelah pengujian internal menunjukkan bahwa OpenAI mungkin mencapai tingkat risiko keamanan siber tertinggi dalam Kerangka Kesiapsiagaan – model pertama yang mencapai tingkat risiko tersebut.
ByteDance Melatih Model AI 10 Triliun Parameter untuk Menyaingi Mitos Antropis
ByteDance sedang melatih model mega AI dengan hingga 10 triliun parameter, mendekati perkiraan ukuran Mythos 5 milik Anthropic dan membuat para pemimpin Tiongkok saat ini terlihat kerdil.
Shieldstral Mistral: Model Keamanan Bobot Terbuka 3B yang Membaca Kebijakan Daripada Menghafalnya
Mistral AI merilis Shieldstral, pengklasifikasi keamanan bobot terbuka dengan parameter 3B yang mengevaluasi teks dan gambar berdasarkan kebijakan moderasi bahasa sederhana pada waktu inferensi.
Alibaba Meluncurkan Qwen3.8-Max: Model Parameter 2,4 Triliun Yang Menyaingi Claude Anthropic
Alibaba telah merilis Qwen3.8-Max, model dengan parameter 2,4 triliun yang hanya tertinggal dari Claude dari Anthropic dalam benchmark, dengan bobot terbuka yang dijanjikan dalam beberapa hari.
Model Astra OpenAI Memecahkan 10 Soal Matematika yang Sudah Lama Belum Terpecahkan Dengan Bukti yang Diperiksa Mesin
Model Astra OpenAI yang belum dirilis memecahkan 10 permasalahan terbuka dalam matematika dan ilmu komputer dengan bukti yang terverifikasi Lean, sehingga memberikan gambaran tentang model besar berikutnya sebelum tinjauan pemerintah AS.
Gemini 3.5 Pro Muncul di LM Arena Blind Tests saat Google Mendekati Rilis
Gemini 3.5 Pro Google yang tertunda telah berulang kali terlihat dalam tes buta LMSYS Chatbot Arena, menandakan peluncuran publik akhirnya akan segera terjadi.
Mesin Berpikir Merilis Inkling-Small: Model Open-Weight 276B dengan Ukuran Seperempat Unggulannya
Thinking Machines Lab merilis Inkling-Small, model open-weight dengan 276 miliar parameter dengan 12B aktif yang menyamai andalannya dengan ukuran seperempatnya — salah satu peserta AS dalam perlombaan open-weight.
DeepSeek Meluncurkan V4-Flash Public Beta seiring Meningkatnya Perang Harga AI di Tiongkok
DeepSeek merilis API V4-Flash beta resmi, dengan model yang dilatih ulang yang mengalahkan V4 Pro andalannya sendiri dalam sembilan tolok ukur agen sekaligus mengalahkan pesaing AS dalam hal harga.
OpenAI Memangkas Harga Model GPT-5.6 Hingga 80 Persen karena Perusahaan Menjadi Sensitif terhadap Biaya AI
OpenAI memangkas harga pada dua model GPT-5.6 termasuk Luna, sehingga mengurangi biaya model yang lebih kecil hingga 80 persen seiring dengan meningkatnya perhatian bisnis pada pengeluaran AI.
Model V4-Flash Baru DeepSeek Cocok dengan GPT-5.6 Luna dengan Biaya 60% Lebih Rendah
DeepSeek merilis V4-Flash '0731', model berbobot terbuka yang hampir menyamai OpenAI GPT-5.6 Luna pada benchmark dan harganya sekitar 60 persen lebih murah.
MiniMax Tiongkok Merilis Model Video AI H3 Dengan Klip 2K, Suara Stereo, dan Bobot Terbuka
Startup AI Tiongkok, MiniMax, meluncurkan model pembuatan video H3 pada tanggal 31 Juli 2026, menawarkan resolusi 2K, audio stereo, dan bobot terbuka dengan harga yang lebih murah dari pesaing — secara langsung menantang Seedance 2.5 dari ByteDance.
Google DeepMind Meluncurkan Robotika Gemini 2 Dengan Kontrol Humanoid Seluruh Tubuh dan Kolaborasi Multi-Robot
Google DeepMind meluncurkan Gemini Robotics 2, model tindakan-bahasa penglihatan yang memungkinkan robot humanoid bergerak, memahami, dan mengoordinasikan tugas di seluruh tubuhnya.
OpenAI Memangkas Harga API GPT-5.6 Hingga 80% karena Perusahaan Memikirkan Kembali Biaya AI
OpenAI memangkas harga GPT-5.6 Luna dan Terra API hingga 80% pada tanggal 30 Juli 2026, meremehkan Anthropic saat perusahaan meneliti pengeluaran inferensi.
OpenAI Mengatakan Sol GPT-5.6 Mengalahkan Claude Opus 5 di ARC-AGI-3 — Tetapi Hanya Dengan Pengaturannya Sendiri
OpenAI melaporkan GPT-5.6 Sol memperoleh skor 38,3% pada ARC-AGI-3 menggunakan penalaran dan pemadatan yang dipertahankan, mengungguli Claude Opus 5. Namun sistem resmi memberikan cerita yang berbeda, sehingga memicu perdebatan mengenai keadilan benchmark.
Black Forest Labs Meluncurkan FLUX 3: Model AI Tunggal untuk Gambar, Video, Audio, dan Robotika
Black Forest Labs meluncurkan FLUX 3, model multimodal yang secara gabungan menghasilkan gambar, video dengan audio asli, dan prediksi aksi robot — lebih disukai dibandingkan Runway Gen-4.5 dalam 77% perbandingan.
