Cohere wis ngrilis Parse 5 (parse-v5.0), model parsing dokumen sing dituju kanggo konsumsi perusahaan kanthi volume dhuwur, lan saiki umume kasedhiya tanpa daftar tunggu. Minangka rinci dening MarkTechPost, rilis kasebut minangka taruhan sing luwih akeh tinimbang perusahaan sing paling akeh biaya taruhan saben kaca. VentureBeat dirangkum blak-blakan: Parse 5 "kelangan pathokan ing poin. Iku menang ing biaya saben kaca."
Apa Parse 5 Sejatine For more context on this story, see our ongoing AI news.
Parse 5 minangka model basa visi 2,3 milyar parameter sing dibangun ing arsitektur North-Micro-Vision-Instruct Cohere Labs, kanthi jendhela konteks 8,192-token lan jejak kira-kira 4.6GB. Butuh kaca PDF, PowerPoint, utawa JPEG minangka input sing dienkode base64 lan ngasilake Markdown ing siji pass: teks kanthi urutan maca, tabel sing dirender minangka HTML, dhaptar, mbentuk pasangan nilai kunci, deskripsi gambar, lan koordinat kothak wates kanggo unsur visual.
Pilihan arsitektur sing misuwur yaiku sing dicopot. Ora ana tataran OCR sing kapisah ing ngarep model - deteksi tata letak, pangenalan teks, lan penataan kedadeyan ing siji jaringan, sing nyederhanakake penyebaran lan ngilangi sumber umum kesalahan cascading ing pipa dokumen tradisional.
Cohere nyathet sangang basa minangka stabil - Arab, Inggris, Prancis, Jerman, Italia, Jepang, Korea, Portugis, lan Spanyol - kanthi dhukungan nol-shot kanggo wong liya kanthi akurasi sing luwih murah.
Loro Mode Output
Ing mode standar, Parse 5 ngasilake string Markdown saben kaca. Mode kapindho, diaktifake kanthi `output_format="blocks"`, ngasilake blok sing diketik, ing ngendi saben blok tabel ngemot HTML, kothak wates, lan deskripsi. Mode kapindho sing ndadekake traceability tingkat kutipan bisa - perusahaan bisa bali menyang persis ing ngendi kaca kasebut asale saka tokoh sing diurai, sing penting kanggo industri sing diatur nyedhiyakake dokumen menyang sistem generasi sing ditambahake.
Peringatan Benchmark
Cohere nglaporake skor ParseBench 79.2 kanggo Parse 5, sadurunge Mistral OCR 4 ing 74.5, Intelijen Dokumen Azure ing 74.3, lan Databricks AI Parse ing 72.4. Nanging ana tanda bintang penting sing analisis MarkTechPost.
ParseBench minangka pathokan LlamaIndex saka kira-kira 2,078 kaca perusahaan sing diverifikasi manungsa sing dicetak ing limang dimensi: tabel, grafik, kasetyan isi, format semantik, lan dhasar visual. Cohere's 79.2 rata-rata mung telu saka limang dimensi kasebut, ngeculake grafik lan grounding visual - sabenere rong dimensi ing ngendi umume parser nindakake paling awon. Ing leaderboard limang dimensi umum, vendor padha skor adoh luwih murah sakabèhé: Mistral OCR 4 lan Databricks AI Parse ing 60.68, Azure Document Intelligence (Layout) ing 59.64, karo LlamaParse Agentic mimpin Papan ing 84.88. Parse 5 saiki ora kadhaptar ing leaderboard kasebut.
Ing tembung liyane, 79.2 minangka skor subset sing dilaporake vendor, dudu makutha pathokan. Rata-rata telung dimensi Azure bisa dadi 74.3, cocog karo metodologi Cohere kanthi tepat - dadi perbandingan paling ora apel-apel ing subset sing kalebu.
Math Rega
Argumentasi biaya yaiku ing ngendi posisi Cohere dadi konkrit. API Parse diregani $1.50 saben 1.000 kaca — $0.0015 saben kaca. Kanggo organisasi sing luwih seneng kapasitas khusus, penawaran Model Vault panyewa tunggal nganggo $4,00 saben jam ($2,500 saben wulan) ing conto Sedheng, utawa $7,00 saben jam ($4,300 saben wulan) ing XL.
Titik silang luwih penting tinimbang nomer siji. Ing tarif meter, instance Medium Vault ngeculake udakara 1.67 yuta halaman saben wulan, lan XL kira-kira 2.87 yuta. Ing ngisor volume kasebut, nelpon API yen perlu luwih murah; ndhuwur mau, kapasitas darmabakti menang rega sadurunge accounting keuntungan data-karesidenan sing biasane drive Adoption Vault ing Panggonan pisanan.
Kasedhiyan
Parse 5 umume kasedhiya liwat Cohere Parse API, Microsoft Foundry, AWS SageMaker, lan panyebaran Model Vault penyewa tunggal. Ora ana akses gating lisensi riset - Cohere nganggep iki minangka infrastruktur produksi wiwit dina.
Apa Tegese kanggo Buyers Enterprise
Rilis kasebut nggambarake pola sing luwih akeh ing AI perusahaan: kemampuan sing ana ing wates-wates dadi cukup cilik kanggo murah, lan para vendor saya saingan babagan ekonomi unit tinimbang skor mentah. Model 2.3B-parameter sing ngurai dokumen ing $1.50 saben ewu kaca ngompres biaya beban kerja sing biasane mbutuhake suite OCR komersial sing larang utawa pipa ing omah sing rapuh.
Rilis kasebut uga ujar babagan ngendi Cohere ndeleng bukaan. Perusahaan kasebut ngetrapake bisnis perusahaan babagan kepraktisan penyebaran - model sing murah, kanthi pribadi, lan bisa ditebak ing lingkungan perusahaan - tinimbang nguber wates. Parser dokumen ora nyenengake ing jejere model penalaran perbatasan, nanging ingestion dokumen minangka salah sawijining sawetara beban kerja AI ing ngendi perusahaan bisa ngukur bali saben kaca saiki, lan Cohere kanthi jelas pengin duwe matematika kasebut.
Kanggo para panuku, saran praktis saka analisis pathokan yaiku kanggo nambani Parse 5 kanthi cara Cohere dhewe nggawe pigura - minangka pratelan kanggo nguji dokumen sampeyan dhewe, utamane yen grafik lan landasan visual minangka pusat beban kerja sampeyan, amarga iku minangka dimensi sing diilangi. Kanggo volume dhuwur, ingestion teks-lan-meja-abot, kasus rega-kinerja langsung; kanggo parsing ngendi denah ngemot makna, pimpinan leaderboard umum tetep worth ngevaluasi pisanan.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →