AI-modeller
53 articles
OpenAI börjar rulla ut GPT-6 Astra för utvalda kunder och förklarar att AGI-eran har anlänt
OpenAI har börjat rulla ut GPT-6 Astra för utvalda cybersäkerhetskunder, med Greg Brockman som utropar AGI-eran. Här är vem som får tillgång och vad som händer härnäst.
Abu Dhabis IFM släpper K2 Horizon: Sex öppna modeller med fullständig träningsdata och kod
IFM lanserade K2 Horizon: sex öppna modeller (0.9B till 375B-A23B) med fullständig träningsdata, kontrollpunkter, loggar och kod under Apache 2.0. Vad den innehåller.
Meta lanserar Muse Spark 1.3 med agentuppgraderingar för Muse Code och Meta Model API
Metas Muse Spark 1.3 rullas ut till Muse Code och Meta Model API med agentiska arbetsflödesuppgraderingar, bättre multitasking och maximalt resonemang för säkerhetstestning.
Google lanserar Gemini 3.8 Flash och Flash Cyber, dess tredje modellsläpp på sex veckor
Google levererar Gemini 3.8 Flash och en cybersäkerhetsfokuserad Flash Cyber-variant, som gör anspråk på nästan Opus-kodningsprestanda till en bråkdel av priset.
Multiverse Computing lanserar Quasar 438B, Europas högst rankade AI-modell
Multiverse Computing lanserade Quasar 438B, en resonemangsmodell av 400B-klassen som fick 43 på Artificiell Analys Intelligence Index, det bästa resultatet av alla europeiska modeller.
Google förbereder Gemini 3.8 Flash-lansering så snart som onsdag för att täppa till AI-kodningsgapet
Google DeepMind planerar att lansera Gemini 3.8 Flash så snart som onsdag, rapporterar WSJ, med interna tester som visar framsteg inom kodning där Gemini har släpat efter rivaler.
OpenAI bekräftar att Astra är dess första "kritiska" cybersäkerhetsmodell, släpper begränsat
OpenAI bekräftade att dess kommande Astra-modell passerade den "kritiska" cybersäkerhetströskeln och kommer snart att levereras med begränsad tillgång till dess mest kraftfulla cyberverktyg.
Anthropic lanserar Claude Fable 5.1 och Mythos 5.1: 25 % billigare, starkare vid Agentic Coding
Anthropics Claude Fable 5.1 sänker typiska kostnader med 25 % och ger stora vinster på riktmärken för agentkodning, medan Mythos 5.1 kommer för användare med betrodd åtkomst.
Cohere släpper Parse 5, en 2.3B-parameters AI för dokumentparsning som är byggd för kostnad-första intag
Cohere's Parse 5 förvandlar PDF-filer, diabilder och skanningar till strukturerad Markdown med en 2,3B-parametermodell. Haken: dess benchmark-ledning vilar på en delpoäng.
Z.ai öppnar GLM-5.3-vikter på kramande ansikte med en licens riktad till hyperscalers
Z.ai har släppt GLM-5.3-vikter på Hugging Face med en 1M-token-kontext och en anpassad licens som kräver säkerhetsgranskningar för $10 miljarder plus MaaS-leverantörer.
Tencent Open-Sources Hy4-förhandsvisning: 770B-Parameter MoE med 1M-Token-kontext
Tencents Hunyuan-team släppte Hy4-förhandsvisning under Apache 2.0 - en 770B-parameter MoE-modell med 49B aktiva parametrar, 1M-token-kontext och vLLM-stöd för första gången.
Google skickar Gemini 3.5 Transcribe och Omni 1.1 Flash: Två uppgraderingar för AI-utvecklare
Googles nya Gemini 3.5 Transcribe når en ordfelsfrekvens på 2,6 % medan Omni 1.1 Flash lägger till 40-sekunders videoscener, 4K-uppskalning och kontroll på ramnivå.
Googles Gemini Omni 1.1 Flash lägger till kontroller i studioklass och 4K-utgång till AI-video
Google släppte Gemini Omni 1.1 Flash med scenförlängning upp till 40 sekunder, start-och-slut-bildövergångar och 4K-uppskalning genom Gemini API.
Google lanserar Gemini 3.5 Transkribera: Taligenkänning i realtid på 85 språk
Google lanserade Gemini 3.5 Transcribe med 85-språksdetektering, 4 % strömningsfelfrekvens och 70 % snabbare svar än Chirp 3, som rullas ut i alla sina appar.
Alibabas Qwen3.8-Flash-Next-förhandsvisningar Qwen4-arkitektur med 6B aktiva parametrar
Alibabas Qwen3.8-Flash-Next-förhandsvisningar Qwen4: 125B parametrar med 6B aktiva, öppna vikter och Qwen3.7-Plus-slagande resultat till en niondedel av träningskostnaden.
Z.ai lanserar GLM-5.3-Flash under MIT-licens: Ox Alpha Revealed, Weights Live
Z.ai:s GLM-5.3-Flash är en 320B-A18B MIT-licensierad multimodal modell som serveras på kinesiska AI-chips som nu toppar rankingen för artificiell analys till låg kostnad.
Z.ai bekräftar att Ox Alpha är en modell i GLM-serien och kommer att släppa sina vikter
Z.ai berättade för Bloomberg att den virala smygmodellen Ox Alpha är en ny GLM-seriesläppning, och öppna vikter anländer i kväll, vilket avslutar en vecka av febrig gissning.
Ox Alphas tillverkare kan ha avslöjats: Analys pekar på Zhipus GLM
Ett snabbt injektionstrick och gzip-kompressionsanalys tyder på att OpenRouters mysteriemodell Ox Alpha är Zhipus GLM - men skeptiker trycker tillbaka.
DeepSeek lägger till vision till V4-Flash med experimentell bildkapabel modell
DeepSeek skickar deepseek-v4-flash-vision-exp med bildinmatning, 1M token-kontext och prissättning på Flash-nivå, vilket fixar modellens mest ökända döda fläck.
OpenAI sänker GPT-5.6 Sol API-prissättningen med mer än 20 % när priskriget når sitt flaggskepp
OpenAI sänkte GPT-5.6 Sol-utvecklarens prissättning med över 20 %, vilket sänkte utdatatokens till 20 USD per miljon. Flytten avslutar månader med att hålla flaggskeppspriset.
Ox Alpha: OpenRouters gratis Stealth AI-modell med 1M-tokenkontext sätter igång en Whodunit
En gratis stealth frontier-modell som heter Ox Alpha dök upp på OpenRouter med en 1M-token-kontext och videoingång, och AI-gemenskapen tävlar för att avslöja sin tillverkare.
Googles Gemma Open Models överträffar 1 miljard nedladdningar som community-varianter Topp 100 000
Google säger att deras Gemma öppna modeller passerade 1 miljard nedladdningar, med 100 000-plus community-varianter, orbital-distributioner med NASA och en ny Awesome Gemma-hub.
Ornith-1.5 matchar Claude Opus 4.8 på Agentic Coding Benchmarks med helt öppna, självförbättrande modeller
Den MIT-licensierade Ornith-1.5-familjen genererar sina egna träningsuppgifter och byggnadsställningar – och dess 397B flaggskeppsband Claude Opus 4.8 på Terminal-Bench 2.1-kodning.
Alibabas Qwen 3.8 27B körs på en bärbar dator och motiverar sina egna större modeller
Alibabas Qwen 3.8 27B är en Apache-2.0 vision-modell som körs på bärbara datorer och slår den slutna Qwen 3.7-Plus - men dess standardinställning för resonemang överväger allt.
Alibabas Qwen AI Models Top 3 Billion Downloads, Overtaking Meta och Google
Alibabas Qwen-modeller passerade 3 miljarder nedladdningar för att gå om Meta och Google i öppen källkod för AI, veckor efter Qwen 3.8 open-weights-släppet.
Z.ai:s GLM-5.3 fördubblar kodningen och kommer fram med häpnadsväckande cybersäkerhetsfärdigheter
Z.ais nya GLM-5.3 presenterar skarpa kodningsvinster och den senaste sårbarhetsupptäckten, vilket minskar klyftan på Anthropic och OpenAI från den öppna gränsen.
Google skickar Gemini 3.7 Flash: dess smartaste arbetshäst hittills för kodning och agenter till halva priset
Googles Gemini 3.7 Flash landar bara tre veckor efter 3.6 Flash med stora kodnings- och agentvinster, plus introduktionspriser till halva kostnaden av sin föregångare.
DeepSeek lanserar V4 Pro för allmän tillgänglighet, öppna källkods-harness Agent och höjer API-priser
Kinesiska AI-labbet DeepSeek släpper V4 Pro utanför förhandsvisningen, levererar Harness v0.1 som öppen källkodskonkurrent till Claude Code och höjer kraftigt API-priserna inför börsintroduktionen.
xAI lanserar Grok 4.6, matchande GPT-5.6 Sol på Frontier Intelligence Index
xAI:s Grok 4.6 får 61 poäng på Artificial Analysis Intelligence Index, vilket knyter GPT-5.6 Sol med enastående agentprestanda till 60 % lägre kostnad. Finns nu i Cursor och Grok Build.
Google DeepMinds SL2T ger översättning av teckenspråk till Pixel 11-telefoner
Google DeepMind presenterade SL2T, en översättningsmodell för teckenspråk som förvandlar teckenspråk till text i Pixel 11-serien, med början i Pixel 11 Pro Fold.
Nvidia bygger Nemotron 4 med 1 biljoner parameter för att utmana de bästa AI-modellerna med öppen källkod
Nvidia utvecklar Nemotron 4, en AI-modell med öppen källkod med minst en biljon parametrar, för att konkurrera med ledande system med öppen vikt. Modellen kan komma i höst.
NVIDIA lanserar Nemotron 3.5 Lightning och NeMo Switchyard för smartare agent AI
NVIDIAs nya öppna modell med 30 miljarder parametrar och routingbibliotek med öppen källkod lovar upp till 4x snabbare utdata och 30 % snabbare agentuppgifter över edge-enheter, datorer och molnet.
Mark Zuckerberg förklarar krig mot slutna AI-rivaler i Superintelligens Manifesto som Meta Open-Sources dess mest kraftfulla modell
Metas Mark Zuckerberg publicerade ett svepande manifest som uppmanade till superintelligent AI för alla, attackerade slutna AI-rivaler och släppte en öppen version av Metas mest kraftfulla modell.
Meta släpper Muse Glimmer, en 30B öppen viktmodell som kör AI-agenter på konsument-GPU:er
Meta publicerade Muse Glimmer, en öppen modell med 30 miljarder parametrar under Apache 2.0 som överträffar Gemma4-31B och Qwen3.6-27B på agentiska benchmarks samtidigt som den körs lokalt.
OpenAI pausar Astra-modellen efter utvärderingar Flagga "kritiska" cybersäkerhetsfunktioner
OpenAI har pausat utvecklingen av sin kommande Astra-modell efter att tester visade att den kan nå den "kritiska" cybersäkerhetströskeln - den första modellen som utlöser den högsta risknivån.
ByteDance lär utbilda en AI-modell med 10 biljoner parametrar för att konkurrera med Anthropics Mythos
Financial Times rapporterar att ByteDance bygger en massiv modell med 10 biljoner parametrar utformad för att matcha omfattningen av Anthropics Mythos, vilket intensifierar AI-racet mellan USA och Kina.
OpenAI pausar arbetet med ny Astra-modell över kritiska cybersäkerhetsproblem
OpenAI har bromsat utvecklingen av sin kommande Astra-modell efter att interna tester avslöjade cyberfunktioner på kritisk nivå, skärpte kontrollerna innan lanseringen.
xAI:s Imagine Image 2.0 landar precis bakom OpenAI:s GPT-Image-2 i Arena Benchmarks
xAI har släppt Imagine Image 2.0 för Grok, rankad tvåa globalt i Arena-riktmärken bakom OpenAI:s GPT-Image-2, med nya redigeringsverktyg, stöd för flera referenser och förkonfigurerade mallar.
OpenAI pausar utvecklingen av Astra-modellen efter att den når "kritisk" risktröskel för cybersäkerhet
OpenAI stoppade delar av Astras utveckling efter att interna tester visade att den kan nå den högsta risknivån för cybersäkerhet i sitt beredskapsramverk – den första av dess modeller som gör det.
ByteDance tränar en AI-modell med 10 biljoner parametrar för att konkurrera med Anthropics mythos
ByteDance tränar en mega-AI-modell med upp till 10 biljoner parametrar, som närmar sig den uppskattade storleken på Anthropics Mythos 5 och överväger Kinas nuvarande ledare.
Mistral's Shieldstral: En 3B säkerhetsmodell med öppen vikt som läser policyer istället för att memorera dem
Mistral AI släppte Shieldstral, en säkerhetsklassificerare med öppen vikt med 3B-parametrar som utvärderar text och bilder mot klarspråkiga modereringspolicyer vid slutledningstidpunkten.
Alibaba lanserar Qwen3.8-Max: En modell med 2,4 biljoner parametrar som konkurrerar med Anthropics Claude
Alibaba har släppt Qwen3.8-Max, en modell med 2,4 biljoner parametrar som bara följer Anthropics Claude på riktmärken, med öppna vikter utlovade inom några dagar.
OpenAI:s Astra-modell löser 10 långa olösta matematiska problem med maskinkontrollerade bevis
OpenAI:s outgivna Astra-modell knäckte 10 öppna problem inom matematik och datavetenskap med Lean-verifierade bevis, vilket retade sin nästa stora modell före granskning av den amerikanska regeringen.
Gemini 3.5 Pro Surfaces i LM Arena blindtest när Google närmar sig release
Googles försenade Gemini 3.5 Pro har upprepade gånger upptäckts i blindtester av LMSYS Chatbot Arena, vilket signalerar att en offentlig lansering äntligen kan vara nära förestående.
Thinking Machines släpper Inkling-Small: 276B öppen viktmodell på en fjärdedel av dess flaggskeppsstorlek
Thinking Machines Lab släppte Inkling-Small, en öppen viktmodell med 276 miljarder parametrar med 12B aktiv som matchar dess flaggskepp med en fjärdedel av storleken – en amerikansk deltagare i öppenviktsloppet.
DeepSeek lanserar V4-Flash Public Beta när Kinas AI-priskrig eskalerar
DeepSeek släppte det officiella V4-Flash beta-API:et, med en omskolad modell som slår sitt eget flaggskepp V4 Pro på nio agentriktmärken samtidigt som de underskrider amerikanska rivaler i pris.
OpenAI sänker GPT-5.6-modellpriserna med upp till 80 procent när företag blir känsliga för AI-kostnader
OpenAI sänkte priserna på två GPT-5.6-modeller inklusive Luna, vilket minskade kostnaderna för mindre modeller med upp till 80 procent när företag granskar AI-utgifterna.
DeepSeeks nya V4-Flash-modell matchar GPT-5.6 Luna till 60 % lägre kostnad
DeepSeek släppte V4-Flash '0731', en modell med öppen vikt som nästan knyter OpenAI:s GPT-5.6 Luna till riktmärken samtidigt som den kostar cirka 60 procent mindre.
Kinas MiniMax släpper H3 AI-videomodell med 2K-klipp, stereoljud och öppna vikter
Kinesiska AI-startföretaget MiniMax lanserade sin H3-videogenereringsmodell den 31 juli 2026, och erbjuder 2K-upplösning, stereoljud och öppna vikter till en bråkdel av konkurrenternas priser – direkt utmanande ByteDances Seedance 2.5.
Google DeepMind avslöjar Gemini Robotics 2 med kontroll över hela kroppen och samarbete med flera robotar
Google DeepMind lanserade Gemini Robotics 2, en vision-språk-action-modell som gör det möjligt för mänskliga robotar att flytta, greppa och koordinera uppgifter över hela kroppen.
OpenAI sänker GPT-5.6 API-priser upp till 80 % när företag omprövar AI-kostnader
OpenAI sänkte priserna för GPT-5.6 Luna och Terra API med upp till 80 % den 30 juli 2026, vilket underskred Anthropic när företag granskar slutsatser.
OpenAI säger att GPT-5.6 Sol slår Claude Opus 5 på ARC-AGI-3 — men bara med sina egna inställningar
OpenAI rapporterar att GPT-5.6 Sol fick 38,3 % på ARC-AGI-3 med bibehållna resonemang och komprimering, vilket toppade Claude Opus 5. Men den officiella selen berättar en annan historia och väckte en debatt om riktmärkets rättvisa.
Black Forest Labs Unveils FLUX 3: A Single AI Model for Images, Video, Audio, and Robotics
Black Forest Labs lanserade FLUX 3, en multimodal modell som tillsammans genererar bilder, video med inbyggt ljud och robothandlingsförutsägelser – föredras framför Runway Gen-4.5 i 77 % av jämförelserna.
