Modele AI
55 articles
GPT-6 Astra lansează utilizatorilor plătitori ChatGPT, deoarece Altman își cere scuze pentru lansarea dezordonată
GPT-6 Astra de la OpenAI ajunge la majoritatea utilizatorilor plătitori după o lansare haotică. Sam Altman și-a cerut scuze și a promis resetări de utilizare pentru abonații blocați.
Google lansează Gemini 3.8 Flash și o variantă cibernetică creată pentru apărarea automată a vulnerabilităților
Google Gemini 3.8 Flash oferă codare și raționament la nivel de frontieră la 0,75 USD per milion de jetoane de intrare, cu o variantă Flash Cyber pentru apărătorii securității.
OpenAI începe să lanseze GPT-6 Astra pentru a selecta clienți, declarând că era AGI a sosit
OpenAI a început să lanseze GPT-6 Astra pentru a selecta clienții de securitate cibernetică, Greg Brockman declarând era AGI. Iată cine are acces și ce urmează.
IFM din Abu Dhabi lansează K2 Horizon: șase modele deschise cu date și coduri complete de antrenament
IFM a lansat K2 Horizon: șase modele deschise (de la 0.9B la 375B-A23B) cu date complete de antrenament, puncte de control, jurnale și cod sub Apache 2.0. Ce include.
Meta lansează Muse Spark 1.3 cu actualizări Agentic pentru Codul Muse și API-ul Meta Model
Muse Spark 1.3 de la Meta se lansează în Muse Code și Meta Model API cu actualizări de flux de lucru agentic, multitasking mai bun și raționament maxim pentru testarea siguranței.
Google lansează Gemini 3.8 Flash și Flash Cyber, al treilea model de lansare în șase săptămâni
Google livrează Gemini 3.8 Flash și o variantă Flash Cyber axată pe securitatea cibernetică, pretinzând performanțe de codare aproape Opus la o fracțiune din preț.
Multiverse Computing lansează Quasar 438B, cel mai înalt model AI din Europa
Multiverse Computing a lansat Quasar 438B, un model de raționament de clasă 400B cu nota de 43 la Artificial Analysis Intelligence Index, rezultatul de top al oricărui model european.
Google pregătește lansarea Gemini 3.8 Flash chiar miercuri pentru a reduce decalajul de codare AI
Google DeepMind intenționează să lanseze Gemini 3.8 Flash imediat miercuri, relatează WSJ, testele interne arătând progrese în codificare, acolo unde Gemini a urmat rivalii.
OpenAI confirmă că Astra este primul său model „critic” de securitate cibernetică, stabilește o lansare restricționată
OpenAI a confirmat că viitorul său model Astra a depășit pragul „critic” de securitate cibernetică și va fi livrat în curând cu acces restricționat la cele mai puternice instrumente cibernetice ale sale.
Anthropic lansează Claude Fable 5.1 și Mythos 5.1: cu 25% mai ieftin, mai puternic la codarea agentică
Claude Fable 5.1 de la Anthropic reduce costurile tipice cu 25% și înregistrează câștiguri mari pe benchmark-urile de codare agentică, în timp ce Mythos 5.1 ajunge pentru utilizatorii cu acces de încredere.
Cohere lansează Parse 5, o inteligență artificială de analiză a documentelor cu parametri 2.3B, creat pentru asimilarea costurilor mai întâi
Parse 5 de la Cohere transformă PDF-urile, diapozitivele și scanările în Markdown structurat cu un model cu parametri 2.3B. Captura: avansul său de referință se bazează pe un scor parțial.
Z.ai deschide greutățile GLM-5.3 pe fața îmbrățișată cu o licență destinată hiperscalerelor
Z.ai a lansat ponderi GLM-5.3 pe Hugging Face cu un context de 1M token și o licență personalizată care necesită recenzii de securitate pentru furnizorii MaaS de peste 10 miliarde USD.
Previzualizare Tencent Open-Sources Hy4: MoE cu parametri 770B cu context de 1M-Token
Echipa Hunyuan de la Tencent a lansat previzualizarea Hy4 sub Apache 2.0 — un model MoE cu parametrii 770B cu 49B parametri activi, context de 1M token și suport vLLM din prima zi.
Google Ships Gemini 3.5 Transcribe și Omni 1.1 Flash: două upgrade-uri pentru dezvoltatorii AI
Noul Google Gemini 3.5 Transcribe atinge o rată de eroare a cuvintelor de 2,6%, în timp ce Omni 1.1 Flash adaugă scene video de 40 de secunde, upscaling 4K și control la nivel de cadru.
Gemini Omni 1.1 Flash de la Google adaugă controale de nivel studio și ieșire 4K la videoclipurile AI
Google a lansat Gemini Omni 1.1 Flash cu extensie de scenă de până la 40 de secunde, tranziții de început și de sfârșit de cadru și upscaling 4K prin API-ul Gemini.
Google lansează Gemini 3.5 Transcribe: recunoaștere a vorbirii în timp real în 85 de limbi
Google a lansat Gemini 3.5 Transcribe cu detectarea în 85 de limbi, o rată de eroare de streaming de 4% și răspunsuri cu 70% mai rapide decât Chirp 3, care se lansează în aplicațiile sale.
Previzualizările Qwen3.8-Flash-Next de la Alibaba Arhitectura Qwen4 cu 6B parametri activi
Qwen3.8-Flash-Next de la Alibaba previzualizează Qwen4: 125B parametri cu 6B activi, greutăți deschise și rezultate Qwen3.7-Plus-bate la o nouă parte din costul antrenamentului.
Z.ai lansează GLM-5.3-Flash sub licență MIT: Ox Alpha a fost dezvăluit, Weights Live
GLM-5.3-Flash de la Z.ai este un model multimodal 320B-A18B licențiat de MIT, servit pe cipuri AI chinezești, care acum se află în fruntea clasamentului Analizei artificiale la costuri reduse.
Z.ai confirmă că Ox Alpha este un model din seria GLM și își va lansa greutățile
Z.ai a declarat pentru Bloomberg că modelul viral de stealth Ox Alpha este o nouă lansare a seriei GLM, iar greutățile deschise sosesc în această seară, punând capăt unei săptămâni de ghicituri febrile.
Creatorul lui Ox Alpha ar putea fi fost demascat: analiza arată că GLM-ul lui Zhipu
Un truc de injectare promptă și o analiză de compresie gzip sugerează că modelul misterios al OpenRouter Ox Alpha este GLM al lui Zhipu - dar scepticii resping înapoi.
DeepSeek adaugă viziune la V4-Flash cu un model experimental capabil de imagine
DeepSeek livrează deepseek-v4-flash-vision-exp cu intrare de imagine, context token de 1M și prețuri la nivel de Flash, reparând cel mai cunoscut punct mort al modelului său.
OpenAI reduce prețurile GPT-5.6 Sol API cu mai mult de 20%, pe măsură ce războiul prețurilor atinge vârful său emblematic
OpenAI a redus prețurile pentru dezvoltatori GPT-5.6 Sol cu peste 20%, scăzând tokenurile de producție la 20 USD per milion. Mișcarea încheie luni de păstrare a prețului emblematic.
Ox Alpha: Modelul gratuit Stealth AI al OpenRouter cu un context de 1 milion de token declanșează un Whodunit
Un model de frontieră stealth gratuit numit Ox Alpha a apărut pe OpenRouter cu un context de 1 milion de token și o intrare video, iar comunitatea AI se grăbește pentru a-și demasca producătorul.
Modelele Google Gemma Open depășesc 1 miliard de descărcări ca variante ale comunității Top 100.000
Google spune că modelele sale deschise Gemma au depășit 1 miliard de descărcări, cu peste 100.000 de variante comunitare, implementări orbitale cu NASA și un nou hub Awesome Gemma.
Ornith-1.5 se potrivește cu Claude Opus 4.8 pe benchmark-uri de codare Agentic cu modele complet deschise, cu auto-îmbunătățire
Familia Ornith-1.5, licențiată de MIT, își generează propriile sarcini de antrenament și schele – iar nava emblematică 397B leagă Claude Opus 4.8 la codificarea Terminal-Bench 2.1.
Qwen 3.8 27B de la Alibaba rulează pe un laptop și depășește propriile modele mai mari
Qwen 3.8 27B de la Alibaba este un model de viziune Apache-2.0 care rulează pe laptopuri și îl depășește pe Qwen 3.7-Plus închis – dar setarea sa implicită de raționament supragândește totul.
Modelele Alibaba Qwen AI Top 3 miliarde de descărcări, depășind Meta și Google
Modelele Qwen de la Alibaba au trecut de 3 miliarde de descărcări pentru a depăși Meta și Google în adoptarea open-source AI, la câteva săptămâni după lansarea Qwen 3.8 open-weights.
GLM-5.3 de la Z.ai se dublează în codificare și apare cu abilități uimitoare de securitate cibernetică
Noul GLM-5.3 de la Z.ai aduce câștiguri semnificative în codificare și descoperiri de vulnerabilități de ultimă generație, reducând diferența dintre Anthropic și OpenAI de la frontiera cu greutate deschisă.
Google livrează Gemini 3.7 Flash: cel mai inteligent cal de bătaie de până acum pentru codare și agenți la jumătate din preț
Google Gemini 3.7 Flash aterizează la doar trei săptămâni după 3.6 Flash cu câștiguri majore de codare și agenți, plus prețuri de lansare la jumătate din prețul predecesorului său.
DeepSeek lansează V4 Pro pentru disponibilitatea generală, agent de exploatare cu surse deschise și crește prețurile API
Laboratorul chinezesc de inteligență artificială DeepSeek lansează V4 Pro din previzualizare, livrează Harness v0.1 ca rival open-source pentru Claude Code și crește brusc prețurile API înainte de IPO.
xAI lansează Grok 4.6, care se potrivește cu GPT-5.6 Sol pe Frontier Intelligence Index
Grok 4.6 de la xAI obține 61 la indicele de inteligență de analiză artificială, legând GPT-5.6 Sol cu o performanță agentică remarcabilă la un cost cu 60% mai mic. Disponibil acum în Cursor și Grok Build.
SL2T de la Google DeepMind aduce traducerea în limbajul semnelor pe telefoanele Pixel 11
Google DeepMind a dezvăluit SL2T, un model de traducere în limbajul semnelor care transformă limbajul semnelor în text din gama Pixel 11, începând cu Pixel 11 Pro Fold.
Nvidia construiește Nemotron 4 cu 1 trilion de parametri pentru a provoca cele mai bune modele de IA open-source
Nvidia dezvoltă Nemotron 4, un model open-source AI cu cel puțin un trilion de parametri, pentru a rivaliza cu sistemele de top open-weight. Modelul ar putea ajunge în această toamnă.
NVIDIA lansează Nemotron 3.5 Lightning și NeMo Switchyard pentru AI Agentic mai inteligent
Noul model deschis de 30 de miliarde de parametri NVIDIA și biblioteca de rutare cu sursă deschisă promit o ieșire de până la 4 ori mai rapidă și sarcini de agent cu 30% mai rapide pe dispozitive de vârf, PC-uri și cloud.
Mark Zuckerberg declară război rivalilor închisi AI în Manifestul Superintelligence, în timp ce Meta folosește sursele deschise cel mai puternic model al său
Mark Zuckerberg de la Meta a publicat un manifest cuprinzător în care cere AI superinteligentă pentru toți, atacând rivalii închiși de AI și lansând o versiune deschisă a celui mai puternic model Meta.
Meta lansează Muse Glimmer, un model deschis de 30B care rulează agenți AI pe GPU-uri pentru consumatori
Meta a publicat Muse Glimmer, un model deschis cu 30 de miliarde de parametri sub Apache 2.0, care depășește Gemma4-31B și Qwen3.6-27B la benchmark-uri agentice în timp ce rulează local.
OpenAI întrerupe modelul Astra după evaluări semnalează capacitățile de securitate cibernetică „critice”.
OpenAI a întrerupt dezvoltarea viitorului său model Astra după ce testele au arătat că ar putea atinge pragul de securitate cibernetică „Critic” – primul model care declanșează cel mai mare nivel de risc.
Se pare că ByteDance antrenează un model AI cu 10 trilioane de parametri la miturile lui Rival Anthropic
Financial Times raportează că ByteDance construiește un model masiv de 10 trilioane de parametri, conceput pentru a se potrivi cu scara lui Anthropic's Mythos, intensificând cursa AI SUA-China.
OpenAI întrerupe lucrările la noul model Astra din cauza unor preocupări critice de securitate cibernetică
OpenAI a încetinit dezvoltarea viitorului său model Astra după ce testele interne au dezvăluit capacități cibernetice la nivel critic, înăsprind controalele înainte de lansare.
Imagine Image 2.0 de la xAI aterizează chiar în spatele GPT-Image-2 de la OpenAI în Benchmark-urile Arena
xAI a lansat Imagine Image 2.0 pentru Grok, ocupându-se pe locul al doilea la nivel global în benchmark-urile Arena, după GPT-Image-2 de la OpenAI, cu noi instrumente de editare, suport pentru mai multe referințe și șabloane preconfigurate.
OpenAI întrerupe dezvoltarea modelului Astra după ce atinge pragul de risc „critic” pentru securitatea cibernetică
OpenAI a oprit anumite părți ale dezvoltării Astra după ce testele interne au descoperit că ar putea atinge cel mai înalt nivel de risc de securitate cibernetică din cadrul său de pregătire – primul dintre modelele sale care face acest lucru.
ByteDance pregătește un model AI cu 10 trilioane de parametri pentru miturile lui Rival Anthropic
ByteDance antrenează un mega model AI cu până la 10 trilioane de parametri, aproape de dimensiunea estimată a lui Anthropic's Mythos 5 și depășind actualii lideri ai Chinei.
Mistral's Shieldstral: Un model de siguranță 3B cu greutăți deschise care citește politicile în loc să le memoreze
Mistral AI a lansat Shieldstral, un clasificator de siguranță cu ponderi deschise cu parametri 3B care evaluează textul și imaginile în raport cu politicile de moderare în limbaj simplu la momentul deducerii.
Alibaba lansează Qwen3.8-Max: un model de 2,4 trilioane de parametri care îl rivalizează cu Claude de la Anthropic
Alibaba a lansat Qwen3.8-Max, un model de 2,4 trilioane de parametri care îl urmărește doar pe Claude de la Anthropic în punctele de referință, cu greutăți deschise promise în câteva zile.
Modelul Astra de la OpenAI rezolvă 10 probleme de matematică nerezolvate de mult cu dovezi verificate automat
Modelul Astra nelansat al OpenAI a rezolvat 10 probleme deschise în matematică și informatică cu dovezi verificate prin Lean, tachinând următorul său model major înainte de revizuirea guvernului SUA.
Gemini 3.5 Pro apare în testele oarbe LM Arena pe măsură ce Google se apropie de lansarea
Gemini 3.5 Pro amânat de la Google a fost observat în mod repetat în testele oarbe ale LMSYS Chatbot Arena, ceea ce semnalează că o lansare publică ar putea fi în sfârșit iminentă.
Thinking Machines lansează modelul Inkling-Small: 276B cu greutate deschisă la un sfert din dimensiunea navei sale emblematice
Thinking Machines Lab a lansat Inkling-Small, un model deschis de 276 de miliarde de parametri cu 12B activ, care se potrivește cu un sfert din dimensiunea navei sale de vârf - un participant american în cursa de greutate deschisă.
DeepSeek lansează versiunea beta publică V4-Flash pe măsură ce războiul prețurilor AI din China crește
DeepSeek a lansat API-ul oficial V4-Flash beta, cu un model reantrenat care își bate propriul său flagship V4 Pro la nouă puncte de referință pentru agenți, subcotând în același timp rivalii din SUA în ceea ce privește prețul.
OpenAI reduce prețurile modelului GPT-5.6 cu până la 80%, deoarece întreprinderile devin sensibile la costurile AI
OpenAI a redus prețurile la două modele GPT-5.6, inclusiv Luna, reducând costurile modelelor mai mici cu până la 80%, pe măsură ce companiile analizează cheltuielile cu AI.
Noul model V4-Flash de la DeepSeek se potrivește cu GPT-5.6 Luna la un cost cu 60% mai mic
DeepSeek a lansat V4-Flash „0731”, un model deschis care aproape leagă GPT-5.6 Luna de la OpenAI pe benchmark-uri, în timp ce costă cu aproximativ 60% mai puțin.
MiniMax din China lansează modelul video H3 AI cu clipuri 2K, sunet stereo și greutăți deschise
Startup-ul chinezesc AI MiniMax și-a lansat modelul de generare video H3 pe 31 iulie 2026, oferind rezoluție 2K, audio stereo și greutăți deschise la o fracțiune din prețurile concurenților, provocând direct Seedance 2.5 de la ByteDance.
Google DeepMind dezvăluie Gemini Robotics 2 cu control umanoid al întregului corp și colaborare cu mai mulți robot
Google DeepMind a lansat Gemini Robotics 2, un model viziune-limbaj-acțiune care le permite roboților umanoizi să miște, să înțeleagă și să coordoneze sarcini pe întregul corp.
OpenAI reduce prețurile API-ului GPT-5.6 cu până la 80%, deoarece companiile regândesc costurile AI
OpenAI a redus prețurile GPT-5.6 Luna și Terra API cu până la 80% la 30 iulie 2026, subcotând Anthropic pe măsură ce întreprinderile analizează cheltuielile prin inferență.
OpenAI spune că GPT-5.6 Sol îl învinge pe Claude Opus 5 pe ARC-AGI-3 – dar numai cu propriile setări
OpenAI raportează că GPT-5.6 Sol a obținut un scor de 38,3% la ARC-AGI-3 folosind raționamentul și compactarea reținute, depășind Claude Opus 5. Dar hamul oficial spune o poveste diferită, stârnind o dezbatere asupra corectitudinii benchmark-ului.
Black Forest Labs dezvăluie FLUX 3: un singur model AI pentru imagini, video, audio și robotică
Black Forest Labs a lansat FLUX 3, un model multimodal care generează împreună imagini, videoclipuri cu sunet nativ și predicții de acțiune a roboților – preferat față de Runway Gen-4.5 în 77% din comparații.
