Modelos de IA
55 articles
GPT-6 Astra é lançado para usuários pagantes do ChatGPT enquanto Altman se desculpa pelo lançamento confuso
O GPT-6 Astra da OpenAI está alcançando a maioria dos usuários pagantes após um lançamento caótico. Sam Altman pediu desculpas e prometeu redefinições de uso para assinantes bloqueados.
Google lança Gemini 3.8 Flash e uma variante cibernética desenvolvida para defesa automatizada contra vulnerabilidades
O Gemini 3.8 Flash do Google oferece codificação e raciocínio de nível de fronteira a US$ 0,75 por milhão de tokens de entrada, com uma variante Flash Cyber para defensores de segurança.
OpenAI começa a lançar o GPT-6 Astra para clientes selecionados, declarando que a era AGI chegou
A OpenAI começou a lançar o GPT-6 Astra para clientes selecionados de segurança cibernética, com Greg Brockman declarando a era AGI. Veja quem tem acesso e o que vem a seguir.
IFM de Abu Dhabi lança K2 Horizon: seis modelos abertos com dados e código completos de treinamento
A IFM lançou o K2 Horizon: seis modelos abertos (0,9B a 375B-A23B) com dados completos de treinamento, pontos de verificação, logs e código no Apache 2.0. O que inclui.
Meta lança Muse Spark 1.3 com atualizações Agentic para Muse Code e Meta Model API
O Muse Spark 1.3 da Meta é implementado no Muse Code e Meta Model API com atualizações de fluxo de trabalho de agente, melhor multitarefa e raciocínio máximo mantido para testes de segurança.
Google lança Gemini 3.8 Flash e Flash Cyber, seu terceiro modelo lançado em seis semanas
O Google envia o Gemini 3.8 Flash e uma variante Flash Cyber com foco na segurança cibernética, reivindicando desempenho de codificação próximo ao Opus por uma fração do preço.
Multiverse Computing lança Quasar 438B, o modelo de IA de maior classificação da Europa
A Multiverse Computing lançou o Quasar 438B, um modelo de raciocínio da classe 400B com pontuação 43 no Índice de Inteligência de Análise Artificial, o melhor resultado de qualquer modelo europeu.
Google prepara lançamento do Gemini 3.8 Flash já na quarta-feira para preencher a lacuna de codificação de IA
O Google DeepMind planeja lançar o Gemini 3.8 Flash já na quarta-feira, relata o WSJ, com testes internos mostrando progresso na codificação onde o Gemini está atrás dos rivais.
OpenAI confirma que Astra é seu primeiro modelo “crítico” de segurança cibernética e define lançamento restrito
A OpenAI confirmou que seu próximo modelo Astra ultrapassou o limite “crítico” de segurança cibernética e será lançado em breve com acesso restrito às suas ferramentas cibernéticas mais poderosas.
Anthropic lança Claude Fable 5.1 e Mythos 5.1: 25% mais barato e mais forte na Agentic Coding
Claude Fable 5.1 da Anthropic reduz os custos típicos em 25% e obtém grandes ganhos em benchmarks de codificação de agentes, enquanto o Mythos 5.1 chega para usuários com acesso confiável.
Cohere lança Parse 5, uma IA de análise de documentos com parâmetros de 2,3B construída para ingestão com custo inicial
O Parse 5 da Cohere transforma PDFs, slides e digitalizações em Markdown estruturado com um modelo de parâmetros de 2,3B. O problema: a liderança do benchmark depende de uma pontuação parcial.
Z.ai abre pesos GLM-5.3 em Hugging Face com uma licença voltada para hiperescaladores
Z.ai lançou pesos GLM-5.3 no Hugging Face com um contexto de token de 1 milhão e uma licença personalizada que requer análises de segurança para provedores de MaaS com mais de US$ 10 bilhões.
Visualização Hy4 de código aberto da Tencent: MoE de parâmetro 770B com contexto de token de 1M
A equipe Hunyuan da Tencent lançou a prévia do Hy4 no Apache 2.0 – um modelo MoE de 770B de parâmetros com 49B de parâmetros ativos, contexto de token de 1M e suporte vLLM no primeiro dia.
Google lança Gemini 3.5 Transcribe e Omni 1.1 Flash: duas atualizações para desenvolvedores de IA
O novo Gemini 3.5 Transcribe do Google atinge uma taxa de erro de palavras de 2,6%, enquanto o Omni 1.1 Flash adiciona cenas de vídeo de 40 segundos, upscaling de 4K e controle de nível de quadro.
Flash Gemini Omni 1.1 do Google adiciona controles de nível de estúdio e saída 4K ao vídeo AI
O Google lançou o Gemini Omni 1.1 Flash com extensão de cena de até 40 segundos, transições de quadro inicial e final e upscaling de 4K por meio da API Gemini.
Google lança Gemini 3.5 Transcribe: reconhecimento de fala em tempo real em 85 idiomas
O Google lançou o Gemini 3.5 Transcribe com detecção de 85 idiomas, taxa de erro de streaming de 4% e respostas 70% mais rápidas que o Chirp 3, sendo implementado em seus aplicativos.
Qwen3.8-Flash-Next do Alibaba mostra a arquitetura Qwen4 com parâmetros ativos de 6B
O Qwen3.8-Flash-Next do Alibaba apresenta Qwen4: parâmetros 125B com 6B ativos, pesos abertos e resultados superiores ao Qwen3.7-Plus por um nono do custo de treinamento.
Z.ai lança GLM-5.3-Flash sob licença do MIT: Ox Alpha Revealed, Weights Live
O GLM-5.3-Flash da Z.ai é um modelo multimodal 320B-A18B licenciado pelo MIT servido em chips de IA chineses que agora lidera as classificações de Análise Artificial com baixo custo.
Z.ai confirma que Ox Alpha é um modelo da série GLM e lançará seus pesos
Z.ai disse à Bloomberg que o modelo viral furtivo Ox Alpha é um novo lançamento da série GLM, e os pesos abertos chegam esta noite, encerrando uma semana de suposições febris.
O criador do Ox Alpha pode ter sido desmascarado: análise aponta para o GLM de Zhipu
Um truque de injeção imediata e uma análise de compressão gzip sugerem que o modelo misterioso Ox Alpha do OpenRouter é o GLM de Zhipu - mas os céticos recuam.
DeepSeek adiciona visão ao V4-Flash com modelo experimental com capacidade de imagem
DeepSeek fornece deepseek-v4-flash-vision-exp com entrada de imagem, contexto de token de 1 milhão e preço em nível de Flash, corrigindo o ponto cego mais notório de seu modelo.
OpenAI reduz preços da API GPT-5.6 Sol em mais de 20% à medida que a guerra de preços atinge seu carro-chefe
A OpenAI reduziu os preços do desenvolvedor GPT-5.6 Sol em mais de 20%, reduzindo os tokens de saída para US$ 20 por milhão. A mudança encerra meses de manutenção do preço principal.
Ox Alpha: modelo de IA furtivo gratuito do OpenRouter com contexto de 1 milhão de tokens desencadeia um policial
Um modelo de fronteira furtiva gratuito chamado Ox Alpha apareceu no OpenRouter com um contexto de token de 1 milhão e entrada de vídeo, e a comunidade de IA está correndo para desmascarar seu criador.
Os modelos Gemma Open do Google ultrapassam 1 bilhão de downloads como variantes da comunidade entre as 100.000
O Google afirma que seus modelos abertos Gemma ultrapassaram 1 bilhão de downloads, com mais de 100.000 variantes comunitárias, implantações orbitais com a NASA e um novo hub Awesome Gemma.
Ornith-1.5 corresponde a Claude Opus 4.8 em benchmarks de codificação Agentic com modelos totalmente abertos e de autoaperfeiçoamento
A família Ornith-1.5 licenciada pelo MIT gera suas próprias tarefas de treinamento e andaimes – e seu carro-chefe 397B vincula Claude Opus 4.8 na codificação Terminal-Bench 2.1.
Qwen 3.8 27B do Alibaba roda em um laptop e supera seus próprios modelos maiores
O Qwen 3.8 27B do Alibaba é um modelo de visão Apache-2.0 que roda em laptops e supera o Qwen 3.7-Plus fechado – mas sua configuração de raciocínio padrão pensa demais em tudo.
Modelos Qwen AI do Alibaba atingem 3 bilhões de downloads, ultrapassando Meta e Google
Os modelos Qwen do Alibaba ultrapassaram 3 bilhões de downloads para ultrapassar Meta e Google na adoção de IA de código aberto, semanas após o lançamento dos pesos abertos Qwen 3.8.
GLM-5.3 da Z.ai duplica a codificação e surge com habilidades surpreendentes de segurança cibernética
O novo GLM-5.3 da Z.ai apresenta ganhos de codificação nítidos e descoberta de vulnerabilidades de última geração, estreitando a lacuna entre Anthropic e OpenAI em relação à fronteira de peso aberto.
Google lança Gemini 3.7 Flash: seu carro-chefe mais inteligente para codificação e agentes pela metade do preço
O Gemini 3.7 Flash do Google chega apenas três semanas após o 3.6 Flash, com grandes ganhos de codificação e agente, além de preço introdutório pela metade do custo de seu antecessor.
DeepSeek lança V4 Pro para disponibilidade geral, agente de aproveitamento de código aberto e aumenta preços de API
O laboratório chinês de IA DeepSeek lança o V4 Pro fora da versão prévia, lança o Harness v0.1 como rival de código aberto do Claude Code e aumenta drasticamente os preços da API antes de seu IPO.
xAI lança Grok 4.6, correspondendo ao GPT-5.6 Sol no Frontier Intelligence Index
O Grok 4.6 da xAI obteve 61 pontos no Índice de Inteligência de Análise Artificial, empatando com o GPT-5.6 Sol com excelente desempenho de agente a um custo 60% menor. Disponível agora em Cursor e Grok Build.
SL2T do Google DeepMind traz tradução de linguagem de sinais para telefones Pixel 11
O Google DeepMind revelou o SL2T, um modelo de tradução de linguagem de sinais que transforma a linguagem de sinais em texto na linha Pixel 11, começando com o Pixel 11 Pro Fold.
Nvidia constrói Nemotron 4 de 1 trilhão de parâmetros para desafiar os principais modelos de IA de código aberto
A Nvidia está desenvolvendo o Nemotron 4, um modelo de IA de código aberto com pelo menos um trilhão de parâmetros, para rivalizar com os principais sistemas de peso aberto. O modelo pode chegar neste outono.
NVIDIA lança Nemotron 3.5 Lightning e NeMo Switchyard para IA Agentic mais inteligente
O novo modelo aberto de 30 bilhões de parâmetros e a biblioteca de roteamento de código aberto da NVIDIA prometem resultados até 4x mais rápidos e tarefas de agente 30% mais rápidas em dispositivos de borda, PCs e na nuvem.
Mark Zuckerberg declara guerra aos rivais fechados de IA no Manifesto de Superinteligência como Meta Open-Sources, seu modelo mais poderoso
Mark Zuckerberg, da Meta, publicou um manifesto abrangente pedindo IA superinteligente para todos, atacando rivais fechados de IA e lançando uma versão aberta do modelo mais poderoso da Meta.
Meta lança Muse Glimmer, um modelo de peso aberto 30B que executa agentes de IA em GPUs de consumo
Meta publicou Muse Glimmer, um modelo aberto de 30 bilhões de parâmetros no Apache 2.0 que supera Gemma4-31B e Qwen3.6-27B em benchmarks de agente enquanto é executado localmente.
OpenAI pausa modelo Astra após avaliações sinalizarem recursos de segurança cibernética “críticos”
A OpenAI pausou o desenvolvimento de seu próximo modelo Astra depois que testes mostraram que ele pode atingir o limite de segurança cibernética “Crítico” – o primeiro modelo a acionar o nível de risco mais alto.
ByteDance supostamente treinando um modelo de IA de 10 trilhões de parâmetros para rivalizar com os mitos da Anthropic
O Financial Times relata que a ByteDance está construindo um enorme modelo de 10 trilhões de parâmetros projetado para corresponder à escala do Mythos da Antrópico, intensificando a corrida de IA EUA-China.
OpenAI pausa trabalho no novo modelo Astra devido a preocupações críticas de segurança cibernética
A OpenAI desacelerou o desenvolvimento de seu próximo modelo Astra depois que testes internos revelaram capacidades cibernéticas de nível crítico, reforçando os controles antes do lançamento.
Imagine Image 2.0 da xAI fica logo atrás do GPT-Image-2 da OpenAI nos benchmarks da Arena
xAI lançou o Imagine Image 2.0 para Grok, ocupando o segundo lugar globalmente em benchmarks Arena, atrás do GPT-Image-2 da OpenAI, com novas ferramentas de edição, suporte multi-referência e modelos pré-configurados.
OpenAI pausa o desenvolvimento do modelo Astra depois que ele atinge o limite “crítico” de risco de segurança cibernética
A OpenAI interrompeu partes do desenvolvimento do Astra depois que testes internos descobriram que ele pode atingir o nível mais alto de risco de segurança cibernética em seu Quadro de Preparação – o primeiro de seus modelos a fazê-lo.
ByteDance está treinando um modelo de IA de 10 trilhões de parâmetros para rivalizar com os mitos da Anthropic
A ByteDance está treinando um mega modelo de IA com até 10 trilhões de parâmetros, aproximando-se do tamanho estimado do Mythos 5 da Antrópico e superando os atuais líderes da China.
Shieldstral de Mistral: um modelo de segurança de pesos abertos 3B que lê políticas em vez de memorizá-las
A Mistral AI lançou o Shieldstral, um classificador de segurança de pesos abertos com parâmetros 3B que avalia textos e imagens em relação a políticas de moderação em linguagem simples no momento da inferência.
Alibaba lança Qwen3.8-Max: um modelo de 2,4 trilhões de parâmetros que rivaliza com Claude da Anthropic
A Alibaba lançou o Qwen3.8-Max, um modelo de 2,4 trilhões de parâmetros que fica atrás apenas de Claude da Anthropic em benchmarks, com pesos em aberto prometidos dentro de dias.
O modelo Astra da OpenAI resolve 10 problemas matemáticos há muito não resolvidos com provas verificadas por máquina
O modelo Astra não lançado da OpenAI resolveu 10 problemas em aberto em matemática e ciência da computação com provas verificadas pelo Lean, provocando seu próximo grande modelo antes da revisão do governo dos EUA.
Gemini 3.5 Pro Surfaces em testes cegos da LM Arena conforme o Google se aproxima do lançamento
O atrasado Gemini 3.5 Pro do Google foi repetidamente detectado em testes cegos do LMSYS Chatbot Arena, sinalizando que um lançamento público pode finalmente ser iminente.
Thinking Machines lança Inkling-Small: modelo de peso aberto 276B com um quarto do tamanho de seu carro-chefe
O Thinking Machines Lab lançou o Inkling-Small, um modelo de peso aberto de 276 bilhões de parâmetros com 12B ativo que se equipara ao seu carro-chefe com um quarto do tamanho – um participante dos EUA na corrida de peso aberto.
DeepSeek lança versão beta pública V4-Flash à medida que a guerra de preços de IA na China aumenta
DeepSeek lançou a API beta V4-Flash oficial, com um modelo retreinado que supera seu próprio carro-chefe V4 Pro em nove benchmarks de agentes, ao mesmo tempo em que reduz o preço dos rivais dos EUA.
OpenAI reduz preços do modelo GPT-5.6 em até 80 por cento à medida que as empresas ficam mais sensíveis aos custos de IA
A OpenAI cortou os preços de dois modelos GPT-5.6, incluindo o Luna, reduzindo os custos dos modelos menores em até 80% à medida que as empresas examinam minuciosamente os gastos com IA.
O novo modelo V4-Flash da DeepSeek corresponde ao GPT-5.6 Luna com um custo 60% menor
A DeepSeek lançou o V4-Flash ‘0731’, um modelo de peso aberto que quase empata o GPT-5.6 Luna da OpenAI em benchmarks, ao mesmo tempo que custa cerca de 60% menos.
MiniMax da China lança modelo de vídeo H3 AI com clipes 2K, som estéreo e pesos abertos
A startup chinesa de IA MiniMax lançou seu modelo de geração de vídeo H3 em 31 de julho de 2026, oferecendo resolução 2K, áudio estéreo e pesos abertos por uma fração dos preços dos concorrentes – desafiando diretamente o Seedance 2.5 da ByteDance.
Google DeepMind revela Gemini Robotics 2 com controle humanóide de corpo inteiro e colaboração multi-robô
O Google DeepMind lançou o Gemini Robotics 2, um modelo de visão-linguagem-ação que permite que robôs humanóides movam, agarrem e coordenem tarefas em todo o seu corpo.
OpenAI reduz preços da API GPT-5.6 em até 80% enquanto as empresas repensam os custos de IA
A OpenAI reduziu os preços das APIs GPT-5.6 Luna e Terra em até 80% em 30 de julho de 2026, reduzindo os preços da Anthropic à medida que as empresas examinam os gastos com inferência.
OpenAI afirma que GPT-5.6 Sol vence Claude Opus 5 no ARC-AGI-3 – mas apenas com suas próprias configurações
OpenAI relata que GPT-5.6 Sol obteve pontuação de 38,3% no ARC-AGI-3 usando raciocínio retido e compactação, superando Claude Opus 5. Mas o equipamento oficial conta uma história diferente, provocando um debate sobre a justiça do benchmark.
Black Forest Labs revela FLUX 3: um modelo único de IA para imagens, vídeo, áudio e robótica
O Black Forest Labs lançou o FLUX 3, um modelo multimodal que gera em conjunto imagens, vídeo com áudio nativo e previsões de ação de robôs – preferido ao Runway Gen-4.5 em 77% das comparações.
