A ByteDance está treinando um modelo de inteligência artificial com até 10 trilhões de parâmetros, um sistema que poderia se aproximar da escala do modelo Mythos de ponta da Anthropic e aumentar dramaticamente os riscos na corrida global de IA. O Financial Times noticiou o plano em 7 de agosto de 2026, citando pessoas com conhecimento do assunto, com a Reuters e outros meios de comunicação posteriormente confirmando os detalhes.
A construção é o mais recente sinal de que as empresas de tecnologia chinesas se recusam a conceder a corrida do modelo de fronteira aos seus rivais americanos. Para notícias de última hora sobre IA contínuas e análise da posição de cada laboratório, a AI Buzz Wire está acompanhando essa história à medida que ela se desenvolve.
O que significa o número de 10 trilhões de parâmetros
Os parâmetros de um modelo são os pesos numéricos que ele aprende com os dados de treinamento para reconhecer padrões, gerar texto e realizar tarefas. Eles são amplamente usados como um proxy aproximado de escala, embora os pesquisadores alertem que a contagem de parâmetros por si só não determina a capacidade de um modelo. Métodos de treinamento, qualidade de dados e arquitetura são igualmente importantes.
Mesmo assim, uma meta de 10 biliões de parâmetros é significativa. Nesse tamanho, o modelo da ByteDance seria três vezes maior que o Kimi K3 da Moonshot AI, que conta 2,8 trilhões de parâmetros e atualmente representa um dos esforços chineses mais ambiciosos até o momento.
Antes do lançamento do Kimi K3, o LongCat-2.0 da Meituan e o V4-Pro da DeepSeek lideravam o campo doméstico da China com cerca de 1,6 trilhão de parâmetros cada, enquanto vários outros laboratórios chineses ultrapassaram o limite de um trilhão de parâmetros. O sistema planejado da ByteDance deixaria todos eles para trás por uma ampla margem.
Fechando a lacuna com os mitos antrópicos
As comparações diretas com os principais modelos americanos são difíceis porque empresas como a Anthropic e a OpenAI não divulgam publicamente as contagens de parâmetros para sistemas como Fable, Mythos ou GPT-5.5. No entanto, o Financial Times citou estimativas da indústria que colocam o Mythos 5 mais avançado da Anthropic em cerca de oito trilhões de parâmetros e o Fable 5 em cerca de cinco trilhões.
Isso colocaria o próximo modelo da ByteDance próximo do tamanho do Mythos, o sistema amplamente considerado como um dos modelos de fronteira mais poderosos disponíveis. Alcançar essa escala seria um marco para um laboratório chinês e intensificaria as questões sobre se a diferença de parâmetros entre os modelos de fronteira dos EUA e da China está finalmente a diminuir.
A ByteDance não respondeu imediatamente aos pedidos de comentários, observaram os relatórios.
O pré-treinamento já está em andamento
O modelo ByteDance está atualmente em pré-treinamento, de acordo com o Financial Times. O pré-treinamento é a fase que exige mais computação no desenvolvimento de um modelo grande, e o processo normalmente dura de três a seis meses antes que um sistema possa ser ajustado e lançado.
Esse cronograma sugere que ainda faltam meses para qualquer lançamento público, embora a decisão de iniciar o pré-treinamento nesta escala reflita um compromisso sério e com bons recursos. O pré-treinamento de um modelo de 10 trilhões de parâmetros requer enormes conjuntos de chips especializados e grandes quantidades de eletricidade, custos que apenas um punhado de empresas no mundo pode absorver.
A ByteDance, mais conhecida como empresa controladora da TikTok e da Douyin, já havia delineado a inteligência artificial como uma de suas quatro prioridades estratégicas para 2026. A empresa tem investido na IA generativa por meio de seu chatbot Doubao e modelo de vídeo Seedance, mas um modelo de linguagem em escala de fronteira representaria seu esforço mais ambicioso até agora para competir frente a frente com os laboratórios líderes.
Por que a corrida armamentista de parâmetros é importante
O impulso relatado ocorre num momento em que as empresas tecnológicas chinesas continuam a acelerar os seus ciclos de lançamento de modelos, lutando contra os rivais dos EUA para construir sistemas mais poderosos sem torná-los proibitivamente caros de operar. A estratégia produziu uma enxurrada de lançamentos ao longo de 2026, desde Kimi K3 da Moonshot até a linha Qwen3 do Alibaba e a série V4 da DeepSeek.
Ao mesmo tempo, o ambiente político mais amplo está a mudar. Pequim tem ponderado controlos de exportação mais rigorosos sobre os seus principais modelos e chips de IA, uma medida que poderá restringir o acesso estrangeiro precisamente ao tipo de sistemas fronteiriços que a ByteDance está agora a construir. Um modelo de 10 biliões de parâmetros desenvolvido sob essas restrições seria um sistema poderoso e largamente servido a nível nacional.
Para os próprios laboratórios, o cálculo é cada vez mais uma questão de economia. Modelos maiores são mais capazes, mas muito mais caros para treinar e operar, e a indústria está dividida sobre se a escala bruta ou uma arquitetura mais inteligente e o pós-treinamento determinarão o próximo vencedor.
O panorama geral
O plano da ByteDance sublinha uma tendência mais ampla: a lacuna entre os maiores modelos de fronteira americanos e chineses, antes considerada intransponível, parece estar a diminuir. Se as estimativas da indústria sobre o tamanho da Mythos forem precisas, um modelo ByteDance no mesmo estádio representaria um fechamento significativo dessa distância.
Também aumenta a pressão sobre OpenAI, Anthropic e Google para manterem a liderança. Com as empresas chinesas a visarem agora mais de biliões de sistemas de parâmetros e os laboratórios ocidentais a perseguirem arquitecturas cada vez maiores, a corrida pelos parâmetros mostra poucos sinais de abrandamento - mesmo quando os investigadores debatem até que ponto os números brutos realmente importam.
Fique à frente da corrida da IA
O cenário do modelo de fronteira está se movendo mais rápido do que nunca. Marque nossa página inicial para os mais recentes desenvolvimentos de IA e cobertura detalhada de cada lançamento importante.
Leia mais notícias sobre IA →