A startup de otimização de inteligência artificial Refiant Inc. lançou o Protea, um conjunto de modelos de IA de longo contexto liderados por uma janela de contexto de 10 milhões de tokens que, segundo a empresa, está entre os maiores já disponibilizados publicamente. Os modelos foram ao ar em 8 de julho de 2026, em refiant.ai, sem lista de espera e sem processo de aprovação.
As janelas de contexto determinam quanta informação um modelo pode conter na memória de trabalho de uma só vez. A maioria dos principais modelos de IA hoje não lida com mais do que algumas centenas de milhares de tokens antes que o desempenho diminua, forçando os desenvolvedores a soluções alternativas que quebram grandes conjuntos de dados em fragmentos. Refiant diz que Protea aumenta esse teto significativamente. Para cobertura contínua dos lançamentos de modelos de IA e tendências do setor, os leitores podem encontrar as últimas notícias sobre IA em nossa página inicial.
O que 10 milhões de tokens significam na prática
Uma janela de contexto de 10 milhões de tokens equivale a aproximadamente 7,5 milhões de palavras, ou cerca de 15.000 páginas de texto. Refiant enquadra as implicações práticas em termos rígidos: uma base de código empresarial inteira pode ser carregada de uma só vez, assim como um arquivo regulatório completo ou anos de dados de ensaios clínicos que antes precisavam ser fragmentados e inseridos em um modelo, peça por peça.
A empresa coloca isso de forma ainda mais concreta. Dez milhões de tokens podem armazenar até cinco anos de e-mails e mensagens do Slack de uma pessoa, ou décadas de seus relatórios e arquivos. Uma equipe de engenharia poderia carregar uma base de código completa e executar análises em um dia. Uma seguradora poderia analisar anos de sinistros sem primeiro dividir os dados em pedaços.
O Protea está disponível em três versões abrangendo 1 milhão, 5 milhões e 10 milhões de tokens, dando aos desenvolvedores flexibilidade para adequar o tamanho do contexto à sua carga de trabalho e orçamento.
Enfrentando o problema do perdido no meio
Um dos desafios mais persistentes com grandes janelas de contexto é o chamado problema perdido no meio, uma fraqueza documentada em que os modelos permanecem precisos no início e no final de uma entrada, mas perdem o controle do material enterrado entre esses pontos finais. Refiant diz que o Protea aborda especificamente esse problema, embora a empresa ainda não tenha publicado resultados de benchmark detalhados que demonstrem a melhoria.
O problema da perda no meio tem sido um obstáculo significativo à adoção prática de modelos de longo contexto. Mesmo quando um modelo aceita tecnicamente milhões de tokens, sua confiabilidade nas informações no meio desse contexto tem sido frequentemente questionável, limitando a utilidade no mundo real para tarefas como análise de base de código completa.
Fundado na Otimização de Swarm e na Pesquisa Evolutiva
A Refiant foi fundada em 2025 por Viroshan Naicker, Siddharth Gutta e Mathew Haswell. Naicker é um matemático quântico, enquanto seus cofundadores têm experiência em finanças e escalonamento comercial. A equipe argumenta que os modelos modernos de IA são profundamente ineficientes e que já existem métodos melhores na natureza.
A abordagem de Refiant toma emprestado da pesquisa evolutiva e do comportamento de enxame, os mesmos princípios de inteligência coletiva observados em bandos de pássaros, cardumes de peixes e colônias de formigas. A empresa aplicou essa abordagem pela primeira vez à compactação de modelos, reduzindo com sucesso o GPT-OSS-120B da OpenAI para rodar em um MacBook Pro com apenas 12 gigabytes de RAM. Esses resultados de compressão ajudaram a garantir parcerias de pesquisa com o Imperial College London e o Sargent Centre for Process Systems Engineering da University College London.
Financiamento e planos futuros
O lançamento do Protea segue uma rodada inicial de US$ 5 milhões que a Refiant fechou no início de 2026, liderada pela VoLo Earth Ventures. A empresa fundada na África do Sul está agora sediada comercialmente no Reino Unido.
O presidente-executivo, Viroshan Naicker, observou que a IA de longo contexto tem sido comentada há mais de um ano, mas ainda não está disponível comercialmente. O cofundador e diretor de produtos Mathew Haswell acrescentou que os clientes desejam modelos que possam testar e construir, em vez de mais listas de espera, uma crítica direta à abordagem de acesso fechado adotada por muitos laboratórios maiores de IA.
A Refiant disse que já executou um protótipo interno com 100 milhões de tokens, mas como avaliar isso e transformá-lo em um produto permanece uma questão em aberto. O lançamento do Protea é a primeira de três etapas planejadas, com a empresa prometendo mais dentro de três meses.
A corrida de IA de longo contexto esquenta
A Refiant entra em um mercado de IA de longo contexto cada vez mais competitivo. Embora os principais laboratórios tenham expandido gradualmente as janelas de contexto, a maioria dos modelos disponíveis comercialmente ainda opera bem abaixo do limite de 10 milhões de tokens. A decisão da Refiant de lançar sem lista de espera e com acesso imediato representa um contraste com a abordagem de implementação faseada comum entre concorrentes maiores.
A metodologia de otimização de enxame da empresa também a distingue dos rivais que dependem principalmente do dimensionamento convencional de transformadores. Ainda não se sabe se os algoritmos inspirados na natureza podem oferecer vantagens de desempenho sustentadas em escala de produção, mas o histórico de compressão da Refiant e as parcerias universitárias conferem credibilidade à abordagem.
Fique à frente da IA
Os modelos Protea já estão disponíveis em refiant.ai. Para obter mais cobertura e análise do setor de IA, visite AI Buzz Wire.
Leia mais notícias sobre IA →



