A OpenAI retirou três dos 722 pré-prints de pesquisa publicados no GitHub em 6 de outubro, informou o Retraction Watch em 8 de outubro, depois que um erro de sinal invalidou um argumento central e, com ele, dois resultados que dependiam dessa construção. A retirada ocorreu menos de 24 horas após o lançamento em massa, que a OpenAI classificou como um esforço “para ampliar a fronteira do conhecimento humano e permitir maiores progressos na matemática”.
As pré-impressões descreveram o suposto progresso de um modelo interno de IA em 372 problemas não resolvidos em geometria, ciência da computação, álgebra e outros campos. A medida atraiu o escrutínio imediato das comunidades de investigação — e, como cobrimos no início desta semana no nosso relatório sobre o divulgação inicial dos 722 manuscritos matemáticos, a empresa enquadrou a queda como uma demonstração sem precedentes do que o seu modelo de fronteira inédito pode produzir. Acompanhe as novidades desta história em nossa cobertura últimos desenvolvimentos de IA.
Um erro de sinal ocorre em cascata por meio de provas dependentes
Em 7 de outubro, a OpenAI anunciou a retirada de três manuscritos devido a um erro de sinal. Segundo o comunicado, o erro invalidou um argumento em um manuscrito e a construção utilizada por dois artigos dependentes. Cada artigo retirado traz agora um aviso explicando “a lacuna”.
A empresa também disse que revisou outros 14 manuscritos com reparos de provas, declarações corrigidas, hipóteses e dependências mais claras e uma correção para uma citação obsoleta. Dan Roberts, líder de pesquisa da OpenAI, anunciou as retiradas do X e escreveu que a empresa “continuará a atualizar o repo com novas formalizações e com quaisquer erratas que notarmos”.
Um porta-voz da OpenAI disse ao Retraction Watch que a empresa identificou os erros durante uma auditoria, descrevendo o processo como iterativo “como acontece com outros manuscritos de pesquisa”. O porta-voz acrescentou que a OpenAI agradece o escrutínio e “trabalhará para corrigir [erros] prontamente e retirará os documentos se nenhuma correção for encontrada”.
Notavelmente, um porta-voz da OpenAI disse que os colaboradores da empresa no Grupo Consultivo de Matemática e Inteligência Artificial (AGMAI) recomendaram a divulgação dos resultados sem esperar pela “formalização completa” – e que cerca de 50% dos resultados foram divulgados sem confirmação.
Matemáticos: soluções rápidas, confiança perdida
As reações dos matemáticos pesquisadores foram medidas, mas pontuais. Alex Townsend, professor associado de matemática na Universidade Cornell, disse ao Retraction Watch que um erro em cascata em três manuscritos não foi surpreendente e que ele suspeita que mais erros serão encontrados. “Dado o ceticismo da IA na comunidade matemática, acho que a OpenAI deveria ter anunciado primeiro os manuscritos que foram verificados pelo Lean”, disse ele, referindo-se à linguagem de programação de código aberto que verifica mecanicamente as provas matemáticas. Um anúncio separado poderia então ter convidado a ajuda da comunidade para verificar o resto, argumentou ele.
Andrew Sutherland, pesquisador sênior do departamento de matemática do MIT, disse que gostou da ação rápida da OpenAI após encontrar os erros, chamando-a de “a coisa responsável a fazer”. Mas ele enfatizou que muitos matemáticos continuam "insatisfeitos com a forma como a OpenAI se comportou até este ponto", apontando em particular para o anúncio da empresa em 8 de setembro de que um sistema de IA havia resolvido o problema de Navier-Stokes - uma afirmação que um grupo de pesquisadores líderes criticou como apressada, "não deixando tempo para uma redação adequada, o isolamento de novos métodos e ideias, e citando trabalhos anteriores relevantes de outros". Mais de 8.000 pesquisadores endossaram essas preocupações.
A Association for Human Mathematics foi mais longe numa declaração divulgada a 7 de Outubro: "Os matemáticos não pediram que este trabalho fosse feito. Publicar mais de 700 ficheiros de uma só vez não é uma demonstração de conhecimento, mas uma demonstração de poder. Instamos os matemáticos a interromper o seu trabalho com OpenAI e a regressar a uma visão da ciência que centra a compreensão humana."
O que isso significa para a ciência gerada pela IA
O episódio está se configurando como um primeiro caso de teste de como os laboratórios de IA devem lidar com pesquisas geradas por máquinas em grande escala. A abordagem da OpenAI – liberar rapidamente, auditar em público, retirar o que falha – contrasta com a abordagem de verificação formal que muitos matemáticos preferem, na qual os resultados são verificados em um assistente de prova como o Lean antes de qualquer anúncio.
Existem argumentos razoáveis de ambos os lados. Esperar pela formalização completa pode atrasar resultados úteis em meses, e a OpenAI afirma que foi lançado com a bênção da AGMAI. Mas o efeito cascata – um sinal de erro eliminando dois artigos dependentes – ilustra por que a verificação antes da publicação tem sido a norma em matemática e por que é provável que surjam mais erros à medida que a comunidade trabalha nos cerca de 700 manuscritos restantes.
Por enquanto, a OpenAI diz que quer aprender com o feedback e seguirá o protocolo da AGMAI “da melhor maneira possível” daqui para frente. Se isso é suficiente para reconstruir a credibilidade junto à comunidade matemática é outra questão. Como disse Sutherland: “Acho que as retiradas e correções serão vistas de forma positiva pela comunidade matemática, mas será necessário muito mais do que isso para reconquistar a confiança que perderam”.
---
Fique à frente da IAReceba as últimas notícias, análises e avanços sobre IA — tudo em um só lugar.
Leia mais notícias sobre IA →
