A Associação de Matemática Humana (AHM) pediu aos matemáticos que deixem de trabalhar com a OpenAI depois que a empresa lançou uma grande coleção de matemática gerada por IA em 6 de outubro. Em sua declaração de 7 de outubro, a principal objeção do grupo é o uso de um modelo privado para abordar problemas abertos avançados e a divulgação simultânea de centenas de artigos resultantes. A associação contesta a afirmação da OpenAI de que esse modelo de publicação promove a matemática, embora os arquivos públicos permitam examinar alegações individuais.

Essa é a posição do Grupo de Trabalho de Comunicação da AHM. Não é uma votação da comunidade matemática nem uma conclusão de que todo manuscrito esteja errado. Terence Tao republicou o texto como uma declaração convidada da AHM, identificando sua autoria em vez de adotá-lo como declaração própria.

A grande mudança

  • O que mudou: A discussão sobre o repositório da OpenAI agora vai além da validade de resultados individuais. A AHM questiona o papel da empresa na escolha dos problemas de pesquisa e na definição das condições em que matemáticos recebem os resultados.
  • Por que isso importa: A disputa envolve quem pode examinar a ferramenta geradora e quem assume o trabalho de verificar e explicar uma divulgação em massa. Essas questões persistem mesmo quando uma prova específica é corrigida ou formalizada.
  • O que acompanhar: A OpenAI afirma que acrescentará formalizações. Uma avaliação independente das alegações revisadas e eventuais correções versionadas ajudarão a esclarecer quais resultados específicos os matemáticos podem verificar e compreender.

O que a AHM contesta

A AHM afirma que os matemáticos não solicitaram esse trabalho. Ela chama a divulgação de mais de 700 arquivos de demonstração de poder, e não de produção acadêmica, e pede que os leitores questionem seu valor para a área. A declaração também cita o Grupo Consultivo independente sobre Matemática e Inteligência Artificial (AGMAI), dizendo que a OpenAI ignorou o pedido inicial do grupo para interromper os testes de matemática avançada em modelos internos.

Essa referência tem uma base clara. As diretrizes da AGMAI de 29 de setembro recomendam que laboratórios de ponta parem de testar problemas avançados em modelos proprietários. O mesmo documento apresenta recomendações condicionais para divulgar resultados caso os laboratórios já os tenham produzido: texto matemático claro, repositórios apropriados, divulgação de como o trabalho foi gerado, formalização quando possível e apoio à compreensão humana. O documento diz que as recomendações se basearam em mais de 600 respostas a uma pesquisa e tiveram o apoio de uma pluralidade dos respondentes. Esses fatos não transformam o pedido posterior da AHM para interromper o trabalho com a OpenAI em uma diretriz da AGMAI ou em uma decisão de toda a área.

Em sua resposta de 6 de outubro ao lançamento, a AGMAI declarou explicitamente que seu papel consultivo não endossava o processo da OpenAI nem avaliava o impacto dos resultados. Descreveu a publicação como o início da avaliação humana e afirmou que somente a comunidade matemática pode determinar até que ponto suas recomendações foram seguidas. A OpenAI já havia descrito o grupo como independente e dito que ele aconselharia sobre revisão e comunicação, sem controlar o ritmo da pesquisa interna da empresa. A diferença entre aconselhamento e autoridade importa: a crítica da AHM questiona as escolhas da OpenAI, mas não prova que um conselho externo as tenha aprovado ou vetado.

Um registro em mudança ainda precisa ser verificado

O repositório da OpenAI diz que os trabalhos da coleção estão em diferentes etapas de verificação. O catálogo atual lista 719 manuscritos em 372 famílias. Uma família pode incluir vários artigos. O repositório afirma que alguns manuscritos não têm formalizações em Lean e que certos resultados não formalizados podem apresentar problemas; informa também que cerca de 42% dos resultados principais estão formalizados. Uma formalização é um argumento especificado e verificável por máquina para uma afirmação específica, não uma confirmação abrangente de todas as alegações em um artigo relacionado; o status de um repositório não substitui a revisão matemática independente. Nosso anterior guia dos arquivos e das configurações das provas explica como acompanhar esse escopo.

A contagem mudou após a retirada de três manuscritos. O registro histórico de 7 de outubro da OpenAI atribui as retiradas a um erro de sinal em uma prova que também afetou dois artigos dependentes. O registro documenta revisões de outros 14 manuscritos, atualizações de referências em mais 13 e seis novas formalizações. Nossa reportagem sobre os três avisos de retirada explica a conclusão mais restrita: os argumentos identificados já não estabelecem as alegações daqueles artigos; os avisos não refutam as afirmações matemáticas. Uma prova retirada, um manuscrito corrigido e um resultado formalizado são estados distintos.

As revisões ilustram o trabalho de análise que uma coleção grande e formalizada de modo desigual pode exigir. Essa é nossa análise do registro do repositório, não uma afirmação da declaração da AHM. A AHM se opõe à decisão de gerar e publicar a coleção por meio de um modelo proprietário. Enquanto isso, a OpenAI forneceu materiais versionados que pesquisadores podem examinar, corrigir e debater. Nossa análise anterior sobre capacidade de revisão abordou o trabalho necessário para transformar um grande conjunto de resultados propostos em matemática compreendida. A disputa atual acrescenta uma pergunta mais incisiva: produzir esse volume de trabalho dessa maneira serve às pessoas que devem avaliá-lo?

Fontes e leituras complementares