Ontem, a OpenAI lançou 722 manuscritos de matemática de IA de uma só vez, e agora mesmo retirou 3 deles.
O motivo é simples: um sinal de mais ou menos foi escrito incorretamente.
Agora mesmo, a OpenAI publicou seu primeiro registro de atualizações no repositório openai/math. O registro mostra que a OpenAI retirou 3 manuscritos, revisou 14 e atualizou citações de outros 13. O número total de manuscritos no repositório caiu de 722 para 719.
Um sinal de mais ou menos derruba três artigos
Os três artigos retirados estão todos relacionados à conjectura de Hodge, um dos Problemas do Milênio:
Algebraicidade das classes de Weil em variedades abelianas de dimensão oito divididas
Algebraicidade das correspondências de Kuga–Satake para superfícies K3
A conjectura de Hodge racional para produtos de superfícies K3
O problema está no primeiro artigo. Na nota de retratação, a OpenAI escreveu que, em um argumento-chave, o artigo registrou o sinal de uma certa operação geométrica como +1, enquanto, de acordo com a convenção do próprio artigo, deveria ser -1.
https://github.com/openai/math/blob/main/history.md
Um mais versus um menos faz toda a diferença. Uma contagem que deveria se cancelar e, em última análise, ser zero tornou-se um número diferente de zero. Um teorema clássico no qual o artigo se baseia tem como pré-condição precisamente que essa contagem seja zero. Com a pré-condição falhando, toda a construção subsequente perde seu suporte.
Os outros dois artigos pegaram emprestada essa construção, então também foram retirados.
No entanto, em todas as três notas de retratação, a OpenAI enfatizou a mesma frase: o que é retirado é a prova, o que não significa que essas proposições matemáticas em si estejam erradas. Os manuscritos originais também não foram excluídos e ainda podem ser visualizados por meio de links arquivados.
Esses três artigos pertencem todos à família de resultados nº 032 do repositório, ou seja, os resultados anteriormente mais acompanhados relacionados à conjectura de Hodge.
Após a retratação, o nome dessa família também mudou: de "Resultados de Hodge e Kuga–Satake para todas as superfícies K3 projetivas" para "a conjectura de Hodge racional para variedades abelianas CM".
Em outras palavras, a parte das conclusões referente às superfícies K3 foi removida da lista. A conclusão central dessa família, ou seja, provar a conjectura de Hodge racional para todas as variedades abelianas CM complexas, ainda é mantida, e a nova versão desse artigo apenas atualizou citações.
Vale mencionar que o artigo com o erro é datado de 18 de setembro, o que o torna um dos primeiros lotes de manuscritos do repositório. Da sua data até sua divulgação pública passaram-se quase três semanas, e foi retirado dentro de um ou dois dias após a publicação. Quanto a quem descobriu o erro, a OpenAI não disse.
Outros 14 artigos foram revisados
Além das retratações, a OpenAI também revisou 14 manuscritos, incluindo correção de provas, retificação de declarações de conclusões e esclarecimento de pré-condições e dependências.
Esses 14 envolvem alturas de Lipschitz e o modelo de Ashkin–Teller em física estatística (4 artigos), o programa de modelo mínimo de Kähler e abundância em geometria complexa (6 artigos), geometria simplética (2 artigos), computação geral para fluidos de Navier-Stokes (1 artigo) e um artigo da fórmula BSD do qual citações desatualizadas foram removidas.
Uma revisão é bastante representativa. A família de resultados nº 342 alegava provar a conjectura de "compatibilidade de pushforward manso" proposta por Simon Donaldson. A conclusão principal não mudou, e há uma formalização em Lean. Mas uma conclusão incidental mais forte no artigo foi considerada exagerada: a versão revisada a restringe a um caso específico e também adiciona um exemplo mostrando que ela não vale em geral.
Taxa de formalização: 42%
A atualização também adicionou 6 formalizações em Lean e 5 resultados auxiliares suplementares. De acordo com a contabilidade da OpenAI, os resultados principais de 300 manuscritos foram agora formalizados, representando cerca de 42% de todos os 719.
Entre as formalizações recém-adicionadas, várias têm peso considerável, como a 103ª família de conquistas em ciência da computação teórica que alega provar que a computação em espaço logarítmico pode ser totalmente des-randomizada (L = RL = BPL).
Deve-se notar que os "cerca de sessenta por cento" que relatamos anteriormente foram contados por família de conquistas, ou seja, desde que um artigo em uma família venha com uma formalização, ele é contado; os 42% anunciados pela OpenAI são contados por resultados principais individuais, o que reflete melhor a proporção real que foi verificada linha por linha por um computador.
Onde ocorrem erros, não há supervisão do Lean
Comparar com o diretório do repositório revela um padrão: o conteúdo que foi retratado e substancialmente revisado desta vez quase todo recai nas partes sem formalização em Lean.
Isso também confirma o lembrete anterior da comunidade matemática: resultados que não passaram por formalização e revisão por pares podem atualmente ser considerados apenas como "alegações".
Felizmente, esta errata foi tratada de forma bastante adequada: os erros foram declarados claramente, a cadeia de dependências foi explicada e a versão antiga foi mantida disponível para referência, em linha com o princípio de "modificação com rastro" recomendado pelo Grupo Consultivo de Matemática e Inteligência Artificial do Institute for Advanced Study.
No entanto, apenas dois dias depois que mais de 700 manuscritos foram tornados públicos, a primeira errata chegou. Muito provavelmente não será a última.
Este artigo vem da conta pública do WeChat "Machine Heart" (ID: almosthuman2014), editor: Panda











