maio 22, 2026
by Ana Beatriz

ArXiv vai banir cientistas que enviarem artigos gerados por IA

Recentemente o ArXiv anunciou que irá banir quaisquer cientistas que enviarem artigos gerados por IA, já que a situação está ficando descontrolada. Nesse post nós da Hosting Machine vamos te contar mais sobre toda essa situação.

ArXiv vai banir cientistas que enviarem artigos gerados por IA

O que é ArXiv?

O arXiv é o repositório de preprints mais influente do mundo, servindo como uma plataforma essencial para a circulação rápida de pesquisas em física, matemática e ciência da computação. Em suma, ele permite que cientistas compartilhem seus rascunhos de artigos antes mesmo da revisão por pares formal. Assim eles ajudam a estabelecer precedência em áreas de rápida evolução tecnológica.

Embora atualmente ele esteja hospedado pela Universidade Cornell, ele está em uma fase de transição para se tornar uma organização sem fins lucrativos independente em julho de 2026. Dessa forma eles esperam garantir maior flexibilidade tecnológica e sustentabilidade financeira para lidar com o crescimento massivo de submissões globais. Assim, mantendo sua missão de oferecer acesso gratuito e aberto à descoberta científica.

Como essa situação começou?

Essa situação começou com a ascensão das ferramentas de IA generativa, que permitem a produção em massa de conteúdo acadêmico superficial, os chamados slop. No entanto, o estopim aconteceu em novembro de 2025, quando arXiv foi forçado a suspender temporariamente as revisões na sua seção de ciência da computação devido ao volume insustentável de submissões. Embora a maioria desses artigos consistia em resumos gerados por máquinas que não ofereciam contribuições originais.

Os moderadores identificaram várias evidências óbvias de negligência, como a presença de instruções do chatbot ou dados fictícios com avisos para que o autor “preenchesse com números reais”. Um estudo no The Lancet confirmou que a taxa de citações fabricadas por IA em artigos científicos cresceu doze vezes desde 2023. Assim, poluindo o registro acadêmico global com referências inexistentes.

Por que ArXiv vai tomar essa atitude?

A decisão de banimentos rigorosos tem o objetivo de proteger a infraestrutura de confiança que sustenta a comunicação científica. Isto é porque o arXiv é uma fonte onde pesquisadores baseiam seus novos trabalhos antes mesmo da revisão formal e a proliferação de erros sintéticos e referências alucinadas pode acarretar em uma corrente de desinformação. Embora exista moderação voluntária na plataforma, eles não possuem recursos para filtrar manualmente os milhares de artigos gerados por máquinas sem qualquer rigor metodológico.

Além disso, a medida reforça o princípio da responsabilidade autoral. Ou seja, ao assinar um artigo, o pesquisador assume total responsabilidade pelo conteúdo, independentemente de como ele foi produzido. O objetivo deles é impedir que maus atores inundem o sistema repetidamente. Assim, preservando a utilidade do site para a comunidade científica legítima.

Qual é a problemática de existir artigos gerados por IA?

A existência de artigos gerados por IA sem verificação humana possui várias problemáticas, além de riscos técnicos e éticos. O problema imediato são as alucinações da IA. Em resumo, chamamos “alucinações” quando IAs inventam referências bibliográficas que, embora plausíveis, não existem. Um estudo da Universidade de Columbia detectou mais de 4.000 citações falsas em milhões de artigos biomédicos. Isto é um grande risco pois pode levar, por exemplo, médicos a tomarem decisões clínicas baseadas em evidências fictícias. Esse fenômeno cria um ciclo de “envenenamento de dados”, onde futuras IAs são treinadas em registros científicos corrompidos, degradando a qualidade do conhecimento acumulado.

Outra preocupação é a erosão de habilidades críticas dos pesquisadores, conhecida como risco de “Tipo 1”. Já que a dependência excessiva de ferramentas automatizadas para redigir ou analisar dados reduz a capacidade do cientista de identificar falhas sutis ou vieses. Dessa forma, transformando o ato de pesquisar em uma gestão superficial de textos gerados por máquinas. Além disso, a produção em massa desses artigos gera um imenso desperdício ambiental, a energia e a água consumidas para processar milhares de manuscritos irrelevantes têm um custo ecológico significativo sem qualquer ganho para a sociedade.

Por fim, há uma questão de equidade e viés algorítmico. Isto é porque detectores de IA frequentemente penalizam pesquisadores cuja língua nativa não é o inglês, já que o uso de estruturas sintáticas mais simples ou vocabulário limitado pode ser erroneamente classificado como texto robótico. Assim, excluindo vozes legítimas da periferia científica global enquanto falha em capturar autores que utilizam IAs de forma mais sofisticada para enganar o sistema.

O que irá acontecer com os cientistas que enviarem esses tipos de artigos?

Os cientistas que submeterem trabalhos com “evidências incontestáveis” de conteúdo gerado por IA não verificado enfrentarão consequências severas sob a nova política de “tolerância zero” do arXiv. A primeira sanção é a remoção imediata do artigo da plataforma e um banimento de um ano para todos os autores listados no artigo. Isto é porque não se trata apenas de uma punição individual. Ou seja, se um pesquisador negligente incluir o nome de colaboradores em um trabalho com “slop”, toda a equipe pode ser suspensa.

Mesmo depois do término do banimento, o retorno do pesquisador ao repositório não é automático. Já que quaisquer submissões futuras desses autores vão precisar ser previamente aceitas em um veículo de prestígio com revisão por pares antes de poderem ser publicadas no arXiv. No entanto, como o principal benefício do repositório é a divulgação rápida de resultados inéditos, essa exigência anularia a vantagem competitiva do autor no campo científico. Alguns especialistas apontam que essa restrição funciona, na prática, como um banimento de longo prazo para rascunhos de pesquisa. Assim, dificultando a carreira de quem for pego negligenciando o rigor acadêmico básico.

Como foi a recepção do público em relação a esse anúncio?

A recepção da comunidade científica foi majoritariamente positiva, com muitos acadêmicos e defensores da ciência aberta descrevendo a política como incrivelmente razoável e necessária. Diversos especialistas elogiaram o fato de o arXiv focar em erros objetivos e comprováveis, ao invés de confiar cegamente em detectores de IA estilísticos, que são frequentemente imprecisos e injustos. Além disso, há um consenso de que o combate ao “lixo digital”, o slop, é vital para evitar o desperdício de tempo dos revisores.

Entretanto, o anúncio também gerou debates e algumas preocupações. Já que alguns pesquisadores temem que o rigor da punição, principalmente a exigência de revisão, possa prejudicar desproporcionalmente jovens acadêmicos ou aqueles que cometem erros acidentais. Outro ponto de debate é o potencial viés contra pesquisadores não nativos em inglês. Já que os estilos de escrita podem ser mais facilmente confundidos com padrões de IA por moderadores humanos ou ferramentas de apoio. No fim, apesar das ressalvas, a maioria concorda que a responsabilidade deve permanecer com o pesquisador humano.

Related Articles