AI slop na Wikipedia: como a enciclopédia detecta e apaga texto gerado por IA

página da Wikipedia sinalizada como AI slop pelo critério G15
Resposta rápida

AI slop na Wikipedia deixou de ser reclamação de editor e virou política escrita. Em 4 de agosto de 2025 a comunidade da Wikipedia em inglês adotou o critério G15, que deixa administradores apagarem rápido páginas geradas por LLM sem revisão humana, sem esperar a discussão de sete dias. Os gatilhos são objetivos: referências inexistentes ou implausíveis e restos de conversa do chatbot colados no texto. Em 20 de março de 2026, uma RfC aprovou por 44 votos a 2 a diretriz WP:LLM, que proíbe gerar ou reescrever conteúdo de artigo com modelo de linguagem, com exceções limitadas

Enquanto o resto do mundo discutia IA no abstrato, a Wikipedia foi escrever regra prática pra apagar texto de máquina 🙂

AI slop é aquele conteúdo produzido em volume por modelo de linguagem, plausível na superfície e oco por dentro: fonte que não existe, frase grandiosa sobre legado e importância, nenhuma checagem

E a enciclopédia é alvo preferencial por um motivo simples: qualquer pessoa edita, o texto entra no ar rápido e o material da Wikipedia alimenta busca, assistente e o treino dos próprios modelos

Aí o estrago não fica parado num artigo obscuro, ele circula

Por que a Wikipedia virou campo de batalha do conteúdo gerado por IA

Tem número pra dimensionar isso

Um estudo de pesquisadores de Princeton usou os detectores GPTZero e Binoculars pra estimar a fatia de artigos novos com conteúdo significativo gerado por IA

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 118 aulas
  • 4 projetos
  • 9h 33min

O resultado: 4,36% de 2.909 artigos criados em agosto de 2024 na Wikipedia em inglês

E o próprio estudo mostra que o número se move conforme a calibragem do detector: na MESMA amostra, com o limiar ajustado pra tolerar 1% de falso positivo, mais de 5% dos artigos novos aparecem sinalizados

Ou seja, é a mesma medição com duas réguas, e a faixa fica entre 4% e pouco mais de 5%

Em alemão, francês e italiano os percentuais foram menores

E o perfil desses artigos sinalizados conta a história melhor que a porcentagem: menos citações, menor integração à rede de links interna da Wikipedia e taxa maior de conteúdo autopromocional ou politicamente motivado

Ou seja, não é gente escrevendo mal, é gente empurrando pauta com ajuda de máquina

Do lado dos voluntários, o trabalho braçal também tem tamanho: mais de 4.800 artigos sinalizados com suspeita de conteúdo gerado por IA até o fim de 2025

Ilyas Lebleu, membro fundador do grupo que faz essa limpeza, descreveu o problema de um jeito que dói: o volume de desinformação gerada rapidamente por IA é uma ameaça existencial aos processos da Wikipedia, que foram desenhados pra discussões longas

E é exatamente esse o nó, se liga na próxima seção

O critério G15: como a Wikipedia apaga um artigo de IA sem esperar sete dias

Primeiro, o porquê

O processo normal de exclusão na Wikipedia exige consenso em uma discussão de sete dias

Sete dias por artigo, com gente lendo, argumentando e votando

A exclusão rápida (speedy deletion) é a via de exceção, aquela reservada pra caso evidente onde discutir é perda de tempo: vandalismo, publicidade pura, esse tipo de coisa

Agora imagina uma enxurrada de artigos gerados em minutos passando por um funil que gasta uma semana em cada um

A conta não fecha

Por isso a comunidade da Wikipedia em inglês adotou o critério G15 em 4 de agosto de 2025, por consenso, voltado a páginas geradas por LLM sem revisão humana

Com o G15, o administrador apaga sem esperar a discussão de sete dias

E o critério não é "achei com cara de IA", ele mira dois sinais objetivos:

  • referências inexistentes ou implausíveis (a citação fabricada clássica)
  • trechos de comunicação do chatbot dirigidos ao usuário, tipo "Here is your Wikipedia article on" ou "up to my last training update"

Repare como os dois são verificáveis por qualquer pessoa: ou a fonte existe ou não existe, ou o modelo está falando com o usuário no meio do artigo ou não está

Isso é proposital, evita transformar exclusão rápida em briga de gosto

Outro detalhe que passa batido: o G15 é um critério da série "G", de geral

Então ele vale pra qualquer tipo de página, não só pra artigo

E segue em vigor em 2026, documentado na página de critérios de exclusão rápida da Wikipedia em inglês

WP:LLM: a diretriz que proíbe escrever artigo com modelo de linguagem

O G15 resolve o caso escancarado

Mas faltava a regra geral, e ela veio depois: uma RfC (pedido de comentários, o mecanismo de decisão da comunidade) encerrada em 20 de março de 2026, com 44 votos a favor e 2 contra

Placar bem pouco dividido, né?

O que ficou aprovado é a diretriz WP:LLM, Writing articles with large language models: proibido usar LLM pra gerar ou reescrever conteúdo de artigo

Com exceções limitadas, que eu separo na tabela logo abaixo

E tem um ponto institucional importante aqui

A Wikimedia Foundation afirma que não define as políticas editoriais da Wikipedia

Quem decide são os editores voluntários

Então isso não é uma big tech baixando regra de cima pra baixo, é a comunidade escrevendo a própria régua e a fundação assistindo

O que a Wikipedia permite e o que proíbe com LLM

Proibido Permitido (exceções limitadas)
Gerar conteúdo de artigo com LLM Usar o LLM pra sugerir refinamentos ao seu próprio texto, com revisão humana e sem o modelo introduzir conteúdo novo
Reescrever conteúdo de artigo com LLM Copidesque básico do seu próprio texto
Agente de IA editando sem aprovação prévia Primeira versão de tradução

A linha de baixo merece explicação

Agentes de IA são tratados como bots na Wikipedia em inglês

Ou seja, não podem editar, inclusive em nome de um usuário humano, sem aprovação prévia em WP:BRFA (o pedido de aprovação de bot)

A exceção é estreita: o espaço de usuário do próprio bot e o do operador

O fio condutor de tudo isso é o mesmo: o modelo pode ajudar você a lapidar o que VOCÊ escreveu, não pode ser o autor

WP:AISIGNS: os sinais que entregam um texto escrito por chatbot

Aqui começa a parte mais interessante pra quem escreve, dentro ou fora da Wikipedia

A página Signs of AI writing, atalho WP:AISIGNS, é uma advice page, uma página de conselhos, não política oficial

Ela cataloga convenções de escrita e formatação típicas de chatbot, com exemplos reais tirados de artigos e rascunhos

O sinal que os editores apontam como mais consistente não é erro de gramática, é tom promocional

O texto infla a importância do assunto com afirmação grandiosa sobre significado e legado, mesmo quando o assunto é uma cidade pequena ou uma empresa qualquer

A lista tem cara conhecida pra quem lê saída de modelo:

  • "rich cultural heritage"
  • "enduring legacy"
  • "plays a significant role"
  • simbolismo exagerado
  • transições repetitivas ligando parágrafo com parágrafo
  • frases em regra de três (três adjetivos, três exemplos, sempre três)
  • comentário editorial onde deveria ter fato

E vem a ressalva mais honesta do documento inteiro: a lista é descritiva, não prescritiva

Indicador não é prova

Os modelos foram treinados em escrita humana, inclusive na própria Wikipedia, então tem gente escrevendo assim desde sempre e continua sendo texto humano

Quem faz a limpeza: o WikiProject AI Cleanup

Esse trabalho todo tem dono, e é voluntário

O WikiProject AI Cleanup foi criado em 2023 por Ilyas Lebleu e outros voluntários da Wikipedia pra combater conteúdo gerado por IA na enciclopédia

Segue ativo, com noticeboard (o quadro onde os casos são levantados e discutidos) e categoria de casos abertos de limpeza

Bem massa pensar nisso: boa parte da documentação de detecção de IA que roda o mundo hoje saiu de um grupo de voluntários, não de um produto

Os limites: por que a proibição não resolve o problema

Agora a parte que ninguém gosta de falar

Regra escrita não é problema resolvido

Em agosto de 2026, editores relatam que parte do que está documentado em WP:AISIGNS ficou desatualizada diante dos modelos mais recentes, o que dificulta a detecção

Faz sentido: se todo mundo publica a lista dos tiques do modelo, os modelos seguintes chegam sem esses tiques

E tem o passivo

Muito texto gerado por LLM inserido entre 2022 e 2026 continua na Wikipedia

A proibição não apaga retroativamente o que já entrou, isso segue em limpeza manual, artigo por artigo

Ou seja, a régua nova vale pra frente e a faxina do que ficou pra trás é no braço

O que isso muda para quem escreve com IA (dentro e fora da Wikipedia)

Dá pra pegar os critérios da Wikipedia e usar como régua de qualidade em qualquer texto, mesmo que você nunca vá editar um artigo lá

  1. Citação fabricada é falha grave, não deslize. Se a fonte não existe ou é implausível, o texto inteiro perde o direito de ser levado a sério. Vale conferir referência por referência, sempre
  2. Resto de conversa do modelo colado no texto é sinal de zero revisão. Aquele "Here is your article on" esquecido no meio do parágrafo é o equivalente moderno de entregar trabalho com o comentário do professor dentro
  3. Tom promocional e frase genérica entregam ausência de trabalho humano. Se o parágrafo poderia estar em qualquer post sobre qualquer assunto, ele não diz nada. Esse é o mesmo raciocínio de quem quer deixar texto de ChatGPT menos artificial: o problema raramente é a gramática, é o vazio
  4. Indicador não é prova, e isso corta pros dois lados. A própria Wikipedia avisa que a lista dela é descritiva. Então acusar alguém de usar IA porque um detector cuspiu um número é atalho ruim, use os sinais pra investigar, não pra sentenciar

Repare que os dois gatilhos do G15 são justamente os verificáveis

A comunidade escolheu punir rápido só o que dá pra provar, e deixou o resto pra discussão

É uma escolha de engenharia de processo, e é bem sensata

Vídeo: introdução ao uso de IA para escrever e programar

Pra começar do zero com ferramentas de IA e ver na prática como esses modelos se comportam, este vídeo do canal mostra uma IA de programar gratuita, sem login e com 1 milhão de contexto (MiMo Code)

Conclusão

A Wikipedia está fazendo algo que quase ninguém fez ainda: desenhando na prática, com regra escrita e caso real, os critérios de qualidade pra conteúdo de IA

O G15 pra apagar o escancarado rápido

O WP:LLM pra dizer o que pode e o que não pode

O WP:AISIGNS pra treinar o olho de quem revisa

E o WikiProject AI Cleanup segurando a vassoura 😀

O próximo passo, se o assunto te interessa, é acompanhar essas páginas e o noticeboard do projeto de limpeza

Porque a documentação muda conforme os modelos mudam, e o que estava certo em agosto de 2025 já foi revisto depois…

até o próximo post!

Perguntas frequentes

O que conta como AI slop dentro da Wikipedia?

É o texto gerado em volume por modelo de linguagem, sem revisão humana, que parece plausível na superfície mas costuma trazer referências inexistentes ou implausíveis e até frases dirigidas ao usuário, tipo restos de conversa de chatbot esquecidos no meio do artigo. É justamente esse padrão que o critério G15 usa pra identificar e apagar a página.

O critério G15 vale só pra artigos novos ou pra qualquer página da Wikipedia?

Vale pra qualquer tipo de página, não só artigo, porque o G15 pertence à série G de critérios gerais de exclusão rápida. Ele segue em vigor em 2026, permitindo que um administrador apague a página sem esperar a discussão padrão de sete dias.

Quem criou o WikiProject AI Cleanup e desde quando ele existe?

O WikiProject AI Cleanup foi criado em 2023 por voluntários da Wikipedia, entre eles Ilyas Lebleu, justamente pra combater conteúdo gerado por IA na enciclopédia. O grupo segue ativo, com um noticeboard próprio e uma categoria de casos abertos de limpeza.

Dá pra usar IA pra traduzir um artigo da Wikipedia?

Sim, essa é uma das exceções previstas na diretriz WP:LLM: usar o modelo pra produzir a primeira versão de uma tradução é permitido. O que fica proibido é o LLM gerar ou reescrever o conteúdo do artigo original a partir do zero.

Os sinais listados em WP:AISIGNS provam que um texto foi escrito por IA?

Não. A própria página avisa que é uma advice page descritiva, não uma política oficial, e que nenhum indicador isolado é prova, já que os modelos foram treinados em cima de escrita humana, inclusive da própria Wikipedia. Editores relatam que parte desse material ficou desatualizada diante dos modelos mais recentes, o que torna a detecção mais difícil.

O que acontece com o texto gerado por IA que já estava publicado antes das novas regras?

Ele não some sozinho: a proibição da WP:LLM e o critério G15 não apagam retroativamente o que já foi inserido entre 2022 e 2026. Esse passivo histórico ainda depende de limpeza manual, o mesmo trabalho artigo por artigo que os voluntários vêm tocando no braço.




Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares